Agent và phát triển ứng dụng
Xây dựng agent trên API tương thích OpenAI
Mỗi bước của agent là một lần gọi, và mô hình phải trả về ổn định gọi công cụ, luồng và JSON. EasyAPI chuyển nguyên vẹn các khả năng này, không viết lại yêu cầu. Đổi base_url là mã của bạn chạy.
Mô hình gợi ý đang khả dụng
Chọn cho agent: gọi công cụ ổn định, đầu ra có cấu trúc, ngữ cảnh chứa được nhiều lượt. Chi phí vòng lặp nhiều bước tăng tuyến tính, nên chạy thông luồng trên mô hình rẻ trước, rồi nâng cấp để so sánh.
Giá nền tảng trên mỗi triệu token, tính theo mức dùng thực tế. Danh sách bám theo API giá trực tiếp; mô hình đã gỡ không xuất hiện ở đây. Chọn một mô hình, cấu hình và chi phí bên dưới sẽ cập nhật theo.
Cấu hình chính xác
Địa chỉ API và mô hình đang chọn qwen3.8-max đã được điền sẵn. Chỉ cần thay key bằng key của bạn.
from openai import OpenAI
client = OpenAI(base_url="https://token.easyapi.com/v1", api_key="sk-your-key")
tools = [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a city",
"parameters": {"type": "object", "properties": {"city": {"type": "string"}}, "required": ["city"]},
},
}]
resp = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "What is the weather in Shanghai today?"}],
tools=tools,
tool_choice="auto",
)
call = resp.choices[0].message.tool_calls[0]
print(call.function.name, call.function.arguments)Chạy thành công một yêu cầu trước
Thay key rồi chạy nguyên văn. Trả về 200 nghĩa là địa chỉ, key và mô hình đều đúng; nếu lỗi, đối chiếu với danh sách bên dưới.
curl https://token.easyapi.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{"model":"qwen3.8-max","messages":[{"role":"user","content":"Hello"}]}'Cần biết
- tools, tool_choice, stream và response_format được chuyển nguyên vẹn lên upstream. Mức hỗ trợ tùy mô hình; bảng tham số ở trang chi tiết mô hình ghi rõ cái nào có hiệu lực.
- Agent nhiều lượt tích lũy messages. Cửa sổ ngữ cảnh là giới hạn cứng: yêu cầu vượt quá sẽ lỗi thay vì bị cắt bớt.
- Chú ý 429 khi đồng thời cao trên một key. Cả giới hạn tốc độ nền tảng lẫn hết số dư đều trả 429; thông báo lỗi ghi rõ loại nào.
- Danh sách dự phòng models và provider.sort cho phép khai báo mô hình dự phòng và ưu tiên định tuyến ngay trong yêu cầu, tự chuyển khi upstream lỗi. Xem tài liệu API.
Lỗi thường gặp
- tool_calls trống và mô hình trả lời bằng văn bản
- Thường là mô hình không hỗ trợ gọi công cụ hoặc chưa đặt tool_choice. Chọn mô hình trong danh sách gợi ý và đặt tool_choice là auto hoặc một hàm cụ thể.
- Streaming không nhận được delta
- Kiểm tra stream là true và client không đệm. curl với -N hiển thị SSE thô, định vị vấn đề rất nhanh.
- JSON trả về không parse được
- Dùng response_format với json_object hoặc json_schema và ghi 'chỉ xuất JSON' trong system prompt. Mô hình không có response_format chỉ dựa vào prompt nên không đảm bảo.
- 429 Too Many Requests
- Đọc thông báo: insufficient quota là hết số dư, hãy nạp thêm; rate limit là đồng thời quá cao, giảm tốc hoặc chia ra nhiều key.
Ví dụ chi phí
Theo giá hiện tại của qwen3.8-max, một yêu cầu điển hình 6,000 token đầu vào + 800 token đầu ra, 2,000 lần mỗi ngày:
Chỉ tính phí theo token thực dùng. Không phí nền tảng, phí định tuyến hay mức tối thiểu hàng tháng. Mức dùng thực tế hiển thị từng yêu cầu trong nhật ký bảng điều khiển.
Kết nối ngay
Sau khi đăng ký, trang chủ bảng điều khiển có hướng dẫn tạo sẵn cấu hình để sao chép theo key và mô hình của bạn, hiển thị cho đến khi lần gọi đầu tiên thành công.
Giải pháp khác: Kết nối Claude Code, Cursor và Codex với API · Dùng mô hình trong Dify, n8n và FastGPT