Công cụ miễn phí
Máy tính chi phí token AI
Nhập lưu lượng gọi và số token mỗi yêu cầu để ước tính, so sánh chi phí API của các mô hình theo giá EasyAPI theo thời gian thực và tìm lựa chọn tiết kiệm nhất.
Thông số sử dụng
Tỷ lệ token đầu vào được lấy từ cache prompt. Chỉ áp dụng cho mô hình có giá cache.
Ước tính token từ văn bản
Ước tính gần đúng: khoảng 1 token cho mỗi chữ Hán và khoảng 4 ký tự mỗi token với tiếng Anh. Mỗi mô hình tách token khác nhau; số liệu usage do API trả về là chính xác.
So sánh chi phí
deepseek-v4.1-flash rẻ nhất, khoảng $2,91 mỗi tháng, tiết kiệm khoảng 99% so với claude-fable-5.1.
| Mô hình | Đầu vào / 1M token | Đầu ra / 1M token | Mỗi lượt | Mỗi ngày | Mỗi tháng |
|---|---|---|---|---|---|
deepseek-v4.1-flash DeepSeekRẻ nhấtGiá động | $0,0969 | $0,3875 | $0,000291 | $0,0969 | $2,91 |
gemini-3.5-flash Google | $1,275 | $7,65 | $0,0051 | $1,70 | $51,00 |
gpt-6-astra OpenAIGiá động | $10 | $50 | $0,035 | $11,67 | $350 |
claude-fable-5.1 Anthropic | $10 | $50 | $0,035 | $11,67 | $350 |
Giá lấy từ bảng giá EasyAPI Model Square theo thời gian thực (đã gồm chiết khấu). Chi phí ngày tính theo 30 ngày mỗi tháng; hóa đơn thực tế là căn cứ cuối cùng.
Cách tính chi phí
API mô hình ngôn ngữ thường tính riêng token đầu vào và đầu ra, theo giá mỗi triệu token. Máy tính dùng các công thức sau:
- Chi phí mỗi lượt = (token vào không trúng cache × giá đầu vào + token vào trúng cache × giá cache + token ra × giá đầu ra) ÷ 1.000.000
- Chi phí tháng = chi phí mỗi lượt × số yêu cầu mỗi tháng; chi phí ngày = chi phí tháng ÷ 30
- Giá đầu ra thường cao gấp nhiều lần giá đầu vào, nên với câu trả lời dài như viết code hay văn bản dài, đầu ra chiếm phần lớn chi phí
- Khi bật cache prompt, system prompt và ngữ cảnh lặp lại được tính theo giá cache thấp hơn, giúp giảm đáng kể chi phí cho ứng dụng ngữ cảnh dài
Câu hỏi thường gặp
Token là gì?
Token là đơn vị cơ bản mà mô hình ngôn ngữ dùng để xử lý văn bản. Với tiếng Anh, một token khoảng 4 ký tự hoặc 0,75 từ; với tiếng Trung, khoảng một chữ Hán. Token đầu vào và đầu ra được tính phí riêng.
Giá trong máy tính có chính xác không?
Giá được đọc theo thời gian thực từ EasyAPI Model Square, đã gồm chiết khấu và khớp với trang chi tiết mô hình. Mô hình giá động được ước tính theo mức cơ bản; hóa đơn trong bảng điều khiển là căn cứ cuối cùng.
Làm sao biết mỗi yêu cầu dùng bao nhiêu token?
Dùng mục “Ước tính token từ văn bản” ở trên để có con số gần đúng. Sau khi tích hợp, lượng dùng chính xác của mỗi lần gọi hiển thị trong trường usage của phản hồi API và nhật ký sử dụng trong bảng điều khiển.
Làm sao giảm chi phí API mô hình ngôn ngữ?
Dùng mô hình nhẹ, rẻ cho tác vụ đơn giản, rút gọn prompt và ngữ cảnh, giới hạn độ dài đầu ra, bật cache prompt và phân luồng yêu cầu giữa các mô hình theo độ phức tạp.
Một API key có gọi được mọi mô hình trong máy tính không?
Có. EasyAPI cung cấp API tương thích OpenAI, một API key gọi được mọi mô hình tài khoản có quyền dùng; đổi mô hình chỉ cần sửa tham số model.
Gọi tất cả mô hình này bằng một API key
Đăng ký EasyAPI để gọi GPT, Claude, Gemini, DeepSeek và nhiều mô hình khác qua API tương thích OpenAI, chỉ trả tiền theo mức sử dụng.