Công cụ miễn phí

Máy tính chi phí token AI

Nhập lưu lượng gọi và số token mỗi yêu cầu để ước tính, so sánh chi phí API của các mô hình theo giá EasyAPI theo thời gian thực và tìm lựa chọn tiết kiệm nhất.

Thông số sử dụng

Tình huống thường gặp

Tỷ lệ token đầu vào được lấy từ cache prompt. Chỉ áp dụng cho mô hình có giá cache.

Ước tính token từ văn bản

Ước tính gần đúng: khoảng 1 token cho mỗi chữ Hán và khoảng 4 ký tự mỗi token với tiếng Anh. Mỗi mô hình tách token khác nhau; số liệu usage do API trả về là chính xác.

So sánh chi phí

10.000 yêu cầu / tháng · 1.000 token vào / 500 token ra mỗi yêu cầu

gpt-6-astraclaude-fable-5.1gemini-3.5-flashdeepseek-v4.1-flash

deepseek-v4.1-flash rẻ nhất, khoảng $2,91 mỗi tháng, tiết kiệm khoảng 99% so với claude-fable-5.1.

Mô hìnhĐầu vào / 1M tokenĐầu ra / 1M tokenMỗi lượtMỗi ngàyMỗi tháng
deepseek-v4.1-flash
DeepSeekRẻ nhấtGiá động
$0,0969$0,3875$0,000291$0,0969$2,91
$1,275$7,65$0,0051$1,70$51,00
gpt-6-astra
OpenAIGiá động
$10$50$0,035$11,67$350
$10$50$0,035$11,67$350

Giá lấy từ bảng giá EasyAPI Model Square theo thời gian thực (đã gồm chiết khấu). Chi phí ngày tính theo 30 ngày mỗi tháng; hóa đơn thực tế là căn cứ cuối cùng.

Cách tính chi phí

API mô hình ngôn ngữ thường tính riêng token đầu vào và đầu ra, theo giá mỗi triệu token. Máy tính dùng các công thức sau:

  • Chi phí mỗi lượt = (token vào không trúng cache × giá đầu vào + token vào trúng cache × giá cache + token ra × giá đầu ra) ÷ 1.000.000
  • Chi phí tháng = chi phí mỗi lượt × số yêu cầu mỗi tháng; chi phí ngày = chi phí tháng ÷ 30
  • Giá đầu ra thường cao gấp nhiều lần giá đầu vào, nên với câu trả lời dài như viết code hay văn bản dài, đầu ra chiếm phần lớn chi phí
  • Khi bật cache prompt, system prompt và ngữ cảnh lặp lại được tính theo giá cache thấp hơn, giúp giảm đáng kể chi phí cho ứng dụng ngữ cảnh dài

Câu hỏi thường gặp

Token là gì?

Token là đơn vị cơ bản mà mô hình ngôn ngữ dùng để xử lý văn bản. Với tiếng Anh, một token khoảng 4 ký tự hoặc 0,75 từ; với tiếng Trung, khoảng một chữ Hán. Token đầu vào và đầu ra được tính phí riêng.

Giá trong máy tính có chính xác không?

Giá được đọc theo thời gian thực từ EasyAPI Model Square, đã gồm chiết khấu và khớp với trang chi tiết mô hình. Mô hình giá động được ước tính theo mức cơ bản; hóa đơn trong bảng điều khiển là căn cứ cuối cùng.

Làm sao biết mỗi yêu cầu dùng bao nhiêu token?

Dùng mục “Ước tính token từ văn bản” ở trên để có con số gần đúng. Sau khi tích hợp, lượng dùng chính xác của mỗi lần gọi hiển thị trong trường usage của phản hồi API và nhật ký sử dụng trong bảng điều khiển.

Làm sao giảm chi phí API mô hình ngôn ngữ?

Dùng mô hình nhẹ, rẻ cho tác vụ đơn giản, rút gọn prompt và ngữ cảnh, giới hạn độ dài đầu ra, bật cache prompt và phân luồng yêu cầu giữa các mô hình theo độ phức tạp.

Một API key có gọi được mọi mô hình trong máy tính không?

Có. EasyAPI cung cấp API tương thích OpenAI, một API key gọi được mọi mô hình tài khoản có quyền dùng; đổi mô hình chỉ cần sửa tham số model.

Gọi tất cả mô hình này bằng một API key

Đăng ký EasyAPI để gọi GPT, Claude, Gemini, DeepSeek và nhiều mô hình khác qua API tương thích OpenAI, chỉ trả tiền theo mức sử dụng.