Bỏ qua menu, vào nội dung chính
Quay lại
AI Token Counter

AI Token & Cost

Ước tính token count cho 9 LLM phổ biến + tính cost USD/VND theo số request/tháng. Heuristic-based (không chuẩn 100% như tiktoken nhưng đủ chính xác để budget).

Input prompt

116 chars·151 bytes·27 words

Cấu hình

Rẻ nhất / tháng$0.16 · 4.056 đGemini 2.5 Flash
Đắt nhất / tháng$31.45 · 802.103 đClaude 4.1 Opus
Chênh lệch198x lầncùng workload

So sánh 9 model

ModelInput tokensOutput tokensCost/callCost/ngàyCost/tháng (USD)Cost/tháng (VND)
Gemini 2.5 Flash39167$0.00005$0.005$0.164.056 đ
GPT-4o mini39125$0.00008$0.008$0.246.185 đ
Llama 3.3 70B (Groq)39125$0.00012$0.012$0.379.315 đ
DeepSeek V3.239125$0.00015$0.015$0.4411.324 đ
Claude 4.5 Haiku39132$0.00056$0.056$1.6842.779 đ
Gemini 2.5 Pro39167$0.00088$0.088$2.6567.607 đ
GPT-4o39125$0.00135$0.135$4.04103.084 đ
Claude 4.5 Sonnet39132$0.00210$0.210$6.29160.421 đ
Claude 4.1 Opus39132$0.01048$1.048$31.45802.103 đ

* Token count heuristic - chính xác ±15%. Cho con số chính xác dùng platform.openai.com/tokenizer. Giá update 05/2026 (1 USD ≈ 25.500 VND).

Ước tính token và chi phí vận hành hàng tháng

Công cụ này tính ra sao

Số token của đoạn văn bản được ước lượng theo ba họ bộ tách từ khác nhau, trong đó ký tự ASCII và ký tự ngoài ASCII được đếm riêng, bởi tiếng Việt có dấu tốn nhiều token hơn hẳn tiếng Anh cùng độ dài. Con số đó nhân với đơn giá đầu vào và đầu ra của từng mô hình, cộng thêm độ dài câu trả lời dự kiến và số lượt gọi mỗi ngày, cho ra chi phí một lượt và chi phí một tháng, quy đổi sang cả tiền đồng.

Lúc lập dự toán cho tính năng AI

Khi lập dự toán trước lúc đưa một tính năng dùng mô hình ngôn ngữ vào sản phẩm. Khi cân nhắc đổi sang mô hình nhỏ hơn và muốn biết tiết kiệm được bao nhiêu cho cùng khối lượng. Khi giải thích với khách vì sao tính năng trò chuyện phải tính phí theo mức dùng chứ không thể gói vào một khoản cố định.

Đọc bảng so sánh

Bảng sắp theo chi phí tháng nên hai đầu bảng cho thấy khoảng dao động rất rộng giữa mô hình rẻ nhất và mô hình đắt nhất cho cùng một khối lượng công việc. Chú ý rằng đơn giá đầu ra thường cao gấp nhiều lần đơn giá đầu vào, nên cách giảm chi phí nhanh nhất là ràng buộc độ dài câu trả lời chứ không phải cắt bớt câu hỏi.

Sai số và phần chưa được tính

Đây là ước lượng theo số ký tự chứ không chạy bộ tách từ thật của nhà cung cấp, sai số vào khoảng một phần bảy; đủ dùng để lập dự toán, không đủ để đối soát hoá đơn. Dự toán này chưa tính phần chỉ dẫn hệ thống và lịch sử hội thoại được gửi lại ở mỗi lượt, vốn thường là khoản tốn nhất trong một ứng dụng trò chuyện nhiều lượt. Đơn giá do nhà cung cấp thay đổi theo thời gian và tỉ giá cũng vậy, nên hãy kiểm lại bảng giá gốc trước khi ký hợp đồng với con số ở đây.

Đoạn văn bản mẫu không rời trình duyệt. Việc đếm token và tính tiền chạy hoàn toàn trong trình duyệt; đoạn văn bản mẫu của bạn không được gửi tới nhà cung cấp mô hình nào, cũng không gửi về máy chủ ALODEV.

Cần bản riêng cho doanh nghiệp bạn?

Mọi công cụ trong Lab đều do đội ngũ Alodev tự xây. Chúng tôi có thể xây phiên bản riêng - gắn thương hiệu, nối dữ liệu nội bộ, thêm tính năng theo quy trình của bạn.