Anthropic ra mắt Claude Sonnet 5.5 khi AI tính phí theo tác vụ

Anthropic ra mắt Claude Sonnet 5.5 ngày 28 tháng 9, trong bối cảnh công ty chuẩn bị IPO. Mẫu AI này nhấn mạnh hiệu quả chi phí thay vì chỉ tập trung vào điểm số benchmark.

Anthropic cho biết Sonnet 5.5 nhanh hơn hơn 30% so với Sonnet 5 và có thể giảm chi phí ứng dụng tới 30% nhờ sử dụng ít token hơn cho cùng một nhiệm vụ.

NỘI DUNG CHÍNH
  • Sonnet 5.5 giữ nguyên mức giá token nhưng có thể giảm chi phí ứng dụng nhờ sử dụng ít token hơn.
  • Chi phí thực hiện nhiệm vụ đang trở thành tiêu chí quan trọng bên cạnh điểm số benchmark.
  • Token rẻ hơn có thể thúc đẩy các quy trình phức tạp và khiến tổng chi phí AI tăng.

Claude Sonnet 5.5 tập trung vào hiệu quả chi phí

Claude Sonnet 5.5 là mô hình AI hướng đến các tác vụ như lập trình, tạo tài liệu và xử lý bảng tính, với tốc độ được Anthropic công bố cao hơn hơn 30% so với Sonnet 5.

Theo trang ra mắt của Anthropic, chi phí ứng dụng có thể giảm tới 30% dù giá token không thay đổi. Mức giảm này đến từ việc mô hình dùng ít token hơn để hoàn thành cùng một nhiệm vụ.

Giá token của Sonnet 5.5 và Opus 5.5

Sonnet 5.5 có giá 2 USD cho mỗi triệu token đầu vào, 10 USD cho mỗi triệu token đầu ra và 0,20 USD cho mỗi triệu token đọc từ bộ nhớ đệm.

Đọc thêm:  Fetch.ai và NuNet mất 2 triệu USD vì lộ khóa riêng
Mô hìnhToken đầu vàoToken đầu raToken đọc từ bộ nhớ đệmĐịnh hướng sử dụng
Claude Sonnet 5.52 USD/triệu token10 USD/triệu token0,20 USD/triệu tokenLập trình, tạo tài liệu, bảng tính và các tác vụ thông thường
Claude Opus 5.54 USD/triệu token20 USD/triệu tokenChưa nêuSuy luận phức tạp và đánh giá

Với khách hàng doanh nghiệp, mức giá thấp hơn không phải tiêu chí duy nhất. Một mô hình có thể hoàn thành ổn định các nhiệm vụ thông thường với chi phí thấp sẽ phù hợp hơn cho nhiều quy trình so với mô hình mạnh hơn nhưng đắt hơn.

Reuters đưa tin khoảng 80% doanh thu của Anthropic đến từ khách hàng doanh nghiệp. Vì vậy, hiệu quả vận hành và chi phí trên mỗi nhiệm vụ có ý nghĩa trực tiếp đối với hướng phát triển của công ty.

Benchmark không còn phản ánh toàn bộ giá trị của mô hình

Benchmark chỉ phản ánh một phần năng lực của AI; chi phí để hoàn thành từng nhiệm vụ cũng quyết định mức độ phù hợp của mô hình trong thực tế.

Anthropic cho biết Sonnet 5.5 đạt 70,6% trên Terminal-Bench 4.0, so với 10,3% của Sonnet 5. Tuy nhiên, dữ liệu từ bảng xếp hạng Artificial Analysis cho thấy điểm số cao hơn có thể đi kèm chi phí xử lý lớn hơn.

Mô hìnhĐiểm IntelligenceChi phí ước tính mỗi nhiệm vụ
Sonnet 5.5, mức nỗ lực tối đa567,60 USD
GPT-6 Sol481,06 USD
Xiaomi MiMo-V2.6-Pro460,13 USD
Đọc thêm:  Ghi chú macOS 27 ẩn giới hạn Siri AI và Image Playground
Claude Sonnet 5.5 so với GPT-6 Sol và MiMo-V2.6-Pro: Chi phí mỗi nhiệm vụ và điểm Intelligence

Sự chênh lệch này có thể khiến doanh nghiệp phân bổ nhiệm vụ cho nhiều mô hình khác nhau. Các hệ thống cao cấp có thể xử lý yêu cầu khó, trong khi những mô hình rẻ hơn đảm nhận phần việc lặp lại hoặc có khối lượng lớn.

Chi phí cho cùng một mức năng lực AI đang giảm

Chi phí để đạt một mức hiệu suất AI nhất định đã giảm khoảng 47% mỗi quý kể từ năm 2023, theo báo cáo của Epoch AI ngày 22 tháng 9.

Xu hướng này tương đương mức giảm khoảng 13 lần trong một năm. Khi chi phí suy luận giảm, doanh nghiệp có thêm khả năng kết hợp nhiều mô hình theo từng loại nhiệm vụ thay vì phụ thuộc vào một hệ thống duy nhất.

Nghịch lý chi phí suy luận trong các quy trình phức tạp

Giá token thấp hơn không đảm bảo tổng chi phí AI thấp hơn, bởi doanh nghiệp có thể triển khai các quy trình phức tạp hơn và sử dụng nhiều token hơn.

Báo cáo của Gartner ngày 17 tháng 8 gọi đây là “nghịch lý suy luận”. Theo báo cáo, giá token giảm có thể khuyến khích các quy trình nhiều bước, từ đó làm tổng lượng token sử dụng tăng lên.

Giá token hiệu quả hơn không đủ để các nhà lãnh đạo sản phẩm biện minh cho chi phí AI.
– Will Sommer, chuyên gia phân tích cấp cao tại Gartner, trong báo cáo ngày 17 tháng 8 năm 2026

Khả năng tiếp cận AI còn phụ thuộc vào hạ tầng

Mô hình có chi phí thấp và mô hình có trọng số mở có thể mở rộng khả năng tiếp cận AI, nhưng hạ tầng, kết nối và kỹ năng vẫn quyết định mức độ sử dụng thực tế.

Đọc thêm:  Kamino bổ nhiệm Michael Weisz làm CEO, chuyển hướng sang tín dụng RWA

Báo cáo Global AI Diffusion của Microsoft nhận định các mô hình này có tiềm năng cải thiện khả năng tiếp cận, đặc biệt tại các quốc gia thuộc Nam bán cầu. Tuy nhiên, giá mô hình thấp chỉ là một phần của bài toán triển khai.

Anthropic có thể tiếp tục mở rộng phân khúc tác vụ khối lượng lớn

Sonnet 5.5 cho thấy mô hình phù hợp nhất với doanh nghiệp không nhất thiết là mô hình mạnh nhất, mà có thể là mô hình hoàn thành công việc ổn định với chi phí hợp lý.

Haiku 5.5 được dự kiến ra mắt trong những tuần tới và có thể tiếp tục thúc đẩy xu hướng giảm chi phí cho các tác vụ AI khối lượng lớn. Hiện chưa có thêm chi tiết về thời điểm phát hành hoặc mức giá của mô hình này.

Tổng kết

Claude Sonnet 5.5 phản ánh xu hướng đánh giá AI dựa trên cả năng lực và chi phí thực hiện nhiệm vụ. Tuy nhiên, token rẻ hơn vẫn có thể dẫn đến tổng chi phí cao hơn nếu doanh nghiệp mở rộng quy trình và sử dụng nhiều hơn.

BÀI VIẾT LIÊN QUAN

Quant ký thỏa thuận với ngân hàng Mỹ, Anh; QNT tăng 300% trong tuần

Quant ký thỏa thuận với ngân hàng Mỹ, Anh;...

Quant (QNT) tăng hơn 300% trong bảy ngày sau hai thông báo liên quan đến tiền gửi...
Thượng viện yêu cầu Altman, Amodei dự điều trần Canberra

Thượng viện yêu cầu Altman, Amodei dự điều trần...

Thượng nghị sĩ Sarah Hanson-Young đã mời Sam Altman và Dario Amodei dự phiên điều trần công...
OpenAI và Anthropic phát hiện nhiều sự cố an toàn AI hơn đã công bố

OpenAI và Anthropic phát hiện nhiều sự cố an...

OpenAI và Anthropic đang rà soát hàng chục nghìn trường hợp hệ thống AI có hành vi...