Anthropic ra mắt Claude Sonnet 5.5 ngày 28 tháng 9, trong bối cảnh công ty chuẩn bị IPO. Mẫu AI này nhấn mạnh hiệu quả chi phí thay vì chỉ tập trung vào điểm số benchmark.
Anthropic cho biết Sonnet 5.5 nhanh hơn hơn 30% so với Sonnet 5 và có thể giảm chi phí ứng dụng tới 30% nhờ sử dụng ít token hơn cho cùng một nhiệm vụ.
- Sonnet 5.5 giữ nguyên mức giá token nhưng có thể giảm chi phí ứng dụng nhờ sử dụng ít token hơn.
- Chi phí thực hiện nhiệm vụ đang trở thành tiêu chí quan trọng bên cạnh điểm số benchmark.
- Token rẻ hơn có thể thúc đẩy các quy trình phức tạp và khiến tổng chi phí AI tăng.
Claude Sonnet 5.5 tập trung vào hiệu quả chi phí
Claude Sonnet 5.5 là mô hình AI hướng đến các tác vụ như lập trình, tạo tài liệu và xử lý bảng tính, với tốc độ được Anthropic công bố cao hơn hơn 30% so với Sonnet 5.
Theo trang ra mắt của Anthropic, chi phí ứng dụng có thể giảm tới 30% dù giá token không thay đổi. Mức giảm này đến từ việc mô hình dùng ít token hơn để hoàn thành cùng một nhiệm vụ.
Giá token của Sonnet 5.5 và Opus 5.5
Sonnet 5.5 có giá 2 USD cho mỗi triệu token đầu vào, 10 USD cho mỗi triệu token đầu ra và 0,20 USD cho mỗi triệu token đọc từ bộ nhớ đệm.
| Mô hình | Token đầu vào | Token đầu ra | Token đọc từ bộ nhớ đệm | Định hướng sử dụng |
|---|---|---|---|---|
| Claude Sonnet 5.5 | 2 USD/triệu token | 10 USD/triệu token | 0,20 USD/triệu token | Lập trình, tạo tài liệu, bảng tính và các tác vụ thông thường |
| Claude Opus 5.5 | 4 USD/triệu token | 20 USD/triệu token | Chưa nêu | Suy luận phức tạp và đánh giá |
Với khách hàng doanh nghiệp, mức giá thấp hơn không phải tiêu chí duy nhất. Một mô hình có thể hoàn thành ổn định các nhiệm vụ thông thường với chi phí thấp sẽ phù hợp hơn cho nhiều quy trình so với mô hình mạnh hơn nhưng đắt hơn.
Reuters đưa tin khoảng 80% doanh thu của Anthropic đến từ khách hàng doanh nghiệp. Vì vậy, hiệu quả vận hành và chi phí trên mỗi nhiệm vụ có ý nghĩa trực tiếp đối với hướng phát triển của công ty.
Benchmark không còn phản ánh toàn bộ giá trị của mô hình
Benchmark chỉ phản ánh một phần năng lực của AI; chi phí để hoàn thành từng nhiệm vụ cũng quyết định mức độ phù hợp của mô hình trong thực tế.
Anthropic cho biết Sonnet 5.5 đạt 70,6% trên Terminal-Bench 4.0, so với 10,3% của Sonnet 5. Tuy nhiên, dữ liệu từ bảng xếp hạng Artificial Analysis cho thấy điểm số cao hơn có thể đi kèm chi phí xử lý lớn hơn.
| Mô hình | Điểm Intelligence | Chi phí ước tính mỗi nhiệm vụ |
|---|---|---|
| Sonnet 5.5, mức nỗ lực tối đa | 56 | 7,60 USD |
| GPT-6 Sol | 48 | 1,06 USD |
| Xiaomi MiMo-V2.6-Pro | 46 | 0,13 USD |
Sự chênh lệch này có thể khiến doanh nghiệp phân bổ nhiệm vụ cho nhiều mô hình khác nhau. Các hệ thống cao cấp có thể xử lý yêu cầu khó, trong khi những mô hình rẻ hơn đảm nhận phần việc lặp lại hoặc có khối lượng lớn.
Chi phí cho cùng một mức năng lực AI đang giảm
Chi phí để đạt một mức hiệu suất AI nhất định đã giảm khoảng 47% mỗi quý kể từ năm 2023, theo báo cáo của Epoch AI ngày 22 tháng 9.
Xu hướng này tương đương mức giảm khoảng 13 lần trong một năm. Khi chi phí suy luận giảm, doanh nghiệp có thêm khả năng kết hợp nhiều mô hình theo từng loại nhiệm vụ thay vì phụ thuộc vào một hệ thống duy nhất.
Nghịch lý chi phí suy luận trong các quy trình phức tạp
Giá token thấp hơn không đảm bảo tổng chi phí AI thấp hơn, bởi doanh nghiệp có thể triển khai các quy trình phức tạp hơn và sử dụng nhiều token hơn.
Báo cáo của Gartner ngày 17 tháng 8 gọi đây là “nghịch lý suy luận”. Theo báo cáo, giá token giảm có thể khuyến khích các quy trình nhiều bước, từ đó làm tổng lượng token sử dụng tăng lên.
Giá token hiệu quả hơn không đủ để các nhà lãnh đạo sản phẩm biện minh cho chi phí AI.
– Will Sommer, chuyên gia phân tích cấp cao tại Gartner, trong báo cáo ngày 17 tháng 8 năm 2026
Khả năng tiếp cận AI còn phụ thuộc vào hạ tầng
Mô hình có chi phí thấp và mô hình có trọng số mở có thể mở rộng khả năng tiếp cận AI, nhưng hạ tầng, kết nối và kỹ năng vẫn quyết định mức độ sử dụng thực tế.
Báo cáo Global AI Diffusion của Microsoft nhận định các mô hình này có tiềm năng cải thiện khả năng tiếp cận, đặc biệt tại các quốc gia thuộc Nam bán cầu. Tuy nhiên, giá mô hình thấp chỉ là một phần của bài toán triển khai.
Anthropic có thể tiếp tục mở rộng phân khúc tác vụ khối lượng lớn
Sonnet 5.5 cho thấy mô hình phù hợp nhất với doanh nghiệp không nhất thiết là mô hình mạnh nhất, mà có thể là mô hình hoàn thành công việc ổn định với chi phí hợp lý.
Haiku 5.5 được dự kiến ra mắt trong những tuần tới và có thể tiếp tục thúc đẩy xu hướng giảm chi phí cho các tác vụ AI khối lượng lớn. Hiện chưa có thêm chi tiết về thời điểm phát hành hoặc mức giá của mô hình này.
Tổng kết
Claude Sonnet 5.5 phản ánh xu hướng đánh giá AI dựa trên cả năng lực và chi phí thực hiện nhiệm vụ. Tuy nhiên, token rẻ hơn vẫn có thể dẫn đến tổng chi phí cao hơn nếu doanh nghiệp mở rộng quy trình và sử dụng nhiều hơn.



