Mục lục
TL;DR: Anthropic đã phát hành Claude Sonnet 5.5, model AI được hãng cho biết nhanh hơn hơn 30% và có thể giảm chi phí mỗi tác vụ tới 30% so với Sonnet 5, trong khi giữ nguyên giá API niêm yết.
Sonnet 5.5 là model thứ hai trong họ Claude 5.5. Anthropic định vị phiên bản này cho các công việc hằng ngày có phạm vi rõ ràng, như sửa lỗi phần mềm, tạo tài liệu, slide và bảng tính; còn Claude Opus 5.5 vẫn dành cho những nhiệm vụ phức tạp, mở và cần phán đoán kỹ hơn.
Với doanh nghiệp và nhà phát triển, thay đổi đáng quan tâm là model được cho là hoàn thành việc trong ít bước hơn. Điều này có thể ảnh hưởng trực tiếp đến thời gian chờ và tổng chi phí vận hành, thay vì chỉ thay đổi bảng giá trên mỗi triệu token.
Cải thiện mạnh ở lập trình và tác vụ dài
Theo Anthropic, Sonnet 5.5 đạt 70,6% trên Terminal-Bench 4.0, bài đánh giá khả năng lập trình qua dòng lệnh với nhiều bước thực hiện. Con số này cao hơn đáng kể mức 10,3% của Sonnet 5. Trên FrontierCode 1.1, model đạt 46,2% ở thiết lập Max, so với 42,4% của phiên bản trước; trên CursorBench 4.0, điểm số là 55,5%, gần mức 57,8% của Opus 5.5.
Các benchmark chỉ phản ánh một phần năng lực trong điều kiện thử nghiệm. Anthropic cũng cho biết Opus 5.5 vẫn mạnh hơn rõ rệt với công việc phức tạp, thiếu cấu trúc và đòi hỏi phán đoán liên tục. Sonnet 5.5 cũng không phải lúc nào đạt điểm cao hơn khi tăng mức nỗ lực xử lý: ở một số bài FrontierCode, thiết lập Max có thể dẫn đến thêm bước kiểm tra hoặc chỉnh sửa ngoài phạm vi.
Với công việc tri thức, Anthropic công bố Sonnet 5.5 đạt 1.844 điểm trên GDPval-AA v2.1, gần mức 1.846 của Opus 5.5 và cao hơn 1.449 của Sonnet 5. Hãng cũng nói model cải thiện trên AA-Briefcase, OSWorld, Humanity’s Last Exam và Chartography, các phép thử về công việc dài hạn, thao tác máy tính, suy luận đa lĩnh vực và đọc biểu đồ từ hình ảnh.

Image credit: Anthropic
Dành cho tài liệu, thiết kế và quy trình lặp nhanh
Anthropic cho biết Sonnet 5.5 viết rõ ràng hơn, hợp tác tốt hơn và có khả năng trình bày, thiết kế tốt hơn thế hệ trước. Các khách hàng thử nghiệm sớm do hãng dẫn lời đánh giá model hiểu codebase nhanh hơn, gọi công cụ với ít bước hơn và có thể tạo slide theo mẫu với ít chỉnh sửa hơn.
Những phản hồi này là kết quả thử nghiệm do Anthropic công bố, không phải đánh giá độc lập. Zendesk cho biết ticket trong thử nghiệm của họ được xử lý nhanh hơn 20%; Slack nói model dùng ít hơn khoảng 14% token đầu ra trong các bài đánh giá Slackbot nội bộ mà không phải thay đổi prompt. Hiệu quả thực tế sẽ phụ thuộc vào dữ liệu, công cụ tích hợp, mức độ giám sát và loại tác vụ của từng tổ chức.
Người dùng có thể điều chỉnh “effort”, tức mức nỗ lực suy luận của model. Mức thấp ưu tiên phản hồi nhanh và ít token hơn cho việc thường ngày; mức cao khiến model làm việc lâu hơn và kiểm tra kỹ hơn, đổi lại chi phí thường tăng. Ứng dụng Claude và Claude Code mặc định ở mức Medium, trong khi Claude Platform mặc định High.
Giá giữ nguyên nhưng chi phí thực tế có thể giảm
Giá niêm yết của Sonnet 5.5 giữ nguyên như Sonnet 5: 2 USD cho một triệu input token, 10 USD cho một triệu output token và 0,20 USD cho một triệu token đọc từ bộ nhớ đệm. Anthropic nói model tạo phản hồi nhanh hơn hơn 30% và trong thử nghiệm nội bộ, chi phí mỗi tác vụ có thể thấp hơn tới 30% nhờ cần ít token hơn.
Token là đơn vị văn bản mà mô hình xử lý và tạo ra. Vì vậy, dù giá trên một triệu token không thay đổi, tổng hóa đơn có thể giảm nếu model thực sự hoàn thành tác vụ trong ít bước hơn. Mức tiết kiệm tới 30% là tuyên bố của Anthropic, không phải mức bảo đảm cho mọi quy trình triển khai.
Bảo vệ an ninh mạng và khả năng tiếp cận
Anthropic cho biết Sonnet 5.5 là model Sonnet đầu tiên ra mắt cùng các biện pháp bảo vệ an ninh mạng tương tự những model mạnh nhất của hãng. Các yêu cầu an ninh mạng có rủi ro cao có thể được chuyển về Sonnet 5, trong khi hoạt động phát triển phần mềm và sửa lỗi thông thường được hãng nói là không bị ảnh hưởng.
Biện pháp bảo vệ về sinh học giữ nguyên như Sonnet 5 và nhắm đến một nhóm yêu cầu gây hại, dù Anthropic lưu ý một số câu hỏi về vi sinh hoặc virus học có thể bị gắn cờ nhầm. Hãng cũng bổ sung bộ phân loại nhằm ngăn hành vi trích xuất năng lực suy luận ở quy mô lớn qua nhiều tài khoản giả.
Claude Sonnet 5.5 hiện có trên Claude Platform, AWS, Google Cloud và Microsoft Azure, với chính sách zero data retention theo Anthropic. Nhà phát triển có thể gọi model bằng tên claude-sonnet-5-5. Nếu đang dùng Sonnet với chế độ thinking tắt, Anthropic yêu cầu chuyển sang thiết lập between_tools trước khi nâng cấp.
Anthropic cũng cho biết Claude Haiku 5.5, phiên bản hướng đến ứng dụng lưu lượng cao và nhạy cảm chi phí, sẽ được bổ sung vào họ Claude 5.5 trong vài tuần tới.
Vì sao đáng chú ý?
Bản phát hành cho thấy cạnh tranh giữa các nhà cung cấp AI không chỉ nằm ở điểm benchmark cao nhất, mà còn ở khả năng đưa model vào quy trình lặp lại hằng ngày. Với các đội ngũ dùng AI để viết mã, xử lý tài liệu hoặc hỗ trợ vận hành, điều cần kiểm chứng là liệu chất lượng đầu ra, mức dùng token và cơ chế bảo vệ có giữ được hiệu quả khi áp dụng trên dữ liệu và công cụ thực tế hay không.
- Nguồn chính thức: Introducing Claude Sonnet 5.5, Anthropic, 28/09/2026


