AI cho doanh nghiệp

OpenAI và Anthropic cùng ra mắt mô hình AI chi phí thấp

OpenAI và Anthropic cùng ra mắt mô hình AI chi phí thấp

TL;DR: OpenAI và Anthropic cùng công bố các mô hình AI chi phí thấp hơn, cho thấy cuộc cạnh tranh đang chuyển mạnh sang hiệu quả vận hành và giá sử dụng trong lúc tranh luận về an toàn AI tiên tiến gia tăng.

OpenAI ngày thứ Ba giới thiệu GPT-6 Sol và GPT-6 Luna, hai tầng mới trong họ GPT-6. Theo công ty, giá API của hai mẫu này thấp hơn 50% so với mức giá khuyến mại của GPT-5.6, nhắm đến các doanh nghiệp muốn kiểm soát chi tiêu khi đưa AI vào sản phẩm và quy trình làm việc.

Cùng ngày, Anthropic phát hành Claude Opus 5.5, bản mới thuộc họ Claude 5.5. Anthropic cho biết mô hình này dùng token hiệu quả hơn, từ đó có chi phí vận hành thấp hơn khoảng 40% so với Opus 5.

Đây là những bản phát hành đầu tiên của cả hai công ty kể từ khi cuộc tranh luận về việc có nên làm chậm phát triển AI tiên tiến trở nên gay gắt trong vài tuần gần đây. Việc hai phòng thí nghiệm lớn đồng thời nhấn vào chi phí phản ánh áp lực kép: đáp ứng nhu cầu thực tế của khách hàng và cạnh tranh với các mô hình open-weight giá rẻ hơn.

OpenAI bổ sung hai lựa chọn theo loại công việc

GPT-6 Sol được OpenAI định vị cho các khối lượng công việc phức tạp hơn, chẳng hạn lập trình. Sol nằm dưới Astra, một tầng khác trong dòng GPT-6, cho thấy công ty tiếp tục phân chia danh mục theo mức năng lực và chi phí thay vì chỉ cung cấp một mô hình cho mọi nhu cầu.

Trong khi đó, GPT-6 Luna hướng đến tác vụ khối lượng lớn như trích xuất thông tin hoặc tóm tắt các tài liệu. Đây là các công việc phổ biến trong doanh nghiệp, ví dụ xử lý nhiều hồ sơ, phân loại dữ liệu văn bản hoặc tạo bản tóm tắt nội bộ, nơi chi phí cho từng lần gọi mô hình có thể tăng nhanh khi triển khai ở quy mô lớn.

API là giao diện để phần mềm gọi mô hình AI tự động. Việc OpenAI giảm giá API 50% so với giá khuyến mại GPT-5.6 có thể đặc biệt quan trọng với các nhà phát triển và doanh nghiệp tích hợp AI vào sản phẩm, thay vì chỉ sử dụng qua chatbot. Tuy nhiên, thông tin được công bố không nêu mức giá tuyệt đối hay điều kiện áp dụng cụ thể cho từng loại tác vụ.

Anthropic tập trung giảm số token cần dùng

Claude Opus 5.5 là phiên bản Anthropic mô tả là tiết kiệm token hơn. Token là các đơn vị văn bản mà mô hình xử lý và tạo ra; trong nhiều cách tính phí AI, lượng token đầu vào và đầu ra ảnh hưởng trực tiếp đến chi phí sử dụng.

Dianne Penn, người đứng đầu quản lý sản phẩm cho mảng nghiên cứu và phòng thí nghiệm tại Anthropic, cho biết công ty đang cải thiện hiệu quả của quá trình suy luận và trả lời, để mô hình dùng ít token hơn tùy theo mức thiết lập nỗ lực. Theo Anthropic, cách tiếp cận này giúp chi phí chạy Claude Opus 5.5 thấp hơn khoảng 40% so với Opus 5.

Điểm đáng lưu ý là mức giảm này đề cập đến chi phí vận hành so với thế hệ trước, không phải một đánh giá độc lập về chất lượng hay hiệu quả ở mọi loại tác vụ. Nguồn thông tin cũng chưa nêu các benchmark, tức bài kiểm tra chuẩn, để đối chiếu trực tiếp Opus 5.5 với các mô hình mới của OpenAI.

Giá thành trở thành mặt trận cạnh tranh rõ nét hơn

Các bản phát hành xuất hiện khi khách hàng ngày càng tìm các mô hình có chi phí hợp lý hơn và muốn kiềm chế ngân sách AI. Với doanh nghiệp, một mô hình mạnh hơn nhưng đắt hơn không phải lúc nào cũng là lựa chọn phù hợp nếu công việc chủ yếu là xử lý lặp lại, tóm tắt hoặc trích xuất dữ liệu ở quy mô lớn.

OpenAI và Anthropic cũng đang chịu cạnh tranh từ các mô hình open-weight, tức mô hình được phát hành với trọng số để bên khác có thể tải về, tinh chỉnh hoặc tự triển khai theo điều kiện giấy phép. Các đối thủ được nhắc đến gồm Alibaba, Moonshot AI và DeepSeek của Trung Quốc, vốn cung cấp những lựa chọn rẻ hơn.

Áp lực này không đồng nghĩa mô hình giá thấp luôn thay thế được mô hình tiên tiến nhất. Các tổ chức còn cân nhắc độ chính xác, độ ổn định, khả năng lập trình, yêu cầu bảo mật và chi phí hạ tầng. Nhưng động thái đồng loạt từ hai công ty cho thấy giá mỗi tác vụ và lượng token tiêu thụ đang trở thành tiêu chí sản phẩm quan trọng hơn.

Tranh luận an toàn vẫn chưa khép lại

Các công bố mới diễn ra sau khi Dario Amodei, CEO Anthropic, kêu gọi toàn ngành làm chậm việc phát triển AI tiên tiến, trong bối cảnh lo ngại về rủi ro của các hệ thống ngày càng mạnh. Cuộc tranh luận trở nên căng thẳng sau khi cựu nghiên cứu viên Anthropic Jacob Coxon viết trên X ngày 8/9 rằng ông rời công ty và cảnh báo cả hai phòng thí nghiệm đang đặt xã hội trước rủi ro.

Sam Altman, CEO OpenAI, và Elon Musk cũng tham gia lời kêu gọi của Amodei theo nguồn tin. Tuy vậy, các sản phẩm mới cho thấy hai công ty vẫn tiếp tục cập nhật danh mục mô hình để phục vụ nhu cầu thương mại hiện tại. Thông tin công bố không cho biết các đợt phát hành này đi kèm biện pháp an toàn mới nào, hoặc liệu chúng có thay đổi lập trường của hai công ty về tốc độ phát triển AI tiên tiến hay không.

Vì sao đáng chú ý?

Thị trường AI đang không chỉ cạnh tranh ở việc ai tạo ra mô hình mạnh nhất. Khả năng cung cấp mức năng lực đủ tốt với chi phí có thể dự báo sẽ quyết định liệu AI có được mở rộng từ các thử nghiệm nhỏ sang quy trình vận hành thường ngày hay không. Với người dùng doanh nghiệp, sự phân tầng như Sol, Luna và Opus 5.5 cũng đồng nghĩa việc chọn mô hình sẽ ngày càng gắn với từng loại công việc cụ thể, thay vì mặc định chọn phiên bản cao cấp nhất.

    Skills Bridge tổng hợp