Anthropic và OpenAI ra mắt mô hình AI có chi phí thấp hơn

Anthropic vừa ra mắt Claude Opus 5.5, ngay sau đó OpenAI đáp trả bằng bộ đôi GPT-6 Sol và Luna với mức chi phí giảm tới một nửa.

Cuộc đua trí tuệ nhân tạo bước vào giai đoạn cạnh tranh gay gắt về tính kinh tế khi hai tên tuổi dẫn đầu thị trường liên tục công bố sản phẩm mới. Thay vì chỉ phô diễn quy mô tham số, trọng tâm của các bản phát hành lần này chuyển dịch rõ rệt sang việc cắt giảm mạnh chi phí vận hành và tối ưu hóa hiệu năng cho các tác vụ lập trình tự chủ.

Anthropic mở màn với Claude Opus 5.5

Anthropic nổ phát súng đầu tiên khi giới thiệu Claude Opus 5.5, mô hình mở màn cho thế hệ Claude 5.5. Phiên bản này đạt hiệu năng tương đương Claude Fable 5.1 trong phần lớn công việc, đồng thời xuất dữ liệu nhanh hơn 30% và tiết kiệm 40% chi phí so với thế hệ Opus 5. Mức giá đọc bộ nhớ đệm (cache read) của Opus 5.5 giảm tới 60%, chỉ còn 0,20 USD cho mỗi triệu token, trong khi giá token đầu vào là 4 USD và đầu ra là 20 USD.

Anthropic mở màn với Claude Opus 5.5

Khả năng lập trình agent là điểm đột phá lớn nhất của Opus 5.5 khi đạt 66,4% trên bảng đánh giá Terminal-Bench 4.0, vượt qua cả GPT-6 Astra lẫn Claude Opus 5. Trong các bài kiểm tra thực tế, mô hình có thể hoàn tất việc chuyển đổi 680.000 dòng mã trong chưa đầy một ngày. Nhận định về hiệu quả làm việc của mô hình, Giám đốc Sản phẩm GitHub Mario Rodriguez chia sẻ: “Lập trình viên cần những agent có thể gánh vác công việc phần mềm thực tế và hoàn thành chúng. Trong thử nghiệm trên GitHub Copilot CLI và VS Code, Claude Opus 5.5 sử dụng số lượng token và số bước ít nhất mà chúng tôi từng ghi nhận”.

Anthropic mở màn với Claude Opus 5.5

Song song với nâng cấp kĩ thuật, Anthropic áp dụng khung an toàn nghiêm ngặt sau khi Giám đốc Điều hành Dario Amodei kêu gọi kiểm soát nhịp độ phát triển AI nhằm đảm bảo an toàn đi đôi với năng lực. Mô hình ghi nhận điểm số cao nhất trong bài kiểm tra hành vi tự động gồm gần 2.000 kịch bản của hãng, đồng thời tự động chuyển các tác vụ nguy cơ cao về an ninh mạng sang mô hình kế cận Opus 4.8. Claude Opus 5.5 hiện đã có mặt trên Amazon Web Services, Google Cloud, Microsoft Azure và nền tảng Claude API. Hai phiên bản Sonnet 5.5 và Haiku 5.5 dự kiến sẽ ra mắt trong những tuần tới.

OpenAI đáp trả bằng GPT-6 Sol và Luna

Ngay sau động thái của đối thủ, OpenAI nhanh chóng nối dài vũ trụ GPT-6 bằng hai phiên bản GPT-6 Sol và GPT-6 Luna nhằm phổ cập năng lực của GPT-6 Astra với chi phí rẻ hơn. Cả hai mô hình mới đều được huấn luyện bằng các phương pháp tương tự Astra, mang lại bước tiến lớn về lập trình, khả năng sử dụng máy tính và độ chuẩn xác dữ liệu.

GPT-6 Sol và Luna

Lợi thế cạnh tranh của bộ đôi này nằm ở mức giá API giảm tới 50% so với giá ưu đãi của thế hệ GPT-5.6. Theo đó, GPT-6 Sol có giá 2 USD cho mỗi triệu token đầu vào và 10 USD cho token đầu ra. Bản GPT-6 Luna hướng đến các nhu cầu xử lí công việc nhẹ nhàng với giá 0,10 USD đầu vào và 0,50 USD đầu ra. Hãng cũng nâng cấp cơ chế prompt caching, giảm 90% chi phí đọc dữ liệu đệm để các agent duy trì hội thoại dài hiệu quả hơn.

GPT-6 Sol và Luna

GPT-6 Sol và Luna

Trên bảng đo lường kĩ thuật phần mềm thực tế DeepSWE v1.1, GPT-6 Sol đạt 68,8%, bám sát mức 69,9% của Claude Fable 5 nhưng chi phí mỗi tác vụ thấp hơn khoảng 80%. Ở mảng quy trình làm việc doanh nghiệp AutomationBench, GPT-6 Sol đạt 33,2%, vượt qua cả Claude Fable 5.1 lẫn Claude Opus 5. Hiện GPT-6 Sol và Luna đã được triển khai trên ChatGPT Work, Codex cho các tài khoản trả phí và hệ thống OpenAI API, riêng bản Luna hỗ trợ cả người dùng miễn phí trên ứng dụng máy tính để bàn.

Thêm hanthienhai.com vào danh sách nguồn ưu tiên trên Google

Theo dõi
Thông báo của
guest
0 Comments
Cũ nhất
Mới nhất Được bỏ phiếu nhiều nhất