Anthropic ra mắt Claude Haiku 5.5

Mô hình AI Claude Haiku 5.5 mới được Anthropic công bố có chi phí rẻ hơn khoảng 75% so với Haiku 4.5.

Ngày 07/10/2026, Anthropic công bố Claude Haiku 5.5, mô hình nhỏ mà hãng gọi là rẻ nhất, nhanh nhất và mạnh nhất họ từng phát hành. Haiku 5.5 xử lí các việc ngắn, lặp lại như tóm tắt, nén ngữ cảnh, truy vấn cơ sở dữ liệu và phân loại, đồng thời làm tác nhân phụ (subagent) cho Opus 5.5 và Sonnet 5.5 khi lập trình. Là mô hình nhanh nhất của hãng ở chế độ tiêu chuẩn, Haiku 5.5 cũng phù hợp với các công việc như hỗ trợ khách hàng trực tiếp và điều khiển trình duyệt.

Với yêu cầu đến 100.000 token, Haiku 5.5 có giá 0,10 USD cho mỗi triệu token đầu vào và 0,50 USD cho mỗi triệu token đầu ra, thấp hơn 90% so với Haiku 4.5. Yêu cầu dài hơn có giá 0,50 USD và 2,50 USD, thấp hơn 50%. Theo Anthropic, 90% yêu cầu gửi tới Haiku 4.5 thuộc nhóm ngắn, nên tính trung bình chi phí giảm khoảng 75%, dù bộ phân loại token mới khiến Haiku 5.5 tốn nhiều token hơn cho mỗi đầu việc.

Claude Haiku 5.5 Benchmark

Trên bảng điểm do hãng công bố, Haiku 5.5 đạt 72,4% ở bài kiểm tra điều khiển máy tính OSWorld 2.1, so với 15,7% của Haiku 4.5 và 48,9% của GPT-6 Luna. Ở Terminal-Bench 4.0 về lập trình trên dòng lệnh, Haiku 5.5 đạt 39,2%, còn Haiku 4.5 được 0%. Sonnet 5.5 vẫn dẫn ở mọi bài, với 83,9% trên OSWorld và 70,6% trên Terminal-Bench.

Haiku 5.5 là mô hình Haiku đầu tiên cho chỉnh mức nỗ lực (effort), để người dùng chọn ưu tiên chi phí hay độ thông minh. Anthropic nói rõ Sonnet 5.5 và Opus 5.5 vẫn hợp hơn cho lập trình tác nhân phức tạp, còn Haiku 5.5 dành cho việc nhỏ, vốn quá tốn kém nếu chạy bằng các bản Claude trước.

OSWorld 2.1

Terminal-Bench 4.0

Về an toàn, Haiku 5.5 tiến bộ lớn ở gần như mọi bài đánh giá căn chỉnh (alignment) so với Haiku 4.5, ít sẵn lòng tiếp tay cho việc lạm dụng hơn. Rào chắn an ninh mạng chặt hơn Haiku 4.5 và cho phép nhiều tác vụ phòng thủ hơn Sonnet 5.5, nhưng vẫn chặn kiểm thử xâm nhập. Rào chắn sinh học giữ nguyên như Sonnet 5, Sonnet 5.5 và Opus 5.

Haiku 5.5 đã có trên Amazon Web Services, Google Cloud, Microsoft Azure và Claude Platform với mã claude-haiku-5-5. Ngoài ra, Anthropic giảm một nửa giá đọc bộ nhớ đệm của Sonnet 5.5, từ 0,20 USD xuống 0,10 USD mỗi triệu token, giúp phần lớn tác vụ dạng tác nhân (agentic) rẻ hơn khoảng 20%. Trong tuần này, gói Max 5x nhận 100 USD (khoảng 2,6 triệu đồng) tín dụng API mỗi tháng, Max 20x nhận 200 USD (khoảng 5,2 triệu đồng), còn gói Team nhận tối đa 500 USD (khoảng 13 triệu đồng) dùng chung.

Bảng giá Claude Haiku 5.5

Chia sẻ trong thông báo ra mắt, nhiều công ty dùng thử Haiku 5.5 cho biết mô hình AI này cho kết quả rất tốt. Box cho biết Haiku 5.5 hơn Haiku 4.5 tới 11 điểm với độ trễ chỉ khoảng một nửa. Ở AlphaSense, tính năng Ask in Document nhận khoảng 8 triệu lượt gọi mỗi tuần, và Haiku 5.5 đạt 0,84 điểm so với 0,76 của Haiku 4.5 qua 400 truy vấn thử.

HubSpot, nơi chủ yếu thử các mô hình nhỏ trong tác vụ quản lí quan hệ khách hàng (CRM), cho biết Haiku 5.5 đạt 92,8% trung bình qua ba lần chạy, điểm cao nhất họ từng ghi nhận trên bộ thử này. Ở bài rà soát các bản ghi cũ khó xác định, nó hoàn tất nhanh nhất, trúng nhiều nhất và ít báo nhầm nhất trong số các mô hình được thử.

Cognition đã đưa Haiku 5.5 vào nhóm mô hình phụ trợ của Devin Fusion. Khi ghép với Haiku 5.5, Fusion vẫn giữ 66,2 điểm FrontierCode, thuộc nhóm dẫn đầu, trong khi giảm cả chi phí lẫn độ trễ. Người dùng có thể thử ngay trên Devin CLI với Opus 5.5 làm mô hình chính.

Tại Rogo, Haiku 5.5 được sử dụng làm tác nhân phụ lấy số doanh thu theo mảng từ báo cáo tài chính 10-K trong khi mô hình lớn hơn dựng bài thuyết trình. “Nó đủ chính xác để chúng tôi tin dùng ở khâu đó, và đủ nhanh, đủ rẻ để chạy rất nhiều”, Alex Wang, thành viên nhóm Applied AI của Rogo, chia sẻ.

Thêm hanthienhai.com vào danh sách nguồn ưu tiên trên Google

Theo dõi
Thông báo của
guest
0 Comments
Cũ nhất
Mới nhất Được bỏ phiếu nhiều nhất