Claude Haiku 5.5 có giá 0,10 USD mỗi triệu token đầu vào, giảm 90% so với Haiku 4.5, chi phí vận hành trung bình thấp hơn khoảng 75%, ra mắt sau Opus 5.5 15 ngày.
Anthropic hôm thứ Tư phát hành Claude Haiku 5.5, mô hình nhỏ mà công ty mô tả là rẻ nhất, nhanh nhất và có năng lực cao nhất từng phát triển. Mô hình hướng tới các tác vụ khối lượng lớn như tóm tắt tài liệu, truy vấn cơ sở dữ liệu, cùng những công việc nhạy cảm về tốc độ như hỗ trợ khách hàng theo thời gian thực và vận hành trình duyệt web thay mặt người dùng.
Với lời nhắc dài tối đa 100.000 token, nhà phát triển trả 0,10 USD cho mỗi một triệu token đầu vào và 0,50 USD cho mỗi một triệu token đầu ra. Mức giá này tương đương GPT-6 Luna, mô hình nhỏ cạnh tranh trực tiếp của OpenAI khi ra mắt ngày 22/9, trong khi Haiku 4.5 có giá lần lượt 1 USD và 5 USD.
Các lời nhắc dài hơn 100.000 token được giảm giá 50%. Do khoảng 90% yêu cầu gửi tới mô hình cũ nằm dưới ngưỡng này, và Haiku 5.5 chia cùng lượng văn bản thành số token nhiều hơn đôi chút, Anthropic ước tính mức tiết kiệm trung bình khoảng 75%. Theo định hướng của công ty, các tác vụ lặp lại, đơn giản và ít đòi hỏi sáng tạo là nhóm phù hợp nhất với mô hình.
Giá rẻ nhưng không đồng nghĩa năng lực thấp
Kết quả đánh giá chuẩn cho thấy Haiku 5.5 vượt xa kỳ vọng thông thường với một mô hình nhỏ. Trên OSWorld 2.1, bài kiểm tra khả năng AI vận hành máy tính thực qua các tác vụ dài nhiều bước, mô hình đạt tỷ lệ thành công 72,4%, so với 48,9% của GPT Luna. Trên Terminal-Bench 4.0, nơi tác nhân AI phải hoàn thành nhiệm vụ chuyên môn bằng lệnh trong môi trường dòng lệnh ngay từ lần thử đầu, Haiku 5.5 đạt 39,2%, so với 16,4% của Luna và 0% của Haiku 4.5.
Để so sánh, Claude Sonnet 5.5 đạt 70,6%. Trên GDPval-AA v2.1, bộ đánh giá công việc chuyên môn thực tế thuộc 44 nghề nghiệp theo thang điểm Elo, Haiku 5.5 đạt 1.620 điểm, cao hơn Luna (1.437) và vượt xa Haiku 4.5 (735).
Tuy nhiên, thử nghiệm của chúng tôi với một câu hỏi logic đơn giản cho thấy mô hình phản hồi gần như tức thì nhưng lại đưa ra đáp án sai, nhắc nhở người dùng cần thận trọng khi đặt niềm tin hoàn toàn vào kết quả đầu ra.
Haiku 5.5 là mô hình Haiku đầu tiên có cơ chế điều chỉnh mức độ nỗ lực suy luận, cho phép cân bằng giữa chi phí và chất lượng. Anthropic cũng giảm một nửa giá đọc bộ nhớ đệm của Sonnet 5.5 xuống 0,10 USD mỗi triệu token, áp dụng với phần văn bản mô hình đã xử lý trước đó.
Mô hình ra mắt 15 ngày sau Opus 5.5 (22/9) và chín ngày sau Sonnet 5.5 (28/9), hoàn tất bộ ba Claude 5.5 mà Anthropic đã cam kết. Opus 5.5 là sản phẩm đầu tiên được phát hành kể từ khi Giám đốc điều hành Dario Amodei công bố bài viết kêu gọi ngành giảm tốc độ gia tăng năng lực AI. Haiku 5.5 hiện có trên trang web Claude, Amazon Web Services, Google Cloud và Microsoft Azure với tên claude-haiku-5-5. Trong tuần này, Anthropic cũng bắt đầu cấp hạn mức tín dụng API theo tháng: 100 USD cho gói Max 5x, 200 USD cho gói Max 20x và tối đa 500 USD dùng chung cho các gói Team.



































































