OpenAI ra mắt GPT-6 Sol, Luna và giảm 50% giá API, chỉ vài phút sau khi Anthropic tung Claude Opus 5.5, đẩy cuộc đua mô hình AI lên cao trào.
OpenAI đã phát hành hai mô hình mới là GPT-6 Sol và GPT-6 Luna vào thứ Ba, chỉ vài phút sau khi Anthropic ra mắt Claude Opus 5.5, mô hình đầu bảng mới của công ty đối thủ. Động thái gần như đồng thời này cho thấy mức độ cạnh tranh giữa hai hãng phát triển trí tuệ nhân tạo hàng đầu hiện đang được tính bằng từng phút, thay vì từng tuần hay từng tháng như trước đây.
Chiến lược phân tầng sản phẩm và cuộc đua về giá
Sol và Luna được xếp dưới GPT-6 Astra, mô hình mà OpenAI từng gọi là mô hình thông minh và có mức độ căn chỉnh cao nhất thế giới khi ra mắt vào ngày 3/9. Trong khi Astra tiếp tục là lựa chọn hàng đầu của OpenAI cho các nhiệm vụ khó nhất, Sol và Luna được định vị là phương án chi phí thấp hơn, tốc độ nhanh hơn, phục vụ công việc hằng ngày. Cấu trúc phân tầng này khá tương đồng với danh mục mô hình của Anthropic, trong đó Astra tương ứng với Fable, Sol tương ứng với Opus, Terra tương ứng với Sonnet, còn Luna tương ứng với Haiku.
Song song với việc ra mắt, OpenAI cũng điều chỉnh mạnh về giá nhằm duy trì khả năng cạnh tranh. Chi phí giao diện lập trình ứng dụng (API) của cả hai mô hình mới đã giảm 50% so với mức giá khuyến mại theo token của GPT-5.6. Cụ thể, Sol hiện có giá 2 USD cho mỗi một triệu token đầu vào và 10 USD cho mỗi một triệu token đầu ra, giảm từ mức 4 USD và 20 USD trước đó; trong khi Luna giảm xuống còn 0,10 USD và 0,50 USD, từ mức 0,20 USD và 1,20 USD. Nhìn chung, mức giá mới của OpenAI ở từng phân khúc đều thấp hơn so với các sản phẩm tương ứng của Anthropic.
Về mặt hiệu năng, OpenAI dẫn số liệu từ AutomationBench, bộ chuẩn đánh giá do Zapier xây dựng nhằm kiểm tra khả năng một tác nhân AI hoàn thành trọn vẹn quy trình nghiệp vụ bằng 47 công cụ trải rộng các lĩnh vực bán hàng, tiếp thị, vận hành, hỗ trợ, tài chính và nhân sự. Theo đó, GPT-6 Sol ở mức suy luận cao nhất đạt tỷ lệ hoàn thành 33,2% với chi phí 0,27 USD mỗi tác vụ, trong khi Claude Opus 5 ở mức thiết lập cao nhất đạt 26,9% nhưng chi phí mỗi tác vụ cao hơn hơn 11 lần.
Trên bộ đánh giá Agents’ Last Exam, vốn kiểm tra khả năng thực hiện các nhiệm vụ dài hạn có giá trị kinh tế cao trên 55 phân ngành, GPT-6 Sol ở mức nỗ lực cao nhất đạt 56,4%, được OpenAI công bố là vượt điểm số tốt nhất của Claude Opus 5 trong khi chi phí mỗi tác vụ thấp hơn 60%. Riêng ở khả năng sử dụng máy tính, đo bằng bộ chuẩn OSWorld 2.0, GPT-6 Sol đạt 60,5%, gần như ngang bằng mức 60,3% của Claude Opus 5 ở mức nỗ lực trung bình nhưng với chi phí thấp hơn khoảng 80%.
GPT-6 Sol và Luna hiện đã được triển khai trên ChatGPT Work và Codex dành cho người dùng các gói Plus, Pro, Business, Enterprise và Edu, trong khi Luna cũng được cung cấp cho người dùng Free và Go thông qua ứng dụng máy tính. Cả hai mô hình hiện vẫn chưa xuất hiện trên ứng dụng ChatGPT thông thường, khi OpenAI cho biết đang triển khai theo từng giai đoạn trong ngày nhằm bảo đảm sự ổn định của dịch vụ.




































































