Người dùng GPT-6 Astra phàn nàn mô hình kém thông minh hơn chỉ sau một tuần ra mắt, lặp lại kịch bản từng xảy ra với GPT-5.6 Sol hồi tháng 7.
Chỉ một tuần sau khi ra mắt với khả năng gây kinh ngạc như tái dựng Manhattan từng con phố bên trong một công cụ trò chơi, GPT-6 Astra của OpenAI đang phải đối mặt với làn sóng chỉ trích ngày càng lớn từ chính những người dùng từng ca ngợi nó.
Trên mạng xã hội X, nhà phát triển ẩn danh synthwavedd mô tả hiện tượng này là “ca phẫu thuật thùy não hậu ra mắt”, một cách nói châm biếm đã trở nên quen thuộc trong cộng đồng người dùng AI mỗi khi họ cảm thấy một mô hình yêu thích đột ngột bị suy giảm hiệu năng.
Nhà phát triển Pranjal Paliwal, sau khi xem lại kỹ đoạn mã do Astra viết, thậm chí còn nhận định rằng đây là một sự thụt lùi chứ không phải bước tiến tới trí tuệ nhân tạo tổng quát (AGI) như tuyên bố ban đầu của chủ tịch OpenAI khi mô hình ra mắt.
Những nghi vấn về “giá trị juice” và phản ứng trái chiều
Các phàn nàn có điểm chung khá rõ ràng: mô hình trả lời nhanh hơn nhưng chất lượng lại kém đi, khiến nhiều người nghi ngờ OpenAI đã âm thầm giảm cái mà cộng đồng gọi là “giá trị juice”, lượng tài nguyên tính toán mà mô hình dành cho quá trình suy luận trước khi đưa ra câu trả lời. Một số người dùng như Salio và nhà nghiên cứu Md Ismail Sojal đã thử nghiệm bằng cách chạy cùng một câu lệnh trên phiên bản Astra ngày ra mắt và phiên bản hiện tại, đều nhận thấy kết quả kém hơn rõ rệt.
Dax Raad, nhà phát triển công cụ Opencode, cho biết nhóm của ông đã quay lại sử dụng GPT-5.6 Sol vì chi phí sử dụng Astra đã tăng gấp đôi trong khi hiệu quả không tương xứng. Tuy nhiên, không phải ai cũng đồng tình rằng đây là sự cố ý làm suy yếu mô hình. Người dùng Antikythera lập luận rằng Astra vẫn giữ nguyên năng lực như lúc ra mắt, chỉ là người dùng đã hết giai đoạn phấn khích ban đầu và bắt đầu nhận ra những hạn chế vốn có, như xu hướng lạm dụng gạch đầu dòng.
Theo, nhà sáng lập T3Chat, đưa ra một giả thuyết khác: Astra có thể vốn thiếu ổn định hơn Claude Fable, dẫn đến việc đôi khi tạo ra mã nguồn xuất sắc nhưng có lúc lại cho kết quả rất kém, và những trường hợp tệ chỉ đơn giản được đăng tải nhiều hơn sau khi giai đoạn trăng mật kết thúc.
Đây không phải lần đầu OpenAI đối mặt với tình huống tương tự. Mô hình tiền nhiệm GPT-5.6 Sol cũng từng trải qua chu kỳ gần như giống hệt vào tháng 7, khi người dùng báo cáo chế độ suy luận cao nhất bỗng trở nên hời hợt chỉ sau một đêm. Khi đó, giám đốc OpenAI Tibo Sottiaux đã phủ nhận việc cố tình làm suy yếu mô hình, nhưng xác nhận công ty có thử nghiệm điều chỉnh mức độ nỗ lực suy luận.
Đến nay, OpenAI vẫn chưa đưa ra bất kỳ tuyên bố chính thức nào về trường hợp của Astra. Đáng chú ý, đây vẫn là mô hình đầu tiên của công ty vượt ngưỡng rủi ro an ninh mạng nghiêm trọng theo tiêu chuẩn nội bộ, với năng lực chỉ được cung cấp cho các chuyên gia phòng thủ đã qua thẩm định trong chương trình Daybreak.
Dù năng lực thực tế ra sao, Astra vẫn được định giá 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra, cao gấp 2,5 lần mức giá của Sol khi ra mắt.




































































