Google phát hành Gemini 3.6 Flash, 3.5 Flash-Lite và mô hình an ninh mạng hạn chế, trong khi Gemini 3.5 Pro trễ hẹn, cổ phiếu Alphabet từng giảm 4,4%.
Google vừa ra mắt ba mô hình trí tuệ nhân tạo mới gồm Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber, nhưng đây không phải là sản phẩm mà phần lớn người dùng chờ đợi. Sau khi giới thiệu Gemini 3.5 Flash tại sự kiện Google I/O 2026 hồi tháng 5 và cam kết phát hành phiên bản Pro trong vòng một tháng, Google đã âm thầm không đáp ứng thời hạn tự đặt ra.
Theo Bloomberg, Gemini 3.5 Pro bị trì hoãn vì không đạt các mục tiêu nội bộ, đặc biệt trong các tác vụ lập trình, và một nỗ lực khắc phục bằng cách cập nhật dữ liệu huấn luyện vào cuối tháng 6 cũng cho kết quả không như kỳ vọng. Cổ phiếu Alphabet giảm khoảng 4,4% sau thông tin này, tương ứng với mức mất khoảng 200 tỷ USD vốn hóa thị trường chỉ trong một phiên giao dịch. Mô hình thuộc phân khúc Pro gần nhất mà Google phát hành vẫn là Gemini 3.1 Pro, ra mắt từ tháng 2.
Gemini 3.6 Flash là sản phẩm chủ lực của đợt phát hành, sử dụng ít hơn 17% số token đầu ra so với phiên bản trước theo Chỉ số Artificial Analysis, đồng thời có chi phí giảm còn 1,50 USD cho mỗi triệu token đầu vào và 7,50 USD cho đầu ra, thay vì mức 9 USD trước đó. Mô hình đạt 49% trên DeepSWE v1.1 và 63,9% trên MLE-Bench, cải thiện đáng kể so với 37% và 49,7% của thế hệ cũ, đồng thời dẫn đầu OSWorld-Verified với 83,0%, vượt Claude Sonnet 5 và GPT-5.6 Luna.
Dù vậy, GPT-5.6 Luna vẫn vượt trội ở DeepSWE và Terminal-Bench 2.1, còn Claude Sonnet 5 dẫn đầu công việc tri thức trên GDPval-AA v2. Trong thử nghiệm lập trình thực tế, mô hình tạo ra tệp HTML lỗi định dạng và cần đến DeepSeek sửa tám lỗi quan trọng mới vận hành được, cho thấy tư duy cốt lõi đúng hướng nhưng chi tiết thực thi còn nhiều sai sót.
Các mô hình còn lại và định hướng tương lai
Gemini 3.5 Flash-Lite được thiết kế cho khối lượng xử lý lớn với tốc độ 350 token đầu ra mỗi giây và chi phí chỉ 0,30 USD cho đầu vào, 2,50 USD cho đầu ra mỗi triệu token, phù hợp với các quy trình thông lượng cao hoặc làm công cụ nén phiên làm việc cho tác nhân trí tuệ nhân tạo. Trong khi đó, Gemini 3.5 Flash Cyber bị giới hạn quyền truy cập, chỉ dành cho chính phủ và đối tác đã được thẩm định để phục vụ phát hiện lỗ hổng phần mềm, do tính lưỡng dụng của năng lực này.
Đáng chú ý, Google xác nhận đã khởi động giai đoạn tiền huấn luyện tham vọng nhất từ trước đến nay cho Gemini 4, cho thấy mô hình kế nhiệm đã chính thức được đưa vào xây dựng. Gemini 3.6 Flash và 3.5 Flash-Lite hiện đã có mặt trên ứng dụng Gemini, Google AI Studio và API, trong khi thời điểm ra mắt Gemini 3.5 Pro vẫn chưa được xác định.




































































