HomeTổng HợpGemini 3.5 Pro trễ hẹn lần 3, Google tung bản tạm

Gemini 3.5 Pro trễ hẹn lần 3, Google tung bản tạm

HÀ NỘI, 23/7/2026Gemini 3.5 Pro, mô hình đầu bảng mà Google hứa hẹn từ hội nghị I/O hồi tháng 5, tiếp tục vắng mặt sau khi lỡ mốc 17/7 — lần trễ hẹn thứ ba liên tiếp. Ngày 21/7, Google chọn cách giữ nhịp bằng bản tạm: tung ra Gemini 3.6 Flash cùng 3.5 Flash-Lite và Flash Cyber, nhưng vẫn không có Pro. Theo TechCrunch, lãnh đạo sản phẩm của DeepMind Logan Kilpatrick xác nhận công ty đang thử nghiệm Pro với đối tác và hy vọng “sớm ra mắt”.

Điểm cần nói rõ: Google vẫn chưa công bố model card hay lịch phát hành chính thức cho Pro, và phần lớn lý do kỹ thuật đằng sau ba lần trễ vẫn đến từ nguồn tin giấu tên cùng báo chí công nghệ. Nhưng khác với vài tuần trước, giờ đã có xác nhận công khai từ chính DeepMind rằng mô hình tồn tại, đang ở giai đoạn thử nghiệm với đối tác qua Vertex AI, và chưa xuất hiện trong tài liệu Gemini API công khai.

Vì sao Gemini 3.5 Pro trễ hẹn lần thứ ba trong năm 2026

Mỗi lần trễ phản ánh một lớp vấn đề khác nhau, và đó mới là chi tiết đáng chú ý.

Lần đầu, từ tháng 6 sang tháng 7, được cho là do tinh chỉnh chất lượng sau khi nhóm khách hàng doanh nghiệp thử nghiệm sớm phản hồi về hiệu quả token và khả năng suy luận nhiều bước. Đây là dạng trễ thông thường trong ngành.

Lần thứ hai nghiêm trọng hơn nhiều. Nhiều nguồn tin cho biết Google DeepMind đã bỏ hẳn mô hình gần hoàn thiện và ra lệnh chạy lại toàn bộ giai đoạn tiền huấn luyện trên nền Gemini 3 thuần. Hai lỗi bị nêu đích danh: mô hình không giữ được tính nhất quán khi tạo bố cục SVG nhiều lớp, và sụp đổ trong môi trường gọi công cụ đệ quy — tức chuỗi thao tác mà tác tử gọi một công cụ, lấy kết quả gọi tiếp công cụ khác, kéo dài hàng chục bước.

Khác biệt giữa hai lựa chọn này rất lớn về mặt kỹ thuật. Tiền huấn luyện là giai đoạn đắt đỏ nhất, quyết định trần năng lực của mô hình. Tinh chỉnh và học tăng cường từ phản hồi con người chỉ có thể mài giũa bên trong cái trần đó, không nâng nó lên. Khi chọn chạy lại tiền huấn luyện thay vì tiếp tục tinh chỉnh, Google được cho là đã thừa nhận trần năng lực của bản gốc nằm sai chỗ — một vấn đề cấu trúc, không phải vấn đề hoàn thiện.

Lần thứ ba, báo cáo hôm 15/7 dẫn nguồn Geeky Gadgets, lại là nhóm lỗi khác: tỷ lệ ảo giác cao và hiệu năng thiếu ổn định trong quy trình thực tế, khiến mô hình chưa bắt kịp GPT-5.6 ở một số bài đo. Nếu thông tin này chính xác, bản dựng lại đã vượt qua hai lỗi ban đầu nhưng vấp phải rào cản mới.

Đến ngày 21/7, bản phát hành tạm không còn là tin đồn. Google chính thức tung Gemini 3.6 Flash — mô hình “ngựa thồ” được quảng cáo mạnh hơn ở lập trình và tác vụ đa phương thức, tiêu thụ ít hơn 17% token đầu ra so với 3.5 Flash, giá 1,5 USD đầu vào và 7,5 USD đầu ra mỗi triệu token — cùng 3.5 Flash-Lite và 3.5 Flash Cyber. Bản Cyber chuyên dò và vá lỗ hổng bảo mật, chỉ mở cho chính phủ và đối tác tin cậy theo diện thử nghiệm giới hạn. Cả ba đều dựng trên nền Flash, củng cố suy đoán rằng Google dùng dòng Flash để giữ nhịp trong lúc Pro chưa sẵn sàng.

Lập trình viên cân nhắc nền tảng khi Gemini 3.5 Pro chưa ra mắt
Đội phát triển được khuyên không đặt lịch sản phẩm phụ thuộc mô hình chưa có model card. Ảnh minh họa.

Đối thủ đã lên kệ, Google còn lại gì

Bối cảnh cạnh tranh đã siết lại đáng kể trong sáu tuần qua. Claude Fable 5 ra mắt ngày 1/7. GPT-5.6 phát hành rộng rãi ngày 9/7 với ba cấp Sol, Terra và Luna. Grok 4.5 của SpaceXAI lên kệ ngày 8/7, giá 2 USD đầu vào và 6 USD đầu ra mỗi triệu token — mức rẻ nhất trong nhóm mô hình đầu bảng đang chạy thương mại.

Điều đó để lại Google là phòng thí nghiệm lớn duy nhất chưa có mô hình đầu bảng 2026 chạy thương mại rộng rãi, đúng vào thời điểm CEO của chính họ đã hứa giao hàng.

Tuy vậy, khoảng trống này không hoàn toàn bỏ ngỏ. Gemini 3.5 Flash ra mắt từ 19/5 vẫn đang gánh phần lớn khối lượng vận hành. Google xác nhận Flash đạt 76,2% trên Terminal-Bench 2.1 và 83,6% trên MCP Atlas, đều vượt Gemini 3.1 Pro, ở mức giá 1,5 USD đầu vào và 9 USD đầu ra mỗi triệu token. Flash được thiết kế cho tác vụ tốc độ cao, khối lượng lớn. Vai trò của Pro — nếu ra mắt — là công việc phức tạp kéo dài: sửa mã nhiều tệp, phân tích tài liệu ngữ cảnh dài.

Thị trường dự đoán đã hấp thụ tín hiệu trễ hẹn. Trên Polymarket, kịch bản Google giao hàng trước ngày 31/7 đang dẫn đầu, trong khi một thị trường khác nghiêng về mốc đầu tháng 8.

Góc nhìn Việt Nam: với đội phát triển trong nước đang cân nhắc nền tảng, bài học thực tế là đừng đặt lịch sản phẩm phụ thuộc vào một mô hình chưa có model card công khai. Tín hiệu duy nhất đáng tin là dòng gemini-3.5-pro xuất hiện chính thức trong tài liệu Gemini API. Trong lúc chờ, các lựa chọn đã sẵn sàng cho phần lớn nhu cầu gồm Gemini 3.5 Flash, GPT-5.6 Terra hoặc Claude Fable 5 — đều nằm trong tầm ngữ cảnh 1 triệu token, đủ cho đa số bài toán doanh nghiệp vừa và nhỏ.

Một lưu ý riêng cho đội đang dùng DeepSeek: các bí danh API cũ deepseek-chatdeepseek-reasoner ngừng phản hồi từ 24/7, cần chuyển sang deepseek-v4-pro hoặc deepseek-v4-flash. Đây là mốc cố định, không liên quan tới lịch của Google.

Câu hỏi lớn hơn vẫn để ngỏ: lợi thế phân phối khổng lồ của Google qua Search, Android, Workspace và Vertex AI có đủ bù cho ba lần trễ hẹn liên tiếp, trong một thị trường mà các đội kỹ thuật đang chốt nền tảng ngay lúc này hay không.

Nguồn: TechCrunch, 9to5Google, Tech Times, Google Blog

Xem thêm: Gemini là gì? Toàn tập về trợ lý AI của Google · GPT-5.6 ra mắt bộ ba Sol, Terra và Luna

Đỗ Anh Tuấn
Đỗ Anh Tuấn
Cây viết tự do tập trung vào mảng AI quốc tế, theo sát động thái của OpenAI, Anthropic, Google DeepMind. Diễn giải tin công nghệ phức tạp thành nội dung dễ đọc và đưa góc nhìn Việt vào các sự kiện AI toàn cầu.
Bài viết liên quan

LEAVE A REPLY

Please enter your comment!
Please enter your name here

- Advertisment -
Google search engine

Xem nhiều nhất

Bình luận gần đây