Google ra mắt ba mô hình mới, gồm Gemini 3.6 Flash! 3.5 Flash-Lite đạt tốc độ chóng mặt, quá trình huấn luyện trước của Gemini 4 đã được khởi động

Theo thông báo trên blog chính thức của Google, vào ngày 21, Google đã chính thức ra mắt các mẫu hình Flash thế hệ mới, bao gồm Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber. Các mẫu hình mới được thiết kế riêng cho quy trình làm việc của AI agents, không chỉ giúp giảm mạnh chi phí đầu ra và mức tiêu hao token, mà còn tích hợp sẵn năng lực thao tác máy tính mạnh mẽ, nhằm nhắm thẳng tới việc triển khai sản xuất quy mô lớn ở cấp doanh nghiệp.
(Tóm lược: Google tung “chip” frozen cho hiệu năng tăng vọt 10 lần! Giá trị vốn hóa của Alphabet bùng nổ thêm 1150 tỷ USD)
(Bổ sung bối cảnh: Gemini 3.5 Pro chậm ra mắt hàng tháng: xung đột nội bộ phái chính trị trong Google khiến nhân viên vô cùng thất vọng)

Mục lục

Toggle

  • Gemini 3.6 Flash:Hiệu năng nhảy vọt, chi phí đầu ra thấp hơn
  • 3.5 Flash-Lite:Tối ưu siêu nhẹ, vọt ra tốc độ 350 tokens/s
  • Tập trung vào an ninh mạng, Gemini 4 đã bắt đầu giai đoạn tiền huấn luyện

Khi công nghệ trí tuệ nhân tạo (AI) bước vào thời đại tác nhân hóa (Agentic), sự cân bằng của mô hình ngôn ngữ lớn về tốc độ, chi phí và năng lực suy luận đã trở thành yếu tố then chốt đối với việc doanh nghiệp lựa chọn triển khai. Vào ngày 21 tháng 7 năm 2026 theo giờ Đài Bắc, giám đốc quản lý sản phẩm cấp cao của đội ngũ Google, Tulsee Doshi, đã đăng bài viết chính thức, công bố ra mắt ba mẫu hình Flash hoàn toàn mới được xây dựng dựa trên phản hồi từ người dùng trước đó, qua đó củng cố thêm lợi thế hạ tầng của họ trong lĩnh vực AI agents.

Gemini 3.6 Flash:Hiệu năng nhảy vọt, chi phí đầu ra thấp hơn

Với vai trò là mô hình làm việc chủ lực thế hệ mới, Gemini 3.6 Flash đã có những cải thiện đáng kể trong việc viết mã, công việc về tri thức và các nhiệm vụ đa phương thức. Dữ liệu cho thấy, mô hình đạt điểm cao 83,0% trong bài đánh giá năng lực sử dụng máy tính (OSWorld-Verified), và hiện các công cụ liên quan để sử dụng máy tính đã được tích hợp trực tiếp vào Gemini API lẫn phiên bản dành cho doanh nghiệp.

Ngoài ra, 3.6 Flash còn tối ưu mạnh hiệu suất sử dụng token. Theo Artificial Analysis Index, lượng token dùng cho đầu ra giảm 17% so với thế hệ trước, và trong một số bài kiểm thử chuẩn (như DeepSWE) có thể giảm tới 65% ở mức cao nhất. Điều này không chỉ rút ngắn thời gian suy luận và gọi công cụ trong các quy trình làm việc nhiều bước, mà còn giúp định giá trở nên cạnh tranh hơn — đầu vào là 1,50 USD cho mỗi 1 triệu token, còn đầu ra là 7,50 USD.

3.5 Flash-Lite:Tối ưu siêu nhẹ, vọt ra tốc độ 350 tokens/s

Đối với các tác vụ cần độ trễ thấp và thông lượng cao (ví dụ tìm kiếm tác nhân và xử lý tài liệu), Google đã giới thiệu riêng Gemini 3.5 Flash-Lite. Tốc độ đầu ra của mô hình đạt tới 350 token mỗi giây, và chi phí đầu vào cực thấp, chỉ 0,3 USD cho mỗi 1 triệu token (đầu ra là 2,5 USD).

Dù được định vị là phiên bản nhẹ, chất lượng của 3.5 Flash-Lite lại vượt xa thế hệ Lite trước đó. Mô hình hỗ trợ các “mức độ tư duy (thinking levels)” có thể điều chỉnh, cho phép nhà phát triển chuyển đổi linh hoạt giữa chế độ tư duy thấp và chế độ tư duy cao để xử lý các quy trình làm việc phức tạp của tác nhân con. Trong các bài đo kiểm bối cảnh dài và mã hóa tác nhân, nó thậm chí còn vượt qua mô hình Gemini 3 Flash bản tiêu chuẩn.

Tập trung vào an ninh mạng, Gemini 4 đã bắt đầu giai đoạn tiền huấn luyện

Trong bản cập nhật lần này, Google cũng phát hành “Gemini 3.5 Flash Cyber”, một mô hình được tinh chỉnh dựa trên 3.5 Flash để phục vụ các tình huống phòng thủ an ninh cụ thể. Mô hình có thể phối hợp với hệ thống đa tác nhân CodeMender để tạo ra các báo cáo tổng hợp, giúp phía phòng thủ nhanh chóng phát hiện và khắc phục các lỗ hổng an ninh mạng. Tuy nhiên, xét đến rủi ro mục đích kép của loại kỹ thuật này, hiện chỉ giới hạn truy cập ở mức hạn chế thông qua các chương trình thí điểm đối với cơ quan chính phủ và các đối tác được tin cậy.

Ở phần cuối bài viết, Doshi cũng tiết lộ rằng ngoài việc đang cùng các đối tác thử nghiệm Gemini 3.5 Pro sắp được triển khai rộng rãi, Google hiện đã chính thức khởi động giai đoạn tiền huấn luyện của Gemini 4 và mô tả đây là “kế hoạch tham vọng nhất” của công ty. Kể từ hôm nay, nhà phát triển có thể truy cập các mẫu hình 3.6 Flash và 3.5 Flash-Lite hoàn toàn mới thông qua các kênh như Gemini API, để trải nghiệm trước tiềm năng mạnh mẽ của các quy trình làm việc AI agents.

Xem bản gốc
Trang này có thể chứa nội dung của bên thứ ba, được cung cấp chỉ nhằm mục đích thông tin (không phải là tuyên bố/bảo đảm) và không được coi là sự chứng thực cho quan điểm của Gate hoặc là lời khuyên về tài chính hoặc chuyên môn. Xem Tuyên bố từ chối trách nhiệm để biết chi tiết.
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Bình luận
Thêm một bình luận
Thêm một bình luận
Không có bình luận
  • Đã ghim