Google ra mắt ba mẫu model Gemini 3.6 Flash cùng với ba mẫu model khác; sẵn sàng cho việc huấn luyện trước Gemini 4

Giám đốc cấp cao phụ trách quản lý sản phẩm của Google, Tulsee Doshi, đã đăng bài blog chính thức vào ngày 21 tháng 7, thông báo việc ra mắt Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber—tất cả đều được thiết kế riêng cho các luồng công việc của AI agent. Ngoài ra, việc huấn luyện trước của Gemini 4 đã được khởi động.

Thông số Gemini 3.6 Flash: OSWorld 83,0%, số lượng token đầu ra giảm 17%

Gemini 3.6 Flash là mô hình chủ lực trong dòng mới, với hiệu suất được nâng cấp đáng kể trong việc viết mã nguồn, các tác vụ tri thức và nhiệm vụ đa phương thức. Hiệu suất đánh giá năng lực sử dụng máy tính (OSWorld-Verified) đạt 83,0%; theo Artificial Analysis Index, lượng token đầu ra của mô hình này giảm 17% so với thế hệ trước, và có thể giảm tối đa 65% trong các bài benchmark như DeepSWE.

Các công cụ sử dụng máy tính (computer use tools) hiện đã được tích hợp trực tiếp trong Gemini API và phiên bản doanh nghiệp, không cần cấu hình bổ sung. Về giá: 1,50 USD cho mỗi 1 triệu token đầu vào và 7,50 USD cho mỗi 1 triệu token đầu ra.

Thông số Gemini 3.5 Flash-Lite: tốc độ đầu ra 350 tokens/s và mức thinking có thể điều chỉnh

Gemini 3.5 Flash-Lite được thiết kế cho các tác vụ độ trễ thấp và thông lượng cao (như tìm kiếm bằng agent và xử lý tài liệu). Các thông số chính như sau:

Tốc độ đầu ra: 350 tokens/s

Giá: 0,30 USD cho mỗi 1 triệu token đầu vào và 2,50 USD cho mỗi 1 triệu token đầu ra

Mức thinking: hỗ trợ các mức thinking có thể điều chỉnh; nhà phát triển có thể chuyển đổi giữa chế độ thinking thấp (phù hợp cho các tác vụ tần suất cao) và chế độ thinking cao (xử lý các luồng công việc phức tạp của các agent con)

Hiệu suất đánh giá: vượt phiên bản chuẩn Gemini 3 Flash trong các bài đánh giá ngữ cảnh dài và mã hóa bằng agent

Gemini 3.5 Flash Cyber: mô hình tinh chỉnh cho các kịch bản an ninh mạng

Gemini 3.5 Flash Cyber là mô hình được tinh chỉnh dựa trên 3.5 Flash, chuyên cho các kịch bản phòng thủ an ninh mạng. Mô hình này có thể phối hợp với hệ thống đa agent CodeMender để tạo nhanh các báo cáo tổng hợp, giúp bên phòng thủ phát hiện và khắc phục lỗ hổng an ninh mạng. Do cân nhắc rủi ro về mục đích sử dụng kép của công nghệ, hiện Gemini 3.5 Flash Cyber bị giới hạn truy cập nghiêm ngặt, chỉ dành cho cơ quan chính phủ và các đối tác hợp tác được tin cậy thông qua các chương trình thí điểm để được tiếp cận giới hạn.

Bắt đầu huấn luyện trước Gemini 4: thông báo của Tulsee Doshi và tiến độ thử nghiệm Gemini 3.5 Pro

Trong bài blog chính thức ngày 21 tháng 7 năm 2026, Tulsee Doshi cho biết Google đã chính thức khởi động công việc huấn luyện trước của Gemini 4 và mô tả đây là kế hoạch “tham vọng nhất” của Google. Ngoài ra, Gemini 3.5 Pro hiện đang trong quá trình thử nghiệm với các đối tác; dự kiến sau khi Gemini 3.5 Pro được triển khai rộng rãi thì các tiến triển tiếp theo của Gemini 4 cũng sẽ lần lượt được công bố; chi tiết về thời gian sẽ theo thông báo chính thức từ Google.

Hiện tại, nhà phát triển có thể truy cập Gemini 3.6 Flash và Gemini 3.5 Flash-Lite thông qua các kênh như Gemini API.

Câu hỏi thường gặp

Giá và các kết quả đánh giá chính của Gemini 3.6 Flash là gì?

Theo bài blog chính thức của Google, giá của Gemini 3.6 Flash là 1,50 USD cho mỗi 1 triệu token đầu vào và 7,50 USD cho mỗi 1 triệu token đầu ra; trong đánh giá năng lực sử dụng máy tính (OSWorld-Verified) đạt 83,0%, lượng token đầu ra giảm 17% so với thế hệ trước (trong benchmark DeepSWE có thể giảm tối đa 65%).

Tốc độ đầu ra và giá của Gemini 3.5 Flash-Lite là bao nhiêu?

Tốc độ đầu ra của Gemini 3.5 Flash-Lite đạt 350 token mỗi giây, giá là 0,30 USD cho mỗi 1 triệu token đầu vào và 2,50 USD cho mỗi 1 triệu token đầu ra; hỗ trợ các mức thinking có thể điều chỉnh, phù hợp cho các tác vụ độ trễ thấp như tìm kiếm bằng agent và xử lý tài liệu.

Điều kiện truy cập của Gemini 3.5 Flash Cyber là gì?

Gemini 3.5 Flash Cyber hiện chỉ giới hạn cho cơ quan chính phủ và các đối tác hợp tác được tin cậy thông qua các chương trình thí điểm để được truy cập giới hạn, vì Google cân nhắc rằng các công nghệ liên quan đến an ninh mạng này có rủi ro mục đích sử dụng kép; cách thức nộp đơn truy cập cụ thể sẽ theo thông báo chính thức từ Google.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận