TTC Việt Nam
Page Header Background

Khám phá các mô hình Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber mới từ Google

Trang chủ»Khám phá các mô hình Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber mới từ Google
Khám phá các mô hình Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber mới từ Google

Google vừa chính thức công bố ba phiên bản mô hình Gemini mới với mục tiêu cốt lõi là tối ưu hóa hiệu suất, giúp xử lý khối lượng công việc lớn hơn nhưng lại tiêu tốn ít token hơn đáng kể.

  • 3.6 Flash
  • 3.5 Flash-Lite
  • 3.5 Flash Cyber

Trong đó, mô hình 3.6 Flash đóng vai trò là bản nâng cấp toàn diện cho mọi tác vụ đa năng. Phiên bản Flash-Lite ưu tiên tốc độ xử lý và tối ưu chi phí bằng cách đánh đổi một phần chất lượng đầu ra. Riêng dòng Cyber là một giải pháp an ninh mạng đặc thù dành riêng cho các tổ chức chuyên môn và không phổ biến rộng rãi cho đại đa số người dùng.

Bài viết này của TTC Việt Nam sẽ phân tích sâu chức năng, hiệu năng thực tế của từng mô hình cũng như vị thế của dòng Gemini 3.5 Pro trên thị trường công nghệ hiện nay.

Tổng quan về các dòng mô hình Gemini mới ra mắt

Mỗi biến thể Gemini mới đều được định vị ở một phân khúc riêng biệt dựa trên tỷ lệ giữa chi phí đầu tư và năng lực vận hành thực tế. Người dùng có thể dựa vào các tiêu chí này để chọn giải pháp phù hợp thay vì chỉ nhìn vào thông số benchmark.

Gemini 3.6 Flash là gì?

Gemini 3.6 Flash là tâm điểm của đợt ra mắt này, được Google định hướng làm lựa chọn mặc định cho các công việc lập trình, xử lý tri thức và các tác vụ đa phương thức phức tạp.

Dựa trên chỉ số Artificial Analysis Index, phiên bản Flash 3.6 giúp tiết kiệm đến 17% lượng token đầu ra so với thế hệ 3.5 cũ. Thậm chí, các đánh giá độc lập như DeepSWE còn ghi nhận mức giảm chi phí lên tới 65%. Sự tối ưu này đến từ khả năng thông minh hơn của mô hình, giúp rút ngắn các bước suy luận trung gian và hạn chế gọi công cụ không cần thiết.

Hệ thống Flash 3.6 hỗ trợ đầu vào bao gồm văn bản, hình ảnh, video, tệp âm thanh và định dạng PDF, kết hợp cùng cửa sổ ngữ cảnh rộng 1 triệu token kèm giới hạn đầu ra 64k. Khả năng tương tác máy tính (Computer use) hiện đã được tích hợp sâu vào Gemini API và Gemini Enterprise, cùng với tính năng gọi hàm, cấu trúc đầu ra và tìm kiếm dữ liệu.

Gemini 3.5 Flash-Lite là gì?

Phiên bản 3.5 Flash-Lite không hướng tới danh hiệu mô hình thông minh nhất, thay vào đó nó tập trung tối đa vào tốc độ với tốc độ xử lý lên đến 350 token đầu ra mỗi giây. Mức giá của mô hình này cũng cực kỳ cạnh tranh, chỉ 0,30 USD cho mỗi triệu token đầu vào và 2,50 USD cho mỗi triệu token đầu ra.

Đối với các hệ thống cần xử lý khối lượng dữ liệu khổng lồ và đòi hỏi độ trễ cực thấp như tìm kiếm agentic hay xử lý tài liệu hàng loạt chạy hàng nghìn lần mỗi ngày, Flash-Lite là một lựa chọn kinh tế vượt trội.

Các lập trình viên có thể tùy chỉnh mức độ tư duy linh hoạt từ tối thiểu/thấp cho các tác vụ cần tốc độ nhanh, chi phí rẻ đến mức cao hơn cho các tiến trình đòi hỏi suy luận phức tạp nhiều tầng.

Gemini 3.5 Flash Cyber là gì?

Cuối cùng là phiên bản Cyber, một dòng sản phẩm chuyên biệt được tinh chỉnh riêng nhằm phát hiện và khắc phục các lỗ hổng bảo mật phần mềm. Mô hình này được vận hành nội bộ trong nền tảng CodeMender của Google, nơi các agent AI phối hợp với nhau để tạo ra các báo cáo bảo mật tổng hợp.

Google công bố dòng mô hình này có năng lực cạnh tranh tốt với các chuẩn an ninh mạng quốc tế như CyberGym dù sở hữu quy mô nhỏ gọn hơn. Quyền tiếp cận hiện bị giới hạn nghiêm ngặt cho các cơ quan chính phủ và đối tác chiến lược qua chương trình thí điểm CodeMender, chưa có giá bán hay lịch phát hành thương mại rộng rãi.

Đánh giá hiệu năng benchmark các mô hình Gemini mới

Các thông số benchmark dưới đây cung cấp cái nhìn khách quan về năng lực kỹ thuật, đi kèm với cấu trúc giá thành để doanh nghiệp dễ dàng cân đối ngân sách đầu tư.

Trong các bài kiểm tra chuyên sâu về lập trình như SWE-Bench Pro hay DeepSWE, các đối thủ như GPT-5.6 Luna hay Grok 4.5 vẫn duy trì được khoảng cách dẫn đầu nếu doanh nghiệp của bạn có khối lượng công việc thuần về code chuyên sâu. Trong khi đó, Claude Sonnet 5 lại thể hiện ưu thế mạnh mẽ trong các bài test về kiến thức chuyên gia và MLE-Bench.

Dẫu vậy, điểm cộng lớn nhất của Gemini 3.6 Flash nằm ở khả năng truy xuất ngữ cảnh dài cực kỳ ấn tượng cùng tốc độ suy luận dựa trên biểu đồ vượt trội, trong khi mức chi phí duy trì lại thấp hơn hầu hết các đối thủ cùng phân khúc.

Nhận định từ chuyên gia kỹ thuật của TTC Việt Nam

Dưới góc nhìn của các kỹ sư giải pháp mạng và hạ tầng tại TTC Việt Nam, việc Google chia nhỏ các dòng Flash thành nhiều phiên bản chuyên biệt (như Flash-Lite hay Flash 3.6) cho thấy chiến lược thực tế hóa AI trong doanh nghiệp đang chuyển dịch mạnh mẽ từ "càng lớn càng tốt" sang "đúng việc, tối ưu chi phí". Các doanh nghiệp vừa và nhỏ tại Việt Nam khi ứng dụng AI vào hệ thống chăm sóc khách hàng tự động hoặc xử lý chứng từ lớn nên cân nhắc kỹ các giải pháp tối ưu token như Flash 3.6 để giảm thiểu chi phí vận hành hạ tầng mạng đáng kể.

Thời điểm ra mắt, khả năng tích hợp và biểu phí dịch vụ

Các phiên bản 3.6 Flash và 3.5 Flash-Lite đã chính thức được cung cấp trên Gemini API, Google AI Studio, Android Studio và Google Antigravity (đối với bản 3.6 Flash). Khách hàng doanh nghiệp có thể trải nghiệm thông qua Gemini Enterprise Agent Platform. Người dùng phổ thông cũng có thể tiếp cận trực tiếp trên ứng dụng Gemini và Google Search AI Mode.

Bảng giá dịch vụ chi tiết bao gồm:

  • 3.6 Flash: 1,50 USD cho mỗi 1 triệu token đầu vào, 7,50 USD cho mỗi 1 triệu token đầu ra.
  • 3.5 Flash-Lite: 0,30 USD cho mỗi 1 triệu token đầu vào, 2,50 USD cho mỗi 1 triệu token đầu ra.
  • 3.5 Flash Cyber: Chưa có biểu phí công khai, áp dụng độc quyền trong chương trình thí điểm CodeMender.

Tổng kết

Việc Google ra mắt bộ ba mô hình Gemini mới cho thấy sự thực tế trong việc giải quyết bài toán hiệu suất và chi phí thay vì cố gắng chiếm lĩnh mọi bảng xếp hạng benchmark. Trong khi Flash 3.6 tối ưu hóa hiệu suất ngữ cảnh dài, Flash-Lite tập trung vào tốc độ và giá rẻ, thì bản Cyber lại đóng vai trò là công cụ bảo mật chuyên dụng.

Chiến lược này giúp tối ưu hóa toàn diện tầng xử lý dữ liệu của Google, đồng thời chuẩn bị nền tảng vững chắc cho các thế hệ mô hình toàn diện hơn trong tương lai.

Để được tư vấn chi tiết về các giải pháp hạ tầng mạng, viễn thông và ứng dụng AI tối ưu cho doanh nghiệp, quý khách vui lòng liên hệ ngay với đội ngũ chuyên gia của TTC Việt Nam qua website ttcvn.net để nhận hỗ trợ nhanh chóng nhất.

NỘI DUNG

  • Đang tải Mục lục...

ĐĂNG KÝ TRẢI NGHIỆM
DỊCH VỤ

HƠN 5.000+ DOANH NGHIỆP ĐÃ VÀ ĐANG ĐỒNG HÀNH CÙNG TTC VIỆT NAM ĐỂ XÂY DỰNG HỆ THỐNG

NHẬN TƯ VẤN MIỄN PHÍ