Alphabet đang phát hành ba mẫu Gemini mới vào thứ Ba, bao gồm Gemini 3.5 Flash Cyber được thiết kế cho lĩnh vực an ninh mạng. Các lần ra mắt này nhằm thể hiện tiến độ trên một dây chuyền sản phẩm đã gặp phải tình trạng chậm trễ và cạnh tranh ngày càng gia tăng. Gemini 3.5 Flash Cyber ban đầu chỉ khả dụng với chính phủ và các đối tác được tin cậy thông qua chương trình thử nghiệm truy cập hạn chế, nhằm lấp “khoảng trống” an ninh mạng của Google so với Anthropic's Fable 5, đơn vị đã xây dựng lợi thế ban đầu trong phòng thủ mã tự động.
Google ra mắt Gemini 3.5 Flash Cyber cho an ninh mạng
Gemini 3.5 Flash Cyber được thiết kế để phát hiện và vá các lỗ hổng phần mềm. Google cho biết mô hình chuyên biệt này có mức giá trên mỗi token thấp hơn so với các mô hình lớn hơn. Mô hình ban đầu chỉ khả dụng với chính phủ và các đối tác được tin cậy thông qua chương trình thử nghiệm truy cập hạn chế.
Gemini 3.6 Flash và 3.5 Flash-Lite giảm chi phí token
Google đang ra mắt Gemini 3.6 Flash, cải thiện hiệu suất viết mã, đa phương thức và công việc tri thức trong khi sử dụng ít hơn tới 17% số token và có chi phí trên mỗi token thấp hơn so với mô hình trước đó. Gemini 3.5 Flash-Lite là mô hình nhanh nhất và ít tốn kém nhất của Google trong dòng 3.5, được xây dựng cho các tác vụ khối lượng lớn và các tác vụ nhỏ hơn trong hệ thống AI-agent quy mô lớn. Dữ liệu của Artificial Analysis cho thấy Gemini Flash của Google khiến các mô hình tương đương từ Anthropic, OpenAI và các đối thủ Trung Quốc có chi phí cao hơn. Theo công ty, Gemini 3.6 Flash rẻ hơn theo mỗi tác vụ so với GPT-5.6 Terra Max, Kimi K3 và Qwen 3.7 Max, trong khi 3.5 Flash-Lite có giá chỉ bằng một phần nhỏ so với mức đó.
Google định vị Gemini trước các đối thủ AI Trung Quốc
Đợt triển khai diễn ra ngay trước thềm công bố kết quả kinh doanh của Alphabet và trong bối cảnh các đối thủ Trung Quốc đang gia tăng đà. Kimi K3 của Moonshot AI thu hút đủ nhu cầu khiến công ty giới hạn các đăng ký mới và quyền truy cập API do ràng buộc về năng lực. Alibaba đang “nhá hàng” Qwen 3.8 Max và cho biết mẫu này chỉ kém Fable 5 của Anthropic về hiệu suất tổng thể.
Google phát triển chip tùy chỉnh để tối ưu hiệu suất Gemini
Theo thông tin, Google đang phát triển một chip chuyên biệt được thiết kế để chạy Gemini hiệu quả hơn tới 10 lần, là một phần trong nỗ lực tổng thể nhằm giảm chi phí phục vụ AI. Người phát ngôn của Google Cloud cho CNBC cho biết trong một tuyên bố rằng các nhóm của họ “liên tục nghiên cứu và thử nghiệm những đổi mới mới để mang lại hiệu suất và hiệu quả tối đa cho người dùng và khách hàng của chúng tôi”. Người phát ngôn bổ sung rằng “dù không phải mọi dự án đều đi vào sản xuất, thì việc khám phá nghiêm túc này là trung tâm của cách tiếp cận full stack của chúng tôi”. Công ty cho biết bằng việc đồng thiết kế phần cứng và phần mềm ngay từ đầu, họ đảm bảo hệ thống được tích hợp liền mạch và tối ưu cao cho các tác vụ trong thế giới thực.
Google thử nghiệm Gemini 3.5 Pro và bắt đầu tiền huấn luyện Gemini 4
Google đang cung cấp thêm mức độ minh bạch về lộ trình sau các câu hỏi liên quan tới sự chậm trễ. Gemini 3.5 Pro hiện đang được thử nghiệm với các đối tác trước khi có sẵn rộng rãi. Công ty cũng đã bắt đầu đợt tiền huấn luyện lớn nhất từ trước tới nay cho Gemini 4.
FAQ
Google đã phát hành những mẫu Gemini mới nào vào thứ Ba?
Google đã phát hành ba mẫu Gemini mới vào thứ Ba: Gemini 3.5 Flash Cyber cho an ninh mạng, Gemini 3.6 Flash với hiệu suất được cải thiện và chi phí token thấp hơn, và Gemini 3.5 Flash-Lite như là mô hình nhanh nhất và ít tốn kém nhất trong dòng 3.5.
Gemini 3.6 Flash cải thiện so với mô hình trước như thế nào?
Gemini 3.6 Flash cải thiện hiệu suất viết mã, đa phương thức và công việc tri thức trong khi sử dụng ít hơn tới 17% số token và có chi phí trên mỗi token thấp hơn so với mô hình trước đó.
Google đang làm gì để cải thiện hiệu suất của Gemini?
Theo thông tin, Google đang phát triển một chip chuyên biệt được thiết kế để chạy Gemini hiệu quả hơn tới 10 lần, như một phần của nỗ lực tổng thể nhằm giảm chi phí phục vụ AI.