
Google ra mắt Gemini 4 Argon cho đối tác an ninh mạng trước.
Mô hình biên giới bị hạn chế bởi các đánh giá trước khi phát hành của chính phủ Hoa Kỳ, chưa có ngày ra mắt công khai hoặc đối tác được nêu tên.
Alphabet đã công bố Gemini 4 Argon và bắt đầu triển khai theo từng giai đoạn, bắt đầu với một số đối tác an ninh mạng chọn lọc thay vì phát hành rộng rãi cho các nhà phát triển. Google cũng đang tiến hành đánh giá an toàn trước khi phát hành của chính phủ Hoa Kỳ, kết hợp các tuyên bố điểm chuẩn mạnh mẽ với một lộ trình truy cập được hạn chế có chủ đích.
Google đã bắt đầu triển khai Gemini 4 Argon, mà họ mô tả là mô hình AI tiên tiến nhất của mình cho đến nay, với "các cải tiến lớn trong lập trình, an ninh mạng và công việc chuyên nghiệp phức tạp." Quyền truy cập ban đầu là hạn chế: Argon sẽ được cung cấp cho một tập hợp "các đối tác an ninh mạng đáng tin cậy" như là giai đoạn mở đầu của một phát hành theo từng giai đoạn, với khả năng sẵn có rộng rãi được xác định rõ là một bước sau.
Việc triển khai theo từng giai đoạn là quan trọng vì đó là một lựa chọn phân phối, không chỉ là một câu marketing. Google không nêu tên các đối tác ban đầu hoặc giải thích điều gì đủ điều kiện cho một tổ chức là "đáng tin cậy," và họ cũng không công bố ngày phát hành công khai hoặc lịch trình chi tiết cho các giai đoạn tiếp theo.
Công ty cũng đang định vị Argon là đã hữu ích trong chính hoạt động của mình. Google cho biết mô hình này đang được sử dụng nội bộ để tối ưu hóa bộ nhớ tại các trung tâm dữ liệu của họ, giải phóng "hàng trăm terabyte bộ nhớ" mà không cần mua thêm phần cứng. Họ cũng cho biết các nhà nghiên cứu về điện toán lượng tử đã sử dụng mô hình này.
Định vị Điểm chuẩn: Nơi Google nói Argon vượt trội hoặc ngang bằng với GPT-6 Astra, Grok 4.7 và Anthropic
Lời chào hàng về hiệu suất của Google cho Argon là rộng rãi và cạnh tranh. Công ty cho biết Argon "đặt ra một kỷ lục mới trong kỹ thuật phần mềm thực tế," "cùng đứng đầu trong an ninh mạng," và "dẫn đầu một điểm chuẩn khác" đo lường hiệu suất trong tài chính, pháp lý và các nhiệm vụ chuyên nghiệp khác.
Trong các so sánh trực tiếp, Google cho biết Argon ngang bằng với GPT-6 Astra và Grok 4.7 trong các điểm chuẩn an ninh mạng. Họ cũng cho biết Argon vượt trội hơn GPT-6 Astra và các mô hình gần đây của Anthropic trên Chỉ số Vals, một chỉ số điểm chuẩn mà Google đề cập là đo lường hiệu suất trong các nhiệm vụ chuyên nghiệp, mà không định nghĩa phương pháp của nó trong các chi tiết đã cung cấp.
Điểm khó khăn cho các nhà giao dịch là những gì không được xác định rõ. Google không chỉ rõ tên các điểm chuẩn hoặc chi tiết điểm số đứng sau tuyên bố kỷ lục "kỹ thuật phần mềm thực tế," và họ không xác định "một điểm chuẩn khác" được sử dụng cho so sánh giữa các chuyên ngành. Thiếu những yếu tố cơ bản đó, các tuyên bố rất khó để ánh xạ đến một khung lặp lại hoặc để sao chép bên thứ ba.
Google cũng đã định hình Argon như một bước tiến an ninh mạng có ý nghĩa so với mô hình Gemini 3.8 Flash Cyber mà họ phát hành trước đó vào tháng 9, bao gồm cả việc vượt trội trong việc phát hiện lỗ hổng. Đó là một nhịp độ lặp nhanh cho một dòng mô hình tập trung vào an ninh mạng, và nó đặt ra kỳ vọng rằng các phát hành "biên giới" có thể ngày càng được biện minh dựa trên khả năng bảo mật hơn là hiệu suất trò chuyện chung.
Kiểm soát An toàn Trước khi Truy cập Công khai: Đánh giá của Chính phủ Hoa Kỳ và Biện pháp Bảo vệ Chống Tiêm Lệnh
Google đang liên kết khả năng công khai của Argon với quy trình an toàn, không chỉ là sự sẵn sàng của mô hình. Công ty cho biết sẽ làm việc với chính phủ Hoa Kỳ về các đánh giá an toàn trước khi phát hành rộng rãi, và họ mô tả kế hoạch phát hành là từng giai đoạn nhằm xây dựng sự tự tin trong khi đưa một mô hình mạnh mẽ về phòng thủ vào tay các nhà phòng thủ.
“Bắt đầu việc triển khai theo cách này mang lại cho chúng tôi nhiều sự tự tin hơn, nhưng cũng cho phép chúng tôi đưa một mô hình đã được đào tạo và mạnh mẽ trong phòng thủ mạng vào tay các nhà phòng thủ càng sớm càng tốt,” Tulsee Doshi, trưởng sản phẩm mô hình Gemini của Google, cho biết.
Google cũng cho biết họ đang tìm cách mở rộng các biện pháp bảo vệ trong bốn lĩnh vực an ninh mạng chính trước khi công khai ra mắt, và họ đã nêu rõ việc lạm dụng và tiêm lệnh.
Tiêm lệnh là kỹ thuật mà kẻ tấn công tạo ra các đầu vào để thao túng một hệ thống AI bỏ qua các quy tắc hoặc tiết lộ thông tin nhạy cảm, và đây là một trong những chế độ thất bại quan trọng nhất khi các mô hình được tích hợp vào các công cụ có thể chạm vào mã, thông tin xác thực hoặc quy trình làm việc.
Hai cột mốc ngắn hạn sẽ làm cho con đường triển khai dễ định giá hơn: Google công bố các đối tác an ninh mạng ban đầu hoặc mở rộng quyền truy cập ra ngoài nhóm đầu tiên, và Google công bố ngày ra mắt công khai hoặc một lịch trình giai đoạn rõ ràng hơn sau các đánh giá trước khi phát hành của chính phủ Hoa Kỳ.
Một điều thứ ba là tiết lộ: nhiều chi tiết hơn về các tiêu chuẩn không xác định đứng sau “kỷ lục” và các tuyên bố liên ngành, cộng với bất kỳ sự xác nhận nào từ bên thứ ba.
Ý kiến của tôi: Tại sao việc phát hành ưu tiên an ninh mạng lại quan trọng hơn các tiêu chuẩn cho các nhà giao dịch tiền điện tử
Phần quyết định xem đây có phải là một đầu vào thị trường thực sự hay không không phải là mục dòng chỉ số Vals, mà là cổng phân phối. Một việc triển khai ưu tiên đối tác an ninh mạng có nghĩa là Google đang coi Argon như một khả năng cần được kiểm soát và thử nghiệm trong thế giới thực, và chi tiết về đối tác không được nêu tên là dấu hiệu cho thấy điều này gần giống như một thử nghiệm kín hơn là một khoảnh khắc nền tảng rực rỡ.
Ngưỡng quan trọng là liệu các đánh giá an toàn trước khi phát hành của chính phủ Hoa Kỳ có biến thành một thời gian biểu cụ thể và các kiểm soát có thể giao hàng hay không, đặc biệt là xung quanh việc lạm dụng và tiêm lệnh.
Nếu Google bắt đầu công bố các đối tác, công bố chi tiết về các tiêu chuẩn tham chiếu, và chuyển từ “các giai đoạn” sang các ngày cụ thể, Argon sẽ không còn là một câu chuyện về hiệu suất tiên phong mà trở thành một chất xúc tác hoạt động có thể thực sự thay đổi chi tiêu an ninh và định vị cơ sở hạ tầng AI.