Công nghệ

Gemini 4 Argon: mô hình đưa Google trở lại cuộc đua, nhưng gần như chưa ai được dùng

Mô hình mới của Google DeepMind viết tới 1 triệu token, dẫn đầu bảng điểm của chính Google nhưng ưu tiên giới phòng thủ mạng
Adrian Kessler
Thêm chúng tôi trên Google

Trong phần lớn năm qua, câu chuyện trí tuệ nhân tạo của Google xoay quanh những gì hãng chưa ra mắt. Gemini 4 Argon là lời đáp trả, và điều hé lộ nhiều nhất về nó không phải là một điểm benchmark. Đó là danh sách khách mời. Mô hình tiên phong mới của Google DeepMind trước tiên chỉ được trao cho một nhóm nhỏ chuyên gia phòng thủ an ninh mạng đã qua thẩm định thông qua chương trình Fairwind của công ty, và không ai khác.

Argon được xây dựng cho các công việc dài hơi: kỹ thuật phần mềm, nghiên cứu pháp lý và tài chính, và phòng thủ mạng. Thay đổi cơ học then chốt là độ dài đầu ra: mô hình giờ đây có thể suy luận và viết hàng trăm nghìn token trong một lượt duy nhất, đủ để đưa một đợt chuyển đổi mã quy mô lớn đi đến cùng thay vì chắp vá từ các mảnh rời rạc.

Google cho biết hàng nghìn kỹ sư của hãng đã sử dụng nó. Trong thông báo, công ty mô tả các tác tử Argon đã giải phóng hơn 300 TiB bộ nhớ trên các trung tâm dữ liệu của hãng và đang chuyển mã C và C++ sang ngôn ngữ an toàn bộ nhớ Rust, đến cả hơn 800.000 dòng của nhân Fuchsia Zircon. Với libgav1, bộ giải mã video mã nguồn mở của Google, Argon đã viết lại 32.000 dòng mã SIMD tinh chỉnh thủ công thành Rust an toàn, chạy nhanh hơn 2,7 lần so với bản chuyển sang Rust trước đó.

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

Giới hạn đầu ra tăng lên 1 triệu token, từ mức 64.000. Các con số benchmark là của chính Google: 77,9% trên DeepSWE v1.1, vị trí số một trên Vals Index về công việc tri thức có trọng số kinh tế và 91,7% trên LVBench về khả năng hiểu video dài. Theo thống kê của VentureBeat, Argon dẫn đầu tuyệt đối ở 12 trong số 18 benchmark được công bố, trong khi GPT-6 Astra của OpenAI vẫn vượt nó hơn mười điểm trên FrontierSWE v2. Chừng nào các bên kiểm thử độc lập chưa thể tự chạy mô hình, đây vẫn là những tuyên bố, chưa phải phán quyết.

Góc độ an ninh mạng giải thích vì sao quyền truy cập bị giới hạn. Google đã huấn luyện Argon để tự tìm, xác thực và vá lỗ hổng, và sẽ cung cấp cho những người phòng thủ đáng tin cậy một phiên bản đã gỡ bỏ các rào chắn an ninh mạng. Thông qua sáng kiến Scan for Good của Wiz, mô hình đã phát hiện một lỗ hổng nghiêm trọng làm lộ dữ liệu cá nhân trong phần mềm bệnh viện mà các mô hình trước đó đã bỏ sót. Cơ chế khó chịu ở đây là một mô hình giỏi vá lỗ hổng đến vậy thì, theo định nghĩa, cũng giỏi tìm ra chúng.

Vì vậy, các biện pháp bảo vệ mới là câu chuyện thực sự. Google cho biết Argon từ chối hỗ trợ các cuộc tấn công mạng cũng như tấn công hóa học, sinh học, phóng xạ hoặc hạt nhân, là mô hình chống prompt injection tốt nhất của hãng từ trước đến nay, và vận hành dưới một cơ chế giám sát theo dõi chuỗi suy luận của nó và dừng thực thi khi nó vượt quá ý định của người dùng. Google cũng tham gia quy trình tự nguyện của chính phủ Mỹ về việc tiếp cận mô hình trước khi phát hành.

Ai có thể dùng Gemini 4 Argon hôm nay? Chỉ nhóm Fairwind và các đội ngũ nội bộ của Google. Chưa có mốc thời gian cho nhà phát triển, doanh nghiệp hay người tiêu dùng; quyền truy cập sẽ bắt đầu với khách hàng API trả phí và người đăng ký Google AI Ultra. Giá giới thiệu là 2 USD cho mỗi triệu token đầu vào và 10 USD cho mỗi triệu token đầu ra, sau đó tăng lên lần lượt 4 USD và 20 USD.

Mô hình được Koray Kavukcuoglu công bố ngày 30 tháng 9, người đảm nhận vị trí cao nhất tại Google DeepMind sau khi Demis Hassabis thôi chức giám đốc điều hành vào tháng 8. Đây là mô hình chủ lực mới đầu tiên của Google kể từ Gemini 3 vào tháng 11 năm 2025, và phép thử thực sự của nó không phải là một bảng xếp hạng mà là liệu một mô hình được phát hành không kèm rào chắn có ở lại trong tay những người mà nó được dành cho hay không.

Thẻ: , , , , , ,

Thêm chúng tôi trên Google

Thảo luận

Có 0 bình luận.