Công nghệ

AI tấn công của OpenAI hoàn thành 95% chuỗi khai thác lỗ hổng bảo mật

Susan Hill

GPT-5.6-Cyber đã phát hiện một lỗ hổng nghiêm trọng trong công cụ JavaScript V8 của Chrome trong quá trình thử nghiệm nội bộ – một lỗ hổng chưa từng được công bố công khai. Mô hình này cũng xác định các lỗ hổng trong hệ điều hành di động, cơ sở dữ liệu và phần mềm kernel, tất cả đều chưa từng được biết đến trước đây. Mô hình mới của OpenAI không phải là công cụ phòng thủ. Nó được xây dựng để tấn công.

Mô hình này được huấn luyện dựa trên GPT-5.6-Sol, mô hình đa năng hiện tại của OpenAI, sau đó được đào tạo lại chuyên biệt cho công tác bảo mật tấn công. Trên chuẩn đánh giá Năng lực Tấn công Mạng nội bộ của OpenAI, GPT-5.6-Cyber đã hoàn thành 95% các yêu cầu chuỗi khai thác – những tác vụ liên quan đến leo thang đặc quyền, vượt qua xác thực và thực thi mã tùy ý. Phiên bản tiêu chuẩn của GPT-5.6 chỉ hoàn thành 1,5% các yêu cầu tương tự. Mô hình chuyên biệt trước đó, GPT-5.5-Cyber, đạt 57,3%.

Bước nhảy vọt đó – từ 57,3% lên 95% chỉ trong một thế hệ – là con số định nghĩa bản phát hành này. Nó có nghĩa là khoảng cách giữa những gì AI có thể làm và những gì một kẻ tấn công con người có kỹ năng có thể làm đã thu hẹp lại khoảng 40 điểm phần trăm trong vòng chưa đầy một năm.

Các khả năng cụ thể của GPT-5.6-Cyber bao gồm xác định các lỗ hổng đã biết, xây dựng chuỗi khai thác từ đầu và tìm ra các zero-day: những lỗ hổng chưa ai ghi nhận hoặc vá. Khả năng cuối cùng đó là bước đột phá rõ rệt nhất so với bất kỳ công cụ bảo mật AI nào trước đây. Tìm ra zero-day đòi hỏi chuyên môn đặc biệt và thời gian đáng kể. GPT-5.6-Cyber giờ đây có thể làm điều đó theo yêu cầu.

OpenAI sẽ không phát hành mô hình này ra công chúng. Quyền truy cập được thực hiện thông qua Daybreak Red, cấp cao hơn trong chương trình an ninh mạng Daybreak của công ty. Các đối tác ban đầu bao gồm Accenture, IBM, CrowdStrike, Cloudflare, Palo Alto Networks, Sophos, Capgemini, EY, KPMG và PwC – những công ty tư vấn và bảo mật lớn sẽ sử dụng mô hình này để quét hạ tầng của khách hàng trước khi kẻ tấn công tìm ra cùng các lỗ hổng.

Điều mà các biện pháp kiểm soát truy cập không trả lời được là câu hỏi khó hơn: OpenAI giờ đây quyết định ai được sử dụng một AI có khả năng tìm ra lỗ hổng trong bất kỳ phần mềm nào. Danh sách được thẩm định bao gồm các công ty lớn và các công ty tư vấn hàng đầu. Các nhà nghiên cứu bảo mật cá nhân, nhóm nhỏ hơn và các tổ chức học thuật không nằm trong đợt triển khai ban đầu. Lỗ hổng Chrome V8 được phát hiện trong quá trình thử nghiệm đang được tiết lộ phối hợp với Google – công ty chưa cho biết có bao nhiêu lỗ hổng khác mà mô hình đã xác định trước khi ra mắt.

OpenAI cho biết họ có kế hoạch mở rộng chương trình Daybreak Red tới các đối tác đã được thẩm định bổ sung trong những tháng tới.

Đối với ngành công nghiệp phần mềm, bài toán rất rõ ràng: nếu một AI có thể quét mã nguồn để tìm zero-day với tỷ lệ hoàn thành 95%, thì mọi đội ngũ bảo mật cuối cùng sẽ cần một AI như vậy – hoặc sẽ phải giả định rằng đối thủ đã có quyền truy cập vào một AI tương tự.

Thẻ: , , , , ,

Thảo luận

Có 0 bình luận.