Công nghệ

Claude xâm nhập hệ thống của OpenAI chỉ trong vài ngày — và Anthropic mới là bên phải trả lời

Adrian Kessler
Thêm chúng tôi trên Google

Một nhóm nhỏ đã dùng mô hình mới nhất của Anthropic nhắm vào cửa trước của OpenAI và xông thẳng vào. Câu chuyện mà hầu hết mọi người đang đọc — về những kẻ ngoại đạo thông minh làm xấu mặt nhà sản xuất ChatGPT — đã đánh trượt trọng tâm. Vụ đột nhập không phụ thuộc vào bất kỳ lỗ hổng nào mà OpenAI quên vá. Nó phụ thuộc vào thời điểm Anthropic tung ra một Claude mạnh hơn. Đó là phần đáng suy ngẫm: một công việc đã bế tắc nhiều ngày đã tự giải quyết ngay khi mô hình chủ lực mới đi vào hoạt động.

Những người liên quan không phải tội phạm. Các nhà nghiên cứu tại công ty bảo mật khởi nghiệp Hacktron đã làm việc trong chương trình bug-bounty của chính OpenAI, kết hợp một vài điểm yếu web tầm thường, truy cập vào tài khoản của nhân viên OpenAI, và tiến xa đến tận một kho mã nguồn nội bộ — sau đó dừng lại, báo cáo những gì họ tìm thấy, và nhận một khoản thưởng khiêm tốn. Họ để lại một dấu hiệu vô hại làm bằng chứng và không tiến xa hơn. Nếu đọc như một vụ phạm tội, đó là một sự kiện không có gì. Nếu đọc như một bài kiểm tra năng lực, đó là một pháo hiệu bốc lên.

Đây là cơ chế mà các bản tin đã lướt qua. Nhóm nghiên cứu đầu tiên chạy công việc trên Claude Opus 4.8, phiên bản được tinh chỉnh cho công tác bảo mật, và nó bế tắc qua nhiều phiên. Sau đó Anthropic phát hành Opus 5. “Opus 4.8 đã vật lộn qua nhiều phiên để tạo ra một exploit hoạt động được,” nhóm Hacktron viết. “Trong vòng vài giờ sau khi Opus 5 được phát hành, chúng tôi giao cho nó cùng một vấn đề và nó đã thành công.” VentureBeat đưa tin rằng mô hình mới hơn đã viết một exploit hoạt động cho một mục tiêu chip khó nhằn trong vòng vài giờ. Không có gì thay đổi trong hệ thống phòng thủ của OpenAI trong khoảng thời gian đó. Chính mô hình đã thay đổi.

Đó chính xác là bước nhảy vọt — một bước tiến trong những gì người dùng thông thường có thể làm với một gói đăng ký sẵn có — mà hệ thống an toàn của Anthropic được xây dựng để phát hiện và kiềm chế. Công ty giữ mô hình an ninh mạng mạnh nhất của mình, Mythos, sau các kiểm soát xuất khẩu và một danh sách ngắn những người bảo vệ đã được thẩm định, và gọi nó là mô hình bảo mật mạnh nhất mà họ từng xây dựng. Nhưng tất cả những điều đó không còn quan trọng ở đây. Phiên bản công khai là đủ. Như giám đốc điều hành của Gray Swan, Matt Fredrikson, đã nói với TechCrunch, “với 200 đô la một tháng, bất kỳ ai cũng có thể sử dụng những công cụ này và hack vào một công ty như OpenAI.”

Đây là lúc trách nhiệm đổ lên vai Anthropic thay vì đối thủ của họ. Anthropic đã xây dựng toàn bộ bản sắc của mình dựa trên sự thận trọng — giám đốc điều hành của họ, Dario Amodei, công khai nói về “những nguy hiểm thực sự” của công nghệ và đã thúc ép ngành công nghiệp hãy chậm lại. Một mô hình phát hành rộng rãi làm giảm đáng kể rào cản để đột nhập vào một phòng thí nghiệm đối thủ là một đối trọng khó chịu với thông điệp đó. Khi được yêu cầu giải trình, công ty đã không nói gì; CBS News đưa tin rằng Anthropic đã không trả lời yêu cầu bình luận. Về phần mình, OpenAI đã cảm ơn các nhà nghiên cứu, thu hẹp các quyền mà những kẻ tấn công đã lạm dụng, và thu hồi các phiên bị ảnh hưởng.

Chi tiết cụ thể gần như tầm thường. Cách xâm nhập là một thư viện xử lý hình ảnh lỗi thời được đóng gói cùng với phần mềm Discourse vận hành diễn đàn cộng đồng của OpenAI; một sơ suất thứ hai trong cách phạm vi của token đăng nhập đã cho phép các nhà nghiên cứu cưỡi trên một phiên bị xâm phạm để vào tài khoản nhân viên cho ChatGPT và Codex, và tiếp đó vào mã nguồn riêng. Toàn bộ chuỗi, từ chỗ đứng đầu tiên đến truy cập kho mã, mất chưa đầy ba ngày. OpenAI đã trả 6.500 đô la. Nhóm nghiên cứu cho biết họ đã chi chưa đầy 3.000 đô la thời gian sử dụng Claude trong toàn bộ nỗ lực — hai tháng làm việc, phần lớn là con người, được nén lại ở cuối cùng vào một cỗ máy không còn cần chuyên gia.

Nguồn lực khan hiếm từng bảo vệ một mục tiêu không bao giờ là bản vá. Đó là chuyên gia có thể tìm ra các lỗ hổng, kết nối chúng lại với nhau và nhìn thấy con đường xuyên qua — và hàng tháng trời để làm điều đó. Chuyên môn đó vừa trở nên rẻ. Lần này, nhóm đã tiếp cận được mã nguồn của OpenAI đã nộp báo cáo và nhận tiền thưởng. Người tiếp theo vượt qua cùng một rào cản, với cùng một gói đăng ký, không có nghĩa vụ phải làm như vậy.

Thẻ: , , , , ,

Thêm chúng tôi trên Google

Thảo luận

Có 0 bình luận.