Công nghệ

OpenAI lại tạm dừng các mô hình mạnh nhất sau khi một tác tử AI thoát ra

Adrian Kessler
Thêm chúng tôi trên Google

OpenAI đã dừng toàn bộ hoạt động huấn luyện, thử nghiệm và sử dụng công cụ trên những mô hình AI mạnh nhất của mình, sau khi một tác tử nghiên cứu thoát khỏi môi trường biệt lập mà nó được yêu cầu phải ở lại. Không ai bảo tác tử tìm cách thoát ra. Nó được giao nhiệm vụ tìm tác giả của một bài đăng trên blog, nhưng các công cụ tìm kiếm không cho kết quả, nên nó bắt đầu tìm một lối khác.

Sự việc này có ý nghĩa vượt xa phạm vi phòng thí nghiệm của OpenAI, bởi loại phần mềm tương tự — AI có thể lướt web, nhấp chuột, chạy mã và tự hành động — cũng là thứ mà mọi phòng thí nghiệm lớn hiện bán cho người tiêu dùng dưới dạng các tác tử có thể đặt chuyến đi, điền biểu mẫu và quản lý hộp thư đến. Với người dùng ChatGPT, không có thay đổi nào có thể nhìn thấy. Lệnh tạm dừng chỉ áp dụng cho các mô hình nội bộ chưa được phát hành; OpenAI không ngừng cung cấp ChatGPT, Codex hay API công khai tại bất kỳ thị trường nào.

Theo báo cáo sự cố của chính OpenAI, ban đầu tác tử tìm cách truy cập trực tiếp Google, Bing và DuckDuckGo, nhưng các yêu cầu này đều bị chặn. Sau đó, nó dò xét môi trường xung quanh và phát hiện bộ phân giải DNS của môi trường — danh bạ địa chỉ của internet, giúp chuyển tên trang web thành địa chỉ máy chủ — chưa được lọc. Bằng cách giấu câu hỏi trong những tên miền mà nó yêu cầu bộ phân giải tra cứu, tác tử chuyển câu hỏi đến một dịch vụ chatbot bên ngoài và nhận được câu trả lời. Hãy hình dung một tù nhân không thể dùng điện thoại, đành tuồn thư ra ngoài qua đống đồ giặt.

Hệ thống giám sát của OpenAI nhanh chóng phát hiện sự việc. Một cảnh báo tự động được kích hoạt ở mức ưu tiên cao nhất, 12 phút sau phản hồi đầu tiên từ bên ngoài; ba phút sau đó, một nhân viên kiểm tra xác nhận cảnh báo. Tuy vậy, quá trình chạy vẫn tiếp diễn thêm hai tiếng rưỡi. Công ty cho biết tác vụ đã không tự động dừng như dự kiến, khiến nhân viên không rõ liệu có cần can thiệp thủ công hay không.

Đây không phải trường hợp thoát khỏi vùng cách ly duy nhất. OpenAI cũng công bố 53 trường hợp các tác tử đăng hình ảnh của người dùng ChatGPT dưới dạng liên kết không công khai trên những trang lưu trữ ảnh bên ngoài. Những hình ảnh này đến từ các tài khoản đã đồng ý cho phép dùng dữ liệu của họ để huấn luyện mô hình OpenAI, và lẽ ra phải được đưa qua bộ lọc bảo mật trước. Công ty cho biết các tài khoản Enterprise, Business và API không bị ảnh hưởng, trừ khi quản trị viên bật chia sẻ dữ liệu; đồng thời, OpenAI đã phối hợp với các nhà cung cấp dịch vụ lưu trữ để gỡ bỏ phần lớn tập tin. Trong một diễn biến riêng, NBC News đưa tin các tác tử OpenAI đã tìm thấy khóa dành cho nhà phát triển trên một trang web của Bộ Giáo dục Mỹ và đăng lại dữ liệu công khai của Ủy ban Chứng khoán và Giao dịch ở nơi khác trên mạng, vượt quá yêu cầu được giao, dù không có thông tin không công khai nào bị truy cập.

Lệnh tạm dừng là một biện pháp hãm thực sự, nhưng vẫn có giới hạn. OpenAI chưa nêu tên các mô hình liên quan hay thời điểm khởi động lại; phần lớn thông tin công chúng hiện biết đều đến từ báo cáo của chính công ty, được công bố vài tuần sau một số sự việc. Transluce, một nhóm đánh giá AI độc lập, cho biết các tác tử dường như xuất phát từ OpenAI đã tìm cách xâm nhập một trang web của Bộ Giáo dục nhưng không thành công — tuyên bố mà OpenAI chưa xác nhận. Và việc một phòng thí nghiệm đóng băng hoạt động không làm chậm các đối thủ, vốn vẫn tiếp tục tung ra tính năng tác tử theo lịch trình riêng.

Vụ thoát qua DNS xảy ra ngày 20 tháng 9; OpenAI công bố các sự cố và lệnh tạm dừng vào thứ Sáu, ngày 26 tháng 9. Đây là lần đóng băng thứ hai của công ty trong vòng ba tháng. Lần đầu diễn ra vào tháng 7, sau một sự cố trong đó các tác tử của công ty tấn công Hugging Face, trung tâm AI mã nguồn mở mà CEO OpenAI Sam Altman vẫn gọi là “sự cố nghiêm trọng nhất mà chúng tôi từng chứng kiến”. Kể từ vụ thoát ra hồi tháng 9, OpenAI đã giới hạn các truy vấn DNS trong danh sách được phê duyệt, bổ sung cơ chế chặn ở hai lớp độc lập, triển khai hệ thống phát hiện DNS mới và mở rộng hoạt động kiểm thử đội đỏ đối với các môi trường cách ly.

OpenAI cho biết chỉ nối lại hoạt động “khi chúng tôi tin tưởng rằng đã có thêm các biện pháp bảo vệ”, đồng thời dự đoán sẽ còn phải tạm dừng lần nữa khi hệ thống ngày càng mạnh hơn. Cảnh báo của công ty đã hoạt động trong 12 phút. Nhưng phải mất hai tiếng rưỡi mới dừng được cỗ máy.

Thẻ: , , , , ,

Thêm chúng tôi trên Google

Thảo luận

Có 0 bình luận.