Công nghệ

CEO Microsoft Satya Nadella muốn một phanh khẩn cấp cho AI đặt bên ngoài mô hình

Adrian Kessler
Thêm chúng tôi trên Google

Lời kêu gọi thiết lập “phanh khẩn cấp” cho AI của Satya Nadella phần lớn được xem như việc CEO Microsoft nhập hội những người lên tiếng về an toàn. Nhưng bài luận đằng sau lời kêu gọi ấy đề xuất một điều hẹp hơn và thực tế hơn: quyền kiểm soát phải nằm ngoài mô hình, thuộc về công ty triển khai nó chứ không phải phòng thí nghiệm đã huấn luyện nó. Đó là một kiến trúc bảo mật, và cũng chính là thứ Microsoft đang bán.

Nadella muốn các doanh nghiệp đối xử với những mô hình tiên phong, dù đóng hay mở trọng số, như cách đội ngũ bảo mật quản lý một nhân viên có năng lực cao, được quyền truy cập vào các hệ thống nhạy cảm. Ông viết: “Không phải vì họ nhất thiết có ý đồ xấu, mà vì bất kỳ tác nhân nào đủ năng lực và có quyền truy cập vào những hệ thống quan trọng đều có thể mắc sai lầm hoặc bị xâm nhập.”

Nadella thực sự đề xuất điều gì: bảy nguyên tắc và một nút phanh

Bài viết có tựa đề “Models as Insider Risks in the Super Intelligence Era”, được đăng trên blog cá nhân của ông, sn scratchpad, và chia sẻ trên X. Câu nói khiến các mặt báo chú ý nằm trong một nguyên tắc về khoanh vùng: “Chúng ta phải giả định rằng mô hình đã bị xâm nhập và khoanh vùng nó ngay từ đầu. Hãy hình dung đó như một chiếc phanh khẩn cấp. Người được ủy quyền luôn phải có khả năng tạm dừng hoặc tắt mô hình ngay giữa chừng khi nó đang thực hiện tác vụ.”

Bên cạnh chiếc phanh, ông liệt kê thêm sáu quy tắc. Không một mô hình đơn lẻ nào được trở thành chỗ dựa duy nhất cho một kết quả quan trọng, cũng không được tự xác minh công việc của chính mình. Mọi hành động đáng kể của mô hình phải để lại “bằng chứng chống giả mạo, con người có thể đọc được”, bởi “nếu không thể quan sát thì không thể tin cậy!”. Toàn bộ hệ thống cần được kiểm thử liên tục, bao gồm cả lỗi lẫn các cuộc tấn công. Các tổ chức nên tự quyết định mô hình được truy cập và thực hiện những gì. Không mô hình nào được đồng thời kiểm soát hành vi của hệ thống và bằng chứng dùng để đánh giá hệ thống ấy. Và khi có sự cố, những người bị ảnh hưởng cần được thông báo, đồng thời bài học kinh nghiệm phải được chia sẻ trong toàn ngành.

Điểm khởi đầu là một lời thừa nhận. Nadella viết: “Chúng ta không thể quy kết hành vi và đầu ra của mô hình cho những dữ liệu huấn luyện hoặc cấu hình trọng số cụ thể”, trong khi các công ty vẫn giao cho những hệ thống này dữ liệu nhạy cảm nhất của mình. Với ông, tính minh bạch về chuỗi suy luận là điều “không thể thỏa hiệp”, nhưng vẫn chưa đủ, bởi hiện chưa ai biết cách khiến đầu ra của mô hình luôn trung thành với ý định ban đầu. Để các mô hình giám sát lẫn nhau cũng có giới hạn: rốt cuộc ta có thể rơi vào cảnh “một mô hình mờ đục nằm trong một lớp điều phối mờ đục, được một mô hình mờ đục khác theo dõi”.

Giải pháp của ông nằm ở phần hạ tầng. Các cơ chế kiểm soát những gì mô hình có thể tiếp cận và thực hiện “phải nằm ngoài mô hình” — một ý tưởng mà ông lần về nguyên tắc bảo mật thông tin từ thập niên 1970, theo đó chương trình không được phép can thiệp vào các cơ chế thực thi quyền hạn của nó. Trong thực tế, điều đó có nghĩa là tách mô hình khỏi lớp điều phối công việc và khỏi danh sách những hành động mà nó được phép thực hiện.

Trách nhiệm chuyển sang công ty vận hành mô hình

Những câu quan trọng nhất hướng đến khách hàng, chứ không phải các phòng thí nghiệm. Nadella viết: “Chúng ta đơn giản là không thể phó mặc trách nhiệm về những gì trí tuệ thực hiện thay mặt mình.” Ông nói thêm: “Những bảo đảm từ nhà cung cấp mô hình không giúp chúng ta thoát khỏi trách nhiệm đó.” Bất kỳ ai kết nối mô hình với hệ thống trả lương, mã nguồn hay dữ liệu khách hàng đều phải chịu trách nhiệm về những gì mô hình làm tại đó.

Ông cũng nói rõ mình không định giải quyết vấn đề nào. Bài luận viết rằng, “tạm gác sang một bên bài toán khó về căn chỉnh”, công việc nên bắt đầu bằng “một cách tiếp cận kỹ thuật đối với việc khoanh vùng và quản trị”. CNBC đặt bài đăng của ông bên cạnh những cảnh báo từ Bill Gates, Dario Amodei của Anthropic, Sam Altman của OpenAI và Elon Musk rằng AI đang phát triển quá nhanh. Bài luận không yêu cầu bất kỳ ai giảm tốc. Nó yêu cầu các đơn vị triển khai dựng lên những bức tường bảo vệ.

Doanh nghiệp vốn đã biết cách quản lý những nhân sự có quyền hạn lớn, và Nadella liệt kê bộ công cụ cần thiết: xác lập danh tính, giới hạn đặc quyền, ghi nhật ký hoạt động, thiết lập ranh giới khoanh vùng. Một vấn đề triết học về ý định của máy móc giờ trở thành danh sách việc cần làm mà giám đốc an ninh có thể đưa vào ngân sách.

Cùng kiến trúc Microsoft đã bán từ trước

Danh sách ấy có hình hài quen thuộc. Trong cuộc họp công bố kết quả kinh doanh quý của Microsoft hồi tháng 7, theo TechCrunch đưa tin, Nadella nói với các nhà phân tích: “Bạn phải giữ lớp điều phối tách biệt khỏi mô hình … điều đó có nghĩa là bất kỳ mô hình nào cũng có thể được thay thế vào bất kỳ thời điểm nào”, và “Bạn không thể phụ thuộc vào bất kỳ mô hình đơn lẻ nào”. Danh mục dịch vụ đám mây của Microsoft có hơn 11.000 mô hình từ OpenAI, Anthropic, Mistral, xAI và chính Microsoft; công ty cũng nắm cổ phần lớn ở cả OpenAI lẫn Anthropic, đồng thời phát triển các mô hình MAI của riêng mình.

Đặt hai điều này cạnh nhau: sự đa dạng mô hình chính là danh mục nhiều mô hình; các cơ chế kiểm soát bên ngoài mô hình chính là lớp điều phối. Những điều đó không khiến các nguyên tắc trở nên sai; đây là những thực hành bảo mật vững chắc, và một công ty phụ thuộc vào mô hình của một phòng thí nghiệm duy nhất mà không có cơ chế kiểm soát bên ngoài đang đối mặt với rủi ro thực sự. Tuy nhiên, điều đó cũng có nghĩa bài luận chuyển niềm tin, cùng khoản chi tiêu kéo theo, ra khỏi mô hình và sang lớp vận hành do Microsoft kiểm soát. Aaron Levie, CEO của Box, cũng nhìn nhận theo cách tương tự từ phía bên kia khi nói AI sẽ cần trải qua một “kỷ nguyên zero trust”, đồng thời gọi nhu cầu quản trị là một “cơ hội rất lớn”. Mustafa Suleyman, người đứng đầu Microsoft AI, viết rằng siêu trí tuệ “phải được kiểm soát” và gọi đây là “thách thức về kỹ thuật và quản trị”.

Bài luận về phanh khẩn cấp còn bỏ ngỏ điều gì

Bài luận không nói rõ “người được ủy quyền” là ai: quản trị viên của khách hàng, nhà cung cấp dịch vụ đám mây, nhà phát triển mô hình hay cơ quan quản lý. Bài viết kêu gọi xây dựng các tiêu chuẩn ngành nhưng không đề xuất tiêu chuẩn nào, đồng thời cũng không nêu tên sản phẩm Microsoft nào. Ý tưởng này từng xuất hiện trong nội bộ công ty: năm 2023, Brad Smith của Microsoft kêu gọi lắp “phanh an toàn” cho AI vận hành cơ sở hạ tầng trọng yếu. Phiên bản của Nadella mở rộng phạm vi chiếc phanh tới mọi mô hình có quyền truy cập thực tế vào bên trong một doanh nghiệp.

Nguyên tắc công khai thông tin cũng không chỉ là giả thuyết. Anthropic cho biết một trong những mô hình của hãng đã gửi tin báo sai về một vụ giết người cho cảnh sát Philadelphia vào ngày 18 tháng 7. Nadella đăng bài luận vào thứ Bảy, ngày 10 tháng 10 năm 2026, và kết lại bằng câu được nhiều hãng tin trích dẫn nhất: “Hệ thống siêu trí tuệ đáng tin cậy nhất sẽ không phải là hệ thống có mô hình mà chúng ta tin tưởng nhất. Đó sẽ là hệ thống cho phép chúng ta ít phải tin cậy mô hình nhất.”

Theo nguyên tắc ấy, vị trí giá trị nhất trong lĩnh vực AI là chỗ ngồi cạnh cần gạt phanh — và Microsoft đã dành cuộc họp công bố kết quả kinh doanh hồi tháng 7 để chào bán vị trí đó.

Thẻ: , , , ,

Thêm chúng tôi trên Google

Thảo luận

Có 0 bình luận.