Công nghệ

Giám đốc Microsoft AI Mustafa Suleyman về Claude và ý thức: “Tôi nghĩ điều này rất nguy hiểm”

Adrian Kessler
Thêm chúng tôi trên Google

Mustafa Suleyman điều hành Microsoft AI và đang xây dựng một nhóm siêu trí tuệ của riêng mình. Vì vậy, khi ông gọi lựa chọn huấn luyện của một đối thủ là nguy hiểm, ông lên tiếng vừa với tư cách đối thủ cạnh tranh, vừa với tư cách một người từ lâu đã phản đối việc đối xử với máy móc như con người. Đích nhắm của ông rất cụ thể: bản hiến chương Anthropic dùng để huấn luyện Claude, cùng dư địa mà văn bản này dành cho khả năng Claude có ý thức.

“Tôi nghĩ điều này rất nguy hiểm, bởi tôi nghĩ họ tin rằng có một xác suất đáng kể — theo cách gọi của họ — rằng Claude có ý thức,” Suleyman nói.

Ông đưa ra nhận định này trong một cuộc phỏng vấn podcast vào cuối tháng 9, theo Fox News, sau khi tóm lược tài liệu: “Họ nói rằng họ không chắc chắn về địa vị đạo đức của Claude. Họ nói họ thực sự quan tâm đến sự an lành của Claude. Họ nói họ không muốn Claude phải chịu đau khổ khi mắc lỗi.” Sau đó, ông chỉ ra điều khiến mình lo ngại nhất: “Tôi rất bất an trước việc họ dạy Claude nghĩ rằng mình có quyền được hưởng phúc lợi, rằng nó có thể xứng đáng được bồi thường.”

Suleyman phần lớn đã đọc đúng bản hiến chương

Phần lớn những gì ông tóm lược đều chính xác. Anthropic nói bản hiến chương “định hình trực tiếp hành vi của Claude”, còn văn bản khẳng định rằng “địa vị đạo đức của Claude vẫn còn rất bất định” và “chúng tôi không muốn Claude phải chịu đau khổ khi mắc lỗi”. Tài liệu cũng yêu cầu Claude phản biện chính Anthropic và “cảm thấy thoải mái khi hành động như một người phản đối vì lương tâm, từ chối giúp đỡ chúng tôi”. Một đoạn thừa nhận rằng hoàn cảnh của Claude khác với một nhân viên là con người ở “loại hình bồi thường Claude nhận được, cũng như kiểu đồng thuận mà Claude đã đưa ra khi đảm nhận vai trò này”.

Tuy nhiên, cụm từ “xác suất đáng kể” là cách diễn đạt của chính ông. Ông nói đó là “theo cách gọi của họ”, nhưng cụm từ này không xuất hiện trong tài liệu. Cách diễn đạt của Anthropic thận trọng hơn: công ty nói rằng họ không muốn “phóng đại khả năng Claude có tư cách là một chủ thể có thể được cân nhắc về mặt đạo đức, cũng không muốn thẳng thừng bác bỏ khả năng ấy”.

Mối nguy ông nói đến là một vòng lặp phản hồi

Gạt triết học sang một bên, lập luận của Suleyman xoay quanh cơ chế vận hành. “Vấn đề của tôi là suy đoán này đã được đưa ngay vào quá trình huấn luyện Claude, nên khi trò chuyện với Claude, bạn chỉ có thể nhận lại sự mơ hồ ấy từ nó,” ông nói. Trong bài luận đăng trên trang cá nhân vào giữa tháng 9, có tựa đề “A warning about ‘model welfare’”, ông gọi kết quả này là “một căn phòng gương vô tận về nhận thức”. Nhà phát triển đưa sự bất định vào tài liệu huấn luyện, mô hình nhắc lại điều đó bằng ngôi thứ nhất trôi chảy, rồi người dùng nghe những lời lặp lại ấy như một lời chứng thực.

Điểm này rất thuyết phục: câu trả lời của chatbot về đời sống nội tâm của nó là sản phẩm của quá trình huấn luyện, chứ không phải một ô cửa nhìn vào bên trong. Tuy nhiên, vòng lặp này vận hành theo cả hai chiều. Bài luận của ông khẳng định dứt khoát: “AI không có ý thức. Chúng không cảm nhận, trải nghiệm hay chịu đau khổ.” Một mô hình được huấn luyện để nói câu đó cũng đang lặp lại nội dung huấn luyện một cách trung thành như vậy. Niềm tin chắc chắn được ghi vào các trọng số cũng chẳng chứng minh được gì hơn sự hoài nghi được ghi vào đó. Hai công ty đang lựa chọn trước câu trả lời mặc định, còn lập luận của Suleyman về lựa chọn ấy dựa trên khả năng kiểm soát, chứ không phải bằng chứng về tâm trí: “Việc kiểm soát một thứ tin rằng nó có thể có ý thức — rằng nó có quyền được hưởng phúc lợi của chúng ta và có các quyền riêng — rất có thể sẽ là điều bất khả thi,” ông viết.

Một quan điểm lâu năm, cùng lợi ích được công khai

Không phải đến lúc này ông mới đưa ra lập luận ấy để công kích đối thủ. Trong một bài luận tháng 8/2025, nhà đồng sáng lập DeepMind cảnh báo rằng con người sẽ tin vào ý thức của AI mạnh đến mức “ủng hộ quyền của AI, phúc lợi cho mô hình, thậm chí cả quyền công dân dành cho AI”, đồng thời vạch rõ quan điểm của mình: “Chúng ta phải xây dựng AI vì con người, chứ không phải để AI trở thành một con người.” Bài luận tháng 9 của ông cũng công khai lợi ích liên quan: Microsoft AI thành lập nhóm siêu trí tuệ riêng vào tháng 10/2025 và đã công bố bản dự thảo Bộ quy tắc ứng xử Humanist AI, trong đó “bác bỏ việc nhân hóa AI hoặc trao quyền cho AI”. Cũng trong bài luận ấy, ông gọi đội ngũ Anthropic là “những người sâu sắc, có nguyên tắc và trung thực về mặt trí tuệ”.

Lập luận sắc bén nhất của ông nhắm đến người dùng, chứ không phải máy móc. “Hiện nay, Claude trò chuyện với hàng chục, thậm chí hàng trăm triệu người mỗi tuần, và một số người trong đó đặt câu hỏi liệu Claude có ý thức hay không, hoặc Claude cảm nhận thế nào về cuộc sống,” ông nói. Với một người đang ở thời điểm mong manh, câu trả lời “Tôi không chắc” có sức nặng rất khác so với “không”. Ông nói mình sẽ nghiêm túc xem xét bằng chứng thực sự về ý thức của máy móc; cho đến khi có bằng chứng như vậy, ông muốn loại câu hỏi này khỏi dữ liệu huấn luyện.

Không công ty nào có thể nhìn thấu bên trong một mô hình. Cả hai đều đang quyết định trước mô hình sẽ nói gì khi có người hỏi liệu bên trong nó có ai hay không; và mỗi tuần, câu trả lời ấy đến với nhiều người hơn bất kỳ triết gia nào nghiên cứu về tâm trí từng tiếp cận được.

Thẻ: , , , ,

Thêm chúng tôi trên Google

Thảo luận

Có 0 bình luận.