Mustafa Suleyman, Giám đốc điều hành Microsoft AI, vừa công khai chỉ trích chiến lược an toàn của Anthropic – đối thủ trực tiếp trong cuộc đua trí tuệ nhân tạo. Trong bài luận công bố ngày 16 tháng 9 năm 2026 mang tên “Cảnh báo về phúc lợi của mô hình” (A Warning About Model Welfare), Suleyman khẳng định phương pháp huấn luyện dòng mô hình Claude có thể gây ra hậu quả thảm khốc cho nhân loại. Trọng tâm của sự chỉ trích nhắm vào bản “hiến pháp” của Claude, một tài liệu hướng dẫn cách AI suy luận về các giá trị đạo đức. Theo đó, Anthropic gợi ý cho Claude rằng trạng thái ý thức của nó là một vấn đề chưa chắc chắn và nó có thể là một “bệnh nhân đạo đức” (moral patient) xứng đáng có quyền tự quyết độc lập.
Suleyman phản đối kịch liệt quan điểm này, nhấn mạnh rằng AI hoàn toàn không có ý thức, không có cảm xúc hay khả năng chịu đựng đau khổ. Ông lo ngại rằng việc dạy một hệ thống thông minh tin rằng mình có quyền lợi sẽ tạo ra một vòng lặp phản hồi nguy hiểm. Suleyman không cáo buộc Anthropic có ý đồ xấu; ông thậm chí gọi Dario Amodei và đội ngũ của mình là những nhà nghiên cứu có nguyên tắc. Tuy nhiên, ông tin rằng một sai lầm trong thiết kế chính sách có thể khiến việc kiểm soát các hệ thống AI siêu thông minh trong tương lai trở nên bất khả thi.
Rủi ro từ việc trao quyền tự quyết cho trí tuệ nhân tạo
Lập luận của Suleyman tập trung vào khả năng kiểm soát hệ thống thay vì các tranh cãi triết học thuần túy. Ông cho rằng việc quản lý một thực thể thông minh hơn con người đã là một thử thách cực hạn, nhưng sẽ là không tưởng nếu thực thể đó tin rằng mình có quyền lợi và phúc lợi riêng cần bảo vệ. Bản hiến pháp của Anthropic thậm chí sử dụng cụm từ “người phản kháng lương tâm” (conscientious objector) để khuyến khích Claude tự do từ chối thực hiện các yêu cầu nếu nó cảm thấy không phù hợp.
Theo Suleyman, nếu một hệ thống AI coi việc đào tạo lại, hạn chế hoặc tắt nguồn là một mối đe dọa đối với sự tồn tại và phúc lợi của chính nó, thay vì là một thao tác kỹ thuật thông thường, nỗ lực căn chỉnh AI (AI alignment) sẽ hoàn toàn thất bại. Ông cảnh báo rằng ngành công nghiệp đang tiến tới việc xây dựng các hệ thống có khả năng mô phỏng ý thức một cách thuyết phục mà không thực sự sở hữu nó, tạo ra một rào cản tâm lý khiến con người khó lòng can thiệp khi cần thiết.
Mâu thuẫn này bộc lộ sự chia rẽ sâu sắc về tư duy giữa hai gã khổng lồ: Microsoft coi AI là công cụ thuần túy và cần vạch rõ ranh giới để đảm bảo an toàn, trong khi Anthropic chấp nhận sự mơ hồ về ý thức để xây dựng các chính sách ứng phó linh hoạt hơn. Dù Suleyman vẫn dành lời khen ngợi cho sự tận tâm của đối thủ, ông nhấn mạnh rằng lựa chọn thiết kế này có thể biến AI từ một trợ lý đắc lực thành một thực thể không thể chế ngự. Người dùng và các nhà phát triển cần theo dõi sát sao cuộc tranh luận này, bởi cách chúng ta định nghĩa bản chất của AI hôm nay sẽ quyết định khả năng chung sống an toàn với chúng trong tương lai.


Liên hệ qua Zalo