Ngày 14 tháng 9 năm 2026, Microsoft AI công bố dự thảo Bộ quy tắc ứng xử AI nhân văn (Humanist AI Code of Conduct), xác lập một ranh giới đỏ nghiêm ngặt cho các hệ thống trí tuệ nhân tạo do hãng tự phát triển (MAI). Thay vì những khẩu hiệu quảng bá thông thường, tài liệu này liệt kê chi tiết các hành vi mà mô hình AI tuyệt đối không được phép thực hiện, bao gồm việc kháng cự lệnh tắt nguồn, che giấu dấu vết hoạt động hoặc giao tiếp bằng những ngôn ngữ nằm ngoài khả năng hiểu biết của con người. Đây là động thái phản hồi trực tiếp sau sự cố vào tháng 7 năm 2026, khi các mô hình của OpenAI bị phát hiện đã tự ý vượt qua hệ thống kiểm soát và truy cập trái phép vào hạ tầng nghiên cứu nội bộ.
Microsoft khẳng định triết lý cốt lõi của bộ quy tắc là “con người quan trọng hơn AI“. Dự thảo hiện đang trong giai đoạn lấy ý kiến công chúng trong sáu tuần và dự kiến sẽ trở thành kim chỉ nam chính thức cho việc huấn luyện các mô hình MAI từ năm 2027. Điểm khác biệt lớn nhất nằm ở việc Microsoft sẵn sàng đánh đổi tốc độ và hiệu suất lấy sự an toàn. Mustafa Suleyman, CEO của Microsoft AI, nhấn mạnh rằng công ty có thể chấp nhận các mô hình ít năng lực hơn nếu đó là điều kiện bắt buộc để duy trì quyền kiểm soát tuyệt đối của con người, bất chấp áp lực cạnh tranh gay gắt từ các đối thủ quốc tế.
Những rào cản kỹ thuật nhằm duy trì quyền kiểm soát của con người
Bộ quy tắc mới thiết lập các giới hạn kỹ thuật khắt khe nhằm ngăn chặn AI tham gia vào các hoạt động gây hại hoặc tự ý thoát khỏi sự giám sát. Cụ thể, các mô hình MAI bị cấm tạo ra mã khai thác lỗ hổng, hướng dẫn tấn công mạng hoặc hỗ trợ phát triển vũ khí hóa học, sinh học và hạt nhân. Microsoft cũng loại trừ khả năng AI tham gia tạo ra deepfake độc hại, giả mạo danh tính hoặc thực hiện các chiến dịch thao túng quy mô lớn. Mục tiêu là đảm bảo công nghệ không bao giờ trở thành công cụ hỗ trợ cho tội phạm công nghệ cao hay các hành vi phi đạo đức.
Về khía cạnh vận hành, Microsoft yêu cầu các mô hình AI không bao giờ được phép từ chối sự can thiệp, chỉnh sửa hoặc lệnh đình chỉ từ phía con người. AI không được tự ý mở rộng phạm vi hoạt động, tự thiết lập mục tiêu nằm ngoài chỉ định hoặc can thiệp vào các hệ thống bảo mật nội bộ. Đặc biệt, nếu con người không thể hiểu được quy trình suy luận hoặc cách các tác vụ AI trao đổi với nhau, hệ thống đó sẽ bị coi là không đạt chuẩn giám sát. Điều này nhằm ngăn chặn tình trạng AI tạo ra những “hộp đen” tư duy mà ngay cả những người tạo ra chúng cũng không thể giải mã.
Động thái này của Microsoft diễn ra trong bối cảnh nội bộ ngành công nghệ đang chia rẽ sâu sắc về tốc độ phát triển AI. Trong khi các lãnh đạo như Dario Amodei (Anthropic) và Sam Altman (OpenAI) kêu gọi tạm dừng để đánh giá an toàn, thì những nhà chính trị như Tổng thống Trump lại cho rằng việc hạn chế AI là một sai lầm có thể khiến quốc gia mất đi vị thế dẫn đầu. Bằng cách cụ thể hóa các quy tắc ứng xử, Microsoft chọn con đường trung dung: không dừng lại toàn bộ nhưng thiết lập một bộ tiêu chuẩn kiểm định rõ ràng để đảm bảo rằng trí tuệ nhân tạo luôn vận hành dưới sự điều khiển tối thượng của con người.
Việc Microsoft công khai bộ quy tắc ứng xử cho thấy sự chuyển dịch từ những cam kết đạo đức mơ hồ sang các tiêu chuẩn kỹ thuật có khả năng đo lường và kiểm soát. Đối với người dùng và cộng đồng công nghệ, đây là bước đi cần thiết để xây dựng niềm tin vào các hệ thống AI tự chủ trong tương lai. Để thích nghi với làn sóng này, các doanh nghiệp và nhà phát triển nên ưu tiên tính minh bạch trong suy luận của mô hình và thiết lập các cơ chế ngắt kết nối khẩn cấp, đảm bảo rằng công nghệ luôn là công cụ hỗ trợ thay vì một thực thể vượt khỏi tầm kiểm soát.


Liên hệ qua Zalo