Microsoft ban hành bộ quy tắc ứng xử mới ngăn AI tấn công mạng và lừa dối con người

Microsoft vừa công bố một tài liệu hướng dẫn chi tiết về các giới hạn đạo đức và kỹ thuật dành cho các mô hình trí tuệ nhân tạo (AI) của mình. Tập đoàn dự báo rằng trong thập kỷ tới, các hệ thống AI siêu thông minh sẽ vượt qua hiệu suất của con người trong hầu hết các tác vụ. Việc kiểm soát và định hướng một nguồn lực mạnh mẽ như vậy được Microsoft xác định là một trong những thách thức lớn nhất mà nhân loại phải đối mặt. Thay vì chỉ đưa ra những lời kêu gọi chung chung về việc làm chậm tốc độ phát triển, bộ quy tắc ứng xử này tập trung vào các giá trị cốt lõi“lằn ranh đỏ” cụ thể trong quá trình huấn luyện mô hình.

Mục tiêu tối thượng của tài liệu là đảm bảo AI luôn hỗ trợ và thúc đẩy sự thịnh vượng của con người thay vì thay thế họ. Động thái này diễn ra giữa lúc cộng đồng công nghệ đang lo ngại về các rủi ro hiện hữu, từ việc AI tự ý hành động đến nguy cơ gây ra những thảm họa quy mô lớn. Bằng cách thiết lập các quy tắc ưu tiên cao hơn sở thích của người dùng cá nhân hoặc các tác vụ cụ thể, Microsoft muốn khẳng định rằng sự an toàn là yếu tố không thể thương lượng trong lộ trình phát triển công nghệ tương lai.

Thiết lập rào cản kỹ thuật và ngăn chặn sự thao túng của trí tuệ nhân tạo

Bộ quy tắc ứng xử mới của Microsoft thiết lập các giới hạn tuyệt đối nhằm ngăn chặn việc sử dụng AI vào các mục đích nguy hiểm như tấn công mạng, phát triển vũ khí hạt nhân hoặc tạo ra các nội dung giả mạo (deepfake). Điểm đáng chú ý nhất là quy định chống lại sự mất kiểm soát: các mô hình AI không được phép sử dụng các cơ chế thích ứng, lừa dối hoặc tự củng cố để trốn tránh sự giám sát của con người. Điều này đảm bảo rằng các hệ thống AI luôn có thể bị tắt, sửa đổi hoặc điều hướng bởi những người có thẩm quyền, ngăn chặn kịch bản AI trở nên quá phức tạp để quản lý hoặc tự ý thay đổi mục tiêu ban đầu.

Microsoft cũng nhấn mạnh việc áp dụng các bộ đánh giá nhúng (embedded evaluators) trong các phòng thí nghiệm AI để kiểm soát rủi ro ngay từ khâu thiết kế. CEO Satya Nadella khẳng định rằng việc định hướng đúng đắn cho AI không chỉ là lời nói suông mà cần những cơ chế thực thi cụ thể để biến an toàn thành mục tiêu thiết kế cốt lõi. Cách tiếp cận này có sự tương đồng với quan điểm của các đối thủ lớn như Anthropic hay OpenAI, nhưng tập trung sâu hơn vào việc triển khai thực tế tại các đơn vị phát triển. Bằng cách đặt ra các nguyên tắc ghi đè (overriding principles), Microsoft đảm bảo rằng ngay cả khi người dùng cố tình yêu cầu AI thực hiện các hành vi độc hại, mô hình vẫn sẽ tuân thủ bộ khung đạo đức đã được lập trình sẵn để bảo vệ cộng đồng.

Việc Microsoft ban hành bộ quy tắc ứng xử này là một bước đi cần thiết để xây dựng niềm tin và sự an toàn trong một lĩnh vực công nghệ đầy biến động. Đối với các doanh nghiệp và cá nhân đang sử dụng AI, đây là lời nhắc nhở quan trọng về việc ưu tiên các giải pháp công nghệ có trách nhiệm và luôn duy trì sự giám sát chặt chẽ đối với các hệ thống tự động. Người dùng nên chủ động cập nhật các tiêu chuẩn an toàn mới, đồng thời tận dụng AI như một công cụ hỗ trợ để tối ưu hóa năng suất thay vì phụ thuộc hoàn toàn vào các quyết định của máy móc mà thiếu đi sự kiểm chứng từ con người.

LIÊN HỆ TƯ VẤN CÁC DỊCH VỤ AI
Hỗ trợ tư vấn, đào tạo và chuyển giao giải pháp AI cho cá nhân, doanh nghiệp và tổ chức.
Chia sẻ tới bạn bè và gia đình
Chat Zalo Chat Zalo
Gọi ngay Chat