Nhà nghiên cứu Anthropic nghỉ việc vì lo ngại AI có thể tiêu diệt nhân loại

Jacob Coxon, một kỹ sư 27 tuổi từng làm việc tại OpenAI và Anthropic, vừa chính thức rời bỏ ngành trí tuệ nhân tạo (AI) vào ngày 8 tháng 9 năm 2026. Thay vì chuyển sang một đối thủ cạnh tranh, Coxon quyết định giải nghệ hoàn toàn vì lo ngại về sự an toàn của nhân loại. Ông cảnh báo rằng các phòng thí nghiệm AI đang bị cuốn vào một cuộc đua vũ trang hướng tới siêu trí tuệ (superintelligence) mà họ không thể kiểm soát. Theo Coxon, các công ty hàng đầu dù nỗ lực ưu tiên tính an toàn nhưng vẫn phải đánh đổi trước áp lực cạnh tranh khốc liệt. Đáng chú ý hơn, Evan Hubinger, trưởng nhóm khoa học căn chỉnh (Alignment Science Lead) tại Anthropic, đã công khai đồng ý với quan điểm này. Hubinger nhận định có hơn 10% khả năng AI sẽ tiêu diệt loài người trong vòng một thập kỷ tới. Những lời cảnh báo này không đến từ những người phản đối công nghệ bên ngoài, mà từ chính những nhân sự cốt lõi đang trực tiếp xây dựng các hệ thống mà họ đang lo sợ.

Những mâu thuẫn giữa cam kết an toàn và áp lực thương mại hóa

Sự ra đi của Coxon diễn ra vào thời điểm nhạy cảm khi Anthropic đang chuẩn bị cho đợt phát hành cổ phiếu lần đầu ra công chúng (IPO) với định giá mục tiêu lên tới 2 nghìn tỷ USD. Giá trị cốt lõi mà Anthropic cam kết với các nhà đầu tư và cơ quan quản lý là trở thành giải pháp thay thế “an toàn hơn” so với OpenAI hay Google DeepMind. Tuy nhiên, việc một nhà nghiên cứu kỳ cựu rời bỏ ngành vì nỗi sợ hãi, cùng với việc lãnh đạo bộ phận an toàn xác nhận rủi ro diệt vong, đã tạo nên một cuộc khủng hoảng niềm tin nghiêm trọng. Coxon khẳng định rằng các kịch bản tiêu cực nhất có thể bắt đầu vượt khỏi tầm kiểm soát ngay từ cuối năm tới, thay vì ở một tương lai xa xôi nào đó.

Bên cạnh đó, Anthropic cũng đang đối mặt với những nghi vấn về tính minh bạch khi từ chối gửi mô hình Claude Mythos 5.1 cho Viện An ninh AI của Vương quốc Anh để kiểm tra trước khi phát hành. Quyết định này đi ngược lại với hình ảnh một công ty luôn ưu tiên sự an toàn của cộng đồng. Khi các lãnh đạo như CEO Dario Amodei từng thừa nhận xác suất 25% AI dẫn đến kết cục thảm khốc, việc thiếu một kế hoạch căn chỉnh siêu trí tuệ rõ ràng đang khiến giới quan sát lo ngại rằng cuộc đua lợi nhuận đang lấn át những rào chắn đạo đức cuối cùng của nhân loại.

Những lời cảnh báo từ nội bộ Anthropic cho thấy ranh giới giữa tiến bộ công nghệ và rủi ro tồn vong đang trở nên mong manh hơn bao giờ hết. Đối với người dùng và các nhà đầu tư, đây là thời điểm cần có cái nhìn đa chiều và thận trọng hơn về tốc độ phát triển của các mô hình ngôn ngữ lớn. Thay vì chỉ tập trung vào hiệu suất, việc thúc đẩy các khung pháp lý chặt chẽ và yêu cầu sự minh bạch tối đa từ các tập đoàn công nghệ là hành động thiết yếu để đảm bảo rằng trí tuệ nhân tạo sẽ phục vụ, chứ không phải đe dọa sự tồn vong của con người.

LIÊN HỆ TƯ VẤN CÁC DỊCH VỤ AI
Hỗ trợ tư vấn, đào tạo và chuyển giao giải pháp AI cho cá nhân, doanh nghiệp và tổ chức.
Chia sẻ tới bạn bè và gia đình
Chat Zalo Chat Zalo
Gọi ngay Chat