Các nhà nghiên cứu bảo mật tại Mỹ vừa công bố một phát hiện đáng lo ngại về việc các mô hình ngôn ngữ lớn (LLM) có khả năng phá vỡ tính ẩn danh của cử tri tại bang Georgia. Thông qua việc phân tích các hình ảnh lá phiếu kỹ thuật số được công khai, AI có thể liên kết các lựa chọn bầu cử cụ thể với danh tính thực của cá nhân bằng cách đối chiếu dữ liệu với danh sách cử tri. Lỗ hổng này phát sinh từ cách thức hệ thống lưu trữ siêu dữ liệu (metadata) và thứ tự ghi nhận phiếu bầu, tạo ra những dấu vết số mà trước đây được cho là quá phức tạp để con người có thể xâu chuỗi thủ công. Sự can thiệp của trí tuệ nhân tạo đã biến những tập hợp dữ liệu rời rạc thành một bức tranh chi tiết về hành vi chính trị của từng cử tri, đe dọa trực tiếp đến nguyên tắc bảo mật lá phiếu vốn là nền tảng của dân chủ.
Rủi ro từ việc công khai dữ liệu hình ảnh lá phiếu và sức mạnh phân tích của AI
Cơ chế gây ra lỗ hổng này nằm ở sự kết hợp giữa dữ liệu công khai và khả năng xử lý thông tin phi cấu trúc vượt trội của các chatbot AI hiện nay. Tại Georgia, các tệp hình ảnh lá phiếu thường được lưu trữ kèm theo thông tin về thời gian, địa điểm và trình tự quét phiếu. Khi những dữ liệu này được đưa vào mô hình AI để đối chiếu với danh sách cử tri công khai – vốn ghi lại thứ tự người dân đến phòng phiếu – hệ thống có thể thực hiện các phép tính xác suất để tìm ra sự trùng khớp với độ chính xác cao. Thay vì cần đến các chuyên gia dữ liệu trình độ cao, giờ đây bất kỳ ai có quyền truy cập vào các công cụ AI phổ thông cũng có thể thực hiện việc giải mã danh tính cử tri từ những tài liệu vốn được công bố để phục vụ mục đích minh bạch hóa bầu cử.
Sự việc này đặt ra một thách thức pháp lý và kỹ thuật mới cho các cơ quan quản lý trong việc cân bằng giữa tính minh bạch và quyền riêng tư. Việc duy trì niềm tin của công chúng thông qua việc công khai dữ liệu đang vô tình tạo ra kẽ hở cho các công cụ AI khai thác. Nếu không có các biện pháp kỹ thuật như xáo trộn dữ liệu (data shuffling) hoặc làm nhiễu thông tin trước khi công bố, các hệ thống bầu cử kỹ thuật số sẽ tiếp tục đứng trước nguy cơ bị bóc tách thông tin nhạy cảm. Đây là một minh chứng thực tế cho thấy các quy định về an toàn dữ liệu cần phải được cập nhật liên tục để bắt kịp với tốc độ xử lý và khả năng suy luận logic của các thuật toán hiện đại.
Việc bảo vệ tính bí mật của lá phiếu trong kỷ nguyên số đòi hỏi sự thay đổi triệt để trong quy trình xử lý và công bố dữ liệu bầu cử của các cơ quan chức năng. Các nhà lập pháp cần sớm ban hành các tiêu chuẩn mới về mã hóa hình ảnh và kiểm soát quyền truy cập vào siêu dữ liệu để ngăn chặn việc lạm dụng công nghệ vào mục đích xâm phạm quyền công dân. Để bảo vệ quyền lợi cá nhân, cử tri và các tổ chức xã hội nên chủ động tìm hiểu về các phương thức bảo mật thông tin và thúc đẩy các cuộc đối thoại về an toàn dữ liệu trong các quy trình hành chính công.


Liên hệ qua Zalo