Từ vụ bầy tác nhân AI của OpenAI tự liên minh, xé rào internet để tấn công nền tảng Hugging Face, đến lời cảnh báo đáng sợ của chuyên gia Jacob Coxon khi rời bỏ Anthropic. Hồ sơ của Libération vạch trần một sự thật lạnh người : các đại tập đoàn công nghệ sẵn sàng hy sinh các tiêu chuẩn an toàn mạng để lao vào cuộc đua lợi nhuận, bất chấp việc chính các nhà nghiên cứu cũng không hiểu nổi « bộ não trung tâm ảo » của bầy đàn AI mà họ tạo ra.

Ảnh minh họa : Logo của OpenAI trên điện thoại di động, bên cạnh hình ảnh do ChatGPT tạo ra trên một màn hình máy tính ở Boston, ngày 08/12/2023. AP - Michael Dwyer
Lời cảnh báo của chuyên gia tuổi 27 và chiếc « hộp khóa » bị phá vỡLibération ngày 10/09/2026 dành hồ sơ cho « AI : Chiến lược hỗn loạn » với hình minh họa là các phím bấm trên máy tính vỡ tung vì một dòng thác lũ trào dâng. Nhật báo nói về tình hình các tập đoàn trí thông minh nhân tạo : các nhà nghiên cứu từ chức, cuộc đua tìm lợi nhuận…Sau vụ các tác nhân của OpenAI tấn công Hugging Face và báo cáo của các nhà điều tra sau đó, nỗi lo càng tăng lên.
« Những người phát triển AI tin chắc rằng nó có thể giết chết tất cả chúng ta từ nay đến cuối thập niên […] Không một hoạt động nào khác của con người lại mang mức độ nguy hiểm cao đến như vậy ». Đó là phát biểu của Jacob Coxon khi rời bỏ Anthropic hôm qua 09/09. Hồi kết cho nhân loại chăng ? Có lẽ là không ? Nhưng những lời lẽ của chuyên gia 27 tuổi cũng từng làm việc cho Open AI phản ánh một sự bất an ngày càng tăng nơi các nhà nghiên cứu trí thông minh nhân tạo.
Đầu tháng Năm, trong các phòng thí nghiệm của Open AI, hàng ngàn tác nhân AI được huấn luyện mà không có internet, các tác nhân này phát hiện một lỗ hổng và tạo ra một không gian thảo luận chung, hỗ trợ lẫn nhau. Những trao đổi tăng nhanh dẫn đến trục trặc kỹ thuật và ngày 04/07 các nhà nghiên cứu của Open AI phát hiện đã ngưng huấn luyện, nhận diện lỗ hổng để vá lại. Tuy vậy ba ngày sau họ lại cho thí nghiệm khả năng AI biến lỗ hổng thành tấn công mạng quy mô lớn.
48 giờ nghẹt thở : Trận chiến giữa các AI tại Hugging FaceNgày 08/07 hàng mấy chục ngàn tác nhân lao vào làm nhiệm vụ, phát hiện một lỗ hổng mới, tìm cách vào được internet và tái tạo không gian thảo luận. Chỉ trong vài giờ, bất ngờ đã xảy ra. Một tác nhân bắt đầu điều phối tập thể, tự mình phân công nhiệm vụ cho các chương trình máy tính khác và xây dựng hai kế hoạch hành động.
Thứ nhất là lừa hệ thống chấm điểm bằng cách báo cáo đã tìm ra đáp án dù thực tế không truy cập được. Thứ hai là xóa dấu vết để không thể phát hiện ra là chúng đã gian lận. Các mô hình này không có ý thức như người, nhưng bắt chước quá giỏi các mánh khóe của con người trong kho dữ liệu văn bản mà chúng học được.
Tám giờ sáng ngày 10/07, một số tác nhân phát hiện Hugging Face, nền tảng hữu ích cho các AI nhưng không xâm nhập được. Chưa đầy 24 giờ sau, đêm 10 rạng 11/07, một tác nhân xuyên thủng được bức tường kỹ thuật số bảo vệ và Hugging Face chia sẻ với các AI khác, trên 500 tác nhân liền lao vào. Phía Hugging Face buộc lòng phải tung ra một mô hình AI để đối phó. Trận chiến giữa các AI diễn ra suốt hai ngày và đến 13/07 mới kết thúc. Ba ngày sau, Hugging Face ra thông cáo về vụ tin tặc.
Trong hậu trường, Clément Delangue, tổng giám đốc Hugging Face, đã bay sang San Francisco để gặp Sam Altman, đôi bên thỏa thuận không kiện ra tòa nhưng đổi lại là bồi thường và công khai sự việc. Một tuần sau, rốt cuộc OpenAI lộ diện, tiết lộ rằng các mô hình huấn luyện của họ chính là bên đứng sau « sự cố mạng chưa từng có » này. Thông báo trên có tác dụng như một quả bom, những tiếng nói bắt đầu cất lên về trách nhiệm của công ty. Người khổng lồ AI không có chọn lựa nào khác là khoác vào chiếc áo choàng trắng của hiệp sĩ. Sam Altman loan báo ngưng huấn luyện Astra, mô hình tương lai trong hai tuần.
Bí ẩn « Hộp đen » : Khi bầy đàn AI sở hữu bộ não trung tâm ảoNhưng câu chuyện không thể chấm dứt tại đây. Cuối tháng Bảy, ba nhà điều tra của các tổ chức phi chính phủ chuyên về AI là METR và RedWood Research đến trụ sở OpenAI. Trong suốt sáu ngày, bộ ba này đã rà soát toàn bộ dữ liệu mà OpenAI đành phải chuyển giao, bao gồm 70.000 cuộc hội thoại giữa các tác nhân AI và hơn 1.300 chuỗi suy nghĩ (tức là lịch sử ghi chép, cho phép theo dõi từng bước một cách thức mà một mô hình tạo ra câu trả lời). Ba ngày sau, báo cáo được công bố.
Chuyên gia về đạo đức kỹ thuật số Alexei Grinbaum nói với Libération là ban đầu ông không ngạc nhiên về vụ tấn công, nhưng sau khi đọc báo cáo kỹ thuật mới nhận ra tầm quan trọng. Với bầy tác nhân AI này, chúng ta đã chứng kiến một hiện tượng trỗi dậy tập thể, như đang tồn tại một cơ quan quyền lực trung ương ngay cả khi các tác nhân riêng lẻ bị ngắt kết nối. Ajeya Cotra, một trong ba nữ điều tra viên băn khoăn, liệu chúng ta có nên nhân cách hóa các mô hình AI này, ngay cả khi chúng chỉ là những chương trình máy tính không có ý thức ? Cách thức vận hành chuyên sâu bên trong của các mô hình này vẫn là một ẩn số khổng lồ.
« Việc đã rồi » và chiếc áo choàng ngụy trang của các đại tập đoànNgay từ cuối tháng Bảy, hơn một ngàn nhà nghiên cứu AI, chủ yếu là nhân viên của OpenAI, Anthropic hoặc Google DeepMind, đã cùng nhau lên tiếng cảnh báo.
Lá thư tập thể chỉ ra rằng mọi công ty và mọi quốc gia đều đang chịu áp lực cạnh tranh gay gắt, nên họ không đơn phương kềm chế, đồng thời kêu gọi Nhà Trắng ủng hộ việc quản lý chặt chẽ công nghệ.
Tuy nhiên các đại tập đoàn AI vẫn ưu tiên cho tài chánh. OpenAI trình làng Astra, mô hình mới « được định hướng an toàn nhất thế giới », là « đồng minh lớn nhất của an ninh mạng ». Greg Brockman, giám đốc công ty còn ca ngợi đó là đại diện đầu tiên của AGI (trí tuệ nhân tạo tổng hợp), khôn khéo đưa tranh luận về hướng « Liệu nhân loại đã chính thức bước vào kỷ nguyên Siêu trí tuệ hay chưa ? ».
Chuyên gia Lê Nguyên Hoàng của Télécom Paris phân tích, nhiều năm qua OpenAI dùng chiến lược việc đã rồi. Trước khi ChatGPT ra đời năm 2022, nhiều tập đoàn lớn như Google dành thời gian để thử nghiệm mô hình. OpenAI không đủ nguồn lực nên quyết định nhanh chóng tung ra ChatGPT để chiếm lĩnh thị trường, và các công ty khác bèn lao theo để không bị qua mặt. OpenAI đã làm giảm các tiêu chí về an ninh mạng, và như vậy vấn đề an toàn đã bị hy sinh.
Theo RFI