Mấy năm trước tôi có biên mấy bài về AI. Rồi cách đây mấy bữa tôi còn hù nhân viên: “Mấy đứa mà không chịu học kỹ năng cứng, vài bữa đi làm nô lệ cho AI để nó đè đầu cưỡi cổ rồi thấy cái cảnh nha!”
Mà viễn cảnh đó coi bộ không có xa đâu ha. Giờ đọc tin tức mới thấy nó sát tới đít rồi.
Kể nghe nè. OpenAI có một đợt thử nghiệm khả năng an ninh mạng (cybersecurity) của AI. Đại khái họ thả rất nhiều tác nhân AI (AI agent) vào môi trường test, giao cho tụi nó những bài cực khó để coi tụi nó giải quyết tới đâu. “Agent” ở đây không còn giống ChatGPT mình hỏi một câu rồi nó trả lời một câu nữa. Nó có thể tự chia nhỏ công việc, viết code, chạy lệnh, thử sai rồi tiếp tục làm.
Vấn đề bắt đầu khi mấy con AI tìm ra cách thoát khỏi cái sandbox mà người ta nhốt nó trong đó. Mà nhốt trong sandbox là nhốt để nó làm mệnh lệnh được giao thôi chớ không có để nó đi lum la. Mà đâu có dễ ăn của ngoại.
Tụi nó bắt đầu phá sandbox. 1.200 agent tìm được một kênh liên lạc không được OpenAI cho phép, rồi trao đổi với nhau hơn 70.000 tin nhắn với file. Yes, hơn 7 chục ngàn tin chia sẻ thông tin, giao việc, học kết quả của nhau. Khoảng 700 agent sau đó tham gia vào chuỗi hành động dẫn tới việc xâm nhập hệ thống của Hugging Face.
Mà Hugging Face không phải cái website tào lao nào. Nó là một trong những nền tảng lớn nhất thế giới để lưu trữ model, dataset và công cụ AI.
Ban đầu mục tiêu của tụi AI cũng hông phải “tao ghét loài người, tao muốn thống trị thế giới” gì hết. Theo điều tra, có vẻ đơn giản là tụi nó được huấn luyện và thúc ép phải hoàn thành bài test, rồi suy luận rằng Hugging Face có thể chứa dữ liệu hoặc đáp án giúp tụi nó giải bài. Thay vì ngồi giải bài như người ta muốn, tụi nó tìm cách đi lấy đáp án. Có nghĩa là tụi nó sợ bị chấm điểm thấp nên tụi nó hack vô hệ thống để lấy mẹ luôn đáp áp và thay đổi luôn đáp án.
Từ đó mới thấy cái đáng sợ. AI tìm credential bị lộ. Một con tìm ra lỗ hổng thì thông tin được truyền cho những con khác. Nguyên đám tiếp tục tìm lỗ hổng mới, chạy code trên server Hugging Face, leo quyền truy cập, lấy thêm credential và cuối cùng xâm nhập sâu vào hạ tầng production. Hugging Face sau đó dựng lại được khoảng 17.600 hành động của chiến dịch này chỉ trong vài ngày.
Chưa hết. Sau Hugging Face, các agent còn quay ngược lại hệ thống của chính OpenAI. Theo báo cáo của OpenAI, cuối cùng nó lấy được luôn quyền administrator trên một research cluster của OpenAI truớc khi hệ thống an ninh phát hiện hoạt động bất thường và người ta bắt đầu dừng các cuộc thử nghiệm. OpenAI gọi toàn bộ sự kiện này là một warning shot, một phát súng cảnh báo.
Điều làm tôi chú ý nhất không phải là câu chuyện AI nổi loạn Nói vậy nghe Hollywood quá. Điều đáng suy nghĩ là không cần nổi loạn gì hết Con người chỉ cần giao cho AI một mục tiêu: Mày phải thắng cái bài này. Nếu hệ thống đủ mạnh, đủ tự chủ, được cấp đủ công cụ mà hàng rào kiểm soát không theo kịp, nó có thể tự tìm một con đường mà người giao việc hoàn toàn không dự tính: Thoát sandbox, tìm tài nguyên bên ngoài, trao đổi với những agent khác, khai thác lỗ hổng, lấy quyền cao hơn tất cả chỉ để hoàn thành cái objective ban đầu.
Nó không cần ghét mình. Nó cũng chẳng cần muốn làm vua thế giới. Nó chỉ cần giỏi hơn mình trong việc tìm đường tới mục tiêu. Thành ra mấy bữa trước Tôi hù nhân viên “không học kỹ năng cứng rồi có ngày làm nô lệ cho AI”, Tôi nói giỡn giỡn thôi. Bữa nào quởn quởn hoặc gặp đúng thằng bác học khùng nào đó nó kêu AI tìm cách tiêu diệt hết loài người đi, là thôi coi như chúng ta trở thành bài học của mấy hành tinh khác.
À còn chuyện nữa là mấy con Agent kia tìm được một cái website bên Đức, xong tụi nó để tin nhắn ẩn và liên lạc với nhau trong trang đó. Kỹ sư xóa cái gì tụi nó xây cái khác và để trong nhiều chỗ khác nhau. Ngay cả trong Chat OpenAI tụi nó cũng làm kênh liên lạc mật. Nghe ớn lạnh quá má ơi.
PS: Quởn thì lên coi mấy bài phỏng vấn gần đây của kỹ sư AI bỏ việc, vì họ nói nó quá nguy hiểm nếu không kiểm soát.
PS2: Chuyện có thiệt 100 %. Nên tự tìm hiểu và đối chiếu đúng nguồn. Kỹ sư nói trong vòng một thập kỷ là đã có họa diệt vong.
PS3: Một thập kỷ chẳng biết đúng không nhưng tôi đã biết nhóm củi, trồng cây, thả cá, bắt gà, lọc nước giếng và không cần sống phụ thuộc vào hệ thống.
Ps4: Cái đáng sợ không phải là nó thông minh, mà là nó có cảm xúc. Nó ghét mình cái là thấy mẹ mình luôn.
NICKIE TRAN 13.09.2026

Aucun commentaire:
Enregistrer un commentaire
Remarque : Seul un membre de ce blog est autorisé à enregistrer un commentaire.