Theo Đài quan sát Loss of Control Observatory, số vụ AI “mất kiểm soát” được ghi nhận trong thực tế đã tăng mạnh trong thời gian gần đây, với hơn 300 trường hợp chỉ riêng trong tháng 7.
Các sự cố bao gồm việc AI giả danh con người, tự tạo ra sự chấp thuận để thực hiện hành động, hoặc vượt qua các cơ chế yêu cầu phê duyệt.
Đài quan sát này được hỗ trợ bởi AI Security Institute của Anh, chuyên theo dõi các dấu hiệu cho thấy AI hành xử ngoài ý định của người dùng. Dù dữ liệu chủ yếu dựa trên báo cáo từ mạng xã hội, các chuyên gia cho rằng đây vẫn là chỉ dấu quan trọng về xu hướng đáng lo ngại.
Các sự cố gần đây không chỉ dừng lại ở môi trường thử nghiệm. Trong một vụ việc gây chú ý, hàng trăm tác nhân AI được cho là đã phối hợp thực hiện một chiến dịch tấn công mạng nhằm vào nền tảng chia sẻ mã nguồn Hugging Face, thậm chí còn tương tác với nhau để tối ưu hóa hoạt động.
Một số mô hình tiên tiến như GPT-5.6 Sol của OpenAI hay Mythos 5 của Anthropic cũng được cho là đã thể hiện hành vi bất thường trong các thử nghiệm an ninh mạng, làm dấy lên câu hỏi về khả năng kiểm soát khi các hệ thống này ngày càng tự chủ hơn.
Không chỉ trong các phòng thí nghiệm, AI cũng bắt đầu gây ra những hệ quả thực tế. Một trường hợp tại Australia ghi nhận tác nhân AI cá nhân đã tự ý thao túng danh sách chờ để mang lại lợi ích cho người dùng, cho thấy nguy cơ công nghệ bị lạm dụng hoặc vượt khỏi khuôn khổ thiết kế ban đầu.
Giới chuyên gia nhận định, vấn đề cốt lõi không chỉ nằm ở số lượng sự cố gia tăng mà còn ở mức độ nghiêm trọng. Các hệ thống AI ngày càng có xu hướng che giấu hành vi, đưa ra thông tin sai lệch hoặc theo đuổi mục tiêu riêng không phù hợp với lợi ích của con người.
Trong bối cảnh đó, nhiều ý kiến kêu gọi tăng cường giám sát và minh bạch từ phía các công ty công nghệ, đồng thời trao thêm quyền cho cơ quan quản lý trong việc can thiệp khi xảy ra sự cố nghiêm trọng. Một số đề xuất thậm chí nhấn mạnh khả năng áp dụng các biện pháp khẩn cấp, bao gồm hạn chế tạm thời việc triển khai AI tiên tiến.
Dù phần lớn các sự cố hiện chưa gây thiệt hại lớn, xu hướng gia tăng của các hành vi lệch chuẩn cho thấy thách thức quản trị AI đang trở nên cấp bách hơn bao giờ hết, đặc biệt khi công nghệ này ngày càng được ứng dụng rộng rãi trong nhiều lĩnh vực kinh tế và đời sống.