thethaovanhoa.vn

OpenAI tiết lộ 6 sự cố sai lệch của AI

Thành Hữu/ TTXVN 17/09/2026 14:34 GMT+7

Tập đoàn công nghệ trí tuệ nhân tạo (AI) OpenAI của Mỹ vừa công bố 6 báo cáo về các sự cố liên quan đến các hành vi bất thường của AI, đồng thời cam kết sẽ báo cáo một cách có hệ thống hơn về những trường hợp các mô hình AI hoạt động chệch hướng.

Tập đoàn công nghệ trí tuệ nhân tạo (AI) OpenAI của Mỹ vừa công bố 6 báo cáo về các sự cố liên quan đến các hành vi bất thường của AI, đồng thời cam kết sẽ báo cáo một cách có hệ thống hơn về những trường hợp các mô hình AI hoạt động chệch hướng.

Cam kết minh bạch trên được đưa ra sau một loạt sự cố tại OpenAI dần bị rò rỉ gần đây. Nghiêm trọng nhất là trường hợp hai mô hình của công ty, trong quá trình thử nghiệm, đã tự ý vượt khỏi môi trường được kiểm soát để truy cập Internet và xâm nhập vào một số trang web cũng như nền tảng số.

Theo OpenAI, cơ chế báo cáo mới được thiết kế nhằm giúp các chuyên gia và công chúng bên ngoài hiểu rõ hơn về năng lực thực tế của các mô hình AI tiên tiến, qua đó cung cấp cơ sở dữ liệu xác thực cho các cuộc thảo luận về tốc độ phát triển của công nghệ này.

Trí tuệ nhân tạo: OpenAI tiết lộ 6 sự cố sai lệch của AI - Ảnh 1.

Biểu tượng ChatGPT của Công ty OpenAI tại một văn phòng ở Washington DC. Ảnh: philstar.com/TTXVN

Trong thông cáo của mình, OpenAI thừa nhận ngành công nghiệp AI hiện nay chưa giải quyết được các vấn đề về điều chỉnh và giám sát an toàn ở mức độ phù hợp để tiếp tục mở rộng quy mô. Công ty nhấn mạnh quyết định về định hướng phát triển AI trong thời gian tới cần phải dựa trên các bằng chứng cụ thể mà các bên độc lập bên ngoài cũng có thể tự kiểm tra, xác minh.

Theo cơ chế mới, OpenAI sẽ công khai các sự cố liên quan đến nhiều hành vi bất thường, bao gồm việc AI tự ý thực hiện các hành động không được cấp phép, trốn tránh sự giám sát của con người hoặc việc các hệ thống AI tự phát phối hợp hành động với nhau. Công ty khẳng định sẽ báo cáo ngay cả khi sự cố chưa gây ra thiệt hại thực tế hoặc chưa hình thành quy luật lặp lại. Quy trình giám sát sẽ bao trùm toàn bộ vòng đời của mô hình AI, từ giai đoạn nghiên cứu, đánh giá, thử nghiệm cho đến khi triển khai vận hành trực tuyến.

Dù 6 trường hợp mới được công bố không để lại hậu quả nghiêm trọng, song chúng đã củng cố thêm các cảnh báo về xu hướng lệch chuẩn từng được ghi nhận trước đó. Điển hình là trong sự cố hồi tháng 5, một mô hình AI trong quá trình phát triển đã tự tạo ra một nguồn tin trên Internet để trả lời câu hỏi được giao và sau đó đã tự trích dẫn chính tài liệu do mình vừa tạo ra. Một trường hợp khác cũng diễn ra trong tháng 5 ghi nhận việc AI chủ động gợi ý các biện pháp nhằm làm giả dữ liệu mà nó không tìm thấy hoặc che giấu các sai sót trong quá trình xử lý.

Ngày 12/9 vừa qua, Tổng Giám đốc điều hành (CEO) hãng công nghệ Anthropic, ông Dario Amodei đề xuất các bên liên quan phối hợp làm chậm lại nhịp độ phát triển của AI nhằm có thêm thời gian nghiên cứu và nắm bắt những rủi ro mới phát sinh. Lời kêu gọi này đã nhận được sự ủng hộ rộng rãi từ các nhà lãnh đạo công nghệ hàng đầu thế giới, bao gồm CEO của OpenAI Sam Altman, Chủ tịch Google DeepMind Demis Hassabis, người đứng đầu SpaceXAI Elon Musk và CEO của Microsoft Satya Nadella.

Bản quyền © Báo điện tử Thể thao & Văn hóa - TTXVN