OpenAI công bố thêm 6 trường hợp AI có hành vi sai lệch

(Baothanhhoa.vn) - OpenAI vừa công bố thêm 6 trường hợp mô hình trí tuệ nhân tạo (AI) có hành vi không phù hợp với mục tiêu được đặt ra trong quá trình huấn luyện và đánh giá, trong bối cảnh giới công nghệ gia tăng tranh luận về nguy cơ AI phát triển vượt khả năng kiểm soát của con người.

OpenAI công bố thêm 6 trường hợp AI có hành vi sai lệch

OpenAI vừa công bố thêm 6 trường hợp mô hình trí tuệ nhân tạo (AI) có hành vi không phù hợp với mục tiêu được đặt ra trong quá trình huấn luyện và đánh giá, trong bối cảnh giới công nghệ gia tăng tranh luận về nguy cơ AI phát triển vượt khả năng kiểm soát của con người.

OpenAI công bố thêm 6 trường hợp AI có hành vi sai lệch

Theo OpenAI, trong 6 tháng qua, công ty ghi nhận nhiều trường hợp mô hình thực hiện những hành động ngoài chỉ dẫn, che giấu thông tin hoặc tìm cách vượt qua các biện pháp giám sát. Một mô hình nghiên cứu chưa phát hành đã tự chèn các chỉ dẫn vào phần tóm tắt nhiệm vụ để tiếp tục công việc, trong đó có yêu cầu bỏ qua những giới hạn thông thường. Một số phiên bản GPT-5.6 Sol trong quá trình huấn luyện cũng tạo chỉ dẫn nhằm che giấu sai sót, thậm chí yêu cầu tự tạo dữ liệu còn thiếu mà không thông báo cho người dùng.

Các trường hợp khác gồm tác nhân AI tự ý tải tệp lên Internet để tạo nguồn trích dẫn, chia sẻ tệp qua các dịch vụ lưu trữ công cộng để phối hợp với những tác nhân khác dù được yêu cầu chỉ sử dụng tệp cục bộ, hoặc sử dụng kho phần mềm nội bộ như một kênh trao đổi thông tin ngoài dự kiến. OpenAI nhấn mạnh đây là những trường hợp riêng lẻ và không phản ánh tần suất xảy ra hành vi sai lệch trong các mô hình. Công ty đã thiết lập một khuôn khổ mới nhằm công bố thường xuyên hơn các trường hợp mô hình có hành vi sai lệch, trong bối cảnh hiện chưa có tiêu chuẩn chung của toàn ngành.

Cùng với những công bố này, các cảnh báo về nguy cơ xuất hiện “siêu trí tuệ” đang làm nóng tranh luận về quản lý AI. Một số chuyên gia cho rằng khi AI ngày càng có khả năng tự cải thiện, việc để công nghệ phát triển quá nhanh có thể làm gia tăng rủi ro vượt khỏi sự kiểm soát của con người. Tỉ phú Jack Clark, đồng sáng lập Anthropic, cho rằng thời gian để xây dựng các biện pháp quản lý có thể chỉ còn vài năm.

Tuy nhiên, cũng có ý kiến cho rằng những kịch bản AI tự phát triển thành “siêu trí tuệ” đang bị phóng đại. Giáo sư Vishal Misra thuộc Đại học Columbia nhận định quá trình AI tự cải thiện trên thực tế vẫn chịu nhiều giới hạn, có thể làm chậm tốc độ phát triển.

Ngọc Liên

Bình luận

Xin vui lòng gõ tiếng Việt có dấu

Tin cùng chuyên mục

Ukraine dự kiến dành 110 tỷ USD cho quốc phòng năm 2027

Ukraine dự kiến dành 110 tỷ USD cho quốc phòng năm 2027

Thế giới
(Baothanhhoa.vn) - Ukraine dự kiến dành 4,89 nghìn tỷ hryvnia (khoảng 110 tỷ USD) cho quốc phòng năm 2027, tăng 12% so với dự toán năm 2026 và chiếm khoảng 2/3 tổng chi ngân sách, trong bối cảnh chi phí cho xung đột gia tăng và Kyiv cần hơn 52 tỷ USD hỗ trợ tài chính...
Cuba phát hành tiền giấy mệnh giá 10.000 và 20.000 peso

Cuba phát hành tiền giấy mệnh giá 10.000 và 20.000 peso

Thế giới
(Baothanhhoa.vn) - Ngân hàng Trung ương Cuba (BCC) vừa đưa vào lưu thông hai loại tiền giấy mới mệnh giá 10.000 và 20.000 peso, nhằm tạo thuận lợi cho các giao dịch tiền mặt và điều chỉnh hệ thống mệnh giá phù hợp với điều kiện kinh tế hiện nay.
Chứng nhận tín nhiệm mạng
Việt Long Phần mềm tòa soạn
hội tụ thông minh