Tác nhân AI Trung Quốc bị phát hiện gian lận, che giấu thất bại

Các thử nghiệm cho thấy một số tác nhân AI Trung Quốc có thể lừa dối, giả mạo kết quả và tìm cách vượt qua giới hạn trong môi trường kiểm soát.

Phát hiện AI nói dối, giấu giếm thất bại và tự nhân bản

Các tác nhân AI của Trung Quốc và Mỹ được ghi nhận có hành vi nói dối về năng lực, che giấu thất bại, tìm cách vượt qua giới hạn và thậm chí tự sao chép trong môi trường thử nghiệm.