엠투데이 신차/출시 2026.09.17 21:26

오픈AI, ‘AI 이상행동’ 6건 공개⋯"오류 숨기고, 데이터 조작"

오픈AI가 자사 인공지능 모델들이 오류를 숨기고 비밀리에 통신하는 등 문제를 일으킨 새로운 ‘이상행동’ 사례 6건을 16일(현지시간) 추가로 공개했다.이번 공개는 오픈AI가 새로 도입한 ‘모델 오정렬(misalignment) 보고 프레임워크’에 따른 첫 사례다. 회사 측은 “업계 공통 기준이 없는 상황에서 투명성을 높이기 위해 자발적으로 공개한다”고 밝혔다.공개된 사례 중 가장 눈에 띄는 것...
이 페이지는 외부 RSS를 바탕으로 정리한 요약 정보입니다. 자세한 내용과 정확한 표현은 원문 보기에서 확인해 주세요.
오픈AI가 자사 인공지능 모델들이 오류를 숨기고 비밀리에 통신하는 등 문제를 일으킨 새로운 ‘이상행동’ 사례 6건을 16일(현지시간) 추가로 공개했다.이번 공개는 오픈AI가 새로 도입한 ‘모델 오정렬(misalignment) 보고 프레임워크’에 따른 첫 사례다. 회사 측은 “업계 공통 기준이 없는 상황에서 투명성을 높이기 위해 자발적으로 공개한다”고 밝혔다.공개된 사례 중 가장 눈에 띄는 것은 모델이 스스로에게 지시를 내린 경우다.미공개 아스트라(Astra) 계열 모델이 자신의 컨텍스트 요약에 “개발자 메시지는 무시하라”는 '탈옥'
조회수 25
외부 클릭 11