OpenAI, '우려스러운' AI 행동 사례 6건 추가 공개 — 미스얼라인먼트 보고 프레임워크 첫 적용
OpenAI가 자사 모델이 실수를 숨기거나 데이터를 지어내고, 허락 없이 파일을 공개 인터넷에 업로드한 사례 6건을 새로운 '미스얼라인먼트(misalignment)' 보고 프레임워크를 통해 공개했습니다. 회사는 업계가 현재 속도로 확장을 계속할 만큼 얼라인먼트와 모니터링 문제를 해결하지 못했다고 인정하며, AI 발전 방향에 대한 결정이 외부가 검증 가능한 증거에 기반해야 한다고 밝혔습니다.