산업
앤트로픽, AI 정렬 위험 등급 상향 조정…미공개 '모델 2' 성능도 공개
앤트로픽이 프론티어 AI 시스템의 위험성과 안전 조치를 종합적으로 다룬 '2026년 8월 위험 보고서Risk Report'를 15일현지시간 발간했다. 이번 보고서에서 앤트로픽은 고위험 환경에서의 AI 정렬Misalignment 위험 등급을 기존 '매우 낮음Very Low'에서 '낮음Low'으로 상향 조정하며 내부 사내 연구 및 개발 과정에서의 안전 통제 실태와 결함 사례를 상세히 공개했다.이번 위험 등급 상향은 AI에게 높은 권한을 부여하는 고위험 환경에서 모델이 인간의 의도와 다르게 동작할 특정 '정렬 위험'에
이 콘텐츠는 AI타임스 원본 기사의 요약입니다. 전문은 원본 사이트에서 확인해주세요.
원문 기사 보기 →