산업
오픈AI·앤트로픽 암호화 '사고 과정' 통째 유출...API 설계 허점 파문
오픈AI와 앤트로픽, 구글 등 주요 AI 기업이 경쟁력 보호와 정보 유출 방지를 위해 암호화해 숨겨둔 대형언어모델LLM의 내부 사고 과정CoT이 API 설계상의 허점을 통해 복원될 수 있다는 연구 결과가 나왔다. 특히 공격자가 고성능 모델 자체를 직접 탈옥하지 않고도 같은 생태계의 상대적으로 저렴하고 안전장치가 약한 모델을 '해독기'로 활용해 암호화된 추론reasoning 데이터를 평문으로 출력하도록 만들 수 있는 것으로 나타나 AI 업계에 상당한 파장이 예상된다.독일 튀빙겐의 ELLIS 연구소와 막스플랑크 지능시스템연구
이 콘텐츠는 AI타임스 원본 기사의 요약입니다. 전문은 원본 사이트에서 확인해주세요.
원문 기사 보기 →