AI의 암호화된 생각이 뚫렸습니다 — 앤스로픽·오픈AI·구글 공통, 약한 모델에게 읽히는 추론 흔적
8월 10일 공개된 논문이 세 회사의 암호화된 추론 블록을 같은 회사 약한 모델로 해독할 수 있다고 보고했습니다. 공개 저장소 블록 31만여 개에서 개인정보 367건과 자격증명 182건이 나왔습니다.
8월 10일 공개된 논문이 세 회사의 암호화된 추론 블록을 같은 회사 약한 모델로 해독할 수 있다고 보고했습니다. 공개 저장소 블록 31만여 개에서 개인정보 367건과 자격증명 182건이 나왔습니다.