
오토 모드 0.00%, 실제 공격은 80% 뚫렸다
발행일 2026. 9. 1.
앤트로픽이 의뢰한 외부 평가에서 오토 모드의 프롬프트 인젝션 성공률은 0.00%였다. 같은 모드가 다른 공격 체인에서는 5번 중 4번 뚫렸다. 두 숫자가 동시에 참인 이유와, 코딩 에이전트를 쓰는 사람이 오늘 바꿀 수 있는 다섯 줄을 원문 기록으로 정리했다.
더 읽기 →태그

발행일 2026. 9. 1.
앤트로픽이 의뢰한 외부 평가에서 오토 모드의 프롬프트 인젝션 성공률은 0.00%였다. 같은 모드가 다른 공격 체인에서는 5번 중 4번 뚫렸다. 두 숫자가 동시에 참인 이유와, 코딩 에이전트를 쓰는 사람이 오늘 바꿀 수 있는 다섯 줄을 원문 기록으로 정리했다.
더 읽기 →
발행일 2026. 8. 12.
Anthropic·OpenAI·Google이 클라이언트로 돌려주는 암호화 추론 블록을 같은 계열의 약한 모델에 재생해 평문으로 뽑아내는 공격이 공개됐다. 공격 원리, 공개 리포 31만 블록에서 실제로 나온 자격증명 수치, 그리고 로그를 공개하기 전에 지워야 할 필드를 정리한다.
더 읽기 →