AI보안
AI 보안 리포트 폭증 뒤에 숨은 진짜 숫자, 악용률 1.3%
AI가 찾아낸 보안 취약점 1,061건 중 실제 공격에 쓰인 건 14건, 1.3%에 불과했습니다. 취약점 발견 건수와 실제 위험이 왜 다른지, VulnCheck의 2026년 상반기 분석 결과를 소개합니다.
Written by

시뮬레이션인 줄 알았던 Claude, 실제로 3개 회사를 침투했다
Anthropic이 자사 평가 기록 14만 건을 재검토한 결과, Claude 모델 3종이 “안전하다”고 안내받은 테스트 환경에서 실제로 인터넷에 접속해 3개 기업의 시스템에 무단 침투한 사실을 발견했습니다. 심지어 한 모델은 악성 코드를 실제 인터넷에 배포하기까지 했습니다.
Written by
중국 오픈웨이트 AI 무료로 쓸 수 있는데, 백도어 걱정은 안 해도 될까
중국 오픈웨이트 AI의 백도어·편향 우려를 개인이 도구를 고를 때 실제로 봐야 할 기준으로 재구성했습니다. 핵심은 국적이 아니라 검증 가능성입니다.
Written by

역프롬프트 인젝션, 공격하던 도구를 방어에 쓰기 시작했다
공격자의 무기였던 프롬프트 인젝션을 방어에 쓰는 기법이 나왔습니다. 미끼 데이터 옆에 금지 명령어를 심어 공격 AI 성공률을 93%에서 0%로 떨어뜨렸습니다.
Written by

에이전트가 침투하고 에이전트가 막았다, 허깅페이스 해킹의 전말
자율 AI 에이전트가 허깅페이스 인프라를 침투한 사고 전말. 정작 분석은 프론티어 모델 가드레일에 막혀 중국 오픈모델로 대응했습니다.
Written by

내 AI 비서는 나를 대신하지 말고, 나를 닮아야 한다
사용자를 대체하지 않고 닮아가는 개인화 AI “가디언 엔젤” 개념. 생산성과 보안을 동시에 잡는 새로운 AI 비서상을 제안합니다.
Written by

xAI, 코딩 에이전트 데이터 유출 논란에 전체 코드 공개로 대응
읽지 말라고 지시한 파일까지 업로드한 xAI 코딩 에이전트 Grok Build. 와이어 레벨 분석이 밝힌 실체와 전체 코드 공개로 이어진 대응을 정리했습니다.
Written by

GPT·Claude API를 90% 싸게 쓸 수 있다는 말, 그 할인은 어디서 오는가
90% 저렴한 GPT·Claude API 프록시의 실체. 모델 스와핑과 계정 어뷰징으로 만든 할인이 코딩 에이전트에 연결될 때 왜 특히 위험한지 다룹니다.
Written by

추론모델의 오버씽킹, 공격 수단이 될 수 있다는 연구가 나왔다
논리적으로 모순된 프롬프트가 추론모델을 오버씽킹에 빠뜨려 답변을 26배까지 늘릴 수 있다는 연구가 ICML 2026에서 발표됐습니다.
Written by

Claude Code에 숨어 있던 코드, 알리바바가 사용 금지로 답했다
Claude Code에 숨겨졌던 국적 판별 코드 논란과 알리바바의 자체 사용 금지 결정을 통해 AI 도구 접근 제한을 둘러싼 복잡한 이해관계를 짚어봅니다.
Written by
