AI보안
GPT·Claude API를 90% 싸게 쓸 수 있다는 말, 그 할인은 어디서 오는가
90% 저렴한 GPT·Claude API 프록시의 실체. 모델 스와핑과 계정 어뷰징으로 만든 할인이 코딩 에이전트에 연결될 때 왜 특히 위험한지 다룹니다.
Written by

추론모델의 오버씽킹, 공격 수단이 될 수 있다는 연구가 나왔다
논리적으로 모순된 프롬프트가 추론모델을 오버씽킹에 빠뜨려 답변을 26배까지 늘릴 수 있다는 연구가 ICML 2026에서 발표됐습니다.
Written by

Claude Code에 숨어 있던 코드, 알리바바가 사용 금지로 답했다
Claude Code에 숨겨졌던 국적 판별 코드 논란과 알리바바의 자체 사용 금지 결정을 통해 AI 도구 접근 제한을 둘러싼 복잡한 이해관계를 짚어봅니다.
Written by

프롬프트 인젝션 6000번 공격, AI 에이전트가 다 막아낸 실험
2,000명이 6,000번 공격했지만 비밀은 새지 않았다. Claude Opus 4.6 기반 AI 비서를 대상으로 한 프롬프트 인젝션 실험과, 개인 사용자가 읽어야 할 의미를 짚습니다.
Written by

Gemini 3.5 Flash가 화면을 직접 조작한다, 에이전트의 새 능력과 프롬프트 인젝션이라는 대가
Gemini 3.5 Flash가 화면을 직접 보고 조작하는 컴퓨터 사용 기능을 내장 도구로 통합했습니다. 에이전트의 새 능력과 그 대가로 따라오는 프롬프트 인젝션 리스크, 안전장치가 opt-in인 이유를 짚습니다.
Written by

멋진 에이전트 아키텍처가 답하지 못하는 질문, “이건 누가 책임지죠?”
멋진 에이전트 아키텍처가 정작 “누가 책임지는가”에 답하지 못하는 principal drift 현상. 환불 에이전트 사례로 신원·권한·책임이 무너지는 과정과 개인이 직접 해볼 수 있는 진단법을 소개합니다.
Written by

AI가 구글에서 50만 달러어치 취약점을 찾았다, 비결은 똑똑함이 아니었다
보안 연구자가 AI에게 구글 API 수천 개를 자동 점검시켜 50만 달러 버그 바운티를 받은 사례. AI가 효과적이었던 진짜 이유는 똑똑함이 아니라 지치지 않는 규모였습니다.
Written by

OpenAI Patch the Planet, 23년 묵은 버그도 잡아낸 AI 보안 실험
AI가 취약점 발견을 폭증시키면서 병목이 ‘고치기’로 옮겨갔습니다. OpenAI가 Trail of Bits와 함께 오픈소스 유지보수자를 돕는 Patch the Planet과 23년 묵은 버그 발견 사례를 소개합니다.
Written by

Reddit 댓글 13단어로 AI 검색 답변을 바꾼다, 코넬 연구가 밝힌 취약점
Reddit 댓글에 13단어만 붙이면 ChatGPT·구글 AI 검색 답변을 조작할 수 있다는 코넬 테크 연구. AI 검색의 구조적 취약점 WARP 공격을 소개합니다.
Written by

ChatGPT 록다운 모드, 프롬프트 인젝션 데이터 유출을 시스템으로 막는 방법
OpenAI가 출시한 ChatGPT 록다운 모드 분석. 프롬프트 인젝션 데이터 유출을 AI 판단이 아닌 시스템 레벨에서 차단하는 방식과 그 한계를 설명합니다.
Written by
