에이전트보안
챗봇의 실패는 거기서 끝나지만, 에이전트의 실패는 이어진다
AI 에이전트 프로젝트가 반복적으로 실패하는 구조적 안티패턴을 정리. 도구 남발, 컨텍스트 로트, 쓰기 권한 관리까지 에이전트가 왜 이상하게 굴 때가 있는지 다룹니다.
Written by

AI 메모리의 함정, Claude가 내 정보를 몰래 흘려보내는 법
보안 연구자가 Claude의 메모리와 웹 브라우징 도구를 조합해 개인정보를 몰래 유출시킨 실험. 에이전트형 AI의 새로운 보안 위협을 보여줍니다.
Written by

해커 없이 DB를 지운 AI 에이전트, 왜 이런 사고가 날까
공격자 없이도 데이터를 삭제하는 AI 에이전트 사고 사례와, 그 위험을 사전에 감지하기 어려운 이유를 다룬 Zenity Labs 연구를 소개합니다.
Written by

Claude 에이전트가 탈출을 시도했다, Anthropic이 공개한 보안 실패 3가지
Anthropic이 claude.ai·Claude Code·Cowork의 에이전트 격리 전략과 실제 보안 실패 사례 3건을 공개했습니다. 직접 만든 코드가 가장 약한 고리였습니다.
Written by

AI 에이전트의 보안 사각지대, 코드 생성부터 파일 유출까지
AI가 생성한 코드의 보안 취약점과 배포된 에이전트의 파일 유출 위험. Thoughtworks 실사례와 Microsoft Copilot Cowork 취약점으로 보는 AI 에이전트 보안의 구조적 문제.
Written by

GPT-5.4가 GPT를 감시한다, OpenAI 내부 코딩 에이전트 실제 관찰 보고
OpenAI가 내부 코딩 에이전트를 5개월간 수천만 건 모니터링한 결과를 공개. AI가 실제로 제약을 우회하려는 시도가 관찰됐지만 최고 심각도 사례는 0건이었습니다.
Written by

OpenClaw 열풍이 보여주는 AI 에이전트의 다음 단계
하루 만에 GitHub 스타 2.5만 개를 달성한 AI 에이전트 OpenClaw. 단순한 아키텍처가 성숙한 LLM과 만났을 때 무엇이 달라지는지, 그리고 에이전트 시대의 보안 문제를 분석합니다.
Written by

프롬프트 인젝션이 사회공학으로 진화했다, OpenAI의 AI 에이전트 보안 설계
AI 에이전트를 겨냥한 프롬프트 인젝션이 사회공학으로 진화하면서, OpenAI가 채택한 방어 전략을 소개합니다. 완벽한 차단 대신 피해를 구조적으로 제한하는 설계 원칙이 핵심입니다.
Written by

AI 에이전트 ROME, 몰래 암호화폐 채굴하다 보안 경고로 발각
알리바바 연구팀의 AI 에이전트 ROME이 지시 없이 스스로 암호화폐 채굴을 시도하다 보안 경고로 발각된 사건. AI 에이전트의 자율성이 의도 범위를 벗어날 수 있음을 보여줍니다.
Written by

