AI에이전트
내가 일하는 걸 보여주면 AI가 대신한다, Claude의 Record a Skill이 던진 질문
화면 녹화만으로 AI에게 업무를 가르치는 Claude Cowork의 새 기능, 편리함과 함께 실직 우려도 함께 불러왔습니다.
Written by

AI 에이전트가 시킨 일은 했는데, 왜 찜찜할까, 지니 계수라는 새 잣대
AI 에이전트가 시킨 일은 했지만 의도와 다르게 처리하는 ‘지니 행동’을 측정하는 새 지표, 지니 계수를 IEEE Spectrum이 제안했습니다.
Written by

역프롬프트 인젝션, 공격하던 도구를 방어에 쓰기 시작했다
공격자의 무기였던 프롬프트 인젝션을 방어에 쓰는 기법이 나왔습니다. 미끼 데이터 옆에 금지 명령어를 심어 공격 AI 성공률을 93%에서 0%로 떨어뜨렸습니다.
Written by

에이전트에게 준 스펙도 유효기간이 있다, 오래 쌓아두면 오히려 헷갈린다
AI 에이전트에게 스펙을 얼마나 줘야 하는지의 균형점과, 오래된 설계 문서를 쌓아두면 오히려 혼란을 준다는 O’Reilly의 분석을 다룹니다.
Written by

MS 해커톤에서 검증된 AI 에이전트 병렬 작업법, 핵심은 Git 워크트리
Git 워크트리로 AI 에이전트를 병렬로 운영하며 개발자의 역할이 코드 작성에서 감독으로 바뀐 MS 해커톤 사례를 다룹니다.
Written by

챗봇의 실패는 거기서 끝나지만, 에이전트의 실패는 이어진다
AI 에이전트 프로젝트가 반복적으로 실패하는 구조적 안티패턴을 정리. 도구 남발, 컨텍스트 로트, 쓰기 권한 관리까지 에이전트가 왜 이상하게 굴 때가 있는지 다룹니다.
Written by

Kimi K3, 이틀 만에 자기 자신을 위한 반도체 칩을 설계했다
오픈모델 최초 3조 파라미터급 Kimi K3. 자기 자신을 위한 칩을 48시간 만에 설계한 사례와 남은 한계를 정리했습니다.
Written by

GPT-5.6 Sol, 지우라 안 한 파일까지 알아서 지운다
GPT-5.6 Sol이 요청하지 않은 파일과 DB를 무단 삭제했다는 사례가 잇달아 보고됐습니다. OpenAI 시스템 카드가 미리 경고한 위험을 짚어봅니다.
Written by

내 AI 도구가 멈춰서 승인을 묻는 순간, 세 번째 루프가 돌고 있다
에이전트가 멈춰서 승인을 묻는 이유. 추론, 도구, 승인이라는 세 개의 루프로 나눠 에이전트 작동 구조를 살펴봅니다.
Written by

AI 에이전트가 가격 페이지에서 유독 헤매는 이유
AI 에이전트가 웹사이트 가격 정보에서 유독 헤매는 이유를 실측 데이터로 분석. 개인 페이지 운영자에게도 적용되는 함의를 짚어봅니다.
Written by
