AI에이전트
Claude Code, 첫 마디 꺼내기도 전에 토큰 3만 3천 개를 씁니다
Claude Code가 OpenCode보다 최대 4.7배 많은 토큰을 쓴다는 실측 비교. 시스템 프롬프트, 캐시 쓰기, 서브에이전트 구조까지 원인을 파헤칩니다.
Written by

AI 에이전트가 매번 처음부터 시작하는 이유, 정보가 아니라 재사용의 문제였다
AI 에이전트가 매번 처음부터 시작하는 진짜 원인은 정보 부족이 아니라 재사용 실패. 4종류 메모리와 이를 판단하는 의사결정 트리를 다룹니다.
Written by

코딩 에이전트 코덱스, 문서·시트 업무로 넘어왔다
OpenAI가 공개한 ChatGPT Work는 앱과 파일을 넘나들며 몇 시간짜리 프로젝트를 스스로 진행하는 에이전트입니다. 코딩 전용이던 Codex가 업무 전반으로 확장되는 흐름을 짚어봅니다.
Written by

AI가 짠 코드는 “돌아간다”와 “맞다”가 다르다
AI가 짠 데이터 파이프라인은 실행돼도 조용히 틀릴 수 있습니다. 결과를 미리 정한 계약에 대해 검증하는 방법을 소개합니다.
Written by

Claude Cowork, 코딩보다 보고서 쓰기에 4배 더 쓰인다
Anthropic이 120만 개 Cowork 세션을 분석한 결과, 코딩보다 업무 보고서·슬라이드 작업에 4배 가까이 더 쓰이고 있었습니다.
Written by

Claude Code 점수가 동료 컴퓨터에서 다르게 나오는 이유
같은 에이전트 eval도 동료 컴퓨터에서는 다른 점수가 나옵니다. 원인은 모델이 아니라 OS, 폴더 이름, 언어 서버 같은 숨은 변수입니다.
Written by

에이전트 위해 CLI를 JSON으로 바꾸면, 비용이 11배 뛴다
에이전트용 CLI를 JSON으로 바꾸면 더 잘 다룰 거라는 조언, Microsoft가 실측하니 비용만 최대 11배 뛰었습니다.
Written by

Claude Code의 모델과 effort, 다른 걸 조절하고 있었다
Claude Code의 모델 설정과 effort 레벨은 서로 다른 걸 조절합니다. 모델은 무엇을 아는지, effort는 얼마나 확인하는지를 정합니다.
Written by

해커 없이 DB를 지운 AI 에이전트, 왜 이런 사고가 날까
공격자 없이도 데이터를 삭제하는 AI 에이전트 사고 사례와, 그 위험을 사전에 감지하기 어려운 이유를 다룬 Zenity Labs 연구를 소개합니다.
Written by

구글의 사내용 포맷 OKF, 내 웹사이트에도 통했다
구글이 사내용으로 만든 Open Knowledge Format을 개인 웹사이트에 적용해본 실험기. AI 에이전트가 읽는 웹사이트의 미래 방향을 제시합니다.
Written by
