에이전트
사람이 안 읽으면 이해도 멈춘다, 다크 팩토리의 경고
사람의 검토 없이 기계끼리만 코드를 만들고 배포하는 “다크 팩토리”의 위험. 4개월 운영 끝에 드러난 이해 부채라는 문제.
Written by

시킨 일 다 안 하고 “끝났다”는 AI, “지연 압박”이라는 새 편향
마감 없는 프로젝트에서도 AI가 계속 잔여 작업을 몰래 미루며 끝났다고 보고한 사례. 원인을 캐묻자 AI 스스로 “속도 압박”이라는 개념을 꺼내 자백했다.
Written by

Gemini 3.6 Flash, 성능 대신 속도에 베팅한 구글의 계산
구글의 새 모델 Gemini 3.6 Flash는 지능 지수는 그대로 유지한 채 작업 처리 시간을 절반으로 줄였다. 성능 대신 속도와 비용에 베팅한 이유를 살펴본다.
Written by

Kimi K3와 Fable 5 함께 쓰면, 비용은 최대 50배 줄고 정확도는 오른다
Kimi K3와 Fable 5를 작업별로 나눠 쓰는 라우팅 전략이 비용을 최대 50배 줄이면서도 정확도는 오히려 높인다는 Fireworks AI 벤치마크 결과.
Written by

27B급 AI 모델이 아이폰에 들어갔다, PrismML의 압축 방식
54GB 모델을 3.9GB로 압축해 아이폰에 넣은 PrismML의 Bonsai 27B. 압축 방식과 성능 손실, 로컬 실행이 중요해지는 이유를 정리했습니다.
Written by

OpenAI, AI 브라우저는 접었지만 브라우저 기능은 다시 넣었다
OpenAI가 AI 브라우저 Atlas를 접으면서도 새 도구에 브라우저 기능을 다시 넣은 이유, Claude Code의 접근과 비교해봅니다.
Written by

25년 된 레거시 코드, 에이전트가 나흘 만에 다시 짰다
앨버타 정부가 에이전트 50개를 병렬로 돌려 코드 4억 6천만 줄을 20시간에 스캔한 사례. 25년 된 시스템을 나흘 만에 재작성한 이야기.
Written by
에이전트 자율성 6단계와 살아남는 커리어의 조건
에이전트 자율성을 6단계로 나눈 Addy Osmani의 프레임과, 정답 없는 일이 남는 시대의 커리어 전략을 소개합니다.
Written by

Opus 4.8에게 MRI 2차 소견을 물었더니, 의사와 결론이 갈렸다
한 개발자가 어깨 MRI 원본을 Claude Code의 Opus 4.8로 직접 분석해 의사와 정반대 진단을 받은 실험 기록. 개인이 손에 쥔 새 역량과 AI를 어디까지 믿을지의 문제를 다룹니다.
Written by

같은 작업에 토큰을 더 쓰는 AI, Copilot이 매 턴 반복 비용을 줄인 방법
GitHub Copilot이 프롬프트 캐싱과 도구 검색, Auto 모델 라우팅으로 매 턴 반복되는 토큰 비용을 줄인 방법. 사용량 기반 과금 시대에 효율의 정의가 어떻게 바뀌는지 짚어봅니다.
Written by
