코딩에이전트
AI 코딩 에이전트를 잘 쓰려면 코딩 실력이 필요한데, AI가 그 실력을 갉아먹는다
AI 코딩 에이전트를 잘 감독하려면 코딩 실력이 필요하지만, AI를 많이 쓸수록 그 실력이 퇴화한다는 역설. Anthropic 연구 포함 실증적 근거를 짚습니다.
Written by

AI 코딩 에이전트, 이제 목표까지 알아서 달린다, Codex CLI /goal 기능
OpenAI Codex CLI 0.128.0에 /goal 기능 추가. 목표를 설정하면 에이전트가 달성 여부를 스스로 판단하며 루프를 반복하는 자율 실행 구조를 소개합니다.
Written by

AI 에이전트가 토큰을 낭비하는 이유, 코드로 생각하게 만드는 해법
AI 에이전트가 파일을 읽을수록 컨텍스트가 망가지는 구조적 이유와, Cloudflare와 독립 개발자가 각자 도달한 같은 해법을 소개합니다.
Written by

Codex 에이전트 자동 오케스트레이션, OpenAI Symphony가 바꾸는 개발 방식
OpenAI가 공개한 오픈소스 오케스트레이션 스펙 Symphony. Codex 에이전트를 이슈 트래커와 연결해 자율적으로 작업을 처리하는 방식을 소개합니다.
Written by

Claude Code 소스코드를 뜯어봤더니, 아키텍처에서 발견한 5가지 설계 원칙
Claude Code TypeScript 소스코드를 직접 분석한 논문에서 드러난 5가지 설계 원칙. Anthropic이 공개하지 않은 에이전트 내부 구조를 해부합니다.
Written by

21GB로 코딩 에이전트 상위권, Qwen3.6-35B-A3B 오픈소스 공개
알리바바 Qwen 팀이 공개한 Qwen3.6-35B-A3B, MoE 구조로 21GB로 압축해 노트북에서 실행 가능하면서 코딩 에이전트 상위권 성능을 냅니다.
Written by

Claude Code 요금 5배 인상 시도, 수 시간 만에 번복된 이유
Anthropic이 Claude Code를 Pro 플랜에서 조용히 제외했다가 수 시간 만에 번복한 사건. 가격 변경보다 커뮤니케이션 방식이 남긴 신뢰 문제를 짚습니다.
Written by

같은 모델로 Top 30에서 Top 5로, 하네스 엔지니어링이 바꾸는 것
같은 Claude 모델로 하네스만 바꿔 Terminal Bench Top 30→Top 5를 달성한 사례. AI 에이전트 성능의 진짜 변수는 모델이 아니라 하네스임을 설명합니다.
Written by

Claude Code vs Pi, 같은 작업에서 토큰 사용이 10배 차이 나는 이유
Claude Code와 Pi를 같은 작업으로 비교했더니 토큰 소비가 10배 차이. 에이전트가 자기 자신에게 쓰는 하네스 세금 개념을 설명합니다.
Written by

코드만 읽는 에이전트가 놓친 것, 논문을 읽은 에이전트가 찾아냈다
에이전트가 코드만 보고 실험하면 왜 얕은 결과가 나오는지, 논문과 경쟁 프로젝트를 먼저 읽게 했을 때 어떤 최적화가 가능한지 SkyPilot의 실험 사례로 소개합니다.
Written by
