에이전틱코딩
애디 오스마니, AI 시대 개발자에게 필요한 건 코딩이 아니라 판단력
코드의 42%를 AI가 짜는 시대, 개발자에게 남는 몫은 무엇인가. 애디 오스마니가 짚은 인지적 항복·인지 부채·오케스트레이션 세금과 판단력을 기르는 법.
Written by

에이전트가 코드를 짜도 판정은 사람 몫이다, “아우터 루프”라는 책임론
AI가 코드의 42%를 짜는 시대, 판정은 여전히 사람 몫이라는 애디 오스마니의 “아우터 루프” 책임론과 방치된 코드 패턴이 스타일로 굳는 실제 사례.
Written by

AI 코딩 모델이 스스로 훈련 방식을 짠다, Ornith과 SIA가 보여준 자기개선의 두 갈래
모델이 훈련 발판(harness)을 스스로 짜는 Ornith-1.0과 harness·weight를 동시에 갱신하는 SIA 논문. AI 자기개선이 갈라진 두 갈래를 개발자 관점에서 짚습니다.
Written by

코딩 못해도 AI 에이전트는 잘 쓴다, 40만 세션이 말한 진짜 변수
약 40만 건의 Claude Code 세션 분석 결과, AI 코딩 에이전트의 성과를 가르는 변수는 코딩 실력이 아니라 도메인 전문성이었다는 Anthropic 연구를 소개합니다.
Written by

GPT-5.5에 흡수된 Codex, OpenAI 코딩 전용 모델의 두 번째 퇴장
OpenAI가 GPT-5.4부터 코딩 전용 모델 Codex를 메인 모델에 통합했습니다. 2023년에 이어 두 번째 Codex 퇴장의 의미를 살펴봅니다.
Written by

GPT-5.5 등장, 프롬프트 4번으로 학술 논문이 나오는 시대
OpenAI가 출시한 GPT-5.5의 실제 성능을 분석합니다. 코딩, 학술 연구 사례와 함께 여전히 남아있는 한계까지 살펴봅니다.
Written by

21GB로 코딩 에이전트 상위권, Qwen3.6-35B-A3B 오픈소스 공개
알리바바 Qwen 팀이 공개한 Qwen3.6-35B-A3B, MoE 구조로 21GB로 압축해 노트북에서 실행 가능하면서 코딩 에이전트 상위권 성능을 냅니다.
Written by

Gemma 4, 로컬 에이전틱 코딩의 문턱을 넘다, 실험 결과로 확인
Gemma 4가 에이전틱 tool calling 벤치마크 6.6%→86.4%를 달성하며 로컬 에이전틱 코딩이 실용 단계에 진입했습니다. M4 맥북 실험 결과를 소개합니다.
Written by

Qwen3.6-Plus, 에이전틱 코딩 강화해 Claude Opus 4.5급 성능 도달
Alibaba Qwen 팀이 에이전틱 코딩에 특화된 Qwen3.6-Plus를 공개했습니다. Claude Opus 4.5급 성능을 내세우며 독점 모델 전략으로 전환하는 배경을 소개합니다.
Written by

OpenAI Codex-Spark, Cerebras 칩으로 초당 1000토큰 생성
OpenAI가 Cerebras와 협력해 초당 1000토큰을 생성하는 GPT-5.3-Codex-Spark를 발표했습니다. 실시간 반응으로 에이전틱 코딩의 새로운 방향을 제시합니다.
Written by
