코딩에이전트
Qwen이 Opus급이라는 말의 진실, 직접 굴려본 창업자의 현실 보고서
1만 5천 달러 GPU로 로컬 Qwen을 1년 넘게 운영한 창업자의 실전 후기. 벤치마크 점수와 실제 신뢰도의 차이, 그리고 로컬 모델이 진짜 빛나는 용도를 짚습니다.
Written by

엔지니어 99%가 매일 AI를 쓰는 회사에서 벌어진 일, 스포티파이가 본 진짜 병목
엔지니어 99%가 AI 코딩 도구를 쓰는 스포티파이에서 병목이 코딩에서 의사결정으로 옮겨간 이야기. 백그라운드 에이전트 Honk와 ‘에이전트를 위한 개발자 경험’을 소개합니다.
Written by

API 키 한 줄만 바꾸면 90% 싸진다는데, 그 차액은 누가 채우고 있을까
90% 싸게 AI API를 쓸 수 있다는 중계 서비스의 이면, 모델 바꿔치기와 코드 주입 위험을 실증한 두 연구 결과를 소개합니다.
Written by

프롬프트로 다 안 됩니다, AI 에이전트를 길들이는 두 가지 현실 감각
프롬프트로 AI 에이전트를 통제하려는 시도의 한계를 짚은 두 개발자의 글. 반드시 지킬 요구사항은 시스템이 검증하게 옮기고, 검증 없는 인기 Skill은 경계하라는 메시지를 다룹니다.
Written by

LLM 컨텍스트 창의 숨겨진 함정, 100k 토큰 넘으면 에이전트가 멍청해진다
LLM의 실제 유효 컨텍스트는 광고 수치와 다르다는 Context Rot 연구와 개발자 경험. 코딩 에이전트 세션이 길어질수록 성능이 떨어지는 이유와 컨텍스트를 예산처럼 관리하는 접근법을 소개합니다.
Written by

루프 엔지니어링이란 무엇인가, Codex·Claude Code가 공유하는 5가지 구조
프롬프트를 직접 입력하던 방식에서 에이전트를 자동으로 구동하는 루프를 설계하는 방식으로. 루프 엔지니어링의 5가지 구성요소를 Codex·Claude Code 비교로 정리합니다.
Written by

Claude Code 실제로 쓰는 연구자는 20%, 사회과학자 1260명 조사 결과
사회과학자 1,260명 대상 조사 결과. AI 챗봇 사용률 81%지만 코딩 에이전트까지 쓰는 연구자는 20%에 불과. 성별·기관 서열에 따른 격차도 분석합니다.
Written by

Uber, AI 코딩 툴 월 $1,500으로 제한, 그 안에 숨은 의미
Uber가 Claude Code 등 AI 코딩 툴 사용량을 월 $1,500으로 제한했습니다. 단순 비용 통제가 아닌, 기업이 AI 툴의 가치를 공식 인정하기 시작했다는 신호로 읽을 수 있습니다.
Written by

Anthropic 첫 분기 흑자 임박, 코딩 에이전트가 만든 수익 구조의 변화
Anthropic 첫 흑자 분기 임박. 엔터프라이즈 요금제를 API 단가로 전환하고 코딩 에이전트로 수익 구조를 바꾼 배경을 분석합니다.
Written by

코딩 에이전트, 논문으로 확인된 구조적 한계
코딩 에이전트는 구조적 제약이 쌓일수록 성능이 급격히 떨어집니다. George Hotz의 6개월 실험과 Constraint Decay 논문이 말하는 에이전트의 실제 한계.
Written by
