AI 모델 격차는 사라졌는데.. 승부는 다른 데서 갈렸다
오픈-폐쇄 모델 성능 격차는 좁혀졌는데, 진짜 승부는 하네스와 벤더 이탈 가능성에서 갈리고 있다는 Mozilla 리포트 분석입니다.
Written by
설계는 비싼 모델, 실행은 저렴한 모델, 이 조합이 통하지 않는 이유
비싼 모델이 설계하고 저렴한 모델이 실행하면 비용이 줄 것 같지만 실제론 반대입니다. 에이전트 비용의 91%는 읽기에서 나옵니다.
Written by
에이전트가 침투하고 에이전트가 막았다, 허깅페이스 해킹의 전말
자율 AI 에이전트가 허깅페이스 인프라를 침투한 사고 전말. 정작 분석은 프론티어 모델 가드레일에 막혀 중국 오픈모델로 대응했습니다.
Written by
중국 오픈모델이 공짜라는 착각, 진짜 비용은 따로 있다
중국 오픈모델 Kimi K3와 Qwen 3.8이 촉발한 공포를 경제학적으로 분석합니다. 진짜 비용은 서빙 원가에 있고, 유일한 실제 위협은 사이버보안입니다.
Written by
에이전트에게 준 스펙도 유효기간이 있다, 오래 쌓아두면 오히려 헷갈린다
AI 에이전트에게 스펙을 얼마나 줘야 하는지의 균형점과, 오래된 설계 문서를 쌓아두면 오히려 혼란을 준다는 O’Reilly의 분석을 다룹니다.
Written by
MS 해커톤에서 검증된 AI 에이전트 병렬 작업법, 핵심은 Git 워크트리
Git 워크트리로 AI 에이전트를 병렬로 운영하며 개발자의 역할이 코드 작성에서 감독으로 바뀐 MS 해커톤 사례를 다룹니다.
Written by
AI 탐지기, 문체를 흉내 내자 글 5개 중 1개를 놓쳤다
AI 텍스트 탐지기가 평범한 AI 글은 거의 잡아내지만, 특정 작가의 문체를 흉내 낸 글은 최대 5개 중 1개꼴로 놓친다는 Epoch AI 연구를 다룹니다.
Written by
생산성은 오르고 만족감은 사라지는 이유, 개발자의 보상 회로가 문제였다
AI로 코딩할수록 생산성은 오르지만 만족감은 사라지는 이유를 “인간 보상 함수 문제”라는 개념으로 짚은 Pydantic 팀원의 에세이를 다룹니다.
Written by
Claude Code의 런타임 Bun, 아무도 모르게 Rust로 재작성됐다
Claude Code의 런타임 Bun이 Rust로 조용히 재작성된 사실과, 그 재작성을 Claude Fable 5가 상당 부분 맡았다는 사실을 다룹니다.
Written by
Kimi K3, 프론트엔드 코드는 1위인데 어려운 수학은 39점
Kimi K3가 프론트엔드 코드 벤치마크는 1위, 고난도 수학은 39점에 그친 이유와 벤치마크 순위가 알려주지 않는 것을 다룹니다.
Written by









