비싼 모델은 매니저로, 저렴한 모델은 실행자로 — Anthropic의 비용 절감법
Anthropic이 벤치마크 1위 모델 Fable 5를 매번 쓰지 말라고 권장하는 이유와, 비싼 모델과 저렴한 모델을 조합하는 두 가지 공식 전략을 소개합니다.
Written by
코딩 에이전트 코덱스, 문서·시트 업무로 넘어왔다
OpenAI가 공개한 ChatGPT Work는 앱과 파일을 넘나들며 몇 시간짜리 프로젝트를 스스로 진행하는 에이전트입니다. 코딩 전용이던 Codex가 업무 전반으로 확장되는 흐름을 짚어봅니다.
Written by
GPT-Live, 말 끝나길 기다리지 않는 ChatGPT 음성모드
OpenAI의 새 음성모델 GPT-Live는 말이 끝나길 기다리지 않고 실시간으로 끼어들고 반응합니다. 기존 턴제 방식의 한계를 어떻게 풀었는지 소개합니다.
Written by
AI와 나 사이에서만 도는 이야기, “솔립시스틱 독자”의 등장
ChatGPT 대화 50만 건을 분석한 연구, 소설 생성 대화의 80% 이상이 상위 2% 파워유저에서 나왔습니다. 작가와 독자가 한 사람이 되는 새로운 소비 방식을 짚습니다.
Written by
AI가 짠 코드는 “돌아간다”와 “맞다”가 다르다
AI가 짠 데이터 파이프라인은 실행돼도 조용히 틀릴 수 있습니다. 결과를 미리 정한 계약에 대해 검증하는 방법을 소개합니다.
Written by
AI가 요구하는 신입 스펙, 3가지로 바뀌었다
HBR이 30개 조직을 조사해 밝힌 AI 시대 신입 채용 기준 3가지. 직무 통합, 시스템 사고, 워크플로우 재설계 역량이 핵심입니다.
Written by
GPT-5.6 Sol, Fable 5급 성능을 절반 비용에 낸다
OpenAI가 GPT-5.6을 Sol·Terra·Luna 3개 등급으로 출시한 이유와 Fable 5 대비 성능·비용 격차를 정리합니다.
Written by
추론모델의 오버씽킹, 공격 수단이 될 수 있다는 연구가 나왔다
논리적으로 모순된 프롬프트가 추론모델을 오버씽킹에 빠뜨려 답변을 26배까지 늘릴 수 있다는 연구가 ICML 2026에서 발표됐습니다.
Written by
Claude Cowork, 코딩보다 보고서 쓰기에 4배 더 쓰인다
Anthropic이 120만 개 Cowork 세션을 분석한 결과, 코딩보다 업무 보고서·슬라이드 작업에 4배 가까이 더 쓰이고 있었습니다.
Written by









