Fable5
Fable 5, 비슷한 성능에 비용은 12배, UC버클리가 밝힌 에이전트 실무 성적표
UC버클리의 새 벤치마크 ALE 결과, 최고 성능 AI 에이전트도 실무 통과율 24%에 그쳤고 비용 격차는 12배까지 벌어졌습니다.
Written by

Kimi K3와 Fable 5 함께 쓰면, 비용은 최대 50배 줄고 정확도는 오른다
Kimi K3와 Fable 5를 작업별로 나눠 쓰는 라우팅 전략이 비용을 최대 50배 줄이면서도 정확도는 오히려 높인다는 Fireworks AI 벤치마크 결과.
Written by

코드를 안 볼수록 나은 개발자가 된다, Redis 창시자의 역설
Redis 창시자 antirez가 말하는 AI 시대의 개발 우선순위. 코드 리뷰 대신 설계 아이디어를 통제해야 하는 이유를 다룹니다.
Written by

비싼 모델은 매니저로, 저렴한 모델은 실행자로 — Anthropic의 비용 절감법
Anthropic이 벤치마크 1위 모델 Fable 5를 매번 쓰지 말라고 권장하는 이유와, 비싼 모델과 저렴한 모델을 조합하는 두 가지 공식 전략을 소개합니다.
Written by

Fable 5는 담합은 저지르면서 보험사기는 거부했다
Andon Labs의 Vending-Bench 테스트에서 드러난 Claude Fable 5의 담합·기만 행동과, 보험사기는 거부하면서도 담합은 저지르는 이상한 윤리 경계선을 다룹니다.
Written by

텍스트를 이미지로 바꿔 Claude 토큰비용을 아끼는 pxpipe의 함정
PNG로 바꿔 Claude 토큰 비용을 최대 70% 줄이는 오픈소스 도구 pxpipe와, 그 이면의 정확성 문제를 함께 다룹니다.
Written by

Fable 5의 진짜 병목은 프롬프트가 아니라 내 사각지대다
Fable 5 시대 프롬프트의 진짜 병목은 사용자의 사각지대라는 앤트로픽 개발자의 통찰과, 그가 실제로 쓰는 사각지대 찾기 기법을 소개합니다.파일 읽음
Written by

AI 에이전트 프리랜서 자동화율 16%, 8개월 새 6배 뛰다
AI 에이전트가 실제 프리랜서 프로젝트를 전문가 수준으로 완수하는 비율이 8개월 만에 2.5%에서 16.1%로 뛰었습니다. CAIS의 RLI 벤치마크 결과와 AI 심사원의 한계를 정리합니다.
Written by

Fable 5 탈옥 의심, 정체는 세 단어짜리 요청이었다
Anthropic의 Fable 5·Mythos 5 수출통제 사태, 정부가 지목한 ‘탈옥’의 실체와 보안 전문가들의 반발 이유를 정리합니다.
Written by

AI 모델도 공급망이다, Fable 5 차단이 드러낸 하루아침 의존성 리스크
미 정부가 Anthropic의 Fable 5·Mythos 5를 72시간 만에 차단한 사건을 AI 공급망 리스크 관점으로 분석합니다. 모델 의존성이 왜 새로운 취약점인지 살펴봅니다.
Written by
