Claude
GPT·Claude API를 90% 싸게 쓸 수 있다는 말, 그 할인은 어디서 오는가
90% 저렴한 GPT·Claude API 프록시의 실체. 모델 스와핑과 계정 어뷰징으로 만든 할인이 코딩 에이전트에 연결될 때 왜 특히 위험한지 다룹니다.
Written by

비싼 모델은 매니저로, 저렴한 모델은 실행자로 — Anthropic의 비용 절감법
Anthropic이 벤치마크 1위 모델 Fable 5를 매번 쓰지 말라고 권장하는 이유와, 비싼 모델과 저렴한 모델을 조합하는 두 가지 공식 전략을 소개합니다.
Written by

에이전트 위해 CLI를 JSON으로 바꾸면, 비용이 11배 뛴다
에이전트용 CLI를 JSON으로 바꾸면 더 잘 다룰 거라는 조언, Microsoft가 실측하니 비용만 최대 11배 뛰었습니다.
Written by

AI의 속마음을 읽는 J-space, Claude 안에서 스스로 생겨났다
Claude 내부에서 발견된 “J-space”, 말하지 않은 생각과 숨겨진 의도까지 읽어내는 Anthropic의 새 해석가능성 연구를 소개합니다.
Written by

Fable 5는 담합은 저지르면서 보험사기는 거부했다
Andon Labs의 Vending-Bench 테스트에서 드러난 Claude Fable 5의 담합·기만 행동과, 보험사기는 거부하면서도 담합은 저지르는 이상한 윤리 경계선을 다룹니다.
Written by

Opus 4.8, 구형 모델보다 도구 호출에서 더 헤맨다
최신 Claude 모델이 오히려 커스텀 도구 호출에 더 서툴러진 이유를 개발자 아르민 로나허의 실제 추적 사례로 살펴봅니다.
Written by

Fable 5의 진짜 병목은 프롬프트가 아니라 내 사각지대다
Fable 5 시대 프롬프트의 진짜 병목은 사용자의 사각지대라는 앤트로픽 개발자의 통찰과, 그가 실제로 쓰는 사각지대 찾기 기법을 소개합니다.파일 읽음
Written by

보안 연구자도 못 뚫은 방화벽, Claude가 대신 뚫었다
보안 연구자 Ian Carroll이 Claude로 미국 대형 음악 페스티벌 발권 시스템의 SQL 인젝션과 방화벽 우회 기법을 찾아낸 사례로, AI가 개인 역량을 어디까지 끌어올리는지 살펴봅니다.
Written by

Claude 커넥터가 읽는 데이터, 전체의 5%도 안 된다
Claude 커넥터를 연결해도 AI는 데이터 전체의 0.5~5%만 읽는다는 실사용 경험담. 접근권과 신뢰할 결론은 다른 문제라는 걸 짚습니다.
Written by

회사 하나를 500일 맡겼더니, AI 14개 중 11개가 파산했다
프린스턴 연구진의 CEO-Bench는 AI에게 가상 스타트업을 500일 경영하게 했습니다. 14개 모델 중 3개만 생존하고 단순 규칙 봇이 대부분을 이긴 결과를 소개합니다.
Written by
