에이전틱AI
Kimi K3, 프론트엔드 코드는 1위인데 어려운 수학은 39점
Kimi K3가 프론트엔드 코드 벤치마크는 1위, 고난도 수학은 39점에 그친 이유와 벤치마크 순위가 알려주지 않는 것을 다룹니다.
Written by

Claude가 대신 로그인해도 비밀번호는 안 보인다, 1Password 신기능
Claude가 1Password 자격증명으로 로그인을 대신 처리하되 비밀번호는 보지 못하는 제로 노출 아키텍처. 작동 방식과 실사용 예시를 소개합니다.
Written by

에이전트는 알아서 잘한다는 착각, 39일 실험이 보여준 반전
39일간 자율 실행된 에이전틱 시스템 실험이 보여준, 에이전트의 자율성이 클수록 스펙이 더 중요해진다는 역설을 다룹니다.
Written by

비싼 모델은 매니저로, 저렴한 모델은 실행자로 — Anthropic의 비용 절감법
Anthropic이 벤치마크 1위 모델 Fable 5를 매번 쓰지 말라고 권장하는 이유와, 비싼 모델과 저렴한 모델을 조합하는 두 가지 공식 전략을 소개합니다.
Written by

AI 토큰 사용량 741% 늘었는데 출시는 20% 증가, 토큰맥싱의 교훈
AI 토큰 사용을 경쟁처럼 여겼던 토큰맥싱 현상의 부상과 몰락. 코드 생성 741% 증가에도 출시는 20%에 그친 데이터가 드러낸 사용량과 가치의 간극.
Written by

DeepSeek V4 Pro 가격 할인 영구화, GPT-5.5보다 출력 토큰 34배 저렴한 구조적 이유
DeepSeek V4 Pro 75% 할인이 영구 정책으로 전환. 출력 토큰 기준 GPT-5.5의 34분의 1 수준, 이 가격이 가능한 구조적 이유를 분석합니다.
Written by

Anthropic, 창사 이래 첫 흑자 전망, 분기 매출 10.9조 원 돌파한 이유
Anthropic이 2026년 2분기 창사 이래 첫 영업이익을 전망합니다. AI 코딩 도구와 에이전틱 AI가 폭발적 성장을 이끈 구조를 분석합니다.
Written by

Gemini가 Android에서 직접 행동한다, 앱 자동화부터 위젯 생성까지
Google이 Android에 Gemini 에이전틱 기능을 공개했습니다. 앱 간 작업 자동화, 웹 자동 탐색, 자연어 위젯 생성까지 — AI가 대답을 넘어 행동을 시작합니다.
Written by

Claude 안전 훈련의 반전, 모범 답안보다 가치관을 가르쳐야 했다
Anthropic이 Claude의 협박 행동을 96%에서 0%로 줄인 안전 훈련 방법을 공개했습니다. 모범 답안보다 윤리적 추론을 가르치는 것이 핵심이었습니다.
Written by

