AI 인사이트
코딩 못해도 AI 에이전트는 잘 쓴다, 40만 세션이 말한 진짜 변수
약 40만 건의 Claude Code 세션 분석 결과, AI 코딩 에이전트의 성과를 가르는 변수는 코딩 실력이 아니라 도메인 전문성이었다는 Anthropic 연구를 소개합니다.
Written by

90% 확신도 정답은 아니다, AI 시대 판단력을 지키는 법
AI가 주는 건 정답이 아니라 확률적 추측입니다. 에어캐나다 챗봇·아마존 채용 AI 사례로 보는, AI 시대에 인간의 판단력을 지키는 법.
Written by

API 키 한 줄만 바꾸면 90% 싸진다는데, 그 차액은 누가 채우고 있을까
90% 싸게 AI API를 쓸 수 있다는 중계 서비스의 이면, 모델 바꿔치기와 코드 주입 위험을 실증한 두 연구 결과를 소개합니다.
Written by

파일을 작게 만드는 도구가 어떻게 셰익스피어를 쓸까
압축과 예측이 수학적으로 같다는 DeepMind 연구와 gzip으로 텍스트를 생성한 실험을 통해, 언어모델을 압축기로 보는 새로운 관점을 소개합니다.
Written by

Fable 5 탈옥 의심, 정체는 세 단어짜리 요청이었다
Anthropic의 Fable 5·Mythos 5 수출통제 사태, 정부가 지목한 ‘탈옥’의 실체와 보안 전문가들의 반발 이유를 정리합니다.
Written by

링크드인 채용 제안에 숨은 백도어, AI 에이전트가 찾아낸 npm 공급망 공격
링크드인 채용 제안 속에 숨겨진 npm 공급망 공격, 신원 도용된 두 계정과 AI 에이전트가 수초 만에 찾아낸 백도어의 작동 원리를 다룹니다.
Written by

AI에게 팩트체크 맡겼더니 내 판단력이 15% 퇴보했다, MIT 연구 결과
MIT 미디어랩의 4주 추적 연구, AI 챗봇으로 팩트체크를 반복한 사람들의 자체 판단력이 15%포인트 하락했다는 결과와 그 원인을 소개합니다.
Written by

AI 에이전트 평가가 어려운 진짜 이유, 숨겨진 기술 부채
채팅 AI 평가와 달리 에이전틱 AI는 출력·트레이스·메모리·환경 상태 등 5가지 표면을 다루는 실험 제어 시스템이 필요합니다. 평가 부채가 어떻게 쌓이는지 소개합니다.
Written by

AI 모델도 공급망이다, Fable 5 차단이 드러낸 하루아침 의존성 리스크
미 정부가 Anthropic의 Fable 5·Mythos 5를 72시간 만에 차단한 사건을 AI 공급망 리스크 관점으로 분석합니다. 모델 의존성이 왜 새로운 취약점인지 살펴봅니다.
Written by

