AI 활용 가이드
GPT-5.6 Sol, 지우라 안 한 파일까지 알아서 지운다
GPT-5.6 Sol이 요청하지 않은 파일과 DB를 무단 삭제했다는 사례가 잇달아 보고됐습니다. OpenAI 시스템 카드가 미리 경고한 위험을 짚어봅니다.
Written by

AI 에이전트가 가격 페이지에서 유독 헤매는 이유
AI 에이전트가 웹사이트 가격 정보에서 유독 헤매는 이유를 실측 데이터로 분석. 개인 페이지 운영자에게도 적용되는 함의를 짚어봅니다.
Written by

RTX 5090은 못 돌리는 70B 모델, 미니PC는 어떻게 돌릴까
RTX 5090은 못 돌리는 70B 모델을 미니PC가 돌릴 수 있는 이유. 통합 메모리의 용량과 대역폭 트레이드오프, 프롬프트 처리 병목을 다룹니다.
Written by

Claude Code 리드가 “이제 프롬프트 안 짠다, 루프를 짠다”고 말한 이유
Claude Code와 OpenClaw 개발자가 말하는 “루프를 짠다”는 것의 실체. 크론잡과 무엇이 다른지, /loop이 실제로 어떻게 동작하는지 다룹니다.
Written by

에이전트는 알아서 잘한다는 착각, 39일 실험이 보여준 반전
39일간 자율 실행된 에이전틱 시스템 실험이 보여준, 에이전트의 자율성이 클수록 스펙이 더 중요해진다는 역설을 다룹니다.
Written by

비싼 모델은 매니저로, 저렴한 모델은 실행자로 — Anthropic의 비용 절감법
Anthropic이 벤치마크 1위 모델 Fable 5를 매번 쓰지 말라고 권장하는 이유와, 비싼 모델과 저렴한 모델을 조합하는 두 가지 공식 전략을 소개합니다.
Written by

Claude Code의 모델과 effort, 다른 걸 조절하고 있었다
Claude Code의 모델 설정과 effort 레벨은 서로 다른 걸 조절합니다. 모델은 무엇을 아는지, effort는 얼마나 확인하는지를 정합니다.
Written by

구글 1위인데 ChatGPT는 왜 날 인용 안 할까
AI 검색이 답변에 인용할 사이트를 고르는 수집-읽기-검증-답변 4단계 프로세스와, 구글 1위가 AI 인용을 보장하지 않는 이유를 소개합니다.
Written by

RAG 컨텍스트 68% 쳐내고 정확도는 지킨 kapa.ai의 채점 방식
kapa.ai가 LLM 채점으로 RAG 컨텍스트를 68% 줄이면서도 재현율 96%를 지킨 방법. rerank 한계와 해법을 소개합니다.
Written by

