내 AI 도구가 멈춰서 승인을 묻는 순간, 세 번째 루프가 돌고 있다
에이전트가 멈춰서 승인을 묻는 이유. 추론, 도구, 승인이라는 세 개의 루프로 나눠 에이전트 작동 구조를 살펴봅니다.
Written by
AI가 얼마나 똑똑한지는, 내가 잘 아는 질문에 달려 있다
잘 아는 분야일수록 AI의 허점이 보이는 이유와, 그 착시를 방치했을 때 사고 전체를 AI에 맡기게 되는 과정을 살펴봅니다.
Written by
메일도 사진도 뒤져서 답하는 Siri AI, 무엇이 달라졌나
애플이 iOS 27과 함께 공개한 새 Siri AI. 메일·사진·메시지를 넘나들며 답을 찾는 방식과 실사용 변화를 살펴봅니다.
Written by
AI 메모리의 함정, Claude가 내 정보를 몰래 흘려보내는 법
보안 연구자가 Claude의 메모리와 웹 브라우징 도구를 조합해 개인정보를 몰래 유출시킨 실험. 에이전트형 AI의 새로운 보안 위협을 보여줍니다.
Written by
AI 에이전트가 가격 페이지에서 유독 헤매는 이유
AI 에이전트가 웹사이트 가격 정보에서 유독 헤매는 이유를 실측 데이터로 분석. 개인 페이지 운영자에게도 적용되는 함의를 짚어봅니다.
Written by
OpenAI, AI 브라우저는 접었지만 브라우저 기능은 다시 넣었다
OpenAI가 AI 브라우저 Atlas를 접으면서도 새 도구에 브라우저 기능을 다시 넣은 이유, Claude Code의 접근과 비교해봅니다.
Written by
애플 신형 음성 인식, Whisper Small을 정확도와 속도 둘 다 앞섰다
애플 신형 음성 인식 API가 Whisper Small을 정확도·속도 모두에서 앞섰다는 첫 실측 벤치마크. 5,559개 발화로 검증한 결과를 정리합니다.
Written by
같은 TypeScript 파일인데 Claude가 GPT보다 토큰을 73% 더 씁니다
같은 TypeScript 코드도 벤더 토크나이저에 따라 토큰 수가 최대 73% 차이 난다는 실측. 목록가 뒤에 숨은 실질 API 비용을 짚어봅니다.
Written by
GPT-5.6 컨텍스트 창은 커졌는데, 내 사용한도는 왜 더 빨리 닳을까
GPT-5.6 Sol의 컨텍스트 창은 커졌는데 사용 한도는 왜 더 빨리 닳는지, 벤치마크 점수가 실제로 뭘 말해주고 뭘 말해주지 않는지 짚어봅니다.
Written by









