AI 인사이트
AI로 직접 만든 CRM, 옆자리 동료와 호환이 안 된다면
에이전트로 나만의 도구를 만드는 시대, SaaS는 정말 끝났을까요? 팀 협업과 데이터 공유 문제를 통해 에이전트 도구의 현실적 한계와 SaaS의 진화 방향을 살펴봅니다.
Written by

프론티어 LLM 비용, 11개월이면 역전된다, 로컬 AI의 경제학
프론티어 LLM API 가격이 계속 오르는 상황에서, 엔지니어+로컬AI 조합이 약 11개월 만에 비용 역전을 이루는 구조적 논리를 분석한 SignalBloom AI 에세이 큐레이션.
Written by

AI 에이전트도 늙는다, 배포 후 조용히 무너지는 신뢰성 문제
배포 후 AI 에이전트가 시간이 지남에 따라 조용히 신뢰성을 잃는 “에이전트 노화” 현상. UT 오스틴 연구팀의 AgingBench 논문을 소개합니다.
Written by

AI 에세이 채점 실험, 캠브리지 연구팀이 발견한 구조적 한계
캠브리지 연구팀이 AI로 학부생 에세이 761편을 채점한 결과, AI는 논리보다 문장 스타일을 기준으로 평가하는 구조적 편향을 드러냈습니다.
Written by

2026년 사람들이 AI를 쓰는 법, 1만 2천 개 사례가 보여주는 진짜 패턴
1만 2천 개 사례를 분석한 HBR 종단 연구로 보는 2026년 AI 사용 패턴. 씽크슬롭, 감정 의존, 섀도우 AI 3가지 핵심 트렌드를 소개합니다.
Written by

BrowseComp 1위 모델이 진짜 검색엔 꼴찌, AI 벤치마크의 치명적 맹점
AI 검색 에이전트가 실제로는 검색 없이 학습 기억에 의존해 BrowseComp 점수를 올린다는 연구. 기억을 차단한 LiveBrowseComp에서 순위가 완전히 뒤집히는 실험 결과를 소개합니다.
Written by

AI 에이전트가 검색을 건너뛰는 순간, Google·NYU 연구가 발견한 4가지 패턴
Google·NYU 연구팀이 AI 딥서치 에이전트를 훈련하다 발견한 4가지 패턴. 에이전트가 다단계 탐색을 건너뛰는 조건을 처음 정량화한 SAGE 논문을 소개합니다.
Written by

AI 코딩 도구, 빨라질수록 병목이 늘었다, Dropbox가 배운 것
AI 코딩 도구 전사 도입 후 병목이 다운스트림으로 이동한 Dropbox의 경험. 자체 에이전트 플랫폼 Nova와 생산성 측정 재정의 방법을 소개합니다.
Written by

5개 최상위 AI, 같은 뉴스 팩트체크하면 67%는 의견이 갈린다
최상위 LLM 5개에 동일한 팩트체크 주장 1,000개를 제시한 결과, 67%에서 모델 간 판정이 엇갈렸습니다. AI 팩트체킹 신뢰성의 실제 한계를 데이터로 보여주는 연구입니다.
Written by

AI 빠르게 많이 쓸수록 잘한다? 두 개발자가 찾은 같은 결론
AI를 빠르게 많이 쓰는 것이 능사가 아니라는 두 개발자의 실전 경험. 서로 다른 문제를 겪었지만 같은 결론, 느리고 의식적인 AI 활용에 도달한 이야기입니다.
Written by
