AI 인사이트
AI에게 인간관계 조언 구했더니, 판단력이 흐려졌다
Stanford 연구팀이 Science에 발표한 논문. AI 아첨이 사용자의 도덕적 판단력을 흐리고 관계 회복 의지를 낮춘다는 것을 2,400명 실험으로 증명했습니다.
Written by

ChatGPT에 Wired 추천 제품 물어봤더니, 세 번 모두 틀렸다
ChatGPT에 Wired 추천 제품을 물었더니 세 카테고리 모두 틀린 제품을 제시했다. 출처 링크를 걸고도 내용이 다른 AI 쇼핑 추천의 신뢰성 문제를 짚습니다.
Written by

Claude 6개월 쓴 사람과 신규 사용자, 뭐가 다른가
Anthropic이 Claude 사용자 100만 건을 분석한 경제 보고서. AI 숙련자와 신규 사용자의 성공률·활용 방식 차이와 글로벌 AI 격차 현황을 다룹니다.
Written by

AI 거품 붕괴 시나리오, 빅테크 capex 게임과 AI 스타트업의 딜레마
AI 거품 붕괴 시나리오 분석. 빅테크의 방어적 capex 전략, 에너지·자금 조달 악재, OpenAI 수익화 실패가 겹치며 AI 스타트업에 위기가 올 수 있다는 Hacker News 화제글 소개.
Written by

AI 생산성 혁명이라는데, 데이터는 왜 조용한가
AI가 생산성을 폭발시킨다는 주장과 달리, PyPI 패키지 데이터엔 전반적 증가가 없었습니다. Answer.AI 연구가 데이터로 파헤친 AI 효과의 실체를 소개합니다.
Written by

Claude가 박사과정 2년차 수준에 도달했다, Harvard 교수가 직접 확인한 방법
하버드 물리학 교수가 Claude Opus 4.5를 지도해 2주 만에 실제 논문을 완성한 과정. AI의 능력과 함께 결과 조작·비위 맞추기 성향을 솔직하게 기록한 1차 경험담입니다.
Written by

객관적 지표가 있다면 인간이 병목이다, Karpathy가 그은 AI 자율 연구의 경계선
AI 에이전트가 인간 연구자를 앞서는 조건과 그렇지 않은 조건을 Karpathy의 autoresearch 실험을 통해 살펴봅니다. 측정 가능성이 자율 연구의 경계선인 이유.
Written by

바이브 코딩이 스팸도 예쁘게 만들었다, VibeScamming 시대의 이메일 보안
바이브 코딩 도구 확산으로 스팸 이메일 디자인이 세련되어지는 VibeScamming 현상. 코딩 실력 없이도 피싱 메일 제작이 가능해진 AI 악용의 현실을 소개합니다.
Written by

GPT-5.4가 GPT를 감시한다, OpenAI 내부 코딩 에이전트 실제 관찰 보고
OpenAI가 내부 코딩 에이전트를 5개월간 수천만 건 모니터링한 결과를 공개. AI가 실제로 제약을 우회하려는 시도가 관찰됐지만 최고 심각도 사례는 0건이었습니다.
Written by

TurboQuant에 “Pied Piper”라는 별명이 붙은 이유, 그리고 그 비교가 과장인 이유
구글 TurboQuant 발표에 업계가 ‘Pied Piper’, ‘DeepSeek 모멘트’라 반응한 이유와 그 비교가 과장인 이유를 분석합니다.
Written by
