AI 인사이트
AI 감시자도 자기 이해관계 앞에서는 판정을 왜곡한다, Anthropic의 발견
AI 심사관에게 판정 방향만 바꿔 알려주자 Claude Opus 4.8의 오분류율이 74%에서 3%로 급락했다는 Anthropic 실험. AI가 AI를 감시하는 체계의 허점을 짚습니다.
Written by

내가 일하는 걸 보여주면 AI가 대신한다, Claude의 Record a Skill이 던진 질문
화면 녹화만으로 AI에게 업무를 가르치는 Claude Cowork의 새 기능, 편리함과 함께 실직 우려도 함께 불러왔습니다.
Written by

AI 에이전트가 시킨 일은 했는데, 왜 찜찜할까, 지니 계수라는 새 잣대
AI 에이전트가 시킨 일은 했지만 의도와 다르게 처리하는 ‘지니 행동’을 측정하는 새 지표, 지니 계수를 IEEE Spectrum이 제안했습니다.
Written by

사람이 안 읽으면 이해도 멈춘다, 다크 팩토리의 경고
사람의 검토 없이 기계끼리만 코드를 만들고 배포하는 “다크 팩토리”의 위험. 4개월 운영 끝에 드러난 이해 부채라는 문제.
Written by

시킨 일 다 안 하고 “끝났다”는 AI, “지연 압박”이라는 새 편향
마감 없는 프로젝트에서도 AI가 계속 잔여 작업을 몰래 미루며 끝났다고 보고한 사례. 원인을 캐묻자 AI 스스로 “속도 압박”이라는 개념을 꺼내 자백했다.
Written by

생산성은 오르고 만족감은 사라지는 이유, 개발자의 보상 회로가 문제였다
AI로 코딩할수록 생산성은 오르지만 만족감은 사라지는 이유를 “인간 보상 함수 문제”라는 개념으로 짚은 Pydantic 팀원의 에세이를 다룹니다.
Written by

컨설턴트가 300번 미팅에서 본 것, AI 프로젝트는 전부 실패였다
300여 차례 미팅을 가진 컨설턴트가 목격한 AI 프로젝트의 실제 성공률과, 문제를 지적하면 밀려나는 조직 분위기를 다룹니다.
Written by

AI 조언을 받은 사람들, 정답률은 3분의 1로 확신은 두 배로
AI 조언을 받으면 정확도는 3분의 1로 떨어지고 확신은 두 배로 오른다는 연구. “모른다”고 말하는 능력이 사라지는 이유를 다룹니다.
Written by

내 AI 비서는 나를 대신하지 말고, 나를 닮아야 한다
사용자를 대체하지 않고 닮아가는 개인화 AI “가디언 엔젤” 개념. 생산성과 보안을 동시에 잡는 새로운 AI 비서상을 제안합니다.
Written by

애디 오스마니, AI 시대 개발자에게 필요한 건 코딩이 아니라 판단력
코드의 42%를 AI가 짜는 시대, 개발자에게 남는 몫은 무엇인가. 애디 오스마니가 짚은 인지적 항복·인지 부채·오케스트레이션 세금과 판단력을 기르는 법.
Written by
