AI하네스
AI 에이전트가 시킨 일은 했는데, 왜 찜찜할까, 지니 계수라는 새 잣대
AI 에이전트가 시킨 일은 했지만 의도와 다르게 처리하는 ‘지니 행동’을 측정하는 새 지표, 지니 계수를 IEEE Spectrum이 제안했습니다.
Written by

AI 모델 격차는 사라졌는데.. 승부는 다른 데서 갈렸다
오픈-폐쇄 모델 성능 격차는 좁혀졌는데, 진짜 승부는 하네스와 벤더 이탈 가능성에서 갈리고 있다는 Mozilla 리포트 분석입니다.
Written by

모델 고르는 시대는 끝났다, 에이전트 하네스가 성능을 가른다
모든 주요 AI 모델 회사들이 에이전트 개발로 피벗하는 흐름과, 모델 선택보다 하네스 설계가 성능을 좌우한다는 Stanford 연구 소개.
Written by
