AI벤치마크
Kimi K2 Thinking: 1조 파라미터로 GPT-5를 제친 오픈소스 모델의 비밀
중국 스타트업 Moonshot AI의 Kimi K2 Thinking이 GPT-5와 Claude를 제치고 추론 벤치마크 1위를 기록했습니다. 1조 파라미터 오픈소스 모델의 파괴적 가성비를 소개합니다.
Written by

AI 에이전트는 프리랜서 일을 대신할 수 있을까? 97.5% 실패의 의미
AI 에이전트가 실제 프리랜서 작업을 완수할 수 있을까? Scale AI의 Remote Labor Index가 240개 실제 프로젝트로 테스트한 결과, 최고 성능 AI도 2.5%만 성공했습니다. 대체가 아닌 증강의 시대.
Written by



