AI 기술 분석
취약점 탐지에 대형 AI가 필요 없다는 걸 증명한 모델들
Cisco의 3억5천만 파라미터 모델이 GPT-5.5보다 빠르고 저렴하게 코드 취약점을 찾아냈다, 크기보다 특화 학습이 이긴 사례.
Written by

TPU 6~10배 효율, 구글이 준비 중인 ‘얼려버린’ AI 칩의 정체
구글이 Gemini 아키텍처를 실리콘에 직접 새기는 전용 칩 Frozen v2를 개발 중이라는 보도. TPU 대비 6~10배 효율을 노리는 이유와 설계 배경.
Written by

AI 탐지기, 문체를 흉내 내자 글 5개 중 1개를 놓쳤다
AI 텍스트 탐지기가 평범한 AI 글은 거의 잡아내지만, 특정 작가의 문체를 흉내 낸 글은 최대 5개 중 1개꼴로 놓친다는 Epoch AI 연구를 다룹니다.
Written by

Kimi K3, 프론트엔드 코드는 1위인데 어려운 수학은 39점
Kimi K3가 프론트엔드 코드 벤치마크는 1위, 고난도 수학은 39점에 그친 이유와 벤치마크 순위가 알려주지 않는 것을 다룹니다.
Written by

27B급 AI 모델이 아이폰에 들어갔다, PrismML의 압축 방식
54GB 모델을 3.9GB로 압축해 아이폰에 넣은 PrismML의 Bonsai 27B. 압축 방식과 성능 손실, 로컬 실행이 중요해지는 이유를 정리했습니다.
Written by

말투 하나까지 설계됐다, Claude Fable 5 시스템 프롬프트가 드러낸 것들
유출된 Claude Fable 5 시스템 프롬프트가 보여준 것들. 메모리를 티 내지 않는 이유부터 거절 규칙까지, AI의 말투가 얼마나 세밀하게 설계됐는지 짚어봅니다.
Written by

내가 만든 AI 답변이 잘 나왔는지, G-Eval은 이렇게 채점한다
정답 없는 AI 출력을 사람 평가에 가깝게 채점하는 G-Eval의 원리와, LLM을 심판으로 쓸 때 따라오는 편향을 함께 짚어봅니다.
Written by

내 AI 도구가 멈춰서 승인을 묻는 순간, 세 번째 루프가 돌고 있다
에이전트가 멈춰서 승인을 묻는 이유. 추론, 도구, 승인이라는 세 개의 루프로 나눠 에이전트 작동 구조를 살펴봅니다.
Written by

애플 신형 음성 인식, Whisper Small을 정확도와 속도 둘 다 앞섰다
애플 신형 음성 인식 API가 Whisper Small을 정확도·속도 모두에서 앞섰다는 첫 실측 벤치마크. 5,559개 발화로 검증한 결과를 정리합니다.
Written by

같은 TypeScript 파일인데 Claude가 GPT보다 토큰을 73% 더 씁니다
같은 TypeScript 코드도 벤더 토크나이저에 따라 토큰 수가 최대 73% 차이 난다는 실측. 목록가 뒤에 숨은 실질 API 비용을 짚어봅니다.
Written by
