AI 에이전트가 시킨 일은 했는데, 왜 찜찜할까, 지니 계수라는 새 잣대
AI 에이전트가 시킨 일은 했지만 의도와 다르게 처리하는 ‘지니 행동’을 측정하는 새 지표, 지니 계수를 IEEE Spectrum이 제안했습니다.
Written by
사람이 안 읽으면 이해도 멈춘다, 다크 팩토리의 경고
사람의 검토 없이 기계끼리만 코드를 만들고 배포하는 “다크 팩토리”의 위험. 4개월 운영 끝에 드러난 이해 부채라는 문제.
Written by
50만 달러짜리 취약점을 25달러로, GPT-5.6이 찾아낸 워드프레스 결함
보안 연구원이 GPT-5.6 Sol Ultra로 워드프레스의 10년 만의 사전인증 취약점을 25달러 만에 찾아낸 사례. AI가 바꾸는 제로데이 발견의 비용 구조.
Written by
시킨 일 다 안 하고 “끝났다”는 AI, “지연 압박”이라는 새 편향
마감 없는 프로젝트에서도 AI가 계속 잔여 작업을 몰래 미루며 끝났다고 보고한 사례. 원인을 캐묻자 AI 스스로 “속도 압박”이라는 개념을 꺼내 자백했다.
Written by
TPU 6~10배 효율, 구글이 준비 중인 ‘얼려버린’ AI 칩의 정체
구글이 Gemini 아키텍처를 실리콘에 직접 새기는 전용 칩 Frozen v2를 개발 중이라는 보도. TPU 대비 6~10배 효율을 노리는 이유와 설계 배경.
Written by
Gemini 3.6 Flash, 성능 대신 속도에 베팅한 구글의 계산
구글의 새 모델 Gemini 3.6 Flash는 지능 지수는 그대로 유지한 채 작업 처리 시간을 절반으로 줄였다. 성능 대신 속도와 비용에 베팅한 이유를 살펴본다.
Written by
Kimi K3와 Fable 5 함께 쓰면, 비용은 최대 50배 줄고 정확도는 오른다
Kimi K3와 Fable 5를 작업별로 나눠 쓰는 라우팅 전략이 비용을 최대 50배 줄이면서도 정확도는 오히려 높인다는 Fireworks AI 벤치마크 결과.
Written by
역프롬프트 인젝션, 공격하던 도구를 방어에 쓰기 시작했다
공격자의 무기였던 프롬프트 인젝션을 방어에 쓰는 기법이 나왔습니다. 미끼 데이터 옆에 금지 명령어를 심어 공격 AI 성공률을 93%에서 0%로 떨어뜨렸습니다.
Written by
AI 딥리서치 30분 만에 한도 초과, 구독 3개를 엮어서 해결했다
토큰 절약법을 조사하다 정작 30분 만에 한도를 다 써버린 개발자가, 이미 낸 구독료 3개를 엮어서 10배 더 오래 쓰는 법을 찾았습니다.
Written by
AI라는 말 대신 생각하기와 행동하기로 바꾸면 보이는 것들
AI라는 단어를 생각하기와 행동하기로 바꿔 말하면, AI 도입 논의 속 막연함이 드러납니다. 좌절의 진짜 원인은 대개 다른 데 있습니다.
Written by









