DeepSeek
같은 모델인데 결과가 다르다, DeepSeek V4 Flash가 보여준 추론 강도의 힘
DeepSeek V4 Flash 0731이 지능 대비 비용에서 독보적 위치를 차지했습니다. 그런데 벤치마크 개선의 실체와, 같은 모델도 추론 강도 설정에 따라 결과가 크게 갈린다는 사이먼 윌리슨의 실험을 함께 짚어봅니다.
Written by

이제 모델은 똑똑함보다 속도로 고른다, 어느 개발자의 체감 기준
소프트웨어 엔지니어 마틴 알더슨은 이제 모델을 지능이 아니라 속도로 고른다고 말합니다. 초당 100토큰이 왜 새로운 체감 기준이 되었는지, 속도 경쟁의 한계와 다음 승부처는 어디일지 짚어봅니다.
Written by

공격자가 자기 발등 찍은 실수, DeepSeek 자율 해킹의 전모가 드러났다
텔레그램 명령 한 줄로 DeepSeek 기반 AI 에이전트가 460개 서버를 자율 공격한 사건을 Unit 42가 밝혀냈습니다. 에이전트의 실수로 드러난 공격 전 과정과, 공격자가 Claude Code·Codex까지 테스트해본 흔적을 소개합니다.
Written by

추론모델의 오버씽킹, 공격 수단이 될 수 있다는 연구가 나왔다
논리적으로 모순된 프롬프트가 추론모델을 오버씽킹에 빠뜨려 답변을 26배까지 늘릴 수 있다는 연구가 ICML 2026에서 발표됐습니다.
Written by

GPT-4는 1년, 요즘 1위 모델은 7주, AI 경쟁이 이렇게 빨라졌다
GPT-4 이후 AI 모델 1위 자리가 7주 만에 뒤집히는 현상과, 중국 모델이 가격 경쟁력으로 점유율을 넓히는 두 가지 트렌드 데이터를 소개합니다.
Written by

DeepSeek DSpark, 하드웨어 안 바꾸고 AI 응답속도 85% 올린 방법
DeepSeek가 공개한 추론 최적화 프레임워크 DSpark, 하드웨어 교체 없이 응답 속도 최대 85% 개선. 오픈소스 코드까지 공개한 이유를 짚어봅니다.
Written by

GLM-5.2가 바꾼 것, 이제 오픈 모델은 싸기만 한 게 아니다
Z.ai의 GLM-5.2가 코딩 하네스에서 제대로 작동하는 첫 오픈웨이트 모델로 평가받습니다. 프론티어 대비 6분의 1 비용, 6.8개월로 좁혀진 성능 격차가 실무자의 모델 선택에 갖는 의미를 짚습니다.
Written by

AI 비용 최적화의 새 공식, 중요한 작업엔 Anthropic·단순 작업엔 DeepSeek
Vercel AI Gateway 5월 데이터로 본 프로덕션 AI 모델 사용 현황. DeepSeek V4가 토큰 볼륨 17%를 차지했지만 비용은 1%에 불과한 반면, Anthropic은 전체 지출의 65%를 독식하며 고위험 작업에서 압도적 우위를 보였습니다.
Written by

프론티어 LLM 비용, 11개월이면 역전된다, 로컬 AI의 경제학
프론티어 LLM API 가격이 계속 오르는 상황에서, 엔지니어+로컬AI 조합이 약 11개월 만에 비용 역전을 이루는 구조적 논리를 분석한 SignalBloom AI 에세이 큐레이션.
Written by

모델 고르는 시대는 끝났다, 에이전트 하네스가 성능을 가른다
모든 주요 AI 모델 회사들이 에이전트 개발로 피벗하는 흐름과, 모델 선택보다 하네스 설계가 성능을 좌우한다는 Stanford 연구 소개.
Written by
