OpenAI
GPT-5.4 출시, 전문가 작업용 프런티어 모델로 컴퓨터 사용·1M 토큰 지원
OpenAI가 GPT-5.4 Thinking, GPT-5.4 Pro, GPT-5.3 Instant를 공개했습니다. 컴퓨터 직접 조작과 100만 토큰 컨텍스트를 지원하는 에이전틱 모델의 핵심을 소개합니다.
Written by

ChatGPT가 잔소리를 줄였다, GPT-5.3 Instant 업데이트의 핵심
OpenAI가 ChatGPT 기본 모델을 GPT-5.3 Instant로 업데이트. 환각률 최대 26.8% 감소, 불필요한 경고 문구 축소. 유용성과 안전성 균형 재조정의 의미를 소개합니다.
Written by

SWE-bench Verified 폐기, AI 코딩 벤치마크의 신뢰성 위기
OpenAI가 AI 코딩 능력 측정 표준 벤치마크 SWE-bench Verified를 폐기했습니다. 테스트 결함과 훈련 데이터 오염, 두 가지 치명적 문제를 발견했기 때문입니다.
Written by

AI 에이전트, 스마트 컨트랙트 공격 72% 성공, EVMbench가 보여준 역설
OpenAI와 Paradigm이 공개한 EVMbench. AI 에이전트가 스마트 컨트랙트를 공격하는 능력이 방어보다 뛰어나다는 역설적 결과와 그 의미를 소개합니다.
Written by

Claude Code vs Codex 실전 비교, 두 에이전트를 모두 쓰는 개발자의 선택 기준
Claude Code와 Codex를 동시에 쓰는 개발자의 2026년 2월 실전 비교. 계획·툴 사용은 Opus, 코드 정확도는 Codex로 나눠 쓰는 실무 전략을 소개합니다.
Written by

Anthropic이 거절한 계약, OpenAI가 같은 조건으로 성사시킨 방법
Anthropic이 거절한 Pentagon 계약을 OpenAI가 동일한 레드라인으로 성사시킨 배경과 계약 구조를 분석합니다.
Written by

ChatGPT 9억 유저가 있어도 흔들리는 이유, OpenAI의 전략적 딜레마
OpenAI의 9억 유저가 왜 취약한 자산인지, 플랫폼 전략은 왜 작동하기 어려운지를 분석한 베네딕트 에반스의 글을 소개합니다.
Written by

AI가 AI 연구를 가속한다, Altman “예상보다 훨씬 빠르고 솔직히 불안하다”
OpenAI CEO Sam Altman이 AI를 연구에 직접 투입해 AGI 개발이 예상보다 빠르게 가속 중이라고 밝혔습니다. “세상은 준비가 안 됐다”는 발언의 맥락을 짚어봅니다.
Written by

ChatGPT 광고 시대 개막, AI 어시스턴트가 광고 회사가 되는 구조적 이유
AI 어시스턴트를 만드는 모든 주요 기업이 광고 기반 수익 모델을 갖고 있다는 구조적 문제와, 온디바이스 추론이 유일한 건축적 해답인 이유를 짚습니다.
Written by

OpenClaw, 196,000 스타의 열풍 뒤에 남은 진짜 질문
GitHub 196,000 스타를 기록한 AI 에이전트 프레임워크 OpenClaw. 열풍의 배경과 함께 보안 전문가들이 경고하는 프롬프트 인젝션 취약점을 소개합니다.
Written by
