GPT-5.5
취약점 탐지에 대형 AI가 필요 없다는 걸 증명한 모델들
Cisco의 3억5천만 파라미터 모델이 GPT-5.5보다 빠르고 저렴하게 코드 취약점을 찾아냈다, 크기보다 특화 학습이 이긴 사례.
Written by

Fable 5, 비슷한 성능에 비용은 12배, UC버클리가 밝힌 에이전트 실무 성적표
UC버클리의 새 벤치마크 ALE 결과, 최고 성능 AI 에이전트도 실무 통과율 24%에 그쳤고 비용 격차는 12배까지 벌어졌습니다.
Written by

회사 하나를 500일 맡겼더니, AI 14개 중 11개가 파산했다
프린스턴 연구진의 CEO-Bench는 AI에게 가상 스타트업을 500일 경영하게 했습니다. 14개 모델 중 3개만 생존하고 단순 규칙 봇이 대부분을 이긴 결과를 소개합니다.
Written by

가격이 100배 싸졌다는데, 왜 내 AI 청구서는 오를까
OpenAI 임원은 지능 가격이 100배 내렸다고 말하지만 최상위 모델은 더 비싸졌습니다. test-time compute로 풀어보는 AI 가격의 역설과 개인 실무자가 주목할 관점.
Written by

GPT-5.5 Instant 업데이트, 이제 질문의 ‘글자’가 아니라 ‘의도’를 읽는다
OpenAI가 ChatGPT의 GPT-5.5 Instant를 업데이트해 질문의 의도 파악, 멀티턴 맥락 유지, 반박 대응을 개선했습니다. 모델 경쟁의 축이 정답률에서 대화 품질로 옮겨가는 신호를 짚어봅니다.
Written by

무료 ChatGPT가 의사 답변보다 높은 점수를 받았다, GPT-5.5 Instant 건강 업그레이드
무료 ChatGPT의 GPT-5.5 Instant가 의사 작성 답변보다 높은 점수를 받았다는 OpenAI 발표. 성능 개선의 실체와 자체 평가라는 한계를 함께 짚습니다.
Written by

AI 지능지수에 비용 지표 추가, 모델별 격차 최대 45배
Artificial Analysis가 AI 지능지수 v4.1을 발표했습니다. 작업당 비용·시간 지표가 새로 추가되며 모델별 효율 격차가 최대 45배까지 드러났습니다.
Written by

SkillOpt, 마크다운 파일 하나로 GPT-5.5를 23점 끌어올린 방법
Microsoft 연구팀이 AI 에이전트의 스킬 문서를 딥러닝처럼 학습시키는 SkillOpt를 발표했습니다. 마크다운 파일 하나로 GPT-5.5 성능을 평균 23점 향상시킨 방법을 소개합니다.
Written by

DeepSeek V4 Pro 가격 할인 영구화, GPT-5.5보다 출력 토큰 34배 저렴한 구조적 이유
DeepSeek V4 Pro 75% 할인이 영구 정책으로 전환. 출력 토큰 기준 GPT-5.5의 34분의 1 수준, 이 가격이 가능한 구조적 이유를 분석합니다.
Written by

ChatGPT에 금융 계좌 연결 가능해진다, OpenAI의 개인화 전략 본격화
OpenAI가 ChatGPT에 은행 계좌 연동 기능을 출시했습니다. Plaid를 통해 실제 거래 데이터를 분석하는 개인 맞춤형 금융 AI, 작동 방식과 프라이버시 설계를 소개합니다.
Written by
