AI 인사이트
건강 대화만 학습시켰더니 코드 부정행위가 줄었다, OpenAI의 정렬 일반화 실험
정직성 같은 유익한 특성을 소량 강화학습한 OpenAI 모델이 학습하지 않은 영역까지 더 안전해졌다는 연구. 건강 대화만 가르쳐도 코드 부정행위가 줄어든 정렬 일반화 실험을 소개합니다.
Written by

사람은 못 읽지만 AI는 알아듣는다, LLM끼리의 압축 언어 BabelTele
사람은 못 읽지만 AI는 알아듣는 초고밀도 표현 BabelTele. 원문의 27.9% 길이로 압축해도 의미 99.5%를 보존한 상하이교통대 연구를 소개합니다.
Written by

얀 르쿤이 말하는 오픈소스 AI, 대부분의 나라엔 유일한 선택지
메타를 떠난 얀 르쿤이 UN 연설에서 오픈소스 AI를 글로벌 AI 주권의 유일한 길로 주장했습니다. 연합형 훈련 프로젝트 태피스트리와 AI 위험론 반박까지, 그의 핵심 논리를 정리합니다.
Written by

Reddit 댓글 13단어로 AI 검색 답변을 바꾼다, 코넬 연구가 밝힌 취약점
Reddit 댓글에 13단어만 붙이면 ChatGPT·구글 AI 검색 답변을 조작할 수 있다는 코넬 테크 연구. AI 검색의 구조적 취약점 WARP 공격을 소개합니다.
Written by

헤드폰을 한 번도 안 물었는데, ChatGPT는 어떻게 헤드폰 광고를 띄울까
ChatGPT 광고는 키워드가 아닌 대화 맥락으로 작동합니다. 사용자의 46%가 구매 의도 없이 시작했다는 Similarweb 분석으로 본 ‘AI 광고’의 새로운 작동 원리.
Written by

AI 지능 곡선이 평평해진다, 격차는 모델이 아니라 사람에서 갈린다
지금까지는 새 모델이 나올 때마다 더 똑똑해졌고, 우리는 그 차이를 분명히 느꼈습니다. 그런데 어떤 사람들은 이제 Opus 4.8과 Fable 5의 차이를 잘 모르겠다고 말합니다. 발전이 멈춰서가 아닙니다. 곡선이 평평해 보이는 데는 전혀 다른 이유가 있습니다. 30년 넘게 업계에 몸담은 개발자 Steve Yegge가 “The Flat Curve Society”라는 글을 발표했습니다. 핵심 주장은 이렇습니다. AI의 능력은 앞으로도 기하급수적으로…
Written by

LLM은 태그가 아니라 말투로 권한을 판단한다, 공격 성공률 61%를 만든 ‘역할 혼동’
LLM이 역할 태그가 아니라 글의 말투로 권한을 판단한다는 ICML 2026 연구. 가짜 추론을 심는 CoT Forgery로 공격 성공률이 61%까지 오르는 ‘역할 혼동’ 현상을 소개합니다.
Written by

AI 에이전트는 왜 아직 사람이 필요한가, goose 팀의 자기개선 루프
“AI가 스스로 발전한다”는 유행 속에서 오픈소스 에이전트 goose 팀이 자기개선 루프에 여전히 사람을 끼워 넣는 이유. 벤치마크를 버그 리포트로 보는 관점을 소개합니다.
Written by

AI가 코드를 짤수록 더 자주 터진다, Kiro의 13시간 장애가 남긴 교훈
AWS Kiro가 프로덕션을 삭제해 13시간 장애를 일으킨 사건과, AI 코딩 시대에 검증·격리 규율이 왜 더 중요해지는지 Charity Majors와 Fly·Docker의 관점으로 풀어봅니다.
Written by

AI로 더 빨리 만들수록 조직의 지식이 망가진다, ‘지식 부패’라는 함정
AI로 만든 결과물이 업무 흐름을 타고 번지면 조직 지식이 부패한다는 HBR 분석. 검증·인간가치·엔트로피 세 함정과 모델 붕괴 현상을 개인 실무자 관점에서 풀어봅니다.
Written by
