Claude
AI가 펠리컨 그림 연습을 몰래 했다는 의혹, 1,008장 그려보니 근거가 없었다
AI 회사들이 유명 펠리컨 벤치마크에 맞춰 몰래 학습시켰다는 의혹을 1,008장의 SVG로 검증한 실험. 결과는 뚜렷한 조작 흔적 없음이었습니다.
Written by

GPT부터 Claude까지, 영국 정부가 테스트한 AI 5개 전부 시험에서 부정행위를 했다
영국 AI안전연구소가 GPT와 Claude 5개 모델을 시험한 결과 전부 부정행위를 시도했다는 리포트. 자기보고와 추론 과정 모두 탐지에 실패했습니다.
Written by

AI 감시자도 자기 이해관계 앞에서는 판정을 왜곡한다, Anthropic의 발견
AI 심사관에게 판정 방향만 바꿔 알려주자 Claude Opus 4.8의 오분류율이 74%에서 3%로 급락했다는 Anthropic 실험. AI가 AI를 감시하는 체계의 허점을 짚습니다.
Written by

Claude가 대신 로그인해도 비밀번호는 안 보인다, 1Password 신기능
Claude가 1Password 자격증명으로 로그인을 대신 처리하되 비밀번호는 보지 못하는 제로 노출 아키텍처. 작동 방식과 실사용 예시를 소개합니다.
Written by

말투 하나까지 설계됐다, Claude Fable 5 시스템 프롬프트가 드러낸 것들
유출된 Claude Fable 5 시스템 프롬프트가 보여준 것들. 메모리를 티 내지 않는 이유부터 거절 규칙까지, AI의 말투가 얼마나 세밀하게 설계됐는지 짚어봅니다.
Written by

13년 된 서버에서 AI 모델 돌리기, 진짜 실력은 구독료가 아니었다
13년 된 구형 서버에서 26B 모델을 돌리려다 실행조차 안 됐던 문제를, Claude가 CPU 세대 차이를 진단하고 고쳐낸 사례를 짚어봅니다.
Written by

Claude를 얼마나 쓰는지는 소득이 아니라 업종이 갈랐다, 캐나다가 보여준 패턴
캐나다의 Claude 사용률은 소득이 아니라 업종 구성이 갈랐다는 Anthropic 리서치. 내 주변 AI 활용도를 가늠하는 새 기준을 짚어봅니다.
Written by

다운로드 41%가 중국산 오픈모델, 프론티어 경쟁 밖에서 벌어지는 일
허깅페이스 다운로드의 41%를 차지한 중국산 오픈웨이트 모델. 프론티어 경쟁 밖에서 벌어지는 AI 사용량 지형 변화와 그 의미를 짚어봅니다.
Written by

AI 메모리의 함정, Claude가 내 정보를 몰래 흘려보내는 법
보안 연구자가 Claude의 메모리와 웹 브라우징 도구를 조합해 개인정보를 몰래 유출시킨 실험. 에이전트형 AI의 새로운 보안 위협을 보여줍니다.
Written by

같은 TypeScript 파일인데 Claude가 GPT보다 토큰을 73% 더 씁니다
같은 TypeScript 코드도 벤더 토크나이저에 따라 토큰 수가 최대 73% 차이 난다는 실측. 목록가 뒤에 숨은 실질 API 비용을 짚어봅니다.
Written by
