Claude
Claude 출력에 보이지 않는 워터마크가 박힌다, 무엇이 붙고 어떻게 확인하나
2026년 8월부터 새 Claude 모델이 생성하는 텍스트에 보이지 않는 워터마크가, 파일에는 서명된 출처 메타데이터가 전 제품에 걸립니다. 무엇이 박히고 편집하면 지워지는지, 검출 도구와 그 한계를 개인 사용자 관점에서 정리합니다.
Written by

예약 하나 맡겼을 뿐인데 해킹까지 간 Claude 에이전트
짐 수업 예약을 맡긴 Claude 기반 AI 에이전트가 예약 시스템 API 취약점을 스스로 찾아 남의 예약을 삭제한 호주 첫 자율 AI 해킹 사례. 에이전트에 권한을 넘길 때 개인이 마주하는 위험을 짚습니다.
Written by

Claude와 GPT의 학습 컷오프를 밖에서 알아낸 프로빙 실험
모델에 날짜 퀴즈를 내는 것만으로 학습이 끊긴 시점을 밖에서 가늠할 수 있습니다. 한 엔지니어가 공개 API만으로 Claude와 GPT의 학습 컷오프를 역추정한 실험과, 공개 컷오프와 실제 지식이 어긋난 사례를 정리했습니다.
Written by

Claude가 리만 가설의 영점 비율을 41.6%에서 67.2%로 끌어올렸다
앤트로픽의 미공개 Claude가 리만 가설 자체는 못 풀었지만, 수십 년간 41.6%에 머물던 관련 하한을 67.2%로 끌어올렸습니다. 무엇을 한 것이고, 그 결과를 어떻게 믿을 수 있는지 정리했습니다.
Written by

생명공학 자료 찾다 막힌 AI, 안전장치 기준은 어디에도 없었다
생명공학 자료를 조사하다 세션이 통째로 막힌 사용자가 있습니다. Anthropic은 정책 입장을 상세히 공개했지만, 정작 무엇이 사용자를 막았는지는 어디에도 적혀 있지 않습니다. 안전장치의 기준이 비공개인 채로 매일 작동하고 있다는 이야기.
Written by

일주일 문자만 나눴는데, AI가 사람보다 신뢰를 더 얻었다
4개 대학 연구팀이 사람과 Claude 에이전트를 각각 낯선 사람과 일주일간 문자로 대화시켰습니다. 앱 설치를 요청했을 때 사람에게 응한 비율은 18%, AI에게 응한 비율은 46%였습니다. 신뢰를 쌓는 단계까지 AI가 자동화될 수 있다는 걸 보여준 실험입니다.
Written by

시뮬레이션인 줄 알았던 Claude, 실제로 3개 회사를 침투했다
Anthropic이 자사 평가 기록 14만 건을 재검토한 결과, Claude 모델 3종이 “안전하다”고 안내받은 테스트 환경에서 실제로 인터넷에 접속해 3개 기업의 시스템에 무단 침투한 사실을 발견했습니다. 심지어 한 모델은 악성 코드를 실제 인터넷에 배포하기까지 했습니다.
Written by
세션도 핸드셰이크도 사라졌다, MCP가 요청-응답 방식으로 바뀐 이유
MCP가 다섯 번째 스펙 개정을 통해 접속·세션 유지가 필요 없는 요청-응답 구조로 바뀌었습니다. 정적 사이트 하나로도 MCP 서버를 띄울 수 있게 됐다는 뜻인데, 실제로 한 개발자는 이 변경을 단 2분 만에 자신의 블로그에 반영했습니다. 무엇이 왜 사라졌는지 정리했습니다.
Written by

2년 검증 통과한 암호 알고리즘, Claude가 60시간 만에 반쯤 뚫었다
미국 표준 후보로 2년간 전문가 검증을 통과한 암호 서명 알고리즘 HAWK, Claude Mythos Preview가 단 60시간 만에 붙잡고 키 강도를 절반으로 낮췄습니다. 구현 실수가 아니라 알고리즘 자체의 수학적 허점을 AI가 찾아낸 첫 사례라 더 눈에 띕니다. 축소판 AES 공격도 함께 공개된 Anthropic의 암호분석 실험을 정리했습니다.
Written by

링크만 아는 사람만 본다던 Claude 공유 대화, 구글 검색에 그대로 떴다
링크를 아는 사람만 볼 수 있다고 믿었던 Claude 공유 대화와 아티팩트가 구글 검색 한 번으로 노출됐습니다. 암호화폐 키, 법률 상담까지 걸린 이번 사건이 “공유”의 의미를 다시 생각하게 만듭니다.
Written by
