ElevenLabs
프레임 3만 장 대신 12KB, 코딩 에이전트를 영상 편집기로 만든 video-use
원본 푸티지를 폴더에 넣고 Claude Code와 대화하면 완성본이 나오는 오픈소스가 공개됐습니다. 비결은 모델이 영상을 보지 않고 읽는다는 설계죠. 프레임을 통째로 넘기면 4,500만 토큰인 작업을 12KB 텍스트로 처리하는 방법을 정리했습니다.
Written by

그래미 레전드도 참여한 AI 음악 앨범, ElevenLabs가 보여준 새로운 가능성
그래미 수상자들이 참여한 첫 메이저 AI 음악 앨범. ElevenLabs가 아티스트 저작권을 보장하며 AI 음악의 윤리 문제를 해결한 방법을 소개합니다.
Written by

학생당 42센트로 AI 부정행위 잡기: NYU 교수의 AI 구술시험 실험
NYU 교수가 학생당 42센트로 AI 음성 에이전트 구술시험을 실시한 실험. AI 부정행위 시대의 현실적 평가 방법과 그 한계를 소개합니다.
Written by

AI 오디오 모델, 2년 내 범용화된다: ElevenLabs CEO가 말하는 진짜 경쟁력
AI 오디오 선두기업 ElevenLabs CEO가 예측한 AI 모델의 상품화와 차별화 전략. 모델 성능에서 애플리케이션 경쟁으로 전환되는 AI 시장의 미래를 분석합니다.
Written by

AI 음성 복제, 이제 진짜와 구분 못한다: 신뢰의 새로운 기준
Queen Mary 대학 연구진이 밝힌 충격적 사실 – AI가 복제한 목소리와 진짜 사람 목소리, 구분 성공률이 단 4%p 차이. 음성만으로 신원을 확인하던 시대가 끝났습니다.
Written by

ElevenLabs Eleven Music 출시: AI가 만드는 스튜디오급 음악의 시대
ElevenLabs가 출시한 AI 음악 생성 서비스 ‘Eleven Music’의 주요 기능과 상업적 활용 가능성, 그리고 AI 음악 생성 시장의 현황과 전망을 소개합니다.
Written by

Mistral Voxtral: 음성 AI의 게임체인저가 된 오픈소스 모델
프랑스 AI 스타트업 Mistral이 공개한 첫 오픈소스 음성 AI 모델 Voxtral의 특징과 활용법을 소개합니다. 기존 솔루션 대비 절반 가격으로 더 나은 성능을 제공하는 Voxtral로 음성 AI 접근성이 크게 개선되었습니다.
Written by
