AI Sparkup

최신 AI 쉽게 깊게 따라잡기⚡

잠재공간 – 머신러닝 모델이 데이터의 의미를 압축해 표현하는 좌표계

잠재공간(latent space)은 이미지, 문장, 음성처럼 복잡한 원본 데이터를 모델이 학습한 숫자 벡터의 좌표계로 옮긴 공간이다. 원본의 모든 픽셀이나 단어를 그대로 저장하는 대신, 과제에 중요한 특징을 가깝고 멀게 배치해 검색·분류·생성을 가능하게 한다.

왜 필요한가

고양이 사진과 고양이라는 단어는 표면 형태가 다르지만, 잘 학습된 표현에서는 의미상 가까울 수 있다. 이 압축 표현을 이용하면 비슷한 상품 찾기, 고객 군집화, 문서 검색, 이상치 탐지를 할 수 있다. 단, ‘가깝다’는 의미는 모델의 학습 데이터와 목적이 정한다. 감정 분류용 잠재공간이 법률 검색에 그대로 좋은 것은 아니다.

세 가지 역할

역할설명예시
표현많은 차원의 원본을 과제에 유용한 벡터로 압축이미지 임베딩
예측가까운 벡터의 패턴으로 분류·회귀유사 고객의 이탈 예측
생성공간의 점을 샘플링·변형해 새 데이터를 복원확산 모델 이미지 생성

오토인코더(autoencoder)는 입력을 encoder로 잠재 벡터로 줄이고 decoder로 복원한다. 생성 모델은 이 공간에서 보간(interpolation)하거나 조건을 주어, 기존 샘플 사이의 그럴듯한 새 결과를 만든다.

활용할 때의 주의점

벡터 차원 수가 작다고 항상 설명하기 쉬운 것은 아니다. 축 하나가 ‘웃음’이나 ‘가격’처럼 분리돼 있다는 보장은 없고, 데이터 편향도 공간에 들어간다. 따라서 검색·추천 서비스는 거리 점수만 믿지 말고 rag-tips-reranking 같은 재순위화와 실제 정답 데이터 평가를 함께 둔다.

관련 문서

참고 자료



AI Sparkup 구독하기

최신 게시물 요약과 더 심층적인 정보를 이메일로 받아 보세요! (무료)