Moait
홈인기 피드모든 블로그모든 태그
홈인기 피드모든 블로그모든 태그

통합 검색 임베딩 모델 개발기: 9개 태스크를 고르게 학습시키기

미리디 favicon미리디·AI/ML·
Information RetrievalTwo Tower ArchitectureEmbeddingContrastive LearningText To Image Retrieval
2026년 08월 11일0

AI 요약

이 글은 AI가 요약했어요. 정확한 내용은 꼭 원문을 확인해 주세요!

핵심 요약

미리디가 9개 태스크를 균등하게 학습시키는 통합 검색 임베딩 모델을 개발하며, 태스크 간 간섭 원인을 분석해 프리픽스/데이터 프리픽스 도입, 태스크별 로그it scale 분리, Interleaved Smart Batching, LLM 평가와 그리드 풀링으로 비용을 절감하고 전체 성능을 개선했습니다. 9개 태스크의 평균 nDCG는 0.7249→0.8173, Precision은 0.6099→0.7322로 올랐습니다.

구현 방법

  • Qwen3-VL-Embedding 기반 파인튜닝 도입
  • 쿼리 프리픽스(서비스명)로 태스크 구분, 타깃 데이터 프리픽스(Template: Element: Photo:)로 대상 구분
  • 태스크별 Temperature를 학습 가능한 파라미터로 분리
  • Interleaved Smart Batching으로 태스크 단위 배치 구성 및 데이터 규모에 비례하는 사이클 운영
  • LLM as Judge와 그리드 풀링으로 평가 비용 약 1/20 수준으로 감소

주요 결과

  • 9개 태스크 평균 성능: nDCG 0.7249 → 0.8173, Precision 0.6099 → 0.7322
  • 표준편차 감소: nDCG 15.7%p → 8.2%p, Precision 17.9%p → 10.4%p
  • 실서비스 대비 평균 상승: nDCG +2.1%p, Precision +4.8%p
  • 요소 스타일검색은 큰 회복, 일부 태스크의 여지는 남아 있음
  • 앞으로는 의미/스타일 정보를 하나의 임베딩에 공동 보존하는 방법이 남은 과제

연관 피드

%가 높을수록 이 글과 비슷할 가능성이 높아요!
T4 GPU 1장으로 일궈낸 올리브영의 Gemma 3 기반 sLLM 구축기 섬네일
77%

T4 GPU 1장으로 일궈낸 올리브영의 Gemma 3 기반 sLLM 구축기

올리브영 favicon올리브영·2026년 01월 21일
2부: 정책을 따르는 평가자, LLM-as-a-Judge 섬네일
74%

2부: 정책을 따르는 평가자, LLM-as-a-Judge

하이퍼커넥트 favicon하이퍼커넥트·2026년 04월 22일
No Image
72%

2조 토큰을 카테고리 분류에 쓰면서 알게된 것들

당근 favicon당근·2026년 02월 27일