Google DeepMind은 텍스트, 코드, 이미지, 비디오, 오디오를 통합된 768차원 벡터 공간으로 매핑하는 오픈소스 멀티모드 임베딩 모델인 EmbeddingGemma 2를 출시했습니다. 이 모델은 총 7억 4천만 개의 파라미터로 구성되며, 2억 7천만 파라미터 텍스트 인코더와 모듈식 비전(1억 7천만) 및 오디오(3억) 인코더를 결합합니다.
- 낮은 지연 시간의 시맨틱 표현을 위해 모바일 기기 및 노트북과 같은 소비자용 하드웨어에서 실행하도록 설계되었습니다.
- 검색, 검색 증강 생성(RAG), 분류 및 클러스터링을 포함한 온디바이스 애플리케이션을 지원합니다.
- Hugging Face를 통해 오픈 모델로 제공됩니다.