Назад к дайджесту
Reddit

Google выпустила мультимодальную модель встраивания EmbeddingGemma 2

Google DeepMind представила открытую модель EmbeddingGemma 2, способную преобразовывать текст, изображения, видео и аудио в единое 768-мерное векторное пространство. Модель объемом 740 млн параметров оптимизирована для работы на потребительских устройствах и поддерживает задачи поиска, RAG, классификации и кластеризации с учетом контекста до 8K токенов.

score 55r/LocalLLaMA