Представлена ИИ-модель Gemini Embedding 2.

иcтoчник: www.kv.by

Gemini Embedding 2 - первая полностью мультимодальная модель, которая объединяет текст, изображения, видео, аудио и документы в единое векторное пространство.

Модель поддерживает более 100 языков, входные тексты до 8192 токенов, до 6 изображений за запрос, 120-секундные видеоролики, собственные аудиодорожки и PDF-файлы объемом до 6 страниц, что упрощает выполнение таких задач, как RAG, семантический поиск, кластеризация и анализ тональности.

Благодаря технологии Matryoshka Representation Learning, которая позволяет задействовать векторы разных размеров, разработчики могут балансировать между производительностью и потреблением памяти, применяя современные подходы мультимодального анализа.