Модель EmbeddingGemma 2 вышла под открытой лицензией Apache 2.0. Разработчик Саймон Уиллисон считает это сильной стороной модели. «Мне очень нравится, что EmbeddingGemma 2 выпущена под лицензией Apache 2.0», — написал он в комментарии на Hacker News. Позже Уиллисон опубликовал этот комментарий на своём сайте.[1][2]
По его мнению, именно для эмбеддинг-моделей нет смысла выбирать закрытую проприетарную модель, доступную только через хостинг. Уиллисон объясняет это тем, что в большинстве приложений такие модели вычисляют тысячи или даже миллионы векторов, а затем эти векторы хранятся, чтобы их можно было сравнивать.[3][4]
«Если модель проприетарная, вендор, скорее всего, однажды решит перестать её предлагать. У него будет модель получше на замену, но вам всё равно придётся платить за пересчёт миллионов уже сохранённых векторов», — сказал Уиллисон.[5]
Уиллисон напоминает, что в апреле 2024 года OpenAI предлагала покрыть пользователям расходы на повторный эмбеддинг контента при переходе на новые модели.[6]
Сам запускать модель у себя Уиллисон не хочет. Он предпочёл бы платить провайдеру за хостинг, но знать, что если тот перестанет предлагать модель, можно будет запустить открытые веса самостоятельно или найти другого поставщика, который сделает это за него.[7]
По материалам
Текст составлен ИИ по материалам ниже и не содержит фактов, которых нет в источниках.
If your model is proprietary, the vendor is likely someday going to decide to stop offering that model. They'll have a better model to replace it, but you still need to pay to re-calculate those millions of stored existing vectors.
Notably, I don't want to host the model myself. I'd much rather pay a provider for a hosted model while knowing that if they ever stop hosting it I can run the open weights version myself - or find another vendor who can do that for me.