30 сентября Google анонсировала Gemini 4 Argon, свою новую флагманскую модель. Компания утверждает, что Argon превосходит GPT-6 Astra, Claude Fable 5.1 и Claude Opus 5.5. По данным Google, в сравнении с GPT-6 Astra и Claude Opus 5.5 модель заняла первое место в 13 из 19 опубликованных бенчмарков. На DeepSWE она набрала 77,9% против 74,2% у Opus 5.5 и 74,1% у Astra.[1][2][3][4]
Модель на старте получат не все. Как сказал Корай Кавукчуоглу из Google DeepMind, сначала доступ откроют «группе доверенных специалистов по киберзащите» и государственным пользователям в рамках программы Fairwind. По его словам, Google участвует в добровольном процессе правительства США по предрелизному доступу к моделям и будет расширять доступ постепенно.[5][6]
Стандартная цена составит $4 за 1 млн входных и $20 за 1 млн выходных токенов. Действует вступительная скидка 50%, со скидкой цена снижается до $2 и $10, когда она закончится, Google не сообщила.[7]
Google заявляет о лимите вывода в 1 млн токенов, прежде он составлял 64 тыс. Независимые замеры расходятся. Vals AI зафиксировал максимум в 262 тыс. токенов, а Artificial Analysis добрался до 1 млн с помощью новой функции API Long Decode Continuation, которая приостанавливает длинный ответ и продолжает его в следующих вызовах.[8][9]
В Intelligence Index от Artificial Analysis Argon набрал 53 балла, столько же, сколько GPT-6 Astra. Доля галлюцинаций в тесте AA-Omniscience у Argon составила 15% против 51% у Astra, но и точность ниже: 50% против 63%. Наблюдатель @BlackHC указал, что в юридическом бенчмарке Harvey модель набрала 19,6% и уступила Muse Spark 1.2 с её 25,42%.[10][11][12]
Как пишет Numerama, в мае Google обещала выпустить Gemini 3.5 Pro, но отменила релиз из-за слишком слабых результатов.[13]
По материалам
Текст составлен ИИ по материалам ниже и не содержит фактов, которых нет в источниках.
Vals lists 262K max output. Artificial Analysis reached 1M output tokens through Long Decode Continuation, a new API feature that pauses long responses and resumes them across calls