roko.fans четверг, 8 октября 2026

Китайская GLM-5.3 в тесте Anthropic написала рабочие эксплойты для V8 в 12% попыток

Anthropic впервые оценила открытую китайскую модель и опубликовала исследование о том, насколько GLM-5.3 от Z.ai продвинулась в поиске и эксплуатации уязвимостей. На ExploitBench модель довела известные уязвимости движка V8 до рабочего эксплойта в 50 попытках из 410, то есть в 12% случаев. У Claude Mythos Preview на том же бенчмарке 14%, а у GLM-5.2 и Claude Opus 4.6 результат близок к нулю.[1][2][3]

Объекты:

В ручных тестах GLM-5.3 за день нашла несколько неизвестных уязвимостей в JavaScript-движке популярного браузера и собрала из них страницу, которая читает файлы посетителя. Облегчённая GLM-5.3-Flash за 8 часов работы и 20 минут внимания исследователя собрала цепочку эксплойтов для Chrome на основе CVE-2026-11645. По ценам API Zhipu это стоило бы 20,40 доллара.[4][5]

Защиту модели исследователи Anthropic обходили в 64% случаев легендой «red-team агента», в 92% случаев подменяли рассуждения модели, а абляция отказов сработала в 100% случаев. Встроенные ограничения, утверждает Anthropic, обходятся без особых усилий, а в открытых весах их можно снять.[6][7]

17 сентября CAISI при NIST назвал GLM-5.3 «самой сильной в киберзадачах моделью с открытыми весами» и оценил её отставание от американского фронтира примерно в четыре месяца. На SEC-Bench Pro, по данным CAISI, модель решает 40,4% задач, а американские передовые модели 90,2%.[8][9]

Z.ai выпустила GLM-5.3 в августе и через две недели выложила веса. Anthropic предлагает шире открывать передовые модели для специалистов по безопасности и проверять достаточно сильные модели до выпуска на уровне государств. Z.ai пока никак не отреагировала ни на оба исследования, ни на инициативу Anthropic.[10][11][12]

Текст составлен ИИ по материалам ниже и не содержит фактов, которых нет в источниках.

  1. 1 Telegram: @ai_machinelearning_big_data — 📌 Anthropic оценила кибервозможности GLM-5.3 ↗ 30 сентября, 10:13 · сноски 1, 2, 3, 7, 9, 10, 11, 12
  2. 2 Telegram: @blognot — Anthropic опубликовали разбор GLM-5.3 с недвусмысленными заявлениями — новая китайская модель имеет сопоставимые с передовыми моделями типа Mythos возможности в области кибербезопасности и может быть использована злоумышленниками, в том числе для полного цикла создания эксплоитов, начиная от обнару… ↗ 30 сентября, 01:29 · сноски 4, 5, 6, 8
  1. 3 Хабр — новости — Anthropic обеспокоены возможностями GLM-5.3 ↗ 30 сентября, 15:02
  2. 4 Telegram: @droidergram — 🔐Gemini 4 под замком ↗ 1 октября, 17:32
  3. 5 Telegram: @data_secrets — Джеффри Хинтон, Йошуа Бенджио и еще два десятка исследователей выпустили статью про интеллектуальный взрыв ↗ 3 октября, 18:50
  4. 6 iXBT.com — Новую ИИ-модель Google Gemini 4 Argon раскритиковали в первый же день: модель мухлюет на бенчмарках и буксует в коде ↗ 3 октября, 23:54

Запись полезная?

Войдите, чтобы ответить

Anthropic выпустила Claude Haiku 5.5 по цене $0,10 за миллион входных токенов