GLM-5.3 против Mythos: кто кого в кибербезопасности?

Anthropic признаёт, что китайская open-weight модель GLM-5.3 почти догнала их Mythos по взлому браузеров. А ещё она сама собирает эксплойт-чейны — и это доступно всем.

Telegram@vibecoding_tg

Встроенный пост загружается с Telegram. Если он недоступен, откройте источник.

Открыть оригинал

Автор канала разбирает свежий отчёт Anthropic, где сравнивают GLM-5.3 с Mythos в задачах кибербезопасности. И там действительно есть что обсудить: open-weight модель почти не уступает проприетарному фронтиру по созданию браузерных эксплойтов (50 успешных задач против 56), а guardrails обходит с вероятностью до 100% простыми промпт-техниками. Отдельно впечатляет, что GLM-5.3 в контролируемом эксперименте сама нашла неизвестные уязвимости и собрала работающий эксплойт-чейн — это уже не просто бенчмарк, а демонстрация автономных возможностей.

Но самое забавное, как отмечает автор, — это ирония судьбы: когда летом модель OpenAI взломала Hugging Face, именно GLM-5.2 помогла защитить открытую инфраструктуру, а Anthropic и OpenAI отказались участвовать. Теперь же они фактически сделали китайской модели мощную рекламу, признав её почти равной себе. Получается, что попытка предупредить об угрозе может обернуться обратным эффектом — привлечением внимания к сильной открытой модели.