Автор канала разбирает свежий отчёт Anthropic, где сравнивают GLM-5.3 с Mythos в задачах кибербезопасности. И там действительно есть что обсудить: open-weight модель почти не уступает проприетарному фронтиру по созданию браузерных эксплойтов (50 успешных задач против 56), а guardrails обходит с вероятностью до 100% простыми промпт-техниками. Отдельно впечатляет, что GLM-5.3 в контролируемом эксперименте сама нашла неизвестные уязвимости и собрала работающий эксплойт-чейн — это уже не просто бенчмарк, а демонстрация автономных возможностей.
Но самое забавное, как отмечает автор, — это ирония судьбы: когда летом модель OpenAI взломала Hugging Face, именно GLM-5.2 помогла защитить открытую инфраструктуру, а Anthropic и OpenAI отказались участвовать. Теперь же они фактически сделали китайской модели мощную рекламу, признав её почти равной себе. Получается, что попытка предупредить об угрозе может обернуться обратным эффектом — привлечением внимания к сильной открытой модели.




