Китайская компания Zhipu ИИ представила модель GLM-5.3, которая, по заявлению разработчика, является самой мощной открытой моделью для программирования. Модель построена на той же базе, что и предыдущая версия GLM-5.2, однако все улучшения достигнуты исключительно за счет расширенного пост-обучения. Наибольший прирост производительности наблюдается в агентных задачах, где модель взаимодействует с инструментами и выполняет сложные сценарии.

Пост-обучение — это этап дообучения уже предобученной модели на специализированных данных. В случае GLM-5.3 компания использовала данные и среды, предназначенные для поиска уязвимостей в программном обеспечении. Согласно Z.ai, модель «начала рассуждать о нескольких этапах эксплуатации, формируя связные планы для полных цепочек атак». В сотрудничестве с китайскими командами безопасности было найдено 2436 уязвимостей в 269 проектах, некоторые из которых существуют до 40 лет. Найденные проблемы задокументированы в публичном реестре.

Этот акцент на кибербезопасности отличает GLM-5.3 от других китайских моделей, таких как Kimi или Qwen, которые пока отстают от американских моделей в этой области. Возможность модели выявлять уязвимости может быть полезна для автоматизации аудита кода, но также поднимает вопросы о потенциальном использовании в вредоносных целях. Zhipu ИИ подчеркивает, что работа велась с командами безопасности, а найденные уязвимости раскрываются ответственно.

Модель показала наибольший прирост в агентных задачах, став самой мощной открытой моделью для кода.

Image: Z.ai
Image: Z.ai · Источник: The Decoder

GLM-5.3 доступна уже сейчас через GLM Coding Plan и совместима с популярными кодинг-агентами, такими как ZCode, Claude Code и OpenCode. Веса модели планируется открыть через две недели, после завершения проверок безопасности. Это делает модель привлекательной для разработчиков, которые хотят использовать открытые веса в своих проектах, но при этом требуют высокой производительности в задачах программирования.

Для отрасли выпуск GLM-5.3 означает усиление конкуренции в сегменте открытых моделей для кода. Если заявленные показатели подтвердятся, модель может стать серьезным конкурентом для таких решений, как CodeLlama или DeepSeek Coder. Однако стоит учитывать, что заявления о «самой мощной» модели требуют независимой проверки, особенно в области агентных задач, где оценка сложна и зависит от конкретных сценариев.