GLM-Z1-32B-0414 — это модифицированный вариант модели GLM-4-32B с усиленными возможностями рассуждения, созданный для глубокого решения математических, логических и программных задач. Модель использует расширенное обучение с подкреплением — как специализированное для конкретных задач, так и общее, основанное на парных предпочтениях — чтобы повысить эффективность при выполнении сложных многошаговых задач. По сравнению с базовой версией GLM-4-32B Z1 значительно улучшает способности к структурированному рассуждению и работе в формальных областях.
Модель поддерживает принудительные этапы «мышления» с помощью инженерии подсказок и обеспечивает повышенную связность при генерации длинных текстов. Она оптимизирована для агентных сценариев и включает поддержку длинного контекста (с помощью YaRN), вызова инструментов через JSON и тонкую настройку параметров семплирования для стабильного вывода. Идеально подходит для случаев, требующих осознанного многошагового рассуждения или формальных выводов.