Z.ai выпустила GLM-5.3: прирост за счет масштабирования RL и рост кибербзопасности
Z.ai представила GLM-5.3 — новую версию своей флагманской модели. Возможности выросли за счет масштабирования post‑training и reinforcement learning: базовая модель при этом осталась той же, что использовалась в GLM-5.2.Главный акцент разработчики сделали на обучении на реальных задачах.
RL использовался не только для улучшения ответов модели, но и для практических инженерных сценариев, включая оптимизацию самого процесса тренировки.
habr.com