пятница, 14 августа 202616:40МСК

Z.ai выпустила GLM-5.3: прирост за счет масштабирования RL и рост кибербзопасности

·Хабр

Z.ai представила GLM-5.3 — новую версию своей флагманской модели. Возможности выросли за счет масштабирования post-training и reinforcement learning: базовая модель при этом осталась той же, что использовалась в GLM-5.2. Главный акцент разработчики сделали на обучении на реальных задачах. RL использовался не только для улучшения ответов модели, но и для практических инженерных сценариев, включая оптимизацию самого процесса тренировки. По словам команды Z.ai , такой подход дал заметный прирост в программировании и задачах, требующих длинных последовательностей действий. На внутреннем Code Bench

Источники сюжета

Заголовки и краткие цитаты приведены со ссылкой на источник в порядке информирования. Полные тексты доступны на сайтах изданий, права на них принадлежат правообладателям.