Z.ai развернула кластер из ста тысяч китайских ускорителей — помогала её модель

Z.ai опубликовала инженерный отчёт о том, как её модель GLM-5.3 участвовала в разворачивании рабочей инфраструктуры для запуска модели GLM-5.3-Flash. Задача была развернуть кластер из более чем ста тысяч китайских ускорителей — не Nvidia, и это первое их применение в таком масштабе.
Компания описывает это как первый шаг к рекурсивному самоулучшению: модель помогала писать и отлаживать то, на чём работает её же младшая версия. Отчёт вышел на первое место обсуждений Hacker News с 264 комментариями — спор идёт о том, сколько в этой работе действительно сделала модель, а не инженеры.
Что говорят
embedding-shapeHacker News
Хотел спросить, как людям их тарифы для кодинга, и понял: цены же резко подняли. Средний план теперь около $80 в месяц, а раньше был вроде $20. Похоже, они упёрлись в жёсткие пределы масштабирования, раз так быстро всё подорожало.
rob74Hacker News
После статьи остался один вопрос: что вообще такое GLM? Честно говоря, и про z.ai я ничего не знаю — самонадеянно считать, что все знакомы с их продуктом.