Яндекс.Метрика
← Дайджест от 12 августа 2026

Tencent показала WorldClaw: 3D-мир по одной фразе, без своей модели

Команда Hunyuan3D из Tencent опубликовала технический отчёт о WorldClaw — системе, которая по текстовому описанию собирает трёхмерную сцену: рельеф, поверхности, постройки, растительность, транспорт. На выходе получаются полигональные модели с текстурами, которые открываются в Blender и правятся руками.

Своей модели у WorldClaw нет — это обвязка над чужими: роль агента-распорядителя играет Claude Opus 4.8, картинки делает GPT-Image-2, отдельные модели отвечают за сегментацию и геометрию. Такой подход показывает, что заметный результат в трёхмерной генерации собирается из готовых частей, а не обучается с нуля.

Что говорят
avaerHacker News
Если это неочевидно: это не модель, а python-скрипты, которые дёргают модели (код недоступен). В основном «а вы знали, что к процедурной генерации можно приделать LLM?», но одна идея любопытна: композицию делает картиночная модель (у них это отлично получается), а потом объекты вытаскиваются в 3D через что-то вроде SAM3D и расставляются в мире.
cautiouscatHacker News
Открытые миры хороши расставленными руками деталями и средовым рассказом — сравните Skyrim/Cyberpunk и Starfield, где почти всё сгенерировано. Для рынка Tencent с потоковым производством гача-игр это, наверное, отлично, но такие миры не почешут тягу к настоящему открытому миру.
cobertosHacker News
На осеннем и зимнем примерах алгоритм, похоже, поставил дома прямо на воду, а в летнем расстановка зданий и лужицы воды слева выглядят небрежно — как будто человек прошёлся кистью-разбрасывателем не глядя. Интересно, насколько примеры отобраны и правда ли это сделано одним проходом.