ByteDance решила резко поднять ставки в гонке ИИ: компания обучает модель, масштаб которой может достичь 10 триллионов параметров. Если план сработает, это будет примерно втрое больше, чем у Kimi K3 — крупнейшей китайской модели на сегодняшний день.

Но финальную цифру пока никто не называет. По данным источников Financial Times, точный размер определят позднее, а одно только предварительное обучение может занять от трёх до шести месяцев.

На этом фоне интересно сравнить проект с американскими разработками. Официальные размеры моделей Anthropic не раскрывает, однако отраслевые оценки дают около 8 триллионов параметров для Mythos 5 и примерно 5 триллионов для Fable 5.

При этом гонка за нулями сама по себе ничего не гарантирует. Качество модели зависит не только от числа параметров, но и от данных, архитектуры и того, как именно систему обучают.

И здесь у ByteDance есть принципиальный выбор. Источники FT утверждают, что компания старается не использовать дистилляцию чужих моделей и хочет создавать технологическую базу самостоятельно. Такой путь может оказаться медленнее, но руководство ByteDance, по словам собеседников издания, считает его необходимым, если компания действительно хочет обойти американские лаборатории.

Если проект доведут до конца, китайская ИИ-гонка получит новый ориентир по масштабу. Для рынка это может означать ещё более дорогую борьбу за вычислительные мощности и данные, а для бизнеса — появление моделей с заметно большими возможностями.