Перейти к содержанию

«Яндекс» создал языковую модель на 80 млрд параметров

Alice AI Foundation обучали с нуля на 18 трлн токенов, а её веса открыли для разработчиков

«Яндекс» разработал большую языковую модель Alice AI Foundation LLM, которую компания обучала с нуля без сторонних иностранных компонентов. В модели 80 млрд параметров, при этом одновременно активны около 3 млрд. Для обучения использовали 18 трлн токенов — фрагментов текста, на которых нейросеть училась понимать и генерировать информацию.

Источник изображения: Grok

Компания также открыла веса модели. Это позволяет разработчикам самостоятельно запускать её и дообучать под свои задачи. Лицензия допускает использование Alice AI Foundation в коммерческих и исследовательских проектах. В «Яндексе» рассчитывают использовать модель как основу для будущей системы с возможностями рассуждения и агентными функциями «Алисы AI».

При этом называть Alice AI Foundation уже официально признанной суверенной моделью пока рано. «Яндекс» позиционирует разработку как полностью суверенную, однако закон устанавливает отдельную процедуру подтверждения соответствия требованиям к таким моделям. Основные нормы, связанные с этим регулированием, начнут действовать с 1 марта 2027 года.

По закону суверенная большая фундаментальная модель должна разрабатываться российским юридическим лицом, а её жизненный цикл должен быть технически воспроизводим. Ответы пользователям и хранение данных должны обеспечиваться российскими центрами обработки данных, а сама модель должна пройти установленное подтверждение соответствия. Для национальной модели требования мягче — закон допускает использование компонентов, созданных как в России, так и за рубежом, если они распространяются на условиях открытой лицензии.

В июле глава «Сбера» Герман Греф говорил, что полностью отечественная большая языковая модель есть только у банка, а «Яндекс» якобы занимается дообучением китайских нейросетей Qwen компании Alibaba. «Яндекс» это отрицал. Теперь компания представила собственную модель, обученную с нуля.

Представитель «Сбера» назвал появление Alice AI Foundation свидетельством высокого уровня российских инженерных команд. При этом он отметил, что моделей с количеством параметров до 100 млрд уже много, а положение страны в мировой гонке, по его оценке, определяется прежде всего флагманскими моделями с сотнями миллиардов и триллионами параметров.

Некоторые эксперты считают новую модель частью конкуренции «Яндекса» и «Сбера». Заведующий кафедрой ИИ Финансового университета Михаил Коротеев назвал её ответом на сложившуюся дискуссию и попыткой «Яндекса» сократить отставание от Сбербанка. После постобучения, по его оценке, модель сможет конкурировать с GigaChat 3.5 Reasoning.

Сколько именно стоила разработка Alice AI Foundation, «Яндекс» не раскрывает. Оценки экспертов сильно расходятся. Собеседник «Ведомостей» в крупном облачном провайдере оценил основной этап обучения в 150–450 млн рублей. Руководитель центра разработки больших языковых моделей Валентин Малых через представителя MWS AI назвал сумму около 4 млрд рублей при аренде систем Nvidia DGX. Директор по развитию бизнеса Data Light Александр Громов оценил расходы на вычисления с учётом экспериментов и неудачных запусков примерно в 0,5–1 млрд рублей.

Читайте ещё материалы по теме: