bg
Цифровые продукты и платформы
08:14, 25 сентября 2026
views
13

У «Яндекса» появилась новая ИИ-модель, обученная с нуля

Транснациональная компания в отрасли информационных технологий «Яндекс» создала собственную большую языковую модель Alice AI Foundation LLM. Разработчики уже выложили базовую версию ИИ-модели в свободный доступ. Представители компании уверяют, что она была обучена с нуля, без использования иностранных составляющих.

Появление новинки – хорошая новость не только для ИТ-специалистов, но и для рядовых российских пользователей. В будущем ее технологии должны перейти к нейросети «Алиса». Это позволит более качественно обрабатывать сложные запросы, обращенные к виртуальному помощнику, а также улучшит рассуждения и выполнение многошаговых заданий.

«Считывает»запросы аудитории

ИИ-модель показала высокие результаты в программировании и способности к рассуждению, а по качеству ответов на русском языке – оставила позади многие мировые аналоги, особенно, когда речь идет о знании фактов, интересных русскоязычной аудитории. По словам представителей «Яндекса», Alice AI Foundation LLM опережает крупные модели искусственного интеллекта, которые находятся в публичном доступе. При этом ей не требуются большие вычислительные мощности для обработки новых данных. Ее можно использовать как в исследовательских, так и в коммерческих проектах благодаря свободной лицензии Apache 2.0. Новый ИТ-продукт «Яндекса» – экспериментальная версия. Разработчик тестирует на нем архитектурные решения для своей будущей единой рассуждающей модели (ЕРМ). Рассуждающая модель в перспективе станет основой агентных возможностей Алисы AI, и пользователи смогут поручать ей выполнение конкретных действий.

Включает 80 миллиардов параметров

Новая большая языковая модель «Яндекса» Alice AI Foundation LLM построена на архитектуре MoE (Mixture of Experts). Она включает 80 миллиардов параметров, из которых в моменте активны только 3 миллиарда. Благодаря этому получается обеспечить высокую скорость и экономичность ее работы. Это важно, ведь чем эффективнее сама ИИ-модель, тем шире возможности ее применения бизнесом и исследовательскими командами, у которых нет доступа к большим вычислительным ресурсам. У новой разработки «Яндекса» есть еще несколько преимуществ: способности к рассуждению и работе в агентных сценариях, эффективность в решении сложных логических задач и программировании. Так, олимпиадные задачи она решает не хуже, чем Qwen3.5-35B-A3B-Base, а в написании кода обогнала модель компании NVIDIA Nemotron-3-Super-120B-Base. Высокое качество анализа информации и программирование нужны ей как воздух для эффективной работы агентов, которые могут выполнять действия по поручению пользователя. Несмотря на компактный размер и меньшую требовательность к вычислительным мощностям, новая модель «Яндекса» обходит в решении задач DeepSeek-V4-Flash-Base с 284 млрд параметров. Исследования показали, что этот российский ИТ-продукт отвечает пользователям на уровне предыдущей закрытой модели «Яндекса»Alice AILLM, хотя у той было в три раза больше параметров и в семь раз больше активных

Компания-разработчик решила оценивать русскоязычные знания своей ИИ-модели с помощью новых инструментов для тестирования системы (бенчмарков). Так, ИТ-команда создала два собственных бенчмарка – WikiWebFacts и HardMultiQA. Первый из них отвечает за проверку дат, определений, событий и персоналий. Второй охватывает более редкие области знаний – от медицины и права до ИТ и искусства.

При создании новой модели ИТ-специалисты «Яндекса» усовершенствовали работу оптимизатора – программы, управляющей процессом обучения. Это позволило в десятки раз сократить вычисления и сохранить около 95% полезных документов. Также инженеры пополнили базу знаний ИИ-модели в области права, медицины и математики. Сегодня новая модель «Яндекса» уже прошла основной этап обучения, ее можно использовать как основу для создания собственных проектов. Она предоставляется под лицензией Apache 2.0 и ее можно применять в коммерческих и исследовательских целях.

Дообучить под собственные задачи? Легко!

Появление новой большой языковой модели «Яндекса» соответствует тренду ИТ-отрасли, в рамках которого компании-разработчики стремятся не просто увеличивать ИИ-модели, а делать их более результативными при меньших вычислительных затратах. Российские ИТ-специалисты движутся в том же направлении, что и весь мировой рынок – создают собственные цифровые решения и вкладываются в их эффективность. Как отмечают представители «Яндекса», Alice AI Foundation LLMстанет технологическим фундаментом для следующих поколений продуктов компании. Кроме того, эту большую языковую модель могут использовать и другие разработчики, ведь ее можно скачать и применять в коммерческих целях. Важно, что вся информация будет сохраняться внутри собственной инфраструктуры пользователя, а ИИ-модель можно будет дообучить с учетом отраслевой специфики.

На сегодняшний день новая модель «Яндекса» может быть полезна в первую очередь узким специалистам, но в будущем ее технологии пополнят портфель нейросети «Алиса» и сделают последнюю более эффективной. В долгосрочной же перспективе, Alice AI Foundation LLM может стать базой для корпоративных ассистентов, автоматизации поддержки, а также для RAG-систем, которые объединяют большие языковые модели с внешними базами данных. И такие примеры уже есть: YandexGPT 5 в Yandex Cloud используется для создания ИИ-ассистентов.

Выход новой большой языковой модели – важный шаг в развитии российской отрасли искусственного интеллекта. Потенциально Alice AI Foundation LLM может стать товаром на экспорт в страны, где используется русский язык и проживает русскоязычная аудитория. Однако говорить об этом преждевременно, поскольку ее еще предстоит превратить из базовой версии в законченный продукт.

Появление новой большой языковой модели, разработанной в России с нуля, – важная веха для отечественной отрасли ИИ. Оно показывает, что российские компании обладают собственными технологиями и полным набором компетенций для создания современных моделей, а отечественная школа ИИ остается конкурентоспособной. Самое интересное – это технический отчет компании-производителя. Мы видим, что сегодня развитие ИИ – это уже не гонка исключительно за размером моделей. У новой разработки 80 млрд параметров, но непосредственно при работе используется около трех. В отчете указано, что при таком эффективном размере модель способна показывать сопоставимые, а в отдельных тестах и более высокие результаты, чем значительно более крупные зарубежные решения
quote
like
heart
fun
wow
sad
angry
Последние новости
Главное
Рекомендуем
previous
next