«Яндекс» представил экспериментальную языковую модель Alice AI Foundation LLM и открыл к ней доступ на Hugging Face. Компания утверждает, что разработала модель с нуля без сторонних иностранных компонентов.
В основе Alice AI Foundation LLM лежит архитектура Mixture of Experts, или «смесь экспертов». Модель состоит из специализированных блоков и для каждого запроса включает только нужные. Всего у нее 80 млрд параметров, но одновременно задействуются 3 млрд. Это снижает требования к вычислительным ресурсам.
По данным «Яндекса», модель сильна в математике, программировании и русскоязычных заданиях. В олимпиадной математике она разделила первое место с Qwen3.5-35B-A3B-Base. В тестах по написанию кода модель опередила Nvidia Nemotron-3-Super-120B-Base, у которой в четыре раза больше активных параметров.
В заданиях на знание фактов Alice AI Foundation LLM показала результат выше, чем более крупная открытая DeepSeek-V4-Flash-Base. Ее показатели также оказались сопоставимы с предыдущей закрытой Alice AI LLM. При этом у закрытой модели втрое больше параметров и в семь раз больше активных.
Вместе с моделью «Яндекс» опубликовал два бенчмарка для русского языка. WikiWebFacts проверяет знание дат, событий, определений и персоналий. HardMultiQA составлен на основе обезличенных запросов к «Алисе AI» и охватывает медицину, право, ИТ, искусство и другие темы. В открытый доступ также выложены эталонные ответы и правила оценки.
Alice AI Foundation LLM пока не стала основой отдельного пользовательского продукта. «Яндекс» использует ее для проверки решений, которые войдут в будущую единую рассуждающую модель. Она должна стать технологической базой для агентных функций «Алисы AI», способных выполнять порученные пользователем действия.