DeepSeek-V4-Flash-Base
DeepSeek-V4-Flash-Base в новостной повестке, календарь упоминаний и aналитика в реальном времени.
Календарь упоминаний:
Яндекс открыл исходный код Alice AI Foundation LLM, опередив DeepSeek-V4-Flash-Base в русскоязычных тестах
Компания Яндекс сделала публичной претрейн-версию своей 80-миллиардной языковой модели на архитектуре MoE. Разработка демонстрирует высокую эффективность генерации ответов на фактологические вопросы по-русски, превосходя более крупные опенсорс-аналоги. В частности, Alice AI Foundation LLM показала лучшие результаты в соответствующих бенчмарках по сравнению с моделью DeepSeek-V4-Flash-Base, которая обладает значительно большим объемом параметров.
Связь: Модель Alice AI Foundation LLM обогнала DeepSeek-V4-Flash-Base (284 млрд параметров) по качеству ответов на фактологические вопросы на русском языке.
Фактор: Архитектура MoE с активацией лишь 3 млрд из 80 млрд общих параметров обеспечивает высокую скорость инференса и снижает нагрузку на оборудование при обработке запросов.
В нашей базе собрано 1 событие по теме «DeepSeek-V4-Flash-Base». Мы показываем все из них.