Вышел в публичный доступ DeepSeek-V4.1-Flash
Лето было богатым на релизы новых моделей нейронок, осень тоже старается от него не отставать. Китайцы из DeepSeek релизнули новую версию флагманской модели - DeepSeek-V4.1-Flash.

Пока что это самая компактная модель в новой архитектурной линейке компании, запуск которой совпал с подготовкой DeepSeek к IPO на шанхайской бирже STAR Market (разумеется, случайно).
DeepSeek-V4.1-Flash построена на архитектуре Causal-Encoder-Decoder с 552 миллиардами параметров, но использует Mixture-of-Experts (MoE): для обработки входных данных активируется всего 8 миллиардов параметров, а для генерации ответов - 16 миллиардов, что значительно снижает вычислительные затраты.
DeepSeek существенно снизил цены API - до 0,02 юаня за миллион кэшированных токенов в часы минимальной нагрузки. Протестировать бесплатно можно на официальном сайте.
Понравилась статья?
Оцените материал — это поможет нам делать лучше.