DeepSeek V4.1-Flash: модель с экономными вычислениями

2026-09-13 · Бельский.ком
DeepSeek представила Flash-версию большой модели. Внутри 552 млрд параметров, но новая архитектура задействует лишь часть: 8 млрд при обработке запроса и 16 млрд при генерации ответа. KV-кэш стал компактнее в 4 раза, 890 байт на токен. Результаты сильные в коде и автоматизации: 90,6% на Terminal-Bench 2.1 и 88,1% на CyberGym, выше представленных конкурентов. Цены вне пиковых часов: 0,15 долл. за миллион входных токенов, 0,60 долл. за выходные, чтение кэша 0,003 долл. В пиковые часы вдвое дороже. Модель уже доступна как deepseek-flash. С 14 сентября запросы к V4-Pro автоматически переведут на Flash по её тарифам, до выхода V4.1-Pro.
Подписывайтесь на наши каналы:
← Все новости