tsingular.ru
Все статьи

DeepSeek официально выпустила V4.1 Flash: младшая модель обошла флагманскую V4 Pro и уронила цены

2026-09-10-deepseek-v4-1-flash-release-pricing

DeepSeek официально выпустила V4.1 Flash: быстрая модель обошла флагманскую V4 Pro и уронила цены до $0.003 за 1M токенов

DeepSeek, - это команда, которая методично продолжает переписывать экономику вычислений и инференса.
Разработчики разослали официальное уведомление о запуске модели V4.1 Flash, и ситуация получилась уникальная: облегченная Flash-версия по итогам масштабных тестов превзошла предыдущий тяжелый флагман V4 Pro по многим метрикам.

⚡️ Младшая модель обогнала тяжеловеса:
По результатам внутренних и внешних бенчмарков V4.1 Flash превосходит V4 Pro по качеству ответов, скорости генерации, общему времени выполнения задач и себестоимости.
Это подтверждает тренд, когда оптимизация архитектуры и эффективный пост-тренинг дают больше прироста, чем простое наращивание параметров.

💰 Экономика инференса на грани бесплатного:
Новые тарифы вступают в силу 10 сентября в 04:00 UTC и снова задают недосягаемую планку для западных конкурентов:
• Входные токены с кэшированием (Cache Hit): всего $0.003 за 1M в непиковые часы ($0.006 в пик).
• Входные токены без кэша (Cache Miss): $0.15 за 1M в непик ($0.30 в пик).
• Выходные токены: $0.60 за 1M в непик ($1.20 в пик).
Пиковые часы строго регламентированы (01:00-04:00 и 06:00-10:00 UTC по будням), а все остальное время действует скидка 50%. Для агентских систем с длинными системными промптами кэш за три тысячных доллара делает контекст почти бесплатным.

🔄 Мягкий переход и автороутинг:
Чтобы разработчики не переписывали прод в спешке, DeepSeek продлила поддержку V4 Pro до 14 сентября (12:00 по Пекину).
Пользователям дают 4 дня на сравнительное A/B тестирование, после чего все запросы к эндпоинту Pro будут автоматически маршрутизироваться на V4.1 Flash и тарифицироваться по сверхдешевому прайсу Flash.

#DeepSeek #LLM #инференс #модели

———

@tsingular | Max | YouTube | RuTube | VK | VK Video | Дзен