Китайская лаборатория искусственного интеллекта DeepSeek представила свою новую модель, которая обещает значительно ускорить обработку и генерацию токенов. Модель V4.1-Flash отличается высокой пропускной способностью и поддержкой визуального восприятия, что позволяет ей эффективно справляться с большими объемами данных. В этой статье мы рассмотрим ключевые особенности новой разработки, ее преимущества по сравнению с конкурентами и возможности применения.
Технические характеристики модели DeepSeek V4.1-Flash
Модель V4.1-Flash имеет размер 552 млрд параметров, что обеспечивает высокую производительность:
- Механизм MoE: Используется механизм Mixture-of-Experts (MoE), который позволяет оптимально распределять ресурсы между задачами.
- Архитектура: Обновленная архитектура Causal Encoder–Decoder с 8 млрд параметров на вводе и 16 млрд — на выводе.
- Методы обучения: Новые подходы к предварительному обучению и последующему обучению с подкреплением обеспечивают высокие результаты.
Сравнение производительности с конкурентами
DeepSeek V4.1-Flash демонстрирует впечатляющие результаты в различных тестах:
- Тест DeepSWE v1.1: Модель набрала 74,2 балла, немного опередив GPT-5.6-Sol (73) и Claude Opus 5 (74).
- Результат на CyberGym: V4.1-Flash показала 88,1 балла, обойдя GPT-5.6-Sol и GLM-5.3 (по 84,5).
- Тест Terminal-Bench 3.0: Модель получила 30 баллов, уступив лишь GPT-5.6-Sol (34,4) и Claude Opus 5 (43,3).
Экономия ресурсов и затрат на обработку
Одним из значительных преимуществ V4.1-Flash является ее экономичность:
- Сокращение использования KV-кеша: Модель потребляет вчетверо меньше памяти HBM и в восемь раз меньше места на SSD.
- Снижение затрат: Сжатие кеша позволяет существенно уменьшить расходы на обработку запросов.
- Гибкая тарификация API: Доступ через API с разделением на пиковые и непиковые часы предлагает более низкие тарифы в непиковое время.
Доступность и поддержка новой модели
DeepSeek V4.1-Flash уже доступна через API с нативной поддержкой мультимодальности:
- Переход на новую модель: Поддержка предыдущих моделей прекращается; запросы перенаправляются на V4.1-Flash.
- Поддержка партнёров: Официальные партнёры WorkBuddy, CodeBuddy и OpenCode уже объявили о поддержке новой модели.
- Тарифы на обработку данных: В непиковые часы цена составляет $0,003 за 1 млн токенов при попадании в кеш.
Таким образом, DeepSeek V4.1-Flash представляет собой мощный инструмент для обработки данных, способный значительно улучшить эффективность работы с ИИ-технологиями.