DeepSeek представила нову модель V4.1-Flash з покращеною продуктивністю

Китайська компанія DeepSeek анонсувала нову модель DeepSeek-V4.1-Flash, яка має обсяг 552 млрд параметрів і підтримує аналіз візуальних даних. За словами розробників, ця модель є найменшою в лінійці, проте перевершує попередні флагмани за продуктивністю та економічністю.

Технічні особливості моделі

Модель використовує архітектуру Causal Encoder-Decoder, що дозволяє активувати лише 8 млрд параметрів для вводу та 16 млрд для виводу. Завдяки новим методам навчання, V4.1-Flash демонструє кращі результати в бенчмарках, ніж Kimi-K3, GLM-5.3, Claude Opus 5, GPT 5.6-Sol та DeepSeek-V4-Pro.

Крім того, зменшено навантаження на апаратні ресурси: модель потребує у 4 рази менше високосмугової пам’яті (HBM) та у 8 разів менше місця на SSD для зберігання KV-кешу в порівнянні з попередниками. Це дозволяє знизити витрати на роботу ШІ-агентів.

Зміни в API та підтримка нової моделі

DeepSeek-V4.1-Flash вже доступна через офіційний API. У зв’язку з цим компанія згортає старі моделі:

  • Запити до V4-Flash та V4-Flash-Vision-Exp автоматично перенаправляються на V4.1-Flash;
  • Модель V4-Pro також поступово виводиться з експлуатації, з 14 вересня всі запити до неї перенаправлятимуться на V4.1-Flash за новими тарифами.

Підтримку нової моделі вже інтегрували партнери DeepSeek, такі як WorkBuddy_AI та OpenCode, що дозволяє використовувати V4.1-Flash для вайб-кодингу. Очікується, що найближчим часом модель буде інтегрована й іншими розробниками.


Джерело: dev.ua (https://dev.ua/news/deepseek-vypustyla-multymodalnu-model-v41-flash-1789118862)