Наш веб-сайт використовує файли cookie, щоб забезпечити ваш досвід перегляду та відповідну інформацію. Перш ніж продовжувати користуватися нашим веб-сайтом, ви погоджуєтеся та приймаєте нашу політику використання файлів cookie та конфіденційність. cookie та конфіденційність

DeepSeek випустила дешевшу модель V4.1 Flash і кидає виклик OpenAI

enovosty.com

DeepSeek випустила дешевшу модель V4.1 Flash і кидає виклик OpenAI

Китайська DeepSeek представила нову модель V4.1 Flash, яка має працювати швидше та обходитися розробникам дешевше за попередні версії. Компанія робить ставку на низьку вартість API та вже готується замінити новинкою модель V4-Pro.

Про це пише Bloomberg.

DeepSeek заявляє, що V4.1 Flash перевершує V4-Pro у низці завдань, зокрема в програмуванні та роботі ШІ-агентів. Водночас модель має бути дешевшою у використанні завдяки новій архітектурі та меншому споживанню пам’яті.

Загалом V4.1 Flash має 552 мільярди параметрів, однак під час обробки запитів активує лише частину з них. Для вхідних даних використовуються близько 8 мільярдів параметрів, а для вихідних — 16 мільярдів.

Модель побудована на архітектурі causal encoder-decoder і використовує підхід MoE, або “суміш експертів”. Це дозволяє не задіювати всю модель для кожного запиту та помітно зменшує витрати на обчислення.

Окремо компанія скоротила потребу в пам’яті для KV-кешу. За даними DeepSeek, новій моделі потрібно приблизно вчетверо менше HBM-пам’яті та у вісім разів менше SSD-сховища порівняно з попереднім поколінням.

Для ШІ-агентів це має особливе значення, оскільки вони можуть тривалий час працювати з великим контекстом і багаторазово звертатися до моделі. Менші витрати на кешування дозволяють здешевити такі сценарії використання.

DeepSeek також заявляє, що вдосконалене попереднє навчання та масштабне донавчання з підкріпленням допомогли V4.1 Flash обійти V4-Pro у програмуванні та агентських завданнях. Водночас вона все ще поступається найпотужнішим моделям OpenAI та Anthropic.

Із 14 вересня DeepSeek планує припинити підтримку V4-Pro. Запити до deepseek-v4-pro автоматично перенаправлятимуть на V4.1 Flash за нижчими тарифами до виходу майбутньої V4.1 Pro.

Компанія також відмовляється від V4-Flash і V4-Flash-Vision-Exp. Запити до цих моделей тимчасово також переводитимуть на нову версію.

V4.1 Flash уже доступна через API під назвою deepseek-flash і підтримує мультимодальні завдання. Для розробників DeepSeek запровадила різні тарифи залежно від часу використання.

У непікові години API коштуватиме приблизно вдвічі дешевше, ніж у періоди найбільшого навантаження. Така схема має одночасно знизити витрати клієнтів і рівномірніше розподілити навантаження на інфраструктуру компанії.

Низькі тарифи DeepSeek посилюють цінову конкуренцію на ринку штучного інтелекту. Іншим розробникам доводиться або ще більше знижувати ціни, або пропонувати помітно кращі можливості, щоб виправдати дорожчий доступ до своїх моделей.

На цьому тлі тиск з боку дешевших китайських моделей зростає і на американські компанії. OpenAI та інші великі гравці також переглядають ціни, намагаючись утримати розробників і корпоративних клієнтів.

  • Останні
Більше новин

Новини по днях

Сьогодні,
11 вересня 2026

Новини на тему

Більше новин