Чт, 10 Вер
Молекула з гаража: науковець за допомогою ChatGPT створив експериментальний препарат від шизофренії Наука 10.09.2026 20:28
У Steam стартував ранній доступ WARDOGS: масштабні бої на 100 гравців, економіка та техніка Ігри 10.09.2026 20:24
Lexus оновила флагманський седан LS: посилений кузов, віброгасники REDS та панорамний дах Автомобілі 10.09.2026 20:16
225 років після Корри та світ у руїнах: вийшов трейлер нового мультсеріалу «Аватар: Сім прихистків» Кіно/Серіали 10.09.2026 20:12
У GTA VI Джейсон зможе голитися, а герої — гладшати, качатися і змінювати стосунки одне з одним Ігри 10.09.2026 20:04
«Телевізори не підслуховують»: LG відповіла на звинувачення у шпигунстві, але підтвердила сканування мережі IT-бізнесГаджети 10.09.2026 19:54
552 мільярди параметрів, відкритий код і ціна $0,15 за мільйон токенів: DeepSeek випустила V4.1 Flash Нейромережі 10.09.2026 19:39
Справжня генерація кадрів від Nvidia запрацювала на RTX 2060: моддери обійшли обмеження DLSS-G ГаджетиТехнології 10.09.2026 19:10
Меркурій стиснувся сильніше, ніж вважали вчені: планета втратила до 23 км у діаметрі Космос 10.09.2026 19:01
Sony відмовилася від шпигунського екшену PHYSINT Хідео Кодзіми: новим видавцем проєкту стала Xbox Ігри 10.09.2026 18:59
Перші оцінки Marvel’s Wolverine: 77 балів на Metacritic та суперечки критиків довкола лінійного геймплею Ігри 10.09.2026 18:55

552 мільярди параметрів, відкритий код і ціна $0,15 за мільйон токенів: DeepSeek випустила V4.1 Flash

Max Ivanov · 10.09.2026 19:39 · 2 хвилини читання

Китайська компанія DeepSeek представила V4.1 Flash — нову мультимодальну мовну модель архітектури MoE із гігантською загальною місткістю 552 мільярди параметрів і контекстним вікном до одного мільйона токенів. Модель оптимізовано під розробку софту, автономні агентні системи та роботу з кодом, а її відкриті ваги опубліковано на платформі Hugging Face під вільною ліцензією MIT.

Економічна архітектура Causal Encoder-Decoder

Незважаючи на величезний паспортний розмір, модель використовує архітектуру «суміші експертів» (Mixture of Experts) із механізмом Causal Encoder-Decoder, що радикально знижує вимоги до обчислювальних ресурсів. Як повідомляється на сторінці моделі на Hugging Face, у кожен момент часу активні лише окремі блоки нейромережі:

  • Під час читання довгих документів, коду чи історії діалогу задіюється лише близько 8 мільярдів параметрів;
  • Під час генерації відповіді та написання коду активується блок на 16 мільярдів параметрів.

Така схема ідеально підходить для агентних завдань, де алгоритму потрібно постійно аналізувати величезний обсяг вхідної інформації перед тим, як видати коротку команду чи фрагмент коду. V4.1 Flash також нативно працює із зображеннями, що дає змогу використовувати її в мультимодальних пайплайнах.

Результати тестів і рекордно низька ціна API

У власних тестах DeepSeek нова модель показала високі результати в спеціалізованих бенчмарках для програмування та агентних завдань: 74,2 бала в DeepSWE v1.1, 88,1 у CyberGym і 54,8 в Automation-Bench. На діаграмах розробників V4.1 Flash обходить GPT-5.6 Sol і Claude Opus 5 у низці кейсів. Утім, незалежні тести на загальних бенчмарках ще не публікувалися, тому порівнювати моделі напряму поки зарано.

Ключовою перевагою новинки стало поєднання відкритих ваг і безпрецедентно низької вартості хмарного доступу. Згідно з офіційним прайс-листом на сервісі TokenCost, у непікові години використання API коштуватиме лише $0,15 за мільйон токенів на вході та $0,60 за мільйон на виході.

Як зазначає агентство Reuters, для розробників автономних ШІ-систем це вкрай приваблива пропозиція: модель із відкритим кодом, величезним контекстным вікном і низькою вартістю токенів ідеально підходить для масового запуску паралельних агентів, які займаються рефакторингом коду, вебавтоматизацією та науковими розрахунками.

Подобається ВсеЗависло?

Додайте нас до улюблених джерел Google, щоб частіше бачити наші новини.

Додай нас у свій Google

Поділитися

Залишити коментар