DeepSeek оголосила про повноцінний реліз DeepSeek-V4-Pro: від прев’ю до комерційного запуску

Компанія DeepSeek офіційно перевела флагманську модель DeepSeek-V4-Pro зі стадії попереднього перегляду (Preview) у повноцінний комерційний реліз (General Availability). Перша версія архітектури моделі дебютувала ще наприкінці квітня 2026 року, але після масштабної модернізації ШІ-асистент отримав систему трьох рівнів міркування та доступ на платформі chat.deepseek.com.
Головною відмінністю комерційного релізу від квітневої прев’ю-версії стало впровадження гнучких рівнів міркування (Thinking Mode) в API, які дають змогу керувати якістю відповіді та бюджетом:
- Low: відключає глибоке планування для швидких відповідей із мінімальною витратою токенів;
- High: стандартний режим планування для написання скриптів, парсингу даних і пошуку багів;
- Max (V4-Pro-Max): задіює максимальні обчислювальні потужності моделі для багаторівневого програмування та олімпіадної математики.
Контекстне вікно моделі становить 1 мільйон токенів, а максимальний ліміт генерації за один запит розширено до 384 000 токенів, що дає змогу нейромережі видавати архітектурні проєкти застосунків в один клік. У релізну версію також вбудували нативну підтримку OpenAI Responses API та налаштування Codex.
Результати бенчмарків
У звіті за підсумками модернізації в максимальному режимі (V4-Pro-Max) модель показала такі результати в тестах:
- LiveCodeBench (написання коду): 93,5% успішних рішень;
- SWE-bench Verified (завдання з GitHub): 80,6% закритих тікетів (на рівні показників Gemini 3.1 Pro);
- GPQA Diamond (логіка та експертні знання): 90,1% точних відповідей.

Вартість API та динамічні тарифи
Базова вартість API DeepSeek-V4-Pro становить $0,435 за 1 млн вхідних і $0,87 за 1 млн вихідних токенів. З 16 серпня компанія впроваджує систему динамічного ціноутворення: у нічні години та періоди низького навантаження (off-peak) вартість запитів до API автоматично знижуватиметься на 50%.
