DeepSeek V4-Pro: потужна відкрита модель для розробників

DeepSeek виходить за межі шару моделі та глибше занурюється у програмне забезпечення, яке використовують розробники для роботи з AI-агентами.
Китайська AI-лабораторія в четвер запустила офіційну версію DeepSeek-V4-Pro – оновлену флагманську модель, значною мірою орієнтовану на робочі навантаження агентів, а також DeepSeek Harness v0.1 – новий фреймворк для агентів з відкритим вихідним кодом, що надає розробникам альтернативу інтегрованим середовищам для кодування з агентами, таким як Claude Code від Anthropic.
Разом ці релізи становлять ширший крок DeepSeek до розробників. V4-Pro тепер доступна через веб-інтерфейс, мобільний додаток та API DeepSeek, з нативною підтримкою OpenAI Responses API та інтеграцією з Codex.
DeepSeek Harness, тим часом, проходить етап попереднього перегляду для розробників під ліцензією MIT, і код вже доступний для завантаження та використання на GitHub. Він побудований навколо незвично модульної основи: практично кожна частина середовища виконання агента може бути замінена як плагін.
Однак розробники, які отримують доступ до V4 через API DeepSeek, незабаром платитимуть за це значно більше. DeepSeek одночасно відмовляється від існуючих фіксованих тарифів API на користь пікових та позапікових ставок, починаючи з 16:00 UTC у неділю, 16 серпня (2 ранку за східним часом).
Навіть знижені позапікові ціни на кеш-промахи та виведення будуть суттєво вищими, ніж доступні сьогодні.
Комбінація є значущою, оскільки DeepSeek більше не конкурує виключно за інтелект моделі та ціни за токен. З Harness, компанія виходить на рівень, який визначає, як моделі використовують інструменти, маніпулюють файлами, підтримують сеанси та виконують тривалі робочі процеси агентів – територію, де Claude Code від Anthropic та інші кодувальні агенти стають дедалі важливішими продуктами для розробників.
DeepSeek створює власний фреймворк для агентів
DeepSeek описує Harness, або dsh, як фреймворк для агентів з відкритим вихідним кодом, побудований на Cordis – фреймворку, розробленому навколо компонованих плагінів.
Його керівний принцип простий: «Все є плагіном».
Це стосується моделей, інструментів, навичок, сеансів, пісочниць, файлових систем, циклів, оркестрації та інтерфейсів користувача, згідно з DeepSeek. Замість того, щоб робити ці компоненти фіксованими частинами одного кодувального агента, Harness розроблений так, щоб дозволити розробникам змішувати, замінювати та розширювати їх.
Проект доступний під ліцензією MIT і наразі може бути запущений з npm за допомогою npx @deepseek-ai/dsh web. DeepSeek також надає інструкції для його збірки безпосередньо з вихідного коду. Репозиторій явно описує програмне забезпечення як попередній перегляд для розробників і попереджає, що «БУДУТЬ ЗМІНИ, ЩО ПОРУШУЮТЬ СУМІСНІСТЬ».
Це застереження є важливим для корпоративних розробників. Harness ще не представлено як стабільну платформу для виробничого використання. Але його архітектура вказує на потенційно важливу стратегію: DeepSeek тепер може запропонувати розробникам не тільки моделі, але й відкритий фреймворк для збирання систем, що їх оточують.
Це робить Claude Code від Anthropic та Codex від OpenAI корисними конкурентними орієнтирами, хоча продукти не слід розглядати як функціонально ідентичні.
DeepSeek Harness є альтернативою з відкритим вихідним кодом, незалежною від моделі, до інфраструктури агентів, що лежить в основі Claude Code та Codex – поки що не повною заміною ширшого досвіду розробника обох продуктів.
Він вже може переглядати репозиторії, редагувати файли, виконувати команди оболонки, шукати файли та в Інтернеті, підтримувати плани, викликати навички, делегувати роботу під-агентам та забезпечувати дотримання політик схвалення. Це основні можливості, які роблять Claude Code та Codex інструментами для кодування з агентами, а не системами автодоповнення.
DeepSeek явно описує стандартний режим як повноцінного кодувального агента з редагуванням файлів, доступом до оболонки, пошуком, плануванням, під-агентами та робочими процесами. Його локальний веб-інтерфейс дозволяє користувачам вибирати робочу область та схвалювати чутливі операції.
Але Claude Code та Codex тепер виходять далеко за межі цього циклу агента. Ось швидке порівняння:
|
Вимір |
DeepSeek Harness |
Claude Code |
OpenAI Codex |
|
Читання, редагування та тестування репозиторію |
Так |
Так |
Так |
|
Оболонка та інструменти розробки |
Так |
Так |
Так |
|
Планування та під-агенти |
Так |
Так |
Так |
|
Керування дозволами та пісочниця |
Так, налаштовується через плагіни |
Так, зріла вбудована система дозволів та пісочниці |
Так, гранулярні елементи керування пісочницею та схваленням |
|
Основні інтерфейси |
Локальний веб-інтерфейс; команда без голови; Python SDK |
Термінал, VS Code, JetBrains, десктоп, браузер, мобільний телефон та Slack |
CLI, розширення IDE, настільний додаток, веб/хмара та інтеграції |
|
Розміщені фонові агенти |
Не документовано як послуга, керована DeepSeek |
Так |
Так |
|
Робочий процес PR, нативний для GitHub |
Не документовано як завершена інтеграція |
GitHub Actions, автоматичні огляди, робочі процеси від проблеми до PR |
Хмарні завдання, автоматичні огляди, виправлення PR та GitHub Action |
|
Вибір моделі |
DeepSeek, Anthropic, OpenAI та власні сумісні кінцеві точки |
Переважно Claude, включаючи хостинг Bedrock, Google Cloud та Microsoft |
Переважно моделі OpenAI, з настроюваними постачальниками в CLI з відкритим вихідним кодом |
|
Розширюваність |
Виняткова: практично кожен компонент можна замінити |
Сильна: навички, хуки, MCP, плагіни та команди агентів |
Сильна: навички, MCP, власні агенти, SDK та сервер додатків |
|
Зрілість продукту |
Попередній перегляд для розробників; очікуються зміни, що порушують сумісність |
Зрілий комерційний продукт |
Зрілий комерційний продукт плюс CLI з відкритим вихідним кодом |
|
Ліцензія |
MIT |
Комерційний продукт з інтерфейсами розширення |
Codex CLI з відкритим вихідним кодом; хмарні та прикладні послуги є керованими продуктами |
DeepSeek Harness натомість наголошує на модульності та заміні: сама модель є ще одним плагіном, а не обов’язково центром вертикально інтегрованого стеку.
Репозиторій DeepSeek вже привертав значну увагу розробників у день запуску, маючи приблизно 27 500 зірок GitHub та 2000 форків станом на 13 серпня, хоча ці швидкозмінні цифри краще розглядати як знімок, а не як показник впровадження.
V4-Pro отримує оновлення, орієнтоване на агентів
Harness виходить разом із загальнодоступним випуском DeepSeek-V4-Pro-0813.
DeepSeek вперше представив сімейство V4 у попередньому перегляді в квітні. Лінійка складається з V4-Pro з 1,6 трильйонами параметрів, з 49 мільярдами параметрів, активованих на токен, і меншого V4-Flash з 284 мільярдами параметрів, з 13 мільярдами активованих. Обидва підтримують вікна контексту до одного мільйона токенів.
Тому випуск компанії від 13 серпня – це не перша поява V4-Pro. Це перехід від попереднього попереднього перегляду до оновленої офіційної версії, де DeepSeek наголошує на продуктивності агентів.
«Офіційна версія DeepSeek-V4-Pro була випущена, що включає значно покращені можливості агентів та підтримку Responses API та інтеграції з Codex», – повідомляє DeepSeek на своєму API-сайті. «Тепер вона повністю доступна через веб, мобільний додаток та API; ми вітаємо ваші тестування та відгуки».
Журнал змін DeepSeek також вказує, що загальнодоступна модель має «значно покращені можливості агентів», особливо в виробничих середовищах. Розробники, які використовують API, не повинні змінювати ідентифікатори моделей: deepseek-v4-pro тепер вказує на останню версію V4-Pro.
Компанія також додала нативну підтримку OpenAI Responses API, зменшуючи обсяг інтеграційної роботи, необхідної для програм, вже побудованих навколо цього інтерфейсу.
DeepSeek зазначає, що V4-Pro оптимізована для власного фреймворку з відкритим вихідним кодом OpenAI, Codex, з налаштуванням в один клік. Її поточна документація API перелічує Responses API, виклик інструментів, виведення JSON та API у форматі Anthropic серед підтримуваних інтерфейсів як для V4-Pro, так і для V4-Flash.
Для розробників, які використовують DeepSeek безпосередньо, а не через API, V4-Pro тепер доступна через «Експертний режим» на сайті та в додатку компанії.
Зусилля з міркувань стають ще одним налаштуванням розгортання
DeepSeek також робить зусилля з міркувань явним контролем у V4-Pro та V4-Flash.
Документація моделі V4 описує три рівні: «Не думати» (Non-think), призначений для швидких рутинних завдань; «Думати високо» (Think High), призначений для складніших завдань з вирішення проблем та планування; та «Максимально думати» (Think Max), який виділяє значно більше ресурсів для складних проблем.
Ця відмінність може бути операційно важливою для систем агентів, оскільки максимальне міркування на кожному кроці може займати зайвий час і токени. Кодувальний агент може використовувати відносно мало ресурсів для перегляду файлу або виклику рутинного інструменту, а потім збільшувати зусилля під час діагностики складного багу або планування багатоетапної зміни коду.
Остання таблиця бенчмарків DeepSeek свідчить про те, що модель 0813 суттєво покращує показники в тестах, орієнтованих на агентів, хоча цифри надані компанією, і деякі результати залежать від конфігурації фреймворку.
DeepSeek повідомляє про показники V4-Pro-0813: 87,9 на Terminal Bench 2.1, 74,1 на Toolathlon-Verified, 71,1 на DSBench-FullStack та 67,2 на DSBench-Hard. Вона не лідирує в кожному порівнянні в таблиці DeepSeek: наприклад, Fable 5 показує 77,9 на Toolathlon-Verified та 77,2 на DSBench-FullStack.
Існує особливо важливе застереження, приховане під таблицею бенчмарків. Для загальнодоступних завдань Code Agent DeepSeek зазначає, що V4-Pro-0813 тестувався за допомогою свого майбутнього DeepSeek Harness у «мінімальному режимі».
Іншими словами, деякі результати агентів, що з’являються разом із Harness, є не просто бенчмарками моделі. Вони вимірюють модель, що працює всередині середовища виконання агента – саме того програмного шару, який DeepSeek тепер випускає для розробників.
Різкий поворот у ціновій траєкторії API DeepSeek
Можливо, більшою миттєвою зміною для команд, які вже використовують DeepSeek у виробництві, є ціноутворення.
Поточна документація API DeepSeek перелічує V4-Flash за ціною $0,14 за мільйон вхідних токенів з кеш-промахами та $0,28 за мільйон вихідних токенів, тоді як V4-Pro коштує $0,435 для вхідних з кеш-промахами та $0,87 для виведення. Кешовані попадання коштують значно дешевше: $0,0028 для Flash і $0,003625 для Pro.
Самі по собі ці ціни являли собою значне зниження порівняно з економікою запуску V4 у квітні. Коли V4 з’явився в квітні, V4-Pro коштувала $1,74 за мільйон вхідних токенів з кеш-промахами та $3,48 за мільйон вихідних токенів. До кінця травня DeepSeek зробив 75% зниження постійним, посилюючи свою позицію як надзвичайно недорогого варіанту для високооб’ємних робочих навантажень агентів. Тепер маятник рухається в інший бік.
Починаючи з 16 серпня о 16:00 UTC, DeepSeek буде стягувати різні ставки залежно від часу виконання запитів до API. Пікові години: з 01:00 до 04:00 UTC та з 06:00 до 10:00 UTC (21:00–00:00 за східним часом та 02:00–06:00 за східним часом відповідно), а всі інші години класифікуються як позапікові. Позапікові ставки становлять половину відповідних пікових цін.
Для V4-Flash позапікові вхідні дані з кеш-промахами зростають з $0,14 до $0,22 за мільйон токенів, тоді як виведення зростає з $0,28 до $0,66. Під час пікових годин ці ставки досягають $0,44 для введення та $1,32 для виведення.
V4-Pro переходить з $0,435 за мільйон вхідних токенів з кеш-промахами та $0,87 за виведення сьогодні до $0,66 та $1,98 позапіково відповідно. Пікові ставки зростають до $1,32 для введення та $3,96 для виведення.
Збільшення ще більш помітні для кешованого введення. Попадання в кеш V4-Pro зростають з $0,003625 за мільйон токенів сьогодні до $0,022 позапіково та $0,044 у пікові години. Flash переходить з $0,0028 до $0,007 позапіково та $0,014 у пікові години.
|
Модель |
Старе введення (за 1 млн токенів) |
Старе виведення (за 1 млн токенів) |
Стара загальна сума (1 млн вх / 1 млн вих) |
|
deepseek-v4-flash |
$0,14 |
$0,28 |
$0,42 |
|
deepseek-v4-pro |
$0,435 |
$0,87 |
$1,305 |
Нові ціни все ще позиціонують DeepSeek як доступну альтернативу західним пропрієтарним лабораторіям через API, але Reuters повідомила в четвер, що, залежно від моделі, категорії токенів та часу використання, зміни становлять збільшення від 50% до понад 1100% порівняно з існуючими ставками.
|
Модель |
Введення ($/1 млн) |
Виведення ($/1 млн) |
Загальна сума ($/1 млн) |
Джерело |
|
Muse Spark 1.2 Contributor |
$0,10 |
$0,20 |
$0,30 |
Meta |
|
MiMo-V2.5 Flash |
$0,10 |
$0,30 |
$0,40 |
Xiaomi |
|
DeepSeek-V4-Flash — позапікові години |
$0,22 |
$0,66 |
$0,88 |
DeepSeek |
|
GPT-5.6 Luna |
$0,20 |
$1,20 |
$1,40 |
OpenAI |
|
MiniMax-M3 |
$0,30 |
$1,20 |
$1,50 |
MiniMax |
|
LongCat-2.0 — тимчасова акція |
$0,30 |
$1,20 |
$1,50 |
LongCat |
|
DeepSeek-V4-Flash — пікові години |
$0,44 |
$1,32 |
$1,76 |
DeepSeek |
|
MiMo-V2.5 |
$0,40 |
$2,00 |
$2,40 |
Xiaomi |
|
DeepSeek-V4-Pro — позапікові години |
$0,66 |
$1,98 |
$2,64 |
DeepSeek |
|
LongCat-2.0 — стандарт |
$0,75 |
$2,95 |
$3,70 |
LongCat |
|
MiMo-V2.5 Pro (≤256K) |
$1,00 |
$3,00 |
$4,00 |
Xiaomi |
|
DeepSeek-V4-Pro — пікові години |
$1,32 |
$3,96 |
$5,28 |
DeepSeek |
|
Muse Spark 1.1 / 1.2 |
$1,25 |
$4,25 |
$5,50 |
Meta |
|
GLM-5.2 |
$1,40 |
$4,40 |
$5,80 |
Z.ai |
|
Grok 4.6 — <200K вхідних токенів |
$2,00 |
$6,00 |
$8,00 |
xAI |
|
MiMo-V2.5 Pro (>256K) |
$2,00 |
$6,00 |
$8,00 |
Xiaomi |
|
Qwen3.8-Max |
$2,00 |
$6,00 |
$8,00 |
QwenCloud |
|
Gemini 3.6 Flash |
$1,50 |
$7,50 |
$9,00 |
|
|
GPT-5.6 Terra |
$2,00 |
$12,00 |
$14,00 |
OpenAI |
|
Grok 4.6 — ≥200K вхідних токенів |
$4,00 |
$12,00 |
$16,00 |
xAI |
|
GPT-5.4 |
$2,50 |
$15,00 |
$17,50 |
OpenAI |
|
Kimi K3 |
$3,00 |
$15,00 |
$18,00 |
Moonshot AI |
|
Claude Opus 5 |
$5,00 |
$25,00 |
$30,00 |
Anthropic |
|
Sakana Fugu Ultra (≤272K) |
$5,00 |
$30,00 |
$35,00 |
Sakana AI |
|
GPT-5.6 Sol — Стандартний режим |
$5,00 |
$30,00 |
$35,00 |
OpenAI |
|
Claude Fable 5 / Claude Mythos 5 |
$10,00 |
$50,00 |
$60,00 |
Anthropic |
|
GPT-5.6 Sol — Швидкий режим |
$10,00 |
$60,00 |
$70,00 |
OpenAI |
Таким чином, «на 50% нижчі» позапікові ціни можуть вводити в оману без контексту. Позапікові ціни на 50% нижчі за *новий* піковий тариф DeepSeek; це не 50% знижка від API-цін, які розробники платять сьогодні.
Для простого робочого навантаження, що складається з одного мільйона вхідних токенів з кеш-промахами плюс один мільйон вихідних токенів, V4-Pro зараз коштує $1,305. Той самий набір токенів буде коштувати $2,64 позапіково, приблизно вдвічі дорожче, або $5,28 в пікові години, що більш ніж у чотири рази перевищує поточну ціну.
V4-Flash переходить з $0,42 за тим же простим розрахунком до $0,88 позапіково та $1,76 у пікові години.
Фактичні витрати на додатки значно варіюватимуться залежно від співвідношення кешованого введення, некешованого введення та згенерованого виведення, тому ці об’єднані цифри є ілюстративними, а не універсальними оцінками загальної вартості.
DeepSeek рухається вгору по стеку агентів
Час робить стратегічний напрямок важко пропустити.
Коли DeepSeek випустив попередній перегляд V4 24 квітня, головною новиною було те, наскільки потужні можливості він може надати завдяки надзвичайно ефективній архітектурі.
V4-Pro використовує гібридний дизайн уваги, що поєднує стиснуту розріджену увагу (Compressed Sparse Attention) та сильно стиснуту увагу (Heavily Compressed Attention); при контексті в один мільйон токенів, DeepSeek стверджує, що йому потрібно лише 27% FLOPs для інференсу з одним токеном та 10% KV-кешу, необхідного для V3.2.
До кінця травня обговорення переключилося на те, що означають ці ефективності економічно для високооб’ємних агентів, чиї повторні читання контексту можуть зробити кешування основним компонентом витрат на інференс. Різкі скорочення цін на V4 від DeepSeek посилили цю перевагу.
Релізи від 13 серпня переносять конкуренцію ще на один рівень вгору.
DeepSeek тепер має оновлений V4-Pro, налаштований на агентські робочі навантаження, стандартизовані інтерфейси, призначені для спрощення підключення до існуючих інструментів розробників, конфігуровані зусилля з міркувань та фреймворк під ліцензією MIT для керування моделями, інструментами, пісочницями, файловими системами та оркестрацією навколо агента.
Водночас DeepSeek демонструє, що розробники не можуть припускати, що його агресивно низькі API-тарифи є постійними. Для організацій, які розглядають платформу, планування робочих навантажень, поведінка кешування та можливість запускати відкриті ваги на власній інфраструктурі тепер стають важливішими частинами загальної вартості.
Це залишає DeepSeek, який одночасно переслідує дві потенційно суперечливі переваги: робить свій стек агентів більш доступним та відкритим, одночасно роблячи свій власний розміщений API значно дорожчим.
Для корпоративних розробників Harness може виявитися найважливішою частиною оголошення четверга. Моделі все частіше можуть бути замінені за стандартизованими інтерфейсами. Фреймворк, який керує тим, як агент міркує, викликає інструменти, редагує програмне забезпечення та зберігається протягом усього робочого процесу, може бути набагато складніше замінити.
DeepSeek тепер також конкурує за цей рівень.
Дізнатися більше на: venturebeat.com
