DeepSeek V4-Pro змагається з Claude Code у відкритому доступі

DeepSeek V4-Pro змагається з Claude Code у відкритому доступі 1

DeepSeek розширює свою діяльність від рівня моделей до програмного забезпечення, яке використовують розробники для роботи з ШІ-агентами.

Китайська AI-лабораторія в четвер представила офіційну версію DeepSeek-V4-Pro — оновлену флагманську модель, зосереджену на агентних навантаженнях, а також DeepSeek Harness v0.1 — новий фреймворк з відкритим кодом для агентів, що надає розробникам альтернативу інтегрованим середовищам для кодування агентів, таким як Claude Code від Anthropic.

Ці випуски означають ширший поштовх DeepSeek для розробників. V4-Pro тепер доступна через веб-інтерфейс, мобільний додаток та API DeepSeek, з нативною підтримкою OpenAI Responses API та інтеграцією з Codex.

DeepSeek Harness, тим часом, виходить у режим попереднього перегляду для розробників під ліцензією MIT, і код уже доступний для завантаження та використання на GitHub. Він побудований на незвично модульному принципі: практично кожна частина середовища виконання агента може бути замінена як плагін.

Однак розробники, які отримують доступ до V4 через API DeepSeek, незабаром платитимуть за нього значно більше. DeepSeek одночасно відмовляється від своєї поточної фіксованої цінової політики API на користь ставок для пікових та позапікових годин, що починаються з 16:00 UTC у неділю, 16 серпня (2:00 за східноамериканським часом).

Навіть знижені ціни на позапіковий час для кеш-промахів та виведення будуть суттєво вищими, ніж чинні сьогодні.

Комбінація цих випусків є значною, оскільки DeepSeek більше не конкурує виключно за інтелект моделей та ціни за токени. З Harness компанія переходить до рівня, який визначає, як моделі використовують інструменти, маніпулюють файлами, підтримують сесії та виконують довготривалі робочі процеси агентів — територія, де Claude Code від Anthropic та інші кодувальні агенти стають все більш важливими продуктами для розробників.

DeepSeek створює власний фреймворк для агентів

DeepSeek описує Harness, або dsh, як фреймворк з відкритим кодом для агентів, побудований на Cordis — платформі, розробленій на основі композиційних плагінів.

Його керівний принцип простий: «Все є плагіном».

Це стосується моделей, інструментів, навичок, сесій, пісочниць, файлових систем, циклів, оркестрації та користувацьких інтерфейсів, за словами DeepSeek. Замість того, щоб робити ці компоненти фіксованими частинами одного кодувального агента, Harness розроблений таким чином, щоб дозволити розробникам змішувати, замінювати та розширювати їх.

Проєкт доступний під ліцензією MIT і наразі може бути запущений з npm за допомогою команди `npx @deepseek-ai/dsh web`. DeepSeek також надає інструкції для збирання безпосередньо з вихідного коду. Репозиторій прямо вказує на програмне забезпечення як на попередній перегляд для розробників і попереджає, що «БУДУТЬ ЗМІНИ, ЩО ПОРУШУЮТЬ СУМІСНІСТЬ».

Ця примітка важлива для корпоративних розробників. Harness ще не представлений як стабільна платформа для виробничого використання. Але його архітектура вказує на потенційно важливу стратегію: DeepSeek тепер може пропонувати розробникам не лише моделі, а й відкриту платформу для складання систем, які їх оточують.

Це робить Claude Code від Anthropic та Codex від OpenAI корисними порівняльними референсами, хоча продукти не слід вважати функціонально ідентичними.

DeepSeek Harness є альтернативою з відкритим кодом, незалежною від моделей, до агентної інфраструктури, що лежить в основі Claude Code та Codex — ще не повною заміною для ширшого досвіду розробників кожного з цих продуктів.

Він вже може інспектувати репозиторії, редагувати файли, виконувати команди оболонки, шукати файли та в Інтернеті, підтримувати плани, викликати навички, делегувати роботу під-агентам та забезпечувати дотримання політик затвердження. Це основні можливості, які роблять Claude Code та Codex інструментами для кодування агентів, а не системами автодоповнення.

DeepSeek прямо описує стандартний режим як повноцінний кодувальний агент з редагуванням файлів, доступом до оболонки, пошуком, плануванням, під-агентами та робочими процесами. Його локальний веб-інтерфейс дозволяє користувачам вибирати робочу область та затверджувати чутливі операції.

Але Claude Code та Codex тепер виходять далеко за межі цього агентного циклу. Ось швидке порівняння:

Вимір

DeepSeek Harness

Claude Code

OpenAI Codex

Читання, редагування та тестування репозиторію

Так

Так

Так

Оболонка та інструменти розробки

Так

Так

Так

Планування та під-агенти

Так

Так

Так

Контроль дозволів та пісочниця

Так, налаштовується через плагіни

Так, зріла вбудована система дозволів та пісочниці

Так, гранульовані елементи керування пісочницею та затвердженням

Основні інтерфейси

Локальний веб-інтерфейс; командний рядок; Python SDK

Термінал, VS Code, JetBrains, десктоп, браузер, мобільні пристрої та Slack

CLI, розширення IDE, десктопний додаток, веб/хмара та інтеграції

Розміщені фонові агенти

Не документовано як керована DeepSeek послуга

Так

Так

Нативна робота з PR в GitHub

Не документовано як завершена інтеграція

GitHub Actions, автоматичні рецензії, робочі процеси від проблеми до PR

Хмарні завдання, автоматичні рецензії, виправлення PR та GitHub Action

Вибір моделі

DeepSeek, Anthropic, OpenAI та власні сумісні кінцеві точки

Переважно Claude, включаючи розміщення на Bedrock, Google Cloud та Microsoft

Переважно моделі OpenAI, з конфігурованими провайдерами в CLI з відкритим кодом

Розширюваність

Виняткова: практично кожен компонент можна замінити

Сильна: навички, хуки, MCP, плагіни та команди агентів

Сильна: навички, MCP, власні агенти, SDK та сервер додатків

Зрілість продукту

Попередній перегляд для розробників; очікуються несумісні зміни

Встановлений комерційний продукт

Встановлений комерційний продукт плюс CLI з відкритим кодом

Ліцензія

MIT

Комерційний продукт з інтерфейсами розширюваності

Codex CLI з відкритим кодом; хмарні та прикладні послуги є керованими продуктами

DeepSeek Harness натомість наголошує на модульності та можливості заміни: сама модель є ще одним плагіном, а не обов’язково центром вертикально інтегрованого стека.

Репозиторій DeepSeek вже привернув значну увагу розробників у день запуску, показавши приблизно 27 500 зірок на GitHub та 2 000 форків станом на 13 серпня, хоча ці цифри, що швидко змінюються, краще розглядати як знімок, а не метрику впровадження.

V4-Pro отримує оновлення, орієнтоване на агентів

Harness виходить разом із загальним випуском DeepSeek-V4-Pro-0813.

DeepSeek вперше представив сімейство V4 у попередньому перегляді у квітні. Лінійка складається з V4-Pro з 1,6 трильйона параметрів, з 49 мільярдами параметрів, активованих на токен, і меншого V4-Flash з 284 мільярдами параметрів, з 13 мільярдами активованих. Обидві підтримують контекстні вікна до одного мільйона токенів.

Тому випуск компанії від 13 серпня — це не перша поява V4-Pro. Це перехід від попереднього попереднього перегляду до оновленої офіційної версії, де DeepSeek наголошує на продуктивності агентів.

«Офіційна версія DeepSeek-V4-Pro випущена, вона має значно покращені можливості для агентів та підтримку Responses API і інтеграції з Codex», — повідомляє DeepSeek на своєму сайті API. «Зараз вона повністю доступна через веб, мобільний додаток та API; ми запрошуємо вас протестувати та надати відгук».

У списку змін DeepSeek також зазначено, що модель загального доступу має «значно покращені можливості для агентів», особливо в робочих середовищах. Розробники, які використовують API, не повинні змінювати ідентифікатори моделей: `deepseek-v4-pro` тепер вказує на останню версію V4-Pro.

Компанія також додала нативну підтримку OpenAI Responses API, зменшуючи обсяг інтеграційної роботи, необхідної для додатків, вже побудованих навколо цього інтерфейсу.

DeepSeek стверджує, що V4-Pro оптимізована для власного фреймворку з відкритим кодом OpenAI, Codex, з налаштуванням в один клік. Його поточна документація API перелічує Responses API, виклик інструментів, JSON-виведення та API у форматі Anthropic серед підтримуваних інтерфейсів для V4-Pro та V4-Flash.

Для розробників, які використовують DeepSeek безпосередньо, а не через API, V4-Pro тепер доступний через «Експертний режим» на сайті та в додатку компанії.

Зусилля з міркування стають ще одним інструментом розгортання

DeepSeek також робить зусилля з міркування явним елементом керування для V4-Pro та V4-Flash.

Документація моделі V4 описує три рівні: Non-think, призначений для швидких рутинних завдань; Think High, призначений для більш складного розв’язання проблем та планування; і Think Max, який виділяє значно більше ресурсів для міркування над складними проблемами.

Це розмежування може бути операційно важливим для систем агентів, оскільки максимальне міркування на кожному кроці може споживати зайвий час і токени. Кодувальний агент може використовувати відносно невеликі міркування для перегляду файлу або виконання рутинного виклику інструменту, а потім збільшувати зусилля при діагностиці складної помилки або плануванні багатоетапної зміни коду.

Остання таблиця тестів DeepSeek свідчить про те, що модель 0813 суттєво покращується в тестах, орієнтованих на агентів, хоча цифри надані компанією, а деякі результати залежать від конфігурації фреймворку.

DeepSeek повідомляє, що V4-Pro-0813 отримав 87.9 балів у Terminal Bench 2.1, 74.1 у Toolathlon-Verified, 71.1 у DSBench-FullStack та 67.2 у DSBench-Hard. Він не лідирує у всіх порівняннях у власній таблиці DeepSeek: наприклад, Fable 5 набирає 77.9 у Toolathlon-Verified та 77.2 у DSBench-FullStack.

Є особливо важливе уточнення, приховане під таблицею тестів. Для публічних завдань Code Agent DeepSeek зазначає, що V4-Pro-0813 тестувався за допомогою майбутнього DeepSeek Harness у «мінімальному режимі».

Іншими словами, деякі результати агентів, що виходять разом із Harness, є не суто бенчмарками моделей. Вони вимірюють роботу моделі всередині середовища виконання агента — саме того програмного рівня, який DeepSeek зараз випускає для розробників.

Різкий поворот у ціновій траєкторії API DeepSeek

Можливо, найсуттєвішою негайною зміною для команд, які вже використовують DeepSeek у виробництві, є ціноутворення.

Поточна документація API DeepSeek показує ціну V4-Flash $0.14 за мільйон вхідних токенів з кеш-промахом та $0.28 за мільйон вихідних токенів, тоді як V4-Pro коштує $0.435 за вхідні токени з кеш-промахом і $0.87 за виведення. Кешовані входи значно дешевші: $0.0028 для Flash та $0.003625 для Pro.

Самі по собі ці ціни вже представляли собою значне зниження порівняно з економікою запуску V4 у квітні. Коли V4 з’явився у квітні, V4-Pro коштував $1.74 за мільйон вхідних токенів з кеш-промахом та $3.48 за мільйон вихідних токенів. До кінця травня DeepSeek зробив 75% зниження постійним, посилюючи свою позицію як надзвичайно недорогого варіанту для агентних навантажень з високим обсягом. Тепер маятник рухається в інший бік.

Починаючи з 16 серпня о 16:00 UTC, DeepSeek буде стягувати різні ставки залежно від часу виконання викликів API. Пікові години — з 01:00 до 04:00 UTC та з 06:00 до 10:00 UTC (21:00–00:00 за східноамериканським часом та 2:00–6:00 за східноамериканським часом відповідно), а всі інші години класифікуються як позапікові. Позапікові ставки становлять половину відповідних пікових цін.

Для V4-Flash позапіковий вхід з кеш-промахом зростає з $0.14 до $0.22 за мільйон токенів, а виведення — з $0.28 до $0.66. У пікові години ці ставки досягають $0.44 для входу та $1.32 для виведення.

V4-Pro переходить з $0.435 за мільйон вхідних токенів з кеш-промахом та $0.87 за виведення сьогодні до $0.66 та $1.98 позапіково відповідно. Пікові ставки зростають до $1.32 для входу та $3.96 для виведення.

Збільшення ще більш помітні для кешованого входу. Кешовані входи V4-Pro зростають з $0.003625 за мільйон токенів сьогодні до $0.022 позапіково та $0.044 у пікові години. Flash переходить з $0.0028 до $0.007 позапіково та $0.014 у пікові години.

Модель

Старий вхід (за 1 млн токенів)

Старе виведення (за 1 млн токенів)

Стара сума (1 млн вх./1 млн вих.)

deepseek-v4-flash

$0.14

$0.28

$0.42

deepseek-v4-pro

$0.435

$0.87

$1.305

Нові ціни все ще позиціонують DeepSeek як доступну альтернативу західним пропрієтарним лабораторіям через API, але Reuters повідомила в четвер, що залежно від моделі, категорії токенів та часу використання, зміни становлять збільшення від 50% до понад 1100% порівняно з поточними ставками.

Модель

Вхід ($/1 млн)

Виведення ($/1 млн)

Сума ($/1 млн)

Джерело

Muse Spark 1.2 Contributor

$0.10

$0.20

$0.30

Meta

MiMo-V2.5 Flash

$0.10

$0.30

$0.40

Xiaomi

DeepSeek-V4-Flash — позапіковий час

$0.22

$0.66

$0.88

DeepSeek

GPT-5.6 Luna

$0.20

$1.20

$1.40

OpenAI

MiniMax-M3

$0.30

$1.20

$1.50

MiniMax

LongCat-2.0 — обмежена пропозиція

$0.30

$1.20

$1.50

LongCat

DeepSeek-V4-Flash — пікові години

$0.44

$1.32

$1.76

DeepSeek

MiMo-V2.5

$0.40

$2.00

$2.40

Xiaomi

DeepSeek-V4-Pro — позапіковий час

$0.66

$1.98

$2.64

DeepSeek

LongCat-2.0 — стандарт

$0.75

$2.95

$3.70

LongCat

MiMo-V2.5 Pro (≤256K)

$1.00

$3.00

$4.00

Xiaomi

DeepSeek-V4-Pro — пікові години

$1.32

$3.96

$5.28

DeepSeek

Muse Spark 1.1 / 1.2

$1.25

$4.25

$5.50

Meta

GLM-5.2

$1.40

$4.40

$5.80

Z.ai

Grok 4.6 — <200K вхідних токенів

$2.00

$6.00

$8.00

xAI

MiMo-V2.5 Pro (>256K)

$2.00

$6.00

$8.00

Xiaomi

Qwen3.8-Max

$2.00

$6.00

$8.00

QwenCloud

Gemini 3.6 Flash

$1.50

$7.50

$9.00

Google

GPT-5.6 Terra

$2.00

$12.00

$14.00

OpenAI

Grok 4.6 — ≥200K вхідних токенів

$4.00

$12.00

$16.00

xAI

GPT-5.4

$2.50

$15.00

$17.50

OpenAI

Kimi K3

$3.00

$15.00

$18.00

Moonshot AI

Claude Opus 5

$5.00

$25.00

$30.00

Anthropic

Sakana Fugu Ultra (≤272K)

$5.00

$30.00

$35.00

Sakana AI

GPT-5.6 Sol — Стандартний режим

$5.00

$30.00

$35.00

OpenAI

Claude Fable 5 / Claude Mythos 5

$10.00

$50.00

$60.00

Anthropic

GPT-5.6 Sol — Швидкий режим

$10.00

$60.00

$70.00

OpenAI

Це робить «на 50% нижчі» позапікові ставки потенційно оманливими без контексту. Позапіковий час на 50% дешевший за нові пікові ставки DeepSeek; це не 50% знижка від цін API, які розробники платять сьогодні.

Для простого робочого навантаження, що складається з одного мільйона вхідних токенів з кеш-промахом плюс одного мільйона вихідних токенів, V4-Pro зараз коштує $1.305. Той самий мікс токенів коштуватиме $2.64 позапіково, приблизно вдвічі дорожче, або $5.28 у пікові години, що більш ніж у чотири рази перевищує поточну ціну.

V4-Flash переходить з $0.42 за тим же простим розрахунком до $0.88 позапіково та $1.76 у пікові години.

Фактичні витрати на додатки значно варіюватимуться залежно від співвідношення кешованого входу, некашованого входу та згенерованого виведення, що робить ці комбіновані показники ілюстративними, а не універсальними оцінками загальної вартості.

DeepSeek рухається вгору по стеку агентів

Час робить стратегічний напрямок важко не помітити.

Коли DeepSeek випустив попередній перегляд V4 24 квітня, головною новиною було те, скільки можливостей передового класу компанія змогла надати з надзвичайно ефективною архітектурою.

V4-Pro використовує гібридну конструкцію уваги, що поєднує Compressed Sparse Attention та Heavily Compressed Attention; при контексті в один мільйон токенів DeepSeek стверджує, що це вимагає лише 27% FLOPs для інференції одного токена та 10% KV-кешу, що вимагався V3.2.

До кінця травня обговорення змістилося на те, що означають ці ефективності економічно для агентів з високим обсягом, чиї повторні читання контексту можуть зробити кешування основним компонентом витрат на інференцію. Різкі зниження цін DeepSeek на V4 посилили цю перевагу.

Випуски від 13 серпня просувають конкуренцію ще на один рівень вище.

DeepSeek тепер має оновлений V4-Pro, налаштований для агентних навантажень, стандартизовані інтерфейси, розроблені для полегшення підключення до існуючих інструментів розробника, конфігуровані зусилля для міркування та фреймворк під ліцензією MIT для керування моделями, інструментами, пісочницями, файловими системами та оркестрацією, що оточують агента.

Водночас DeepSeek демонструє, що розробники не можуть припускати, що його агресивно низькі ціни на API є постійними. Для організацій, які розглядають платформу, планування робочих навантажень, поведінка кешування та можливість запускати відкриті ваги на власній інфраструктурі тепер стають більш важливими частинами розрахунку загальної вартості.

Це залишає DeepSeek, який одночасно переслідує дві потенційно суперечливі переваги: робить свій стек агентів більш доступним і відкритим, одночасно роблячи свій власний розміщений API значно дорожчим.

Для корпоративних розробників Harness може виявитися найбільш значущою частиною оголошення четверга. Моделі все частіше можуть замінюватися за стандартизованими інтерфейсами. Фреймворк, який контролює, як агент міркує, викликає інструменти, редагує програмне забезпечення та зберігається протягом робочого процесу, замінити набагато важче.

DeepSeek тепер також конкурує за цей шар.

Подробиці можна знайти на сайті: venturebeat.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *