Категорія
Новини
Дата

DeepSeek представила ШІ-модель V4-Pro: у рази дешевша за конкурентів і з покращеним агентним кодуванням

2 хв читання

Поширити
Getty Images

DeepSeek випустила V4-Pro – ціна у 7 разів нижча за модель Anthropic Фото Getty Images

Китайська DeepSeek представила ШІ-модель V4-Pro після кількох місяців затримок. Компанія заявила про суттєве покращення агентних можливостей і ціну $3,48 за 1 млн вихідних токенів проти $25 у моделі Opus 4.6 від Anthropic, пише WSJ.

Заощаджуйте, отримуючи 6 журналів за ціною 4

Купуйте річну передплату на шість журналів Forbes Ukraine за 1 799 грн замість 2 400 грн. Читайте головні історії українського бізнесу, ексклюзивні рейтинги та глибоку аналітику в кожному номері.

Купити

Деталі

  • V4-Pro отримала значно кращі можливості агентного кодування порівняно з попередніми версіями і вже використовується всередині компанії як основна модель для таких задач, повідомила DeepSeek у своєму WeChat. 
  • За внутрішніми оцінками, вона перевершує Sonnet 4.5 від Anthropic за користувацьким досвідом і якістю результатів, наближаючись до Opus 4.6 у режимі без «ланцюжка міркувань», хоча поступається у складніших сценаріях.
  • Запуск став першим великим оновленням DeepSeek після тривалої паузи, на тлі активного розвитку конкурентів у Китаї, серед яких Moonshot AI, MiniMax, Alibaba та ByteDance.
  • Компанія заявила про технологічний прорив: ключові методи ефективності моделі протестовано як на GPU від Nvidia, так і на чипах Ascend від Huawei. Остання заявила про повну підтримку V4 у своїй екосистемі, що підкреслює зростаючу роль китайських напівпровідників у сфері ШІ, зазначило видання.
  • Серед технічних нововведень – використання Sparse Attention, що дозволяє моделі обробляти лише релевантні частини даних. Це підвищує ефективність і дає змогу працювати з довшими документами.
  • Попри те, що V4-Pro дорожча за попередні моделі DeepSeek, вона залишається значно дешевшою за західні аналоги – $3,48 за 1 млн вихідних токенів. 
  • Компанія також представила V4-Flash – швидшу і доступнішу версію, яка демонструє хороші результати на простіших задачах, але поступається у складних.
  • DeepSeek готується до першого зовнішнього раунду фінансування і прагне залучити щонайменше $300 млн. Як зазначив WSJ, оцінка компанії залежатиме від успіху нових моделей.

Контекст

DeepSeek – один із найдинамічніших гравців китайського ШІ-ринку, який конкурує з локальними гігантами та західними компаніями, роблячи ставку на ефективність і нижчу вартість моделей. 

Паралельна оптимізація під Nvidia і Huawei свідчить про спробу зменшити залежність від американських технологій і масштабувати рішення на внутрішньому ринку. 

На початку квітня OpenAI, Anthropic і Google об’єднали зусилля, щоб ускладнити китайським конкурентам доступ до результатів роботи передових американських моделей штучного інтелекту та не допустити отримання ними переваги у світовій гонці ШІ.

Тема дистиляції опинилася у центрі уваги в січні 2025 року після несподіваного запуску моделі R1 від DeepSeek, що суттєво вплинуло на ринок ШІ. Після цього Microsoft та OpenAI почали перевірку щодо можливого виведення великих обсягів даних з американських моделей для створення R1.

У лютому OpenAI додатково попередила законодавців США, що DeepSeek і надалі використовує дедалі складніші методи для отримання результатів роботи американських моделей, незважаючи на посилення захисту. У зверненні до Конгресу компанія заявила, що китайський розробник застосовує дистиляцію для створення нової версії свого чат-бота.

Матеріали по темі

Ви знайшли помилку чи неточність?