DeepSeek засновник Лян Венфен у внутрішньому спілкуванні власноруч підтвердив, що нове покоління флагманської моделі V4 буде офіційно випущено наприкінці квітня. Розкриті специфікації вказують, що загальна кількість параметрів наближається до 1 трлн, підтримує контекст у діапазоні 1 млн tokens, а також повністю виконуватиметься на чипах Huawei Ascend. Усе це вважають ключовим кроком, який має послабити залежність китайського AI від Nvidia.
(Попередня історія: DeepSeek V4 відмовляється від Nvidia — за Huawei! Alibaba, ByteDance, Tencent змагаються за купівлю чипів Huawei 950PR)
(Додатковий контекст: DeepSeek запустив «режим експерта» та «візуальний режим» — V4 перед офіційним релізом іде останнє прогрівання?)
За повідомленням, яке «Сіньлань цзинцзи» передає з посиланням на інсайдерів, Лян Венфен, засновник DeepSeek, вже розкрив, що нове покоління флагманської великої моделі DeepSeek V4 буде офіційно представлено наприкінці квітня. Хоча офіційно ще не оприлюднено точну дату, розробницька спільнота вже першим відчула «сигнали прогріву»: варіант V4-Lite тестується на вузлах API, швидкість міркування порівняно з попереднім поколінням зросла на 30%, а коефіцієнт пригадування контексту 128K tokens досягає 94%.
З огляду на наразі оприлюднену неофіційно, але не підтверджену інформацію, архітектура V4 зберігає дизайн Mixture-of-Experts (MoE): загальна кількість параметрів — близько 1 трлн, однак параметри, які реально активуються для кожного token, становлять лише приблизно 37 млрд, підтримуючи обчислювальну ефективність у стилі «акуратного актуарія», якому притаманна марка DeepSeek.
Частина про контекстне вікно: V4 через новий модуль Engram має змогу підтримувати наддовгий контекст у 1 млн tokens, змагаючись із нинішніми топовими моделями. Головна ідея Engram — умовне запитування пам’яті: це дозволяє моделі отримувати доступ до знань із часовою складністю O(1), а не лінійно роздуватися зі збільшенням довжини послідовності.
Щодо можливостей, розкриті тестові показники демонструють HumanEval на рівні 90%, а SWE-bench Verified — понад 80%. Якщо дані справді точні, це також майже повторює показники наявних нинішніх провідних флагманських моделей. Щодо модальностей: V4 нативно підтримує введення тексту, зображень і відео; ціна — приблизно $0.30/MTok (вхід), продовжуючи стратегію низьких цін DeepSeek.
Окрім технічних характеристик, найбільше публіки цікавить один момент: апаратна стратегія повністю зміщується в інший бік. Офіційно заявляють, що вся модель буде повністю виконуватися на чипі Huawei Ascend 950 PR і не залежатиме від жодних GPU Nvidia.
Це рішення має наслідки далеко ширші, ніж сам DeepSeek. Alibaba, ByteDance і Tencent уже почали здійснювати масштабні закупівлі чипів Huawei наступного покоління. Якщо V4 успішно підтвердить, що Ascend здатен забезпечити тренування та обчислення для топових флагманських моделей, це стане найбільш переконливим практичним кейсом для китайського ланцюжка постачання AI у частині самостійної автономності виробництва чипів на сьогодні.
У цьому контексті заходи США з обмеження експорту Nvidia, навпаки, можуть стати каталізатором, що пришвидшить дозрівання китайської автономної екосистеми.