DeepSeek V4 – нова модель ШІ, яку потрібно налаштувати для китайських апаратних прискорювачів обчислень
DeepSeek готується до релізу нової моделі V4
На цьому тижні, за даними *Financial Times*, китайська компанія DeepSeek планує представити довгоочікувану мультимодальну модель ШІ — V4. Особливістю буде оптимізація під прискорювачі Huawei і Cambricon, що дозволить китайським фірмам просувати власні рішення без сильної залежності від імпортних технологій.
Ключові дати та контекст
- Анонс моделі буде пов’язаний з парламентською сесією в КНР, яка розпочнеться 4 березня.
- Це стане найбільшим релізом DeepSeek з січня минулого року, коли компанія запустила модель R1. Тоді стверджувалося, що нова система порівнювана за ефективністю із західними аналогами при значно менших витратах.
Проблеми та протиріччя
Раніше виявилося, що DeepSeek використовувала дані американських моделей для навчання своїх систем і навіть опиралася на прискорювачі Nvidia. Однак у КНР ці пристрої під санкціями. У зв’язку з цим компанія свідомо не оптимізувала V4 під пристрої Nvidia.
Перші спроби навчати модель на прискорювачах Huawei виявилися не настільки успішними, але тепер DeepSeek має намір покращити сумісність із цими платформами.
Вплив на ринок
Оптимізація V4 під Huawei і Cambricon повинна стимулювати попит на ці апаратні рішення в Китаї та зменшити імпортозалежність. За прогнозами експертів, це зміцнить позиції китайського ШІ‑ринку.
Додаткова інформація
Анотація до моделі V4 з’явиться вже цього тижня у скороченому вигляді; повне описання очікується приблизно через місяць. У той же час американська компанія Anthropic звинуватила DeepSeek у «дистилюванні» власних ШІ‑моделей, що додало напруженості в міжнародні відносини щодо технологій штучного інтелекту.
Коментарі (0)
Поділіться своєю думкою — будь ласка, будьте ввічливі та по темі.
Увійдіть, щоб коментувати