Аліба́ба, БайТенс і Куайшоу випустили нові моделі ШІ — від робототехніки до генерування відео-контенту для кіно.
Китайські IT‑гіганти демонструють нові ІІ‑алгоритми
Контекст
На минулому тижні американський ринок штучного інтелекту був зайнятий обговоренням можливостей моделей Anthropic і Altruist, які впливають на програмування та фінансові сервіси. У той же час китайські технологічні гіганти – Alibaba, ByteDance (власник TikTok) і Kuaishou – представили власні ІІ‑моделі, продемонструвавши зростання продуктивності в робототехніці та генерації відео. Ці розробки підтверджують, що Китай не відстає від західних конкурентів.
Фон
Оголошення про нові алгоритми прийшли після недавнього заяви Демиса Хассабісу (основателя Google DeepMind), який зазначив, що китайські ІІ‑моделі відстають від західних на кілька місяців. Тим не менш представлені в цьому році інструменти здатні виступати прямими супротивниками продуктам OpenAI (Sora), Nvidia і Google у галузі генерації відео та робототехніки.
1. RynnBrain – «розумний» роботизований помічник від Alibaba
* Що це?
Дослідницьке підрозділ Alibaba DAMO анонсувало модель RynnBrain, призначену для того, щоб роботи краще розпізнавали навколишній світ і взаємодіяли з об’єктами.
* Демонстрація
У ролі показано робота з клешнями замість рук, який збирає апельсини та складає їх у кошик. Також демонструється витягування молока з холодильника.
* Технічні особливості
- Розширене навчання необхідне для розпізнавання повсякденних об’єктів.
- RynnBrain включає вбудоване усвідомлення часу і простору: робот запам’ятовує, де й коли відбуваються події, слідкує за прогресом завдання і може продовжувати роботу на кількох етапах.
- Це підвищує надійність і послідовність у реальних умовах.
* Позиціювання
Alibaba ставить ціль створити «базовий інтелектуальний рівень» для втілених систем, конкуруючи з Nvidia і Google у робототехніці.
2. Seedance 2.0 – генерація відео від ByteDance
* Функціонал
Модель дозволяє створювати реалістичні відеоролики за простим текстовим описом. Алгоритм також може обробляти існуючі відео і зображення, об’єднуючи їх у нові композиції.
* Переваги
- Покращена керованість, швидкість і ефективність порівняно з попередніми версіями.
- Позитивний відгук від дослідниці Hugging Face Адіни Якефу: модель «здивувала своєю збалансованістю» і видає якісні результати вже при першому запуску.
* Технічні деталі
Seedance 2.0 поєднує візуалізацію, звукове супроводження й операторську роботу у єдиний потік, створюючи завершений продукт замість експериментального прототипа.
* Проблеми і обмеження
- Через питання конфіденційності ByteDance тимчасово вимкнула функцію генерації голосу людини на основі завантаженої фото.
- Це рішення було прийнято після того, як блогер висловив побоювання щодо несанкціонованої синтезу мови.
3. Kling 3.0 – конкурент від Kuaishou
* Загальне описання
Модель Kling 3.0 призначена для генерації відео і позиціонується як прямий супротивник Seedance 2.0.
* Ключові покращення
- Покращена узгодженість (деталі не розкриті в тексті, але підпадає на значний приріст якості).
Висновки
- Китайські компанії активно розвивають ІІ‑алгоритми для робототехніки і генерації відео, демонструючи конкурентоспроможні рішення.
- Alibaba зосереджена на «розумних» роботах із усвідомленням часу й простору.
- ByteDance пропонує просунуту модель створення відеоконтенту, але стикається з питаннями етики синтезу голосу.
- Kuaishou продовжує розширювати свій портфель генеративних моделей, конкуруючи з ByteDance.
Ці розробки підтверджують, що Китай не лише слідкує за західними інноваціями, а й активно формує власний ринок ІІ‑продуктів.
Коментарі (0)
Поділіться своєю думкою — будь ласка, будьте ввічливі та по темі.
Увійдіть, щоб коментувати