Алібаба запускає компактні моделі Qwen 3.5, що працюють безпосередньо на ноутбуках і перевершують аналогічні продукти від OpenAI
Alibaba Qwen 3.5 — нова серія компактних ІІ-моделей
У рамках свого підрозділу з штучного інтелекту Alibaba оголосила про випуск лінійки моделей Qwen 3.5, які обіцяють «маленький розмір + висока ефективність». Порівняно з американськими аналогами вони демонструють кращу точність при меншому об’ємі пам’яті.
| Модель | Розмір | Ключові особливості |
|---|---|---|
| Qwen 3.5‑0.8B | 0,8 млрд параметрів | «Мініатюрна» і «швидка», призначена для прототипів та мобільних пристроїв з обмеженою автономією |
| Qwen 3.5‑2B | 2 млрд | Аналогічно 0.8B, але трохи потужніше |
| Qwen 3.5‑4B | 4 млрд | Мультимодальна, контекстне вікно 262 144 токенів; підходить для легких агентських рішень |
| Qwen 3.5‑9B | 9 млрд | Здатна розсудовувати, перевищує OpenAI gpt‑oss‑120B (13,5× більше параметрів) і демонструє рівень аспірантури у логічному мисленні |
Усі моделі доступні під ліцензією Apache 2.0, що дозволяє використовувати їх у комерційних проектах та донавчати при необхідності.
Що нового в архітектурі?
Alibaba відмовилася від класичних Transformer‑ів і застосувала гібридну схему:
* Gated Delta Networks (GDN) – забезпечують високу пропускну здатність і низьку затримку.
* Mixture‑of‑Experts (MoE) – вирішують проблему обмеженої пам’яті, характерної для невеликих моделей.
Завдяки цьому Qwen 3.5 може працювати з мультимодальними токенами одразу, а не «прикріпляти» генератори зображень до текстових моделей, як це робили попередні покоління. У результаті версії 4B і 9B вміють розпізнавати UI‑елементи та підраховувати об’єкти у відео.
Тести й результати
Бенчмарк | Qwen 3.5‑9B | Порівняння
---|---
MMMU‑Pro (візуальний) | 70,1 % | Перевершила Google Gemini 2.5 Flash‑Lite (59,7) і спеціалізовану Qwen 3‑VL‑30B‑A3B (63,0)
Логічне мислення | 81,7 % | Більше OpenAI gpt‑oss‑120B (80,1), хоча у останньої в 10× більше параметрів
HMMT Feb 2025 (математика) | 83,2 % (9B), 74,0 % (4B) | Доказала, що для складних задач точних наук не потрібні гігантські хмарні ресурси
OmniDocBench v1.58 | 7,7 % | Лідер серед усіх моделей
MMMLU (мультиязычність) | 81,2 % | Перевершила gpt‑oss‑120B (78,2 %)
Чому це важливо?
Поява Qwen 3.5 збіглася з ростом попиту на автономних ІІ‑агентів. Сучасний користувач вимагає не лише чат‑ботів, а й систем, які:
1. Думають – розсудовують над задачами.
2. Видають – обробляють зображення, відео та UI‑елементи.
3. Діють – вміють користуватися інструментами (заповнювати форми, сортувати файли).
З урахуванням того, що великі моделі (три‑п’ятнадцятьмільярд параметрів) коштують дорого в експлуатації, Qwen 3.5 — більш економічне рішення. Моделі можна запускати локально без підключення до хмар і API, а навчання з підкріпленням дозволяє їм приймати «чоловіські рішення» – наприклад, організувати робочий стіл або розробляти код за відеозаписом.
Практичне застосування
* Мобільні пристрої – 0,8 млрд параметрів легко вміщуються у смартфон і забезпечують автономну роботу.
* Робочі станції – 9 млрд параметрів дають повний набір функцій агентського ІІ без хмар.
* Інтерфейс‑агентство – завдяки «прив’язці на рівні пікселів» моделі можуть переміщатися по UI, заповнювати форми і сортувати файли, виконуючи прості команди на природній мові з точністю близько 90 %.
Таким чином, Alibaba Qwen 3.5 відкриває шлях до більш доступних, гнучких і потужних ІІ‑агентів, які можуть працювати як у хмарі, так і локально, задовольняючи зростаючі вимоги сучасного користувача.
Коментарі (0)
Поділіться своєю думкою — будь ласка, будьте ввічливі та по темі.
Увійдіть, щоб коментувати