Майкрософт випустила три нові внутрішні моделі ШІ для створення тексту, мови та графіки
Microsoft AI запускає три нові мультимодальні моделі
У рамках зусиль щодо зміцнення позицій у сфері штучного інтелекту (ШІ) дослідницьке підрозділ Microsoft AI оголосило про випуск трьох власних моделей, які здатні генерувати текст, звук і зображення. Це рішення стало відповіддю на конкуренцію з провідними лабораторіями ШІ.
Модель | Призначення | Ключові показники
MAI‑Transcribe‑1 | Перетворює мову в текст | 25 мов, швидкість 2,5 × швидше Azure Fast
MAI‑Voice‑1 | Створює аудіодоріжку | Минутка за одну секунду, налаштування голосів
MAI‑Image‑2 | Генерує зображення за текстом
Команда і лідерство
Проект розроблявся групою MAI Superintelligence – підрозділом, що займається фундаментальними дослідженнями у сфері передових систем ШІ. У листопаді 2025 року до команди приєднався виконавчий директор Мустафа Сулейман (Mustafa Suleyman).
Економічна ефективність
Розробники приділили особливу увагу зниженню вартості обчислень у порівнянні з аналогами від Google і OpenAI:
Услуга | Ціна
Розшифровка тексту | $0,36/год
Синтез мови | $22 за 1 млн символів
Обробка зображень | $5 за 1 млн вхідних токенів; $33 за генерацію 1 млн вихідних токенів
Моделі вже розгорнуті на платформі Microsoft Foundry. Транскрипція та синтез мови доступні у MAI Playground.
Партнерство з OpenAI
Незважаючи на активну розробку власних рішень, Мустафа Сулейман підтвердив прив’язаність до співпраці з OpenAI: Microsoft вже інвестувала понад $13 млрд. Корпорація продовжить використовувати моделі OpenAI у своїх продуктах відповідно до багаторічного контракту, застосовуючи стратегію диверсифікації аналогічну роботі з мікрочіпами.
Таким чином, Microsoft AI зміцнює свої позиції на ринку ШІ, пропонуючи швидкі та економічні мультимодальні рішення при збереженні тісних зв’язків із ключовими партнерами.
Коментарі (0)
Поділіться своєю думкою — будь ласка, будьте ввічливі та по темі.
Увійдіть, щоб коментувати