Microsoft выпустила три собственные ИИ-модели для речи и изображений

Пост опубликован в блогах iXBT.com, его автор не имеет отношения к редакции iXBT.com
| Новость | ИИ, сервисы и приложения

Microsoft представила три собственные модели искусственного интеллекта для работы с речью и изображениями. Системы MAI-Transcribe-1, MAI-Voice-1 и MAI-Image-2 доступны через сервис Microsoft Foundry и площадку MAI Playground.

Модель преобразования речи в текст MAI-Transcribe-1 показала средний уровень ошибок 3,8% при тестировании на 25 языках по методике FLEURS. Алгоритм обрабатывает файлы форматов MP3, WAV и FLAC объемом до 200 МБ. Скорость пакетной транскрипции превышает показатели существующих предложений Azure в 2,5 раза. Технология применяется в режимах голосового управления Copilot и для расшифровки разговоров в Teams.

Автор: qwen. ai Источник: chat.qwen.ai

Генератор голоса MAI-Voice-1 создает 60 секунд аудио за одну секунду реального времени и поддерживает клонирование голоса по коротким образцам. Стоимость услуги составляет 22 доллара за миллион символов. Система создания изображений MAI-Image-2 размещена в тройке лидеров рейтинга Arena. ai и работает вдвое быстрее предыдущей версии. Тарифы установлены на уровне 5 долларов за миллион входных токенов и 33 доллара за миллион выходных токенов.

Разработка моделей велась командами численностью менее десяти человек. Требования к вычислительным ресурсам снизились вдвое по сравнению с показателями конкурентов. Запуск состоялся после пересмотра соглашения с OpenAI в сентябре 2024 года, который снял ограничения на самостоятельные исследования в области общего искусственного интеллекта. Партнерство с OpenAI сохраняется до 2032 года.

Руководитель направления суперинтеллекта Мустафа Сулейман сообщил о планах обеспечить независимость компании в создании моделей всех типов. Стратегия ценообразования направлена на снижение себестоимости внутренних продуктов.

Источник: venturebeat

Автор не входит в состав редакции iXBT.com (подробнее »)
Об авторе
Интересуюсь технологиями и рассказываю о них вам.

0 комментариев

Добавить комментарий

Сейчас на главной

Новости

Публикации

Быстро заряжает смартфоны Xiaomi. Обзор пауэрбанка Ugreen 55W PB727

Пауэрбанк Ugreen модели PB727 — компактный внешний аккумулятор с ёмкостью встроенного аккумулятора 10 000 мА·ч. Устройство поддерживает популярные протоколы быстрой зарядки, в том числе...

Обзор UGREEN US316: двухметровый USB-C 100W с образцово низким сопротивлением

UGREEN US316 — это двухметровый USB-C кабель с поддержкой мощности до 100 Вт и скоростью передачи данных 480 Мбит/с. Модель позиционируется как универсальное решение для зарядки и...

Обзор зарядной станции Magssory Fold Ultra – удобная 3 в 1 или очередная подставка

Складные зарядные станции 3 в 1 уже давно перестали быть редкостью, но с ростом мощности и переходом на Qi2 к ним начинают предъявляться новые требования. В этом обзоре рассмотрим Magssory Fold...

Декоративный камин с эффектом живого пламени: ожидание и реальность

Жители шумных мегаполисов с однотипными многоэтажными человейниками часто мечтают о том, как в конце дня они могли бы отдыхать в своем доме, сидя в удобном кресле с чашкой горячего чая и...

Угольный фильтр в холодильнике: нужен ли он и стоит ли за него платить

Современный холодильник представляет сложную система, где воздух постоянно циркулирует для равномерного охлаждения всех продуктов. При хранении разнообразной еды в камере могут появляться...