Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

MWS AI открыла свой инструмент для оценки моделей распознавания речи

Дата публикации: 06-10-2026 08:18:00

MWS AI (входит в МТС Web Services) выложила в открытый доступ RESON (Research Engine for Speech Observation & Notes) — инструмент для комплексной...

Основное содержимое страницы с новостью.

06 Октября 2026 11:18 06 Окт 2026 11:18 |

MWS AI (входит в МТС Web Services) выложила в открытый доступ RESON (Research Engine for Speech Observation & Notes) — инструмент для комплексной оценки качества моделей автоматического распознавания речи (ASR). Он позволяет сравнивать модели по более чем 10 метрикам и автоматически формирует интерактивный HTML-отчет с результатами анализа. RESON стал первой открытой разработкой MWS AI в области распознавания речи. Об этом CNews сообщили представители MWS AI.

Чтобы проанализировать качество модели с помощью RESON, пользователю необходимо загрузить результаты распознавания модели и эталонные расшифровки. Инструмент позволяет привести тексты к единым правилам, чтобы некритичные различия в написании слов не влияли на итоговую оценку качества, а также проводит анализ по выбранным метрикам и сравнивает результаты. На выходе формируется интерактивный отчет, который открывается в формате веб-страницы. Его можно использовать для технического анализа и для наглядного представления результатов бизнес-команде.

RESON поддерживает более 10 метрик, которые можно настраивать под свои задачи. В числе доступных, например: WER (Word Error Rate) — показывает количество ошибок при распознавании слов; CER (Character Error Rate) — рассчитывает ошибки на уровне отдельных символов; MWA (Mean Word Accuracy) — дает каждому уникальному слову одинаковый вес и помогает заметить ошибки на словах, которые редко встречаются в данных, например названиях компаний, продуктов или сервисов.

WIS (Word Importance Score) — разработанный MWS AI показатель, который помогает находить слова, которые почти не влияют на общий результат, но важны для конкретного сценария — например название брендов и продуктов, англицизмы. Он учитывает, как часто встречается слово, насколько плохо оно распознается, какие ошибки возникают и на какие варианты модель его заменяет. Это позволяет, в частности, приоритизировать улучшения модели в отраслевых сценариях.

RESON доступен в формате открытой Python-библиотеки. Его можно встроить в существующие процессы разработки через командную строку или Python API и развернуть в собственной инфраструктуре компании, в том числе в закрытом контуре. Инструмент рассчитан на команды, которые сравнивают разные версии моделей и на компании, выбирающие между решениями разных разработчиков.

Новый открытый бенчмарк для оценки моделей MWS RESON ASR OSD

Вместе с RESON MWS AI опубликовала MWS RESON ASR OSD — открытый бенчмарк (набор данных и правил для сравнения моделей в одинаковых условиях) с готовыми русскоязычными аудиоданными для оценки качества моделей распознавания речи. Он включает более 12 тыс. размеченных аудиозаписей общей длительностью около 38 часов и ориентирован в том числе на сценарии голосовой связи и контакт-центров.

Грани искусственного интеллекта: как компании внедряют ИИ в реальную практику

Грани искусственного интеллекта: как компании внедряют ИИ в реальную практику цифровизация

В бенчмарке представлены два типа данных: разговорная речь и фразы с числами и числовыми последовательностями. В него входят обращения в поддержку, автоматические уведомления и бытовые звонки, а также телефонные номера, счета, даты, суммы и другие данные. Записи представлены как без выраженных помех, так и с акустическим шумом и фоновой речью — например, звуками телевизора или посторонними голосами. В данных также встречаются англицизмы и названия компаний, банков, операторов связи, цифровых сервисов, устройств и приложений.

В рамках публикации бенчмарка MWS AI провела замеры качества открытых моделей Сбербанка, Alpha Cephei, Nvidia и OpenAI. Модели сравнивали по WER — показателю, который отражает количество ошибок при распознавании слов. Среди моделей, протестированных на всех четырех наборах данных, лучший средний результат показала GigaAM v3 от Сбера: средний WER составил 7,42%. У Vosk показатель составил 11,07%, у Nvidia Parakeet — 15,83%, у Nvidia Nemotron — 25,52%. GigaAM допускала более чем вдвое меньше ошибок, чем Nvidia Parakeet, и более чем втрое меньше, чем Nvidia Nemotron. На втором месте по точности другая российская разработка – Vosk от Alpha Cephei.

«RESON изначально создавался для внутренних задач команды. Раньше оценка качества фактически собиралась из нескольких инструментов: отдельно считались метрики, отдельно разбирались ошибки, а результаты приходилось сводить вручную. RESON объединил этот процесс в одной системе — от подготовки данных до сравнения моделей и разбора конкретных ошибок. Анализ, который раньше мог занимать несколько часов, сократился до 10–15 минут. Сейчас мы открываем этот подход индустрии — это наш вклад в формирование общего подхода к оценке ASR-моделей, как минимум на русскоязычных данных», — сказал руководитель команды распознавания речи MWS AI Александр Шевченко.

Другие материалы рубрики

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1MWS AI открыла свой инструмент для оценки моделей распознавания речи06.606-10-2026
2Российский ИИ обошел OpenAI и Nvidia в работе с задачами на русском языке09.4806-10-2026
3MWS Cloud выделит бизнесу более 1 млрд руб. на построение мультиклауд-инфраструктуры013.4928-09-2026
4MWS Cloud выделит бизнесу более 1 млрд руб. на построение мультиклауд-инфраструктуры013.4928-09-2026
5MWS Cloud выделит бизнесу более 1 млрд руб. на построение мультиклауд-инфраструктуры013.4928-09-2026
6Microsoft представила голосовую ИИ-модель MAI-Transcribe-2: в тестах она превосходит решения от Google и OpenAI012.5602-10-2026
7«Яндекс» представил Sona — ИИ-модель, способную заменить десятки алгоритмов рекомендаций010.4101-10-2026
8«Яндекс» представил Sona — ИИ-модель, способную заменить десятки алгоритмов рекомендаций010.4101-10-2026
9«Яндекс» представил Sona — ИИ-модель, способную заменить десятки алгоритмов рекомендаций010.4101-10-2026
10В HR-платформу «Пульс» внедрён ИИ-агент поддержки на GigaChat016.9428-09-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 6.6. Источник: se.cnews.ru.