Тема

синтез речи

Все материалы по теме в хронологическом порядке.

2 октября

Microsoft представила первую потоковую модель транскрибации MAI-Transcribe-2-Streaming

Microsoft расширила семейство моделей MAI, представив первую потоковую модель транскрибации MAI-Transcribe-2-Streaming и две модели синтеза речи — MAI-Voice-2.1 и MAI-Voice-2.1-Flash. Они предназначены для голосовых агентов, которые слушают пользователя и отвечают почти мгновенно.

2 минДля профи
29 сентября

ElevenLabs выпустила модель речи Eleven v4 с задержкой 150 мс

ElevenLabs выпустила Eleven v4 — модель синтеза речи, которая точнее следует указаниям и сохраняет голос на протяжении длинных записей. Версия Turbo для голосовых агентов начинает говорить за 150 миллисекунд.

3 минДля профи

МТС: ИИ-секретарь помог слабослышащим провести 500 тыс. звонков за полгода

МТС сообщила, что за первые полгода работы сервис «Секретарь для глухих и слабослышащих» помог провести около 500 тыс. разговоров по телефону. ИИ в реальном времени преобразует входящий звонок в текст, а письменные ответы озвучивает собеседнику.

1 мин
26 сентября

МТС: ИИ-сервис для глухих обработал почти 500 тыс. звонков

За первые шесть месяцев работы сервис МТС «Секретарь для глухих и слабослышащих» обработал около 500 тыс. входящих звонков. Услуга работает в реальном времени: речь преобразуется в текст, а ответы пользователя озвучиваются собеседнику.

1 мин