Тема

аудио

Все материалы по теме в хронологическом порядке.

2 октября
29 сентября

ElevenLabs выпустила модель речи Eleven v4 с задержкой 150 мс

ElevenLabs выпустила Eleven v4 — модель синтеза речи, которая точнее следует указаниям и сохраняет голос на протяжении длинных записей. Версия Turbo для голосовых агентов начинает говорить за 150 миллисекунд.

3 минДля профи
27 сентября

Nvidia выпустила бесплатную модель Nemotron 3 Diarization на 100 млн параметров

Nvidia представила Nemotron 3 Diarization — бесплатную ИИ-модель, которая определяет, кто говорит в каждый момент разговора. Она различает до восьми голосов, работает с записями и живым аудио и лидирует в бенчмарке VoiceArena.

1 минДля профи
25 сентября