Suno запустила генерацию речи в публичной бете
Suno запустила функцию Speech в публичной бете на веб- и мобильных платформах. Она генерирует речь и фоновую музыку одновременно в одном треке. Максимальная длительность — около восьми минут.
Изображения, видео, музыка и голос
Suno запустила функцию Speech в публичной бете на веб- и мобильных платформах. Она генерирует речь и фоновую музыку одновременно в одном треке. Максимальная длительность — около восьми минут.
Black Forest Labs представила Flux 3 Image — графическую часть семейства Flux 3. Модель поддерживает многошаговое редактирование, работу с текстом и фотореализм, а API доступен со скидкой 50% до 8 октября.
Tavus представила Griffin — первую модель класса Human Interaction Model, которая ведёт видеоразговор в реальном времени. В исследовании компании 48% участников приняли аватар за настоящего человека после минутного звонка.
Ideogram представила модель Ideogram 4.5, которая редактирует только указанную пользователем область изображения, не затрагивая остальное. Модель доступна на платформе Ideogram и через API, открытые веса обещают выпустить позже.