TechCrunch · AI · 1 ч назад

Fish Audio привлекает 52 миллиона долларов на создание голосовых моделей искусственного интеллекта для авторов и предприятий

С момента запуска в прошлом году в стартапе сегодня насчитывается более 8 миллионов человек, использующих версии своих моделей с открытым исходным кодом или размещенные на хосте, и теперь он генерирует ежегодный регулярный доход в размере 21 миллиона долларов.

Источник TechCrunch
Опубликовано 1 ч назад
Оригинальный заголовок Fish Audio raises $52M seed to build AI voice models for creators and enterprises
Важность 5/5
Почему это может быть интересно Важно для понимания, куда реально двигаются модели, агенты и продуктовые AI-инструменты.
← Назад к ленте Открыть оригинал
#ai#startups#tech

Подробности

Рынок голосовых моделей, генерируемых искусственным интеллектом, огромен. Творческие варианты использования требуют, чтобы голосовые модели искусственного интеллекта были более выразительными, а предприятиям, стремящимся автоматизировать поддержку клиентов и операции по продажам, они должны быть более управляемыми.

Компания Fish Audio из Пало-Альто хочет удовлетворить все эти варианты использования с помощью своей библиотеки, содержащей более 15 000 элементов управления на естественном языке. С момента запуска в прошлом году в стартапе сегодня более 8 миллионов человек используют версии своих моделей с открытым исходным кодом или размещенные на хостинге, и теперь он генерирует ежегодный регулярный доход в размере 21 миллиона долларов.

Чтобы продолжить развитие этой тенденции, во вторник стартап заявил, что привлек $52 млн в рамках посевного раунда, который возглавили Coreline Ventures и Capital Today. В финансировании также приняли участие 359 Capital, Parable, Play Time, Alphalist Partners, Bayhouse Ventures, Carya Venture Partners и HF0.

Fish Audio начинался как небольшой проект бывшего исследователя NVIDIA Шицзя Ляо, который, разочарованный невыразительными синтетическими голосами, доступными на рынке, обучил модель генерации голоса на одном графическом процессоре, исходный код которого он открыл. Репозиторий Fish Speech на GitHub сейчас имеет более 31 000 звезд и используется независимыми разработчиками, дизайнерами видеоигр и создателями.

За последний год компания выпустила пять моделей: четыре модели генерации речи и одну модель преобразования речи в текст. Компания выложила в открытый доступ три модели генерации речи, но последняя модель S2.1 Pro доступна только через платный API.