Нейросеть Fish Audio для озвучки текста

Версия *

До 3000 знаков. Цена считается по объёму текста

Напишите пару слов или приложите снимок — составим подробный промпт. Обычно 1 ₽

Для диалога. Расставьте в тексте метки <|speaker:0|> и <|speaker:1|> — они указывают, чья реплика

1 — обычная скорость

дБ

0 — без изменений

Формат файла

4 ₽ с подпиской · подробнее

Результаты появятся здесь после генерации

Срок хранения файлов зависит от тарифа

Похожие нейросети

Цены по версиям

Возможности каждой версии и цена по всем трём тарифам рядом

Версия Возможности модели Без подписки Стандарт ПРО
S2.1 Pro Топ Новинка Живая интонация, диалог на два голоса, пометки эмоций 6 ₽/1000 знаков 4 ₽/1000 знаков 4 ₽/1000 знаков

Fish Audio — что это за нейросеть

Fish Audio озвучивает текст голосом, который трудно отличить от живого. Модель понимает пометки прямо в тексте: [laughs] — смех, [sigh] — вздох, [short pause] — короткая пауза, [whispering] — шёпот. Так в озвучку добавляется то, чего обычный синтезатор речи не умеет. Второе её отличие — диалог: можно задать два голоса и расставить в тексте метки говорящих, и модель озвучит сцену на два лица. Скорость и громкость настраиваются.

Как работает Fish Audio

  1. Текст разбирается на реплики, паузы и пометки эмоций.

  2. Каждой реплике сопоставляется голос из библиотеки.

  3. Речь синтезируется целиком, поэтому интонация не рвётся между фразами.

Как пользоваться

  1. Вставьте текст, который нужно озвучить, — до 3000 знаков.

  2. Выберите голос. Для диалога задайте второй голос и расставьте в тексте метки <|speaker:0|> и <|speaker:1|>.

  3. Добавьте пометки в квадратных скобках, если нужны смех, вздох или пауза.

  4. Настройте скорость и громкость, если нужно, и нажмите «Сгенерировать».