Нейросети для музыки и озвучки

В разделе два рода работы. Первый — музыка: песня целиком, с вокалом и аранжировкой, по описанию жанра или на ваш текст. Второй — голос: озвучка написанного текста выбранным голосом, диалог на несколько голосов, звуковые эффекты.

У каждой модели ниже указано, что именно она делает и сколько стоит запуск.

Открыть рабочую зону

Модели для звука

  • Kling (Kuaishou, от 1 токенов за запуск) — Звуки к видео и озвучка текста. 40 голосов, звук по описанию. Лучше всего подходит: звук по текстовому описанию.
  • Suno (Suno Inc., от 2 токенов за запуск) — Песни с вокалом, каверы, продолжения, дорожки и свой голос. свой текст песни. Лучше всего подходит: песня на свой текст.
  • Gemini TTS (Google, от 1 токенов за запуск) — Озвучка текста голосами Google: 30 голосов с образцами, русский, диалог по ролям. 30 голосов. Лучше всего подходит: диалог из коробки.
  • ElevenLabs (ElevenLabs, от 1 токенов за запуск) — Озвучка текста живым голосом: 68 голосов, русский и ещё 28 языков. 67 голосов. Лучше всего подходит: русская речь без акцента.
  • OpenAI Audio (OpenAI, от 0.02 токенов за секунду) — Озвучка текста и расшифровка записей. 10 голосов. Лучше всего подходит: запись, которую не хочется переслушивать.

Сравнения моделей

Вопросы и ответы

Можно ли сделать песню на свой текст?

Да, это умеет Suno: текст песни можно написать самому или отдать модели, описав тему и жанр.

Чем озвучить текст?

Голосовыми моделями раздела: у каждой свой набор голосов, их число указано в характеристиках. Текст на русском языке поддерживается.

Можно ли попробовать бесплатно?

Да: на бесплатном тарифе есть токены на старте, их хватает на первую песню. Доступность конкретной версии видна на странице модели.

Как оплатить и нужен ли VPN?

Оплата — картой российского банка или через СБП, в рублях; VPN и зарубежная карта не нужны.