Нейросети для музыки и озвучки
В разделе два рода работы. Первый — музыка: песня целиком, с вокалом и аранжировкой, по описанию жанра или на ваш текст. Второй — голос: озвучка написанного текста выбранным голосом, диалог на несколько голосов, звуковые эффекты.
У каждой модели ниже указано, что именно она делает и сколько стоит запуск.
Модели для звука
- Kling (Kuaishou, от 1 токенов за запуск) — Звуки к видео и озвучка текста. 40 голосов, звук по описанию. Лучше всего подходит: звук по текстовому описанию.
- Suno (Suno Inc., от 2 токенов за запуск) — Песни с вокалом, каверы, продолжения, дорожки и свой голос. свой текст песни. Лучше всего подходит: песня на свой текст.
- Gemini TTS (Google, от 1 токенов за запуск) — Озвучка текста голосами Google: 30 голосов с образцами, русский, диалог по ролям. 30 голосов. Лучше всего подходит: диалог из коробки.
- ElevenLabs (ElevenLabs, от 1 токенов за запуск) — Озвучка текста живым голосом: 68 голосов, русский и ещё 28 языков. 67 голосов. Лучше всего подходит: русская речь без акцента.
- OpenAI Audio (OpenAI, от 0.02 токенов за секунду) — Озвучка текста и расшифровка записей. 10 голосов. Лучше всего подходит: запись, которую не хочется переслушивать.
Сравнения моделей
Вопросы и ответы
Можно ли сделать песню на свой текст?
Да, это умеет Suno: текст песни можно написать самому или отдать модели, описав тему и жанр.
Чем озвучить текст?
Голосовыми моделями раздела: у каждой свой набор голосов, их число указано в характеристиках. Текст на русском языке поддерживается.
Можно ли попробовать бесплатно?
Да: на бесплатном тарифе есть токены на старте, их хватает на первую песню. Доступность конкретной версии видна на странице модели.
Как оплатить и нужен ли VPN?
Оплата — картой российского банка или через СБП, в рублях; VPN и зарубежная карта не нужны.