Сервис AI Books для озвучивания текстов

Сервис AI Books для озвучивания текстов

AI Books – это новый проект компании «Директ-Медиа», который предлагает набор инструментов для копирования голосов и озвучивания текстов, а также доступ к GPT чату от OpenAI в России.

О возможностях ChatGPT я уже писала в одном из прошлых постов. Сегодня расскажу об озвучивании текстов с помощью сервиса.

Доступ к сервису платный. Пополнить баланс можно с помощью российской карты, минимальный платёж — 10 рублей. 

Напомню, как можно зарегистрироваться внутри сервиса и приступить к работе.

Регистрация

Заходим на сайт сервиса, нажимаем на кнопку «Регистрация»

Указываем своё имя, адрес электронной почты и придумываем пароль. Нажимаем на кнопку «Создать аккаунт».

На указанный номер придёт SMS с кодом. Код вписываем в открывшееся окно, нажимаем «Отправить» — и попадаем внутрь сервиса.

Для начала нужно пополнить баланс. Для этого переходим во вкладку  «Баланс» . Выбираем способ пополнения счёта, например, банковской картой, указываем любую сумму от 10 рублей и нажимаем «Пополнить».

Откроется окошко для оплаты. После завершения платежа сумма поступает на счёт, а мы возвращается на сайт сервиса.

И для работы открываем вкладку «Озвучить».

Как озвучивать текст?

Чтобы начать озвучку, в предложенное окно вставляем текст (до 5 тысяч символов), выбираем язык и голос для озвучивания.

Голос можно настроить, выбрав интонацию (нейтральная, строгая или добрая), скорость речи и высоту тона.

Чтобы результат получился качественным, можно проставить ударения в сложных словах (значок + перед ударной гласной), написать слова не так, как они пишутся, а так, как произносятся.

Сервис предлагает опцию «Подготовка текста». С ее помощью можно расшифровать числительные и аббревиатуры.

Закончив с настройками, нажимаем на кнопку «Озвучить».

Готовый результат можно скачать на ПК.

А это то, что у меня получилось. По-моему, очень достойно. 

Кольский мост

AI Books

Озвучивание «своим голосом»

Можно озвучить текст, используя другие голоса. Для этого у сервиса есть фунция «Мои голоса».

Как она работает? Для начала нам нужен небольшой аудиофайл с записью того голоса, который мы хотим использовать в озвучке.

Дальше вставляем в поле текст для озвучки и нажимаем на кнопку «Мои голоса» и выбираем «Создать».

Даём голосу название и загружаем аудиофайл с ПК. Нажимаем «Создать».

Теперь снова возвращаемся к нашему тексту. В разделе «Мои голоса» выбираем тот голос, который только что создали.

Справа открываются настройки.

Здесь можно определить скорость речи и уровень похожести голоса. Чтобы запустить озвучку, нажимаем на кнопку «Озвучить».

Готовый результат можно скачать. Вот так звучит мой Шерлок Холмс. Голос звучит, правда, более молодо, но хрипотца передается. И интонация интересная.

Шерлок Холмс

AI Books

А это Николай Дроздов рассказывает об услугах библиотеки. 

Николай Дроздов

AI Books

Zvukogram. Озвучиваем текст с помощью нейросети

Zvukogram. Озвучиваем текст с помощью нейросети

Звукограм — это российский сервис для озвучивания текста с помощью искусственного интеллекта.

Чтобы протестировать сервис, можно воспользоваться бесплатным тарифным планом. С его помощью можно озвучить 2000 символов обычным голосом и 10000 — премиальным.

Платные тарифы стартуют от 150 рублей.

Кроме того, среди большой звуковой базы сервиса можно найти и материалы для многих библиотечных аудио- и видеопроектов. Например, для создания презентации о животных Кольского Севера могут пригодиться звуки голосов полярной гагары, глухаря, белого медведя, тюленя и т.д.

Регистрация

Заходим на сайт сервиса и нажимаем на кнопку «Вход» (справа вверху).

Для регистрации надо указать адрес электронной почты и придумать пароль. После этого нажимаем на кнопку «Зарегистрироваться».

На указанную почту придет письмо со ссылкой для активации. Переходим по ней.

Осталось пройти капчу, решив небольшой пример. Вписываем нужное число и нажимаем «Активировать».

Как озвучивать текст?

Переходим во вкладку «Озвучка текста». Перед нами — поле для того, чтобы вписать текстовый фрагмент для озвучки.

По умолчанию в поле стоит примерный текст. Удаляем его нажатием на иконку метлы или вы на клавиатуре. Вставляем свой текст из буфера обмена или печатаем.

Вверху, над текстом, — несколько кнопок для подготовки его к озвучке.

1 — вставка одиночной паузы. По умолчанию это будет небольшая одиночная пауза. Но можно удлинить её. Для этого в месте планируемой паузы вставляем <break time=″1000ms″/> и указываем необходимое время. Значение 1000ms равно одной секунде. Соответственно каждая прибавленная тысяча будет равна ещё одной секунде.

2 — очистка. В один клик убираем введённый текс, чтобы вставить новый.

3 — шаг назад. Так можно вернуться к старому тексту. Если вводили текст вручную в окне, то будет удаляться по одной букве.

4 — шаг вперёд. Если удалили введённый ранее текст, то можно получить его обратно. Если вводили текст вручную, то текст будет появляться по одной букве.

5 — управление интонацией. Выбираем слово или фрагмент тексты, выделяем его «мышкой» и нажимаем на эту кнопку. Откроется окно, в котором вручную можно изменить интонацию.

6 — акцент, логическое ударение. Полезная штука для привлечение внимания к слову. Чтобы поставить логическое ударение, выделяем слово и нажимаем на эту кнопку. При это появляется служебная надпись: <prosody volume=″+20″>выделенное слово</prosody>. Акцент достигается за счёт усиления голоса. И появляющиеся данные усиления +20 можно изменить  в большую или меньшую сторону.

7 — экспертная опция для разметки текста. На первых порах пользоваться ей необязательно.

8 — выбор диктора. Пригодится, если текст нужно озвучить разными голосами. Выделяем фрагмент текста, выбираем диктора и нажимаем на кнопку «Обернуть».

9 — обрезка. Звукограм создает из текста цельный аудиофайл в форматах MP3, WAV и OGG. Но для монтажа роликов или подкастов часто нужны отдельные фрагменты — система умеет автоматически разрезать озвученный текст на куски.

Ставим курсор в нужное место и нажимаем кнопку разделения на панели меню. Кнопка вставляет специальный тег <obrezka/>. Можно копировать его и расставлять по тексту вручную — где поставите тег, там аудио и разрежется.

После добавления хотя бы одного тега в озвученном файле появится кнопка «скачать отрезки». Так можно не заниматься самостоятельно разрезкой аудиофайла на фрагменты, а поручить это сервису.

10 — позволяет добавлять звуки внутрь текста из базы сервиса.

Еще несколько полезных советов для подготовки текста.

Чаще всего дикторы правильно расставляют ударения. Но в русском языке встречается много слов, где ударение на другую гласную полностью меняет смысл слова. Самый простой способ установки ударения — поставить знак + перед ударной буквой.

В редких случаях с географическими названиями, фамилиями это не всегда помогает. Тогда можно воспользоваться опцией SSML. Ставим знак + перед ударной буквой, выделяем слово и нажимаем на «SSML», дальше нажимаем на «phoneme». Система сгенерируют фонетический разбор слова, каждую букву можно изменить.

Можно написать сложные слова не так, как они пишутся, а так, как произносятся, например: проект, шоссе и т.д.

Если в процессе разметки мы еще не выбрали диктора, это можно сделать в верхнем меню. Рядом кнопки для изменения высоты тона и скорости речи.

Чтобы запустить процесс создания озвучки, нажимаем внизу на кнопку «Озвучить текст».

Готовый аудиофайл можно скачать.

С первой попытки получилось не безупречно, но все-таки неплохо.

Одного жаль: к сожалению, токены не пополняются. И как только они закончатся, придется либо переходить на платный тариф, либо заводить новый аккаунт.

Рассказ о музее Есенина

Звукограм

База звуков

У сервиса есть хорошая библиотека звуковых файлов, которые можно использовать в своих проектах.

Чтобы открыть коллекцию, переходим в раздел «Звуки». Все файлы рассортированы по категориям. Для быстроты работает поиск.

Любой понравившийся звук можно скачать на ПК.

Нейросеть Mubert для создания инструментальной музыки

Нейросеть Mubert для создания инструментальной музыки

Mubert — это онлайн-сервис на основе искусственного интеллекта, который умеет генерировать инструментальную музыку.

Нейросеть Mubert была обучена на больших массивах музыкальных данных и создаёт треки в разных стилях и жанрах. 

У сервиса несколько тарифных планов, включая бесплатный, который ограничен 25 генерациями в месяц, 10 скачиваниями и общей продолжительностью треков – до 30 минут в месяц.

Регистрация

Заходим на сайт сервиса и нажимаем на кнопку «Sign Up». В дальнейшем для входа в личный кабинет можно использовать кнопку «Log In».

На следующей странице нам предложат два варианта регистрации.

Первый – через Google аккаунт — самый быстрый способ. Второй – через электронную почту.

В последнем случае указываем адрес электронной почты, придумываем пароль и соглашаемся с условиями сервиса. После этого нажимаем на кнопку «Create account».

На почту придет код верификации, который нужно будет ввести в предложенное поле для завершения регистрации. И снова нажимаем «Create account».

Генерируем трек по описанию

После регистрации открывается стартовое окно для генерации. Mubert корректно обрабатывает только запросы на английском языке.

В поле ввода промта вписываем запрос, например: «Background music for video, light, positive, piano». В поле «Set type» выставляем значение «Track». Далее указываем длительность, например, две минуты. А потом нажимаем на кнопку «Generate track».

После генерации трека его можно переименовать, нажав на значок с тремя точками, а дальше – на кнопку «Rename».

Нажав на значок со стрелкой, музыкальный файл скачиваем на ПК. При предварительном прослушивании музыки будет слышен «водяной знак» с названием сервиса. При скачивании он пропадает.

Перед тем как начнется скачивание, сервис предупреждает, что при публикации трека нужно будет дать ссылку на нейросеть, которая его сгенерировала. Чтобы запустить скачивание, нажимаем на кнопку «Skip for now».

Вот такая фоновая музыка у меня получилась.

Фоновая музыка

Mubert

Генерируем трек c использованием тегов

В Mubert есть функция генерации трека с использованием встроенных тегов. Для этого нужно нажать на одну из кнопок под полем для запросов: Genres (Жанры), Moods (Настроения), Activies (Действия).

После этого раскроется список, в котором сгруппированы различные теги по жанрам, настроению, активности. Можно выбрать любые теги, и они автоматически попадут в окно для запросов. В этом случае добавить или изменить запрос вручную уже нельзя.

Жанры – все самые известные: от классической до электронной музыки.

Настроения – от праздничного и радостного до страшного и напряженного.

Среди активностей – спорт, сон, отдых.

Теги можно выбирать только в одном разделе. Запускаем генерацию, нажав «Generate track». Готовую работу сохраняем на ПК.

Это пример поп-музыки от нейросети.

Генерируем трек по картинке

Для активации этой функции, которая недавно появилась на платформе Mubert, нажимаем на соответствующую иконку возле поля ввода.

Загружаем картинку по кнопке «Upload png, jpg or webp». Нажимаем «Continue».

Выставляем длительность трека, нажимаем «Generate track». Ждем несколько секунд, прослушиваем и скачиваем результат.

Я попробовала сгенерировать трек вот по этой картинке.

Вот что получилось.

Миксование музыки

Давайте сгенерируем композицию в смешанном стиле. В списке жанров выбираем основной стиль, например, Classical.

В поле «Set type» выбираем режим «Mix». Выставляем нужную длительность и нажимаем «Generate track». В этом режиме Mubert будет произвольно миксовать композицию с другими жанрами.

Иногда может получиться неожиданно.

Например, вот так. 

Редактирование

Сгенерированные треки можно немного подредактировать. Для этого рядом с композицией нажимаем на значок с изображением молнии.

В открывшемся окне тип генерации оставляем «Track» или меняем на «Mix», продолжительность тоже меняется, затем кликаем по кнопке «Generate track». Даже если мы всего лишь меняем длительность музыкального файла, сервис перегенерирует всю композицию заново.

Новая композиция будет отмечена надписью «Remix».

Suno. Как создавать музыку c помощью нейросети

Suno. Как создавать музыку c помощью нейросети

Suno AI — это генеративная нейросеть, которая позволяет людям без какого-либо музыкального образования и опыта игры на инструментах создавать качественные треки с вокалом и без.

Сервис был представлен обычным пользователям в 2024 году и вызвал большой интерес. 

На сайте сервиса собрана большая музыкальная библиотека из произведений пользователей. Всё это можно использовать для вдохновения или просто слушать.

Suno генерирует по текстовому описанию полноценные песни с музыкальным сопровождением, словами и вокалом. Нужно лишь указать, о чём будет трек, его жанр, настроение. При желании можно загрузить свои собственные тексты, и нейросеть пропоёт их. Русский язык поддерживается.

В бесплатной версии сервиса доступно 50 ежедневных кредитов, которых хватит на пять генераций по 2 песни в каждой, то есть на 10 треков.

Авторизация

Заходим на сайт сервиса и нажимаем на кнопку «Sign Up». В дальнейшем для входа можно будет использовать кнопку «Sign In».

Сервис предлагает регистрацию по номеру телефона, но с территории РФ она недоступна. Поэтому авторизироваться нужно через аккаунты Google, Apple или Microsoft.

Как создать песню в автоматическом режиме

После авторизации мы оказываемся в личном кабинете, в разделе «Create».

По умолчанию здесь включен самый простой режим — «Simple». С него и начнем.

В поле «Song Description» описываем песню (пишем промпт). Можно указать жанр и настроение, рассказать о герое или сюжете песни, описать эмоции и желаемые инструменты. Главное — уместиться в 200 символов.

Принимается и русский, и английский язык. Если нужна просто музыка без слов, то активируем переключатель «Instrumental».

Если нажать на значок с игровым кубиком, можно использовать случайный промпт из коллекции сервиса.

Через несколько минут нейросеть создаст две песни и нарисует к ним обложки. Треки можно прослушать, оценить лайком или дизлайком и скачать на ПК.

Чтобы сохранить полученные музыкальные эксперименты, нажимаем на значок с тремя точками, а дальше из выпадающего списка выбираем «Download».

Скачать музыку можно как аудиофайл MP3 или как видео. 

На момент написания статьи видео сгенерировать не получилось. А вот аудио скачалось быстро. Использовать трек можно только в некоммерческих целях, о чем предупреждают при скачивании.

Вот такая песня у меня получилось по запросу: «Напиши поп-песню в среднем темпе с запоминающимся припевом, бодрым настроением, с выраженным риффом на электрогитаре и синтезаторами. Тема песни — принятие перемен и отказ от прошлого».

Как создать песню в продвинутом режиме

Ещё интереснее создавать песню на основе своего стихотворения. Для этого подключаем режим «Custom».

В поле «Lyrics» вписываем готовый текст песни. 

Для лучшего построения структуры песни можно (и нужно!) использовать метатеги, которые Suno AI распознает, если заключить слова в квадратные скобки. Вот самые основные:

[Intro] — вступление;
[Verse] — куплет;
[Bridge] — бридж, переход;
[Chorus] — припев;
[Instrumental Interlude] — проигрыш;
[Outro] — окончание;
[Fade Out] — плавное затухание;
[Guitar Solo] — гитарное соло;
[Male Singer] — мужской голос;
[Female Singer] — женский голос.

Метатеги расставляем по тексту песни. Минимально стоит разбить лирику на абзацы и обозначить их тегами [Verse] и [Chorus].

Чтобы избежать ошибок, можно писать слова так, как они произносятся, А не так, как пишутся, и использовать букву «ё».

Дальше переходим в раздел «Styles». Здесь указываем жанр и стиль будущей нетленки. Можно писать на русском, можно на английском.

Вот примерный список возможных вариантов:

Rock (Рок)
Classic Rock (Классический рок)
Hard Rock (Хард-рок)
Punk Rock (Панк-рок)
Glam Rock (Глэм-рок)
Progressive Rock (Прогрессив-рок)
Alternative Rock (Альтернативный рок)
Indie Rock (Инди-рок)
Grunge (Гранж)
Psychedelic Rock (Психоделический рок)
Garage Rock (Гаридж-рок)

Metal (Метал)
Heavy Metal (Хэви-метал)
Death Metal (Дэт-метал)
Black Metal (Блэк-метал)
Thrash Metal (Трэш-метал)
Power Metal (Пауэр-метал)
Doom Metal (Дум-метал)
Gothic Metal (Готик-метал)
Nu Metal (Ню-метал)
Progressive Metal (Прогрессив-метал)
Folk Metal (Фолк-метал)

Pop (Поп)
Classic Pop (Классический поп)
Synth-pop (Синти-поп)
Teen Pop (Тин-поп)
Dance Pop (Дэнс-поп)
Electropop (Электропоп)

Rap and Hip-hop (Рэп и Хип-хоп)
Old School Rap (Олд-скул рэп)
Gangsta Rap (Гангста рэп)
Trap (Трэп)
Lo-fi Hip-hop (Ло-фай хип-хоп)
Alternative Hip-hop (Альтернативный хип-хоп)

Electronic Music (Электронная музыка)
Techno (Техно)
Trance (Транс)
House (Хаус)
Drum and Bass (Драм-н-бейс)
Downtempo (Даунтемпо)
Dubstep (Дабстеп)

Jazz and Blues (Джаз и Блюз)
Traditional Jazz (Традиционный джаз)
Swing (Свинг)
Bebop (Бибоп)
Blues (Блюз)
Soul Jazz (Соул-джаз)

Folk and Ethnic Music (Фолк и Этническая музыка)
Traditional Folk (Традиционный фолк)
Celtic Music (Кельтская музыка)
Flamenco (Фламенко)
Reggae (Регги)
Ska (Ска)

Недавно у сервиса появилась новая опция — «Audio». С ее помощью можно загрузить небольшой фрагмент песни с ПК для образца. Для этого нажимаем «Audio» — «Upload». Можно загрузить не более 6 секунд, но только ту музыку, на которые у вас есть права.

Закончив с настройками, нажимаем «Create».

Это один из моих удачных результатов. По-моему, вышло неплохо.