Синтез мовлення

Перетворіть будь-який текст на природне мовлення.

Вставте текст, оберіть один із 138 голосів - зокрема носіїв двадцяти двох мов - і натисніть відтворення. Слухайте кожен голос безкоштовно, платіть за символи, завантажуйте MP3.

Створіть свій перший кліп →
Оплата за кожні 1,000 символів - без щомісячного плану. Потрібен безкоштовний акаунт.

Послухайте голоси, перш ніж витратити бодай один кредит

Справжні зразки, прямо з генератора. Носії мови позначені - це місцеві голоси, а не англійський голос, що читає іноземну мову.

Marin Жіночий
Cedar Чоловічий
Nova Жіночий
Onyx Чоловічий

Переглянути всі 138 голоси →

Почуйте різницю

Те саме українське речення, двічі. Vira говорить українською; Aria - універсальний голос, який читає українську з англійським акцентом. Найпомітніше це на г, на парі и та і й на ненаголошених голосних.

Aria - універсальний голос

Чому український голос звучить інакше

Найчастіша вада українського синтезу мовлення - не англійський акцент, а російський: багатомовні моделі вчили кирилицю переважно на російських даних. Українське г - це дзвінкий гортанний звук, а не тверде ґ; ненаголошене о лишається о, а не перетворюється на а; и та і - два різні звуки, які російськомовні голоси зливають в один. Коли це не працює, виходить російська вимова, накладена на український текст, і саме це слухач помічає першим.

Усі чотири голоси - носії української. Vira звучить молодо й природно, як оповідачка; Yaroslava жвава й енергійна, добре лягає на новинні та інформаційні матеріали. Evgeniy - соковитий чоловічий голос і найпопулярніший український голос у бібліотеці; Leonid спокійний, з київським забарвленням, зручний для пояснень і довгих текстів. Апостроф в об'єкт і м'який знак читаються як окремі фонетичні події, а не пропускаються.

Усе, щоб озвучити ваш текст

Один із двох основних інструментів Speecho - мовлення стає текстом, а текст стає мовленням.

138 стокові голоси

Тринадцять голосів OpenAI плюс сто двадцять п’ять від ElevenLabs, зокрема носії двадцяти двох мов - кожен із безкоштовним зразком.

Три рівні якості

Standard - для чернеток і службового аудіо, Enhanced та Premium (ElevenLabs) - коли звучати має по-людськи.

Розмовляє вашою мовою

Голоси говорять мовою вашого тексту - а для двадцяти двох мов можна обрати справжнього носія замість англійського акценту.

Завантаження MP3

Слухайте у браузері або завантажуйте файл. Кліпи зберігаються в історії 90 днів.

Озвучте свої транскрипції

У кожної транскрипції є кнопка «Озвучити» - транскрибуйте, перекладіть, а потім озвучте іншою мовою.

Без підписки

Оплата за кожні 1,000 символів із того самого балансу кредитів, що й транскрипція. Кредити не згорають.

Оберіть якість - побачте ціну

Оплата за кожні 1,000 символів тексту - приблизно одна хвилина мовлення. Точна вартість показується перед генерацією.

Standard
OpenAI
50 кредитів / 1k символів
≈ $0.10 / хв мовлення

Швидкі, чисті голоси для чернеток, внутрішнього аудіо та службової озвучки.

Premium
ElevenLabs Multilingual v2
180 кредитів / 1k символів
≈ $0.37 / хв мовлення

Найлюдяніші голоси ElevenLabs - разом із носіями мови в найкращій якості.

Ціни в доларах наведені за тарифом пакета $5 - більші пакети знижують усі тарифи. Лише готові голоси: Speecho не клонує голоси.

Як це працює

Від тексту до MP3 менш ніж за хвилину.

1

Вставте текст

До 20,000 символів на кліп - близько 20 хвилин мовлення. Вартість у кредитах оновлюється наживо, поки ви друкуєте.

2

Оберіть голос

У кожного голосу є безкоштовний зразок. Перемикайте рівні, щоб почути різницю ще до витрати кредитів.

3

Слухайте та завантажуйте

Готово за секунди - слухайте у браузері або завантажуйте MP3. Кліпи зберігаються 90 днів, видаляйте будь-коли.

Платіть лише за те, що використали

Поповніть один раз. Кредити не згорають. Без підписки - той самий баланс покриває транскрипцію, сканування та субтитри.

Підтвердьте пошту й отримайте 150 безкоштовних кредитів - досить, щоб озвучити близько 3,000 символів і по-справжньому випробувати голоси.

$5
2,400 кредитів

  • ≈ 48 хв мовлення
  • 138 стокові голоси
  • 3 рівні якості
  • Голоси-носії для 14 мов
  • Завантаження MP3 · історія 90 днів
Створіть свій перший кліп →
$25
15,000 кредитів
+1,800 бонусних кредитів · ≈ 36 хв
  • ≈ 5.5 год мовлення
  • 138 стокові голоси
  • 3 рівні якості
  • Голоси-носії для 14 мов
  • Завантаження MP3 · історія 90 днів
Створіть свій перший кліп →
$50
30,000 кредитів
+6,000 бонусних кредитів · ≈ 2 год
  • ≈ 12 год мовлення
  • 138 стокові голоси
  • 3 рівні якості
  • Голоси-носії для 14 мов
  • Завантаження MP3 · історія 90 днів
Створіть свій перший кліп →

Оцінки тривалості мовлення розраховані для голосів Standard (~$0.10 / хв). Enhanced і Premium звучать природніше й коштують дорожче за хвилину - див. рівні вище. Точна вартість показується наживо перед генерацією.

Поширені запитання

Це звучить українською чи російською?

Українською. Це носії мови, тому г - дзвінкий гортанний, ненаголошене о не редукується до а, а и та і лишаються різними. Саме ці три речі й видають синтез, навчений на російській.

Чи правильно читаються ї, є, ґ та апостроф?

Так. Усі чотири специфічні для української знаки для цих голосів рідні, а апостроф читається як роздільність, яку він і позначає, а не ігнорується.

Чи можна змішувати українську й англійську в одному тексті?

Так. Назви брендів і технічні терміни латинкою читаються по-англійськи, а не транслітеруються за правилами кириличного читання.

Як тарифікується синтез мовлення?

За кожні 1,000 символів вхідного тексту, з того самого балансу кредитів, що й транскрипція: 50 кредитів для голосів Standard (OpenAI), 90 - для Enhanced (ElevenLabs Flash), 180 - для Premium (ElevenLabs Multilingual v2). Приблизно 1,000 символів - це одна хвилина мовлення. Точна вартість показується наживо під полем для тексту перед генерацією.

Які голоси доступні?

138 ліцензовані стокові голоси від двох провайдерів: тринадцять голосів OpenAI на рівні Стандарт і сто двадцять п’ять голос ElevenLabs, спільних для Покращеного та Преміум - шість універсальних плюс носії англійської (US і UK), іспанської, німецької, французької, португальської, італійської, японської, арабської, корейської, нідерландської, польської, турецької, української та в’єтнамської. Кожен із безкоштовним зразком. Speecho не пропонує клонування голосу.

Якими мовами воно говорить?

Голоси говорять мовою вставленого тексту: пишете українською - отримуєте українське мовлення. Для двадцяти двох мов рівні ElevenLabs додатково пропонують носіїв - з місцевим акцентом замість англійського. Коли ви вставляєте текст, застосунок визначає мову й сам пропонує відповідні голоси.

Чи можу я керувати тим, як голос читає?

Так - голоси Стандарт (OpenAI) підтримують манеру подачі: звичайна, оповідь, енергійна, спокійна, новини або розмовна. Той самий текст може звучати як аудіокнига, випуск новин чи невимушена розмова. Рівні ElevenLabs читають у своїй природній манері.

Чи можу я перетворити транскрипцію на мовлення?

Так - у кожної транскрипції в історії є кнопка «Озвучити», яка одразу передає її текст у генератор. У поєднанні з перекладом це перетворює запис однією мовою на озвучене аудіо іншою: транскрибуйте, перекладіть, озвучте.

Який формат я отримую і скільки він зберігається?

MP3, який можна слухати у браузері та завантажувати. Кліпи зберігаються 90 днів, і ви будь-коли можете видалити окремий кліп - або весь акаунт - після чого аудіо видаляється негайно.

Чи можу я використовувати аудіо в комерційних цілях?

Так. Генерація працює на платних API-тарифах OpenAI та ElevenLabs, ліцензії яких дозволяють комерційне використання згенерованого аудіо. Ви відповідаєте за зміст тексту, який перетворюєте.

Чи є безкоштовний рівень?

Так. Підтвердьте пошту - ви отримаєте 150 безкоштовних кредитів, тобто близько 3,000 символів мовлення на рівні Standard, і зможете згенерувати справжній кліп, перш ніж щось платити (зразки голосів теж безкоштовні). Далі - оплата за символи без підписки: разовий пакет $5 покриває приблизно 48,000 символів мовлення на рівні Standard.

Дайте вашому тексту голос.

Прослухайте голоси безкоштовно - платіть лише за символи, які перетворюєте.

Спробувати синтез мовлення →