Tekst na mowę

Zamień dowolny tekst w naturalną mowę.

Wklej tekst, wybierz jeden z 138 głosów - w tym native speakerów dwudziestu dwóch języków - i naciśnij odtwarzanie. Odsłuchaj każdy głos za darmo, płać za znaki, pobierz MP3.

Wygeneruj swój pierwszy klip →
Rozliczenie za 1,000 znaków - bez miesięcznego planu. Wymagane bezpłatne konto.

Posłuchaj głosów, zanim wydasz choć jeden kredyt

Prawdziwe próbki, prosto z generatora. Native speakerzy są oznaczeni - to lokalni lektorzy, a nie angielski głos czytający obcy język.

Marin Kobiecy
Cedar Męski
Nova Kobiecy
Onyx Męski

Zobacz wszystkie 138 głosy →

Posłuchaj różnicy

To samo polskie zdanie, dwa razy. Adam mówi po polsku; Aria to głos uniwersalny, który czyta polski z angielskim akcentem. Najpierw sypią się zbitki sz, cz i rz oraz nosowe ą i ę.

Aria - głos uniwersalny

Dlaczego polski głos brzmi inaczej niż uniwersalny

Polski to język zbitek spółgłoskowych: w słowie szczęście pięć spółgłosek stoi przed pierwszą samogłoską, a różnica między sz i ś, cz i ć, ż i ź zmienia znaczenie, nie tylko brzmienie. Głosy trenowane na angielskim zlewają te pary i rozbijają zbitki wtrąconymi samogłoskami. To najwyraźniejszy sygnał, że tekst czyta obcy syntezator. Dochodzi do tego akcent na przedostatniej sylabie, praktycznie bez wyjątków: głos stosujący angielskie wzorce myli się w co drugim słowie.

Wszystkie cztery polskie głosy to native speakerzy standardowej polszczyzny. Magdalena czyta spokojnie i z autorytetem, Beata łagodniej i bardziej refleksyjnie; obie dobrze sprawdzają się w dłuższych i edukacyjnych materiałach. Adam to najczęściej wybierany polski głos w bibliotece: poważny narrator z lekko zachrypniętą barwą i mazowieckim zabarwieniem. Alex brzmi cieplej i przystępniej, w sam raz do opowieści i materiałów wyjaśniających. Nosowe ą i ę, czyli to, co najtrudniej podrobić, wychodzą jako nosówki, a nie jako zwykła samogłoska z doklejonym n.

Wszystko, czego potrzebujesz, by dać tekstowi głos

Jedno z dwóch podstawowych narzędzi Speecho - mowa staje się tekstem, a tekst mową.

138 gotowe głosy

Trzynaście głosów OpenAI plus sto dwadzieścia pięć od ElevenLabs, w tym native speakerzy dwudziestu dwóch języków - każdy z darmową próbką.

Trzy poziomy jakości

Standard do szkiców i nagrań roboczych, Enhanced i Premium (ElevenLabs), gdy ma brzmieć jak człowiek.

Mówi w Twoim języku

Głosy mówią w języku twojego tekstu - a dla dwudziestu dwóch języków możesz wybrać prawdziwego native speakera zamiast angielskiego akcentu.

Pobieranie MP3

Odtwarzaj w przeglądarce lub pobierz plik. Klipy zostają w historii przez 90 dni.

Udźwiękowij transkrypcje

Każda transkrypcja ma przycisk Głos - transkrybuj, przetłumacz, a potem wypowiedz to w innym języku.

Bez abonamentu

Rozliczenie za 1,000 znaków z tego samego salda kredytów co transkrypcja. Kredyty nigdy nie wygasają.

Wybierz jakość, zobacz cenę

Rozliczenie za 1,000 znaków tekstu - mniej więcej minuta mowy. Dokładny koszt zobaczysz przed wygenerowaniem.

Standard
OpenAI
50 kredytów / 1k znaków
≈ $0.10 / min mowy

Szybkie, czyste głosy do szkiców, nagrań wewnętrznych i lektora użytkowego.

Premium
ElevenLabs Multilingual v2
180 kredytów / 1k znaków
≈ $0.37 / min mowy

Najbardziej ludzkie głosy ElevenLabs - w tym native speakerzy w najlepszym wydaniu.

Ceny w dolarach podane dla pakietu $5 - większe pakiety obniżają każdą stawkę. Tylko gotowe głosy: Speecho nie klonuje głosów.

Jak to działa

Od tekstu do MP3 w niecałą minutę.

1

Wklej tekst

Do 20,000 znaków na klip - około 20 minut mowy. Koszt w kredytach aktualizuje się na żywo, gdy piszesz.

2

Wybierz głos

Każdy głos ma bezpłatną próbkę. Przełączaj poziomy, by usłyszeć różnicę, zanim wydasz kredyt.

3

Odtwarzaj i pobieraj

Gotowe w kilka sekund - słuchaj w przeglądarce lub pobierz MP3. Klipy zostają 90 dni, usuniesz je w każdej chwili.

Płać tylko za to, czego używasz

Doładuj raz. Kredyty nigdy nie wygasają. Bez abonamentu - to samo saldo pokrywa też transkrypcję, skany i napisy.

Potwierdź e-mail i odbierz 150 darmowych kredytów - wystarczy, by udźwiękowić około 3,000 znaków i wypróbować głosy na serio.

$5
2,400 kredytów

  • ≈ 48 min mowy
  • 138 gotowe głosy
  • 3 poziomy jakości
  • Głosy native dla 14 języków
  • Pobieranie MP3 · historia 90 dni
Wygeneruj swój pierwszy klip →
$25
15,000 kredytów
+1,800 kredytów bonusowych · ≈ 36 min
  • ≈ 5.5 h mowy
  • 138 gotowe głosy
  • 3 poziomy jakości
  • Głosy native dla 14 języków
  • Pobieranie MP3 · historia 90 dni
Wygeneruj swój pierwszy klip →
$50
30,000 kredytów
+6,000 kredytów bonusowych · ≈ 2 h
  • ≈ 12 h mowy
  • 138 gotowe głosy
  • 3 poziomy jakości
  • Głosy native dla 14 języków
  • Pobieranie MP3 · historia 90 dni
Wygeneruj swój pierwszy klip →

Szacunki mowy dotyczą głosów Standard (~$0.10 / min). Enhanced i Premium brzmią naturalniej i kosztują więcej za minutę - zobacz poziomy powyżej. Dokładny koszt widać na żywo przed wygenerowaniem.

Najczęściej zadawane pytania

Czy głosy poprawnie czytają polskie zbitki i znaki diakrytyczne?

Tak. ą, ę, ć, ł, ń, ó, ś, ź i ż to dla nich naturalne dźwięki, a zbitki takie jak szcz czy prz są czytane jako całość, bez wtrącanych samogłosek.

Czy akcent pada we właściwym miejscu?

Tak. Polski akcent pada na przedostatnią sylabę niemal bez wyjątków, a polskie głosy stosują go automatycznie, także w długich formach odmienionych, na których obce syntezatory się gubią.

Co z angielskimi słowami w polskim tekście?

Nazwy marek i terminy techniczne zapisane po angielsku są czytane po angielsku, a nie przez polskie reguły czytania. Odmiana zostaje taka, jaką zapiszesz: głos nie zmienia gramatyki.

Jak rozliczana jest zamiana tekstu na mowę?

Za każde 1,000 znaków tekstu wejściowego, z tego samego salda kredytów co transkrypcja: 50 kredytów dla głosów Standard (OpenAI), 90 dla Enhanced (ElevenLabs Flash), 180 dla Premium (ElevenLabs Multilingual v2). W przybliżeniu 1,000 znaków to jedna minuta mowy. Dokładny koszt widać na żywo pod polem tekstowym, zanim wygenerujesz.

Jakie głosy są dostępne?

138 licencjonowane głosy z katalogu dwóch dostawców: trzynaście głosów OpenAI w poziomie Standard i sto dwadzieścia pięć głosów ElevenLabs wspólnych dla poziomów Ulepszony i Premium - sześć uniwersalnych plus native speakerzy angielskiego (US i UK), hiszpańskiego, niemieckiego, francuskiego, portugalskiego, włoskiego, japońskiego, arabskiego, koreańskiego, niderlandzkiego, polskiego, tureckiego, ukraińskiego i wietnamskiego. Każdy z darmową próbką. Speecho nie oferuje klonowania głosu.

W jakich językach mówi?

Głosy mówią w języku wklejonego tekstu: napisz po polsku, otrzymasz polską mowę. Dla dwudziestu dwóch języków poziomy ElevenLabs oferują dodatkowo native speakerów - z lokalnym akcentem zamiast angielskiego. Po wklejeniu tekstu aplikacja rozpoznaje język i sama podpowiada pasujące głosy.

Czy mogę kontrolować, jak głos czyta?

Tak - głosy Standard (OpenAI) obsługują styl czytania: domyślny, narracja, energiczny, spokojny, wiadomości lub swobodny. Ten sam tekst może brzmieć jak audiobook, serwis informacyjny albo luźna rozmowa. Poziomy ElevenLabs czytają swoim naturalnym stylem.

Czy mogę zamienić transkrypcję w mowę?

Tak - każda transkrypcja w historii ma przycisk Głos, który przesyła jej tekst prosto do generatora. W połączeniu z tłumaczeniem zamienia to nagranie w jednym języku w mówione audio w innym: transkrybuj, przetłumacz, udźwiękowij.

W jakim formacie to otrzymam i jak długo jest przechowywane?

MP3, do odtwarzania w przeglądarce i pobrania. Klipy są przechowywane przez 90 dni, a każdy z nich - albo całe konto - możesz usunąć w dowolnej chwili, co natychmiast kasuje audio.

Czy mogę używać audio komercyjnie?

Tak. Generowanie działa na płatnych poziomach API OpenAI i ElevenLabs, których licencje pozwalają na komercyjne wykorzystanie wygenerowanego audio. Za treść przetwarzanego tekstu odpowiadasz Ty.

Czy jest darmowy poziom?

Tak. Potwierdź e-mail, a otrzymasz 150 darmowych kredytów - około 3,000 znaków mowy Standard - dzięki czemu wygenerujesz prawdziwy klip, zanim cokolwiek zapłacisz (próbki głosów też są bezpłatne). Potem płacisz za znak, bez abonamentu: jednorazowy pakiet $5 pokrywa około 48,000 znaków mowy Standard.

Daj swojemu tekstowi głos.

Posłuchaj głosów za darmo - płać tylko za znaki, które przetwarzasz.

Wypróbuj zamianę tekstu na mowę →