OpenAI Whisper, senza terminale.
Speecho gira su Whisper di OpenAI. Carichi un file nel browser e ottieni la stessa trascrizione che avresti da un'installazione locale, senza pip, senza CUDA e senza una serata passata sugli errori di dipendenze.
Trascrivi con Whisper →Quanto costa davvero far girare Whisper da soli
Il modello è gratuito. Tutto ciò che gli sta intorno no.
La configurazione
Python, ffmpeg, un ambiente virtuale e la build di torch giusta per la tua GPU. Un pomeriggio di errori di dipendenze prima della prima trascrizione.
Qui: apri la pagina, trascini il file. Nulla da installare e nulla da tenere aggiornato.
L'hardware
Su CPU, il modello large va più lento del tempo reale: un'ora di audio può richiedere ben più di un'ora, con la ventola al massimo.
Qui: gira su GPU server. Un'ora di audio torna in pochi minuti mentre tu fai altro.
L'output grezzo
Whisper ti dà del testo. Etichette dei relatori, file di sottotitoli, riassunti e traduzione sono ognuno un progetto a sé da costruire.
Qui: tornano tutti e quattro dallo stesso caricamento, già pronti.
Cosa ottieni oltre al modello
Le parti che quasi tutti finiscono per scriversi da soli dopo la prima esecuzione in locale.
Etichette dei relatori
Ogni riga attribuita a una voce nelle registrazioni con più interlocutori: interviste, tavole rotonde, riunioni. Dopo rinomini "Relatore 1" con i nomi veri.
Sottotitoli pronti all'uso
Esporti .srt e .vtt con interruzioni di riga e tempi sensati, invece di rielaborare i segmenti grezzi di Whisper in qualcosa che un player accetti.
99 lingue in entrata, 18 in uscita
La forza multilingue di Whisper, più la traduzione della trascrizione finita in 18 lingue e un riassunto AI di quello che è stato detto.
Paghi solo quello che usi
Ricarichi una volta. I crediti non scadono mai. Nessun abbonamento. Un unico credito per trascrizioni, scansioni e sottotitoli.
I nuovi account ricevono 15 minuti gratis di prova: i crediti valgono anche per scansioni e sottotitoli.
Frequently asked questions
È davvero OpenAI Whisper?
Sì. Speecho trascrive con Whisper, la stessa famiglia di modelli che installeresti in locale, in esecuzione su infrastruttura ospitata. Non stai ricevendo un motore diverso sotto un'etichetta a forma di Whisper.
Non conviene semplicemente far girare Whisper in locale?
Se hai una GPU adeguata, ti trovi a tuo agio con Python e trascrivi di continuo, allora onestamente sì: Whisper in locale ti costa l'elettricità e il tempo di configurazione, e nulla all'ora dopo di quello. La versione ospitata ha senso quando non hai l'hardware, non vuoi mantenere lo stack, oppure vuoi etichette dei relatori, sottotitoli, riassunti e traduzione senza costruirteli da solo.
Devo installare qualcosa?
No. Gira nel browser: niente Python, niente ffmpeg, nessun peso del modello da scaricare. Ai file video viene estratto l'audio in locale prima del caricamento, quindi non stai nemmeno mandando gigabyte sulla rete.
Quali lingue gestisce?
Whisper trascrive 99 lingue, e Speecho traduce la trascrizione finita in 18. L'accuratezza è massima su audio pulito nelle lingue più diffuse, esattamente come in qualsiasi installazione locale di Whisper.
Il mio audio viene usato per addestrare modelli AI?
No. Le registrazioni non vengono usate per addestrare modelli, i file sorgente sono cancellati dopo l'elaborazione, e puoi eliminare le trascrizioni dalla cronologia in qualsiasi momento.
Quanto costa?
Tra $0,83 e $1,25 per ora di audio, a seconda del livello di modello che scegli. Non c'è abbonamento, i crediti non scadono mai, e ricevi 15 minuti gratis confermando la tua email.
Whisper, meno il pomeriggio di configurazione.
Trascrizione, etichette dei relatori, sottotitoli, riassunto e traduzione da un solo caricamento.
Trascrivi con Whisper →