Whisper, hébergé

OpenAI Whisper, sans passer par le terminal.

Speecho fonctionne avec Whisper d’OpenAI. Déposez un fichier depuis votre navigateur et obtenez la même transcription qu’avec une installation locale — sans pip, sans CUDA et sans une soirée passée sur des erreurs de dépendances.

Transcrire avec Whisper →
Rien à installer, aucun compte requis pour commencer. Dès $0.83 par heure d’audio.

Ce que coûte vraiment Whisper installé chez soi

Le modèle est gratuit. Tout ce qui l’entoure ne l’est pas.

🧰

L'installation

Python, ffmpeg, un environnement virtuel et la bonne version de torch pour votre GPU. Une après-midi d’erreurs de dépendances avant la première transcription.

Ici : ouvrez la page, déposez le fichier. Rien à installer, rien à maintenir à jour.

🖥️

Le matériel

Sur CPU, le grand modèle tourne moins vite que le temps réel : une heure d’audio peut prendre bien plus d’une heure, ventilateur à fond.

Ici : cela tourne sur des GPU serveur. Une heure d’audio revient en quelques minutes pendant que vous faites autre chose.

La sortie brute

Whisper vous donne du texte. Identification des locuteurs, fichiers de sous-titres, résumés et traduction sont autant de chantiers séparés.

Ici : les quatre reviennent du même dépôt, déjà faits.

Ce qui vient s’ajouter au modèle

Exactement les briques que l’on finit par coder soi-même après le premier essai en local.

Identification des locuteurs

Chaque ligne attribuée à une voix sur les enregistrements à plusieurs intervenants — entretiens, tables rondes, réunions. Renommez ensuite « Locuteur 1 ».

Des sous-titres prêts à l’emploi

Exportez en .srt et .vtt avec des coupures et un minutage cohérents, au lieu de retravailler les segments bruts de Whisper jusqu’à ce qu’un lecteur les accepte.

99 langues en entrée, 18 en sortie

La force multilingue de Whisper, plus la traduction de la transcription finie vers 18 langues et un résumé IA de ce qui a été dit.

Pay only for what you use

Top up once. Credits never expire. No subscription. One wallet for transcription, scans and captions.

New accounts get 15 free minutes to try — credits work for scans and captions too.

$5
2,400 credits
≈ 4h audio
$25
15,000 credits
+1,800
≈ 28h audio
$50
30,000 credits
+6,000
≈ 60h audio
✓ Speaker labels ✓ AI summary ✓ Translation to 18 languages ✓ TXT, SRT, VTT, Word, PDF export

Frequently asked questions

Est-ce vraiment OpenAI Whisper ?

Oui. Speecho transcrit avec Whisper — la même famille de modèles que celle que vous installeriez en local, exécutée sur une infrastructure hébergée. Il n’y a pas un autre moteur derrière une étiquette Whisper.

Ne vaudrait-il pas mieux exécuter Whisper en local ?

Si vous avez un GPU capable, que Python ne vous fait pas peur et que vous transcrivez en continu, honnêtement oui : en local vous payez l’électricité et votre temps d’installation, puis plus rien à l’heure. L’hébergé prend son sens quand le matériel manque, que vous ne voulez pas maintenir la pile, ou que vous voulez locuteurs, sous-titres, résumés et traduction sans les construire vous-même.

Faut-il installer quoi que ce soit ?

Non. Tout se passe dans le navigateur — pas de Python, pas de ffmpeg, pas de poids de modèle à télécharger. Pour les vidéos, l’audio est extrait localement avant l’envoi : vous ne poussez pas des gigaoctets sur le réseau.

Quelles langues sont prises en charge ?

Whisper transcrit 99 langues, et Speecho traduit la transcription finie vers 18. La précision est meilleure sur un audio propre dans des langues très parlées, comme avec n’importe quelle installation locale de Whisper.

Mon audio sert-il à entraîner des modèles ?

Non. Les enregistrements ne servent pas à l’entraînement, les fichiers source sont supprimés après traitement, et vous pouvez effacer les transcriptions de votre historique à tout moment.

Combien cela coûte-t-il ?

Entre $0.83 et $1.25 par heure d’audio selon le niveau de modèle choisi. Pas d’abonnement, les crédits n’expirent jamais, et vous recevez 15 minutes offertes en confirmant votre e-mail.

Whisper, sans l’après-midi d’installation.

Transcription, locuteurs, sous-titres, résumé et traduction à partir d’un seul dépôt.

Transcrire avec Whisper →