Whisper local / open source
Δωρεάν εάν έχετε GPU και πολλές ώρες ελεύθερες. Χωρίς διαχωρισμό ομιλητών εκ των προεπιλογών.
Ρίξτε ένα αρχείο MP3 σε οποιοδήποτε bitrate από 64 έως 320 kbps. Λάβετε ένα χρονολογημένο, με ετικέτες ομιλητή απογραφή σε 99 γλώσσες — χωρίς μετατροπή μορφής, χωρίς επανακωδικοποίηση, χωρίς αναμονή σε ουρά.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ ��είτε τι βγαίνει
Διαβάζουμε τις κεφαλίδες πλαισίου MP3 απευθείας — VBR, CBR, joint-stereo, οποιοσδήποτε encoder (LAME, Fraunhofer, FFmpeg). Εάν το αρχείο είναι true stereo με ομιλητές σε ξεχωριστά κανάλια, το χρησιμοποιούμε για να διαχωρίσουμε φωνές. Το mono mix-down πέφτει πίσω σε ακουστικό διαχωρισμό.
So when did you first realise the archive was incomplete?
Probably around 2019, when we started digitising the reel-to-reels.
And the missing tapes — were they catalogued anywhere at all?
There's a paper index from '78, but half of it's water-damaged.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Τρεις πραγματικές επιλογές · ειλικρινής σύγκριση
Μπορείτε να εκτελέσετε Whisper στο δικό σας laptop για δωρεάν εάν είστε τεχνικά καταρτισμένοι. Otter και Sonix δέχονται ανεβάσματα MP3 μέσα σε dashboards συνδρομής. Παίρνουμε το αρχείο, επιστρέφουμε την απογραφή, και δεν σας αναγκάζουμε να ζήσετε μέσα σε ένα UI.
Δωρεάν εάν έχετε GPU και πολλές ώρες ελεύθερες. Χωρίς διαχωρισμό ομιλητών εκ των προεπιλογών.
Ρίξτε το MP3. Λάβετε κείμενο με ετικέτες ομιλητή σε σχεδόν πραγματικό χρόνο × 0.025.
Polished dashboard, μηνιαίο όριο λεπτών, English-tuned. Το ανέβασμα αρχείου νοιώθει σαν δευτερεύον χαρακτηριστικό.
Τα τιμολόγια και η διαθεσιμότητα χαρακτηριστικών είναι ακριβή από Μάιος 2026. Η απόδοση Whisper ποικίλει ανάλογα με το μέγεθος του μοντέλου και το υλικό.
Συγκεκριμένο για MP3
Το MP3 είναι μια μορφή, όχι ένα στυλ εγγραφής — πράγμα που σημαίνει ότι τα σημεία αποτυχίας προέρχονται από τον κωδικοποιητή, όχι από την ομιλία.
Προεπιλογές που ταιριάζουν ~80% των αρχείων MP3. Παράκαμψη ανά εργασία από τη φόρμα.
Accuracy · real-world numbers
Η ακρίβεια MP3 περιορίζεται από αυτό που ο κωδικοποιητής κράτησε, όχι από εμάς. Η αντιληπτική συμπίεση πάνω από ~96 kbps διατηρεί την νοητικότητα ομιλίας πολύ καλά. κάτω από 64 kbps, ο σιγαμός και οι σύμφωνοι αρχίζουν να διαλύονται. Οι αριθμοί παρακάτω είναι από πραγματικά MP3 πελατών σε παραγωγή.
Σχεδόν ασυμπίεστο για ομιλία. Podcast masters, εξαγωγές εφαρμογής υπαγόρευσης, επαγγελματικά συστήματα συνέντευξης. Ο διαχωρισμός είναι καθαρός εάν οι ομιλητές είναι σε ξεχωριστά κανάλια.
Το πιο κοινό bitrate για MP3s που ομιλούν. Εξαγωγές Zoom, λήψεις Riverside, προεπιλογή καταγραφέων φωνής. Τα αρχουραφήματα συμπίεσης δεν ακούγονται στον αναγνώρισμα.
Προεπιλογή voice memo στα περισσότερα τηλέφωνα. Ο ακουστικός διαχωρισμός χειρίζεται 2-4 ομιλητές. Οι αριθμοί και τα κύρια ονόματα χρειάζονται περιστασιακά μια ματιά.
Παλιά rips απαντητικής μηχανής, αρχεία διαλέξεων, πηγές στενής ζώνης. Οι υψηλής συχνότητας σύμφωνοι (f/s/sh) θολώνουν. Ακόμα ευα��άγνωστο — σχεδιάστε διόρθωση.
Συχνές ερωτήσεις
30 δωρεάν λεπτά κάθε μήνα. Χωρίς κάρτα. Ετικέτες ομιλητή, 99 γλώσσες, κάθε μορφή εξαγωγής περιλαμβάνεται.
Ξεκινήστε δωρεάν