Sprachmemo zu Text.iPhone, Android, jede App.

Lade dein Sprachmemo vom Telefon hoch. Wir lesen M4A, AAC und MP3 direkt von iPhone Voice Memos, Android Recorder oder beliebigen Diktat-Apps — ohne Umwandlung, ohne Desktop-Sync.

Audio oder Video ablegen

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Direkt aus Ihrem Browser aufnehmen

Die Registrierung dauert 30 Sekunden – die Aufnahme öffnet sich danach direkt im Dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTDateien werden automatisch nach 24h gelöscht

↓ So sieht das Ergebnis aus

Sprachmemo rein. Durchsuchbares Transkript raus.

Sprachmemos sind meist ein Mikrofon-Platzierungsproblem, keine Frage der Audioqualität. Telefon-Mikrofone sind gut — Stoff, Wind und eine Hosentasche nicht. Die Zahlen unten stammen aus echten Kundenmemos, nicht aus Labdateien.

iPhone Voice Memos · M4AREC Solo-Diktat · 4:12
auto-erkannt en-US44.1 kHz mono · AAC 64 kbps
~90s
Transkript · Streaming95% Genauigkeit
S1

Idee für das Dienstag-Stück — mit der FOIA-Antwort eröffnen, nicht mit der Klage.

S1

Das 217-seitige PDF ist der Leitartikel. Das geschwärzte Absatz auf Seite 84 zitieren.

S1

Dann zur Ratssitzung wechseln. Muss Reyes vor 17 Uhr zurückrufen.

S1

Arbeitstitel — 'Was die Schwärzungen uns sagen.' Zur Seite legen, morgen weitermachen.

95% bei nahbereichs DiktatDOCX · TXT · SRT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Drei echte Optionen · ehrlicher Vergleich

Apples Angebot. Otter mobile. Oder wir.

iOS 18 hat die Transkription in Voice Memos integriert. Otter hat einen mobilen Rekorder. Beide funktionieren — bis das Memo lang ist, mehrsprachig oder du eine Datei brauchst, die du tatsächlich exportieren kannst. Wir beginnen mit dem, was die Aufnahme-App gespeichert hat.

Option 01

Apple Voice Memos-Transkript

In iOS 18+ Voice Memos integriert. Nur auf neueren iPhones, Englisch-lastig, keine Exportfunktion.

ErforderlichiPhone 12+ auf iOS 18
SprecherlabelsNein
SprachenEN, ES, FR, DE, JA, ZH
ExportNur Kopieren/Einfügen
Alte MemosEinzeln neu verarbeiten
KostenKostenlos mit Hardware
Best forEinzelne iPhone-Nutzer auf einem neuen Gerät, die nur gelegentlich ein Memo überfliegen müssen.
Option 02

Transcription.Solutions

Teile jedes Memo von iOS oder Android. Erhalte DOCX, SRT, TXT — und Sprecherlabels wenn es zwei Stimmen gibt.

ErforderlichNichts — Teilen-Menü funktioniert
SprecherlabelsJa (Pro / Business)
Sprachen99, auto-erkannt
ExportDOCX · SRT · TXT · JSON
Alte MemosBatch-Upload aus Dateien
Kosten · pro Min$0.03
Best forJeder mit einer Sammlung von Memos, gemischten Geräten, nicht-englischer Diktat oder Memos, die in Word oder ein CMS müssen.
Option 03

Otter mobile / Google Recorder

Aufnahmen in ihrer App oder es funktioniert nicht. Werden Memos nicht gelesen, die du anderweitig erfasst hast.

ErforderlichAufnahme in ihrer App
SprecherlabelsAkustisch, EN-optimiert
SprachenHauptsächlich EN · Google mit ein paar mehr
Bestehende M4A-DateienOtter kostenlos: kein Upload
Monatliche Obergrenze300 Min kostenlos (Otter)
Kosten$17/Mo (Otter Pro)
Best forPersonen, die bei Null anfangen und nicht dagegen haben, für jede Notiz zu einer neuen Rekorder-App zu wechseln.

Preisgestaltung und Funktionsflags sind ab Mai 2026 korrekt. Apples Voice Memos-Transkription wurde mit iOS 18 im späten 2024 ausgerollt.

Spezifisch für Sprachmemos

Drei Dinge, die Telefon-aufgenommene Memos stillschweigend ruinieren.

Das hat nichts mit der KI zu tun. Es geht darum, wo sich das Telefon befand, als du auf Aufnahme gedrückt hast.

Was schiefgeht

  1. 1Hosentaschen-Aufnahmen. Stoff am Mikrofon erzeugt ein niederfrequentes Grollen, das Konsonanten maskiert. Das Modell hört 'sch', wo du 's' gesagt hast.
  2. 2Plosive von nah am Telefon. Das Telefon wie ein Mikrofon zu halten, bringt P- und B-Pops direkt auf die Membran. Worte direkt nach dem Pop werden verschluckt.
  3. 3Lange Stille beim Nachdenken. Generische Erkennungssysteme halluzinieren Füllwörter ('äh', 'ich meine') in 3+ Sekunden-Lücken. Liest sich gut, ist nicht das, was du gesagt hast.

Was hier anpassen

  1. 1Wir erkennen automatisch Mono-Stoff-Rausch-Memos und wenden einen Hochpass-Filter vor der Erkennung an. Du kannst auch 'Hosentaschen-Aufnahme' auf dem Jobformular aktivieren.
  2. 2Halte das Telefon an die Seite deines Mundes, nicht davor, oder nutze Ohrhörer mit Mikrofon. Dann stelle Sprechermodell: Solo-Diktat ein — das deaktiviert vollständig die Diarisierung.
  3. 3Aktiviere Halluzinationen in Stille unterdrücken und das Modell gibt während langer Pausen nichts aus, statt Sprache zu erfinden. Deine Pausen bleiben Pausen.

Empfohlene Job-Einstellungen für Sprachmemos

Wirf ein M4A oder AAC ab und diese schalten sich automatisch ein. Überschreibe pro Job über das Formular.

Sprechermodell
Solo-Diktat (automatischer Wechsel bei 2. Stimme)
Diarisierung
Standardmäßig aus · an für Interviews
Sprache
Auto-erkannt · 99 unterstützt
Füllwörter
Standardmäßig entfernt
Stille-Behandlung
Halluzinationen in Lücken unterdrücken
Export
DOCX · TXT · zeitgestempeltes SRT

Accuracy · real-world numbers

95%+ bei nahbereichs Diktat. Bis zu 78% in deiner Jackentasche.

Sprachmemos sind meist ein Mikrofon-Platzierungsproblem, keine Audioqualitätsfrage. Telefon-Mikrofone sind gut — Stoff, Wind und eine Tasche nicht. Die Zahlen unten stammen aus echten Kundenmemos, nicht aus Labdateien.

95%+
Solo-Diktat bei nahbereichs Aufnahme

Telefon 15–30 cm von deinem Gesicht entfernt, ruhiger Raum. iPhone oder Pixel Hauptmikrofon. Der sauberste Fall — die meisten Journalist:innen- und Schriftsteller:innen-Memos landen hier.

92%
Solo-Memo mit leichtem Raumgeräusch

Café-Summen, HVAC, eine vorbeziehende Sirene. Telefon auf deinem Schreibtisch vor dir. Füllwörter und das gelegentliche 'äh' können durchrutschen, wenn du sie nicht entfernst.

87%
Interview mit zwei Personen erfasst

Telefon auf dem Couchtisch zwischen dir. Akustische Diarisierung trennt Stimmen, aber Übersprache und ähnliche Tonhöhen verschmelzen manchmal — budgetiere 2 Min Nachbearbeitung.

78%
Hosentaschen- oder Freiland-Aufnahme-Memo

Stoff reibt das Mikrofon, Wind, Verkehr. Worte sind normalerweise für Notizen wiederherstellbar, aber Eigennamen und Zahlen fallen am schnellsten weg. Schlechtester Fall in unseren Daten.

Häufig gestellte Fragen

8 häufig gestellte Fragen über Sprachmemo-Transkription.

01Muss ich M4A von iPhone Voice Memos zuerst konvertieren?+
Nein. M4A lädt direkt hoch — gleiches für Android AAC und MP3. Wir lesen den Container nativ und codieren nicht neu. Tippe einfach Teilen → Transcription.Solutions in der Voice Memos-App oder ziehe die Datei aus dem Finder.
02iOS 18 transkribiert Voice Memos bereits — warum Sie nutzen?+
Apples Transkript bleibt in der App — keine DOCX, kein SRT, kein Batch-Export. Es ist auch Englisch-lastig und nur auf iPhone 12 und neuer. Wenn du eine Datei brauchst, die du bearbeiten kannst, an einen Klienten senden oder in ein CMS einfügen, brauchst du ein externes Tool.
03Können Sie ein 4-Stunden-Memo verarbeiten? Ich habe vergessen, die Aufnahme zu beenden.+
Ja. Maximale Dateigröße ist 5 GB und maximale Dauer ist 10 Stunden pro Job. Ein 4-Stunden-Mono-M4A ist ungefähr 200 MB und wird im Standard-Modus in etwa 12–15 Minuten verarbeitet.
04Ich habe ein Interview auf meinem Telefon aufgenommen — funktionieren Sprecherlabels?+
Ja, in Pro- und Business-Plänen. Zwei Stimmen auf einem einzigen Mikrofon sind schwieriger als separate Kanäle. Erwarte 85–90% Diarisierungsgenauigkeit, wenn ihr beide nah am Telefon wart. Plane eine schnelle Umbenennung der Sprecherlabel ein.
05Funktioniert das Teilen-Menü aus der iOS Voice Memos-App?+
Ja. Öffne das Memo, tippe Teilen, wähle unsere App aus dem Teilen-Menü. Die Datei wird hochgeladen und das Transkript erscheint in deinem Dashboard. Kein Desktop-Sync, kein AirDrop-Schritt erforderlich.
06Benutzerdefiniertes Vokabular für medizinische oder juristische Diktat?+
Ja. Füge Arzneimittelnamen, Fallzitate oder Kundennamen in das Feld Benutzerdefiniertes Vokabular auf dem Jobformular ein. Wir übergeben sie dem Erkennungssystem als Hinweise, um die Aussprache zu verbessern, erzwingen aber keine exakten Treffer bei ähnlich klingenden Wörtern.
07Was passiert mit meinem Memo nach der Transkription?+
Quell-Audio wird innerhalb von 24 Stunden permanent gelöscht. Das Transkript bleibt in deinem Konto, bis du es löschst. Wir trainieren nicht mit Kundenaudio und bewahren es nicht für 'Qualitätsprüfung' auf.
08Kann ich eine Sammlung alter Memos in Batch verarbeiten?+
Ja. Ziehe einen Ordner mit M4As in den Upload-Bereich oder packe sie ein. Jede Datei wird ein separater Job mit seinem eigenen Transkript. Nützlich, wenn du Jahre von Voice Memos auf deinem Telefon unverarbeitet liegen hast.

Lade dein Sprachmemo hoch. Sieh, was rauskommt.

30 kostenlose Minuten jeden Monat. Keine Kartennummer erforderlich. Funktioniert mit iPhone M4A, Android AAC und allem, was deine Rekorder-App speichert.

Kostenlos beginnen