Apple 设备转录 M4A。无需转换。

直接从 Voice Memos、QuickTime 或任何 Apple 应用中上传 M4A 录音。支持说话者标签、时间戳、99 种语言 — 无需转换为 MP3 的麻烦,无需 iCloud 中介。

Drop your audio or video

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

直接在浏览器里录音

注册只要 30 秒——之后直接在控制台里开始录音。

No card required~90s per 60-min fileSRT · VTT · DOCX · TXT文件 24 小时后自动删除

↓ 看看输出结果

Voice Memo 输入。 可发布的文本输出。

M4A 是 MPEG-4 容器内的 AAC — iPhone Voice Memos 和 Mac QuickTime 都默认使用它。我们直接读取容器、提取 AAC 流,并跳过任何会降低音频质量的重新编码步骤。

Voice Memo · iPhone 15REC 2 位说话者 · 38:42
自动检测 en-USAAC 64 kbps · 44.1 kHz 单声道
~90s
文本 · 实时流式传输94% 准确度
S1

在我们讨论融资轮之前 — 我可以为我的笔记录音吗?

S2

好的,没问题。不过董事会的事情不要记录。

S1

明白。那么从你第一次见到主投资者的时候开始讲。

S2

那是三月,在帕洛阿尔托的一次晚宴。完全陌生的介绍。

Voice Memo 单声道 94% 准确度SRT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

三个真实选项 · 诚实比较

Apple 内置。Otter。 或我们。

iOS 18 为 Voice Memos 添加了设备端转录功能。Otter 希望你将每个 M4A 导入其应用库。我们直接获取文件并提供文本 — 无库、无需安装应用。

Option 01

Voice Memos (iOS 18+)

内置于 Voice Memos 应用的设备端转录。免费,但功能有限。

需要iPhone 12+ on iOS 18
说话者识别
语言约 13 种,侧重英语
导出从应用中复制粘贴
时间戳
费用免费
Best for在最近的 iPhone 上快速处理个人语音笔记,只需浏览一下你说过的内容。
Option 02

Transcription.Solutions

上传 M4A 即可。说话者标签、时间戳、全部导出格式。

需要浏览器
说话者识别声学识别,2-10 位说话者
语言99 种,自动检测
导出SRT · VTT · DOCX · TXT · JSON
时间戳词级
费用 · 每分钟$0.03
Best for需要来自手机录音采访的可引用文本的记者、研究人员和学生。
Option 03

Otter.ai

功能完善的网络应用。需要文件在其库中,以英文为主,免费版有文件限制。

需要帐户 + 应用上传
说话者识别仅英文优化
语言EN / ES / FR only
导出需要付费版
文件大小300 MB 上限,免费版
费用$17/user/mo (Pro)
Best for只使用英文且希望建立会议长期库的用户,不介意按月订阅。

定价和功能标志截至 2026 年 5 月准确。Voice Memos 转录可用性取决于 iOS 版本和设备芯片。

M4A 专用

上会让人困扰的三件事。 通用转录工具

大多数问题与 M4A 的捕获方式有关,而非格式本身。

哪里会出错

  1. 1通过 iCloud 链接共享 Voice Memo。 通用工具无法从 icloud.com 获取 — 它们需要实际文件。'Share' 工作表默认为链接,而非 M4A。
  2. 2手机平放在木桌上。 Voice Memos 会检测到键盘、杯子、手机通知的表面振动。说话者识别会被隆隆声混淆。
  3. 3长采访分散在多个 memo 中。 Voice Memos 在来电或电池低电量时自动停止。你会得到三个 M4A,失去其间的上下文。

这里如何调整

  1. 1在 iPhone 上:打开 Voice Memos → 点击 memo → ••• → 保存到文件。然后上传文件。AirDrop 到 Mac 也有效 — M4A 会完整保留。
  2. 2将手机靠在书或咖啡杯上,使 麦克风面向说话者,而非桌子。或者使用 Lightning/USB-C 领夹话筒(如果有的话)。
  3. 3在一个任务中上传 全部三个 M4A — 我们按上传顺序连接,并在合并的音频上运行说话者识别,以保持说话者标签的一致性。

M4A 推荐任务设置

上传 M4A,这些默认打开。从表单中按任务覆盖。

容器处理
直接读取 AAC/ALAC 流
说话者模型
采访 · 2-6 位说话者
语言
自动检测 · 多语言开启
噪声配置
手机麦克风实地录音
填充词
保留(记者可切换)
导出
DOCX · SRT · 带时间戳的 TXT

Accuracy · real-world numbers

Voice Memo 上的 94%。 手机放在桌子对面时也能保持。

M4A 的 AAC 编解码器对语音很友好 — 上限由 手机的位置而非文件格式决定。下面的数字来自实际客户的 Voice Memo 和 QuickTime 文件,而不是合成基准。

95%
手机靠近说话者,安静房间

经典的 1 对 1 采访,手机距说话者 30 厘米。Voice Memos 默认 64 kbps AAC 足够 — 错误只是文本错误。

94%
Voice Memos · 无损模式

设置 → Voice Memos → 音频质量:无损。M4A 容器内的 ALAC,约 1 Mbps。与默认设置相比,对语音的改进有限。

89%
手机放在桌子上,3-4 位说话者

圆桌采访,手机在中间。对于不同的声音,声学识别有效;附近的椅子和笔记本电扇会混入。

82%
实地录音 · 咖啡馆或街道

浓缩咖啡机、交通、身后的另一场对话。单词可用于引用;预计在数字和名称上需要重新听一遍。

常见问题

人们提出的 8 个问题。 关于 M4A 转录

01我需要先将 M4A 转换为 MP3 吗?+
不需要。我们直接读取 M4A 容器并按原样提取 AAC(或 ALAC)音频流。转换为 MP3 会实际降低质量 — 相同比特率下 AAC 的音质比 MP3 更清晰。
02它适用于 iPhone Voice Memos 文件吗?+
是的 — Voice Memos 是我们看到的最常见的来源。打开 memo → ••• → 保存到文件,或 AirDrop 到 Mac,然后上传。M4A 标题包括录音日期,我们在文本元数据中保留它。
03从 Mac 的 QuickTime 屏幕录制怎么样?+
QuickTime 默认导出 MOV,但仅音频录制保存为 M4A。两者都有效。对于带视频轨道的 MOV,我们在服务器端提取音频并转录 — 你不需要先进行解复用。
04我可以上传 iCloud 共享链接吗?+
不行。iCloud 需要我们无法模拟的 Apple ID 登录。先在本地下载 M4A(文件应用或 icloud.com → 下载),然后在此上传。大约需要 20 秒。
05最大���件长度是多少?+
在标准计划中,每个文件最多 10 小时。默认质量的 4 小时 Voice Memo 约为 110 MB — 远低于 5 GB 上传限制。无损模式会更大;如果达到限制,请分成两次上传。
06手机放在桌子上时,说话者标签会工作吗?+
会的,如果声音在声学上足够清晰 — 大多数 2-4 人采访都没问题。如果两个参与者听起来非常相似,预计需要手动重命名一些片段。立体声外部麦克风(Shure MV88、RØDE VideoMic)帮助很大。
07它能处理 M4A 内的 ALAC(Apple 无损)吗?+
可以。Voice Memos 的无损设置将 ALAC 写入 M4A 容器而不是 AAC。我们从容器元数据中检测编解码器并解码任一路径。无损在嘈杂环境中可以提高准确度。
081 小时 M4A 的周转时间有多快?+
通常 4-6 分钟。在手机热点连接上,上传是慢的部分 — 默认质量的 1 小时 Voice Memo 约为 28 MB。任务完成后 24 小时内删除源音频。

上传你的 M4A。 看看输出是什么。

每月 30 分钟免费。无需卡。包括说话者标签、99 种语言、全部导出。

免费开始