ffmpeg + Whisper
무료, 로컬, 까다로워요. 파이프라인과 그 안의 모든 버그를 당신이 소유합니다.
MP4 파일을 그대로 드롭하면 — 오디오 트랙을 서버 측에서 추출한 후 타임스탬프가 있는 스크립트를 반환하고 YouTube, Vimeo, 또는 당신의 NLE로 바로 업로드할 수 있는 SRT를 제공합니다.
↓ 어떤 결과가 나오는지 보세요
MP4는 컨테이너예요 — 오디오 스트림을 바로 읽어서 비디오를 다시 인코딩하지 않습니다. 타임스탬프는 원본 타임라인에 정확하게 유지되니까 SRT가 처음 가져올 때 바로 맞습니다.
좋아요, 이 모듈에서는 환불 워크플로우를 처음부터 끝까지 살펴볼 거예요.
시작하기 전에 빠른 질문이 있는데 — 부분 환불에도 적용되나요?
좋은 질문이네요. 부분 환불도 같은 화면을 쓰는데 다른 사유 코드를 사용합니다.
알겠습니다. 그래도 승인 한도는 여전히 200달러인가요?
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
세 가지 실제 옵션 · 솔직한 비교
오디오를 직접 추출하고 Whisper를 실행할 수 있습니다. MP4를 Descript나 VEED로 끌어다 놓고 그들의 에디터 안에서 작업할 수도 있습니다. 또는 여기에 파일을 드롭하면 스크립트와 SRT를 받으면 되고, 에디터에 갇힐 필요가 없습니다.
무료, 로컬, 까다로워요. 파이프라인과 그 안의 모든 버그를 당신이 소유합니다.
MP4를 드롭하세요. 오디오 추출, 화자 분리, SRT, 요약 — 한 번에.
MP4를 에디터에 불러오세요. 스크립트가 타임라인 UI의 일부로 나타납니다.
가격 및 기능 제한은 2026년 기준 대략입니다. Descript와 VEED 티어 이름은 자주 변하니 최신 제한은 그들의 사이트를 확인하세요.
MP4에만 해당
MP4는 코덱이 아니라 컨테이너고 — 대부분의 전사 도구는 그걸 하나의 오디오 덩어리로 처리합니다. 거기서 실수가 나옵니다.
MP4를 드롭하면 이것들이 기본으로 켜집니다. 작업 양식에서 작업별로 무시할 수 있습니다.
Accuracy · real-world numbers
MP4 정확도는 코덱이 아니라 마이크로 결정됩니다. 조용한 스튜디오에서 라벨 마이크를 사용하는 게 4K 카메라 온보드 오디오보다 항상 낫습니다. 아래 수치는 실제 고객 MP4에서 나온 것으로 오디오를 캡처한 방식으로 정렬했습니다.
레이펠이나 붐을 레코더로, 48 kHz AAC 192+ kbps, 방음 처리된 공간. 최고의 경우입니다. 화자 표시는 두 명 촬영에서 완벽하게 작동합니다.
카메라 상단 마이크 스피커로부터 2–4피트. 약간의 방음이지만 음성은 명확합니다. 대부분의 YouTube 크리에이터 영상이 여기에 해당합니다.
OBS, Loom, Camtasia 내보내기. 마이크는 가깝지만 방음이 안 됐고 종종 시스템 오디오 누수가 있습니다. 튜토리얼 스크립트에는 충분합니다.
휴대폰 내장 마이크, 바람 또는 핸들링 노이즈, 샷마다 거리가 다릅니다. 말은 사용 가능한데 고유 명사는 분당 1–2개 수정을 예상하세요.
자주 묻는 질문
매월 무료 30분. 카드 필요 없음. 오디오는 서버 측에서 추출되고 화자 표시, 프레임 정확한 SRT — 모두 포함됩니다.
무료 시작