← 全部指南
Audio · 入门 · 约 20 分钟 · 发布 2026-08-26 ▶ 视频版

用 Whisper 在本地
把1 小时录音变成文字稿

会议、访谈、语音备忘——转写全程本地完成,录音不上传。

本页目录
01 · RESULT
RESULT FIRST · 先看结果

1 小时录音,得到带时间戳的中文文字稿(txt + srt),全程离线。

适合会议纪要、访谈整理和批量处理历史录音。

02 · PROBLEM

原来的做法慢在哪

在线转写按分钟计费,而且要上传录音——敏感会议内容不适合出本机。人工听打1 小时录音要三到四小时,这类任务本该完全交给机器。

03 · WHEN

什么时候用,什么时候别用

适合

  • 会议纪要与访谈整理
  • 有隐私要求的录音
  • 批量处理历史录音

不适合

  • 实时字幕——延迟不满足
  • 多人重叠对话的精确分离
  • 不能安装 Python 环境的机器
04 · STEPS

四步

  1. 安装。pip install -U openai-whisper
  2. 转写。whisper meeting.m4a --model medium --language Chinese
  3. 取结果。输出目录里有 .txt(纯文本)和 .srt(带时间戳)。
  4. (可选)提速。量大或机器较慢时换 faster-whisper,速度提升数倍。
05 · WHY

为什么有效

语音转写是"输入 → 模型 → 输出"的标准形态,本地模型的中文质量已经过了可用线。这类任务上本地方案的收益全在隐私与成本,不牺牲多少质量。

06 · FILES

文件与命令

pip install -U openai-whisper
whisper meeting.m4a --model medium --language Chinese

medium 模型约 1.5GB,首次运行自动下载;对精度要求不高时 small 更快。

07 · LIMITS

限制,说清楚

  • 校对:专有名词和人名会出错,正式纪要需人工过一遍;
  • 速度:无 GPU 的机器上,medium 转1 小时录音可能接近实时时长;
  • 标点:由模型推断,偶有断句偏差。
09 · VIDEO

视频版本

工具技巧视频 · 已发布 2026-08-26
← 返回全部指南

※ 内容增长模拟稿:本页为示例指南,用于评审列表与导航效果,发布前将完整实测。