本页目录
RESULT FIRST · 先看结果
1 小时录音,得到带时间戳的中文文字稿(txt + srt),全程离线。
适合会议纪要、访谈整理和批量处理历史录音。
原来的做法慢在哪
在线转写按分钟计费,而且要上传录音——敏感会议内容不适合出本机。人工听打1 小时录音要三到四小时,这类任务本该完全交给机器。
什么时候用,什么时候别用
适合
- 会议纪要与访谈整理
- 有隐私要求的录音
- 批量处理历史录音
不适合
- 实时字幕——延迟不满足
- 多人重叠对话的精确分离
- 不能安装 Python 环境的机器
四步
- 安装。
pip install -U openai-whisper - 转写。
whisper meeting.m4a --model medium --language Chinese - 取结果。输出目录里有
.txt(纯文本)和.srt(带时间戳)。 - (可选)提速。量大或机器较慢时换 faster-whisper,速度提升数倍。
为什么有效
语音转写是"输入 → 模型 → 输出"的标准形态,本地模型的中文质量已经过了可用线。这类任务上本地方案的收益全在隐私与成本,不牺牲多少质量。
文件与命令
pip install -U openai-whisper
whisper meeting.m4a --model medium --language Chinese
medium 模型约 1.5GB,首次运行自动下载;对精度要求不高时 small 更快。
限制,说清楚
- 校对:专有名词和人名会出错,正式纪要需人工过一遍;
- 速度:无 GPU 的机器上,medium 转1 小时录音可能接近实时时长;
- 标点:由模型推断,偶有断句偏差。
视频版本
工具技巧视频 · 已发布 2026-08-26
※ 内容增长模拟稿:本页为示例指南,用于评审列表与导航效果,发布前将完整实测。