
Buzz 本地语音转文字三步跑通 Whisper 离线转录的免费教程【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz会议录音没法上传云端逐字手打又太慢Buzz 把 OpenAI Whisper 语音识别模型把音频转成文字的模型完整搬进你的电脑离线完成语音转文字覆盖 99 种语言结果支持 TXT、SRT、VTT 三种格式导出全程不联网上传。它替你省掉了什么✅ 批量转录一次拖入十个音视频文件或粘贴 YouTube 链接自动排队依次处理✅ 零联网依赖模型与推理全部在本地完成敏感录音不出这台电脑✅ 实时转录麦克风边说边出文字演示窗口还能把内容放大投给听众✅ 字幕即取即用一键导出 TXT、SRT、VTT 三种格式视频制作不用二次加工✅ 功能可插拔AI 摘要、字幕长度自动调整等插件按需启用最短上手路径各平台安装一行讲完macOS下载 .dmg 双击安装Windows运行官方安装包弹出签名警告时选仍要运行Linuxsudo snap install buzz或改装 Flatpak 版本pip 方式需先装好 FFmpeg 与 Python 3.12pip install buzz-captions第一次成功转录只需 4 步选一个 Whisper 模型首次会自动把模型文件下载到本地之后纯离线使用拖入音频、视频文件或粘贴 YouTube 链接指定目标语言不确定的话保留自动检测点开始任务表格实时刷新进度完成后转写文件已存在本地全程无需账号也没有任何必填项卡住你。典型工作流 一文件夹录音集中整理场景一周的访谈录音要一次性变文字稿。 操作十个文件同时拖入多人对话或环境吵的文件再勾上转录前语音分离。 得到任务排队跑完TXT/SRT/VTT 文件全部就位。 会议讲座边说边记场景开会要边听边记中途还得翻回某句原话。 操作按麦克风按钮开始实时转录想查证时到转写查看器里搜关键词拖动进度条回放。 得到文字随说随出原话按秒级定位。 给视频配字幕场景教程视频要带字幕发布。 操作转写完成后进查看器逐句校对改错字再用字幕调整功能把每条按目标长度自动切分。 得到字幕节奏符合播出习惯SRT 直接拖进剪辑软件。选型对照Whisper 模型怎么选模型大小速度定位硬件门槛Tiny最快出草稿CPU 即可Base快日常够用CPU 即可Small中等均衡之选CPU 或 GPUMedium较慢精度更高需要一定内存Large最慢精度最高大内存加强算力后端另有 Transformers、Whisper.cpp、faster-whisper、Hugging Face、OpenAI API 五条路Nvidia 显卡开 CUDAMac 走 Apple Silicon核显笔记本用 Whisper.cpp 的 Vulkan 加速。没有万能答案拿同一段自己的录音跑几个大小对比结果最可信。跑通之后再看这几点用初始提示填入人名与行业术语专业内容准确率提升明显嘈杂录音先开启语音分离或降噪再进转录超过 1 小时的长音频先分段避免中途卡住打开文件夹监控新文件丢进去自动开始转录需要批量跑脚本时直接调用命令行接口高频问题问转录速度太慢怎么提上来答换 Tiny 或 Base 小模型或按你的硬件开启 GPU 加速CUDA、Vulkan、Apple Silicon 三选一。问转出来的文字里出现原文没有的句子答这是模型的幻觉现象换一个模型大小或后端重跑一次通常就能规避。问小语种能识别吗答Whisper 系覆盖 99 种语言Hugging Face 后端还可加载 Meta 的 MMS 模型族扩展到 1000 种语言。挑个最头疼的文件跑一遍装上对应系统的版本把你压得最久的那段录音丢进去跑一次速度和精度是否合意立刻就有答案。官方文档目录docs/docs/插件源码AI 摘要、字幕调整等buzz/plugins/命令行参考docs/docs/cli.md【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考