
Buzz离线音频转文字的本地完整指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz整理会议录音时你是否总担心文件被上传到云端Buzz 是一款本地语音转录工具基于 OpenAI Whisper一个开源的语音识别模型把音频转文字和翻译全部跑在你自己的电脑上。不联网也能用数据不出门。 核心能力一览批量文件转录支持 MP3、WAV、FLAC、MP4 等音视频格式还能直接贴 YouTube 链接。一次拖入多个文件Buzz 自动排队依次处理不用盯着进度条。实时语音转文字点一下麦克风按钮它就边听边转。开会、讲座、直播时开一个窗口字幕实时滚出来。多转录后端同时支持 Whisper、Faster Whisper、Whisper.cpp 等引擎还能调用 Nvidia 显卡、Apple 芯片或核显加速。速度快的场景选小模型追求准确就上大模型切换不用换工具。翻译与导出转录完成后可一键译成目标语言结果支持导出 TXT、SRT、VTT做字幕直接用。转录查看器文本按时间戳切分配播放控制和搜索。听一句对一句改错字很方便。Buzz 主界面文件队列、模型选择和实时进度一屏看清 从安装到出结果的完整路径先把环境搭好Windows 和 macOS 用户直接下载对应系统的安装包双击安装就行Windows 上如果提示未签名点更多信息再选择运行即可。Linux 用户走 Flatpak 或 Snapflatpak install flathub io.github.chidiwilliams.Buzz习惯 Python 的话从 PyPI 装也方便。注意需要 Python 3.12 环境并提前装好 ffmpeg一个处理音视频的开源工具pip install buzz-captions python -m buzz添加文件跑一遍转录打开应用点工具栏上的选中音频或视频文件想加几个加几个。每个任务可以单独指定模型点开始后 Buzz 逐个处理状态列会实时显示排队中、进度百分比还是已完成。把结果看明白、导出去完成后双击任务进入转录查看器。左侧是起始和结束时间中间是逐句文本底下有播放条。觉得哪句不准就直接改改完点 Export 导出成你需要的格式。转录查看器时间戳、播放控制和导出按钮都在一个窗口里⚙️ 进阶配置与调优模型切换在偏好设置的 Models 标签页里能看到 Whisper.cpp、Whisper 等分组下的各档模型没下载的可以在线拉取也可以填自定义模型地址。调它的效果很直接小模型快但偶尔漏词大模型慢但错字少。同一台机器上处理十分钟的录音和处理两小时的讲座完全可以用不同档次的模型。各个后端的具体实现都在 转录器核心模块 里想看引擎怎么被调度的可以从这里入手。模型设置界面已下载模型分组显示支持下载新模型和自定义模型字幕长度调优导出 SRT 之前可以先用 Resize 功能整理字幕行按最大长度拆、按标点断句、按时间间隙合并短句三个开关都能单独调。调完的效果是每行字幕长度均匀不会出现一整段话挤在一行的情况。字幕调整界面按间隙合并、按标点与长度拆分文件夹监听与插件在 Folder Watch 里指定一个目录之后往里面丢音频文件Buzz 会自动加入转录队列适合每天固定收到录音的场景。此外还有 AI 摘要、自动整理转录等扩展统一放在 插件系统 目录下按需启用。 源码目录速览buzz/transcriber/— 各转录后端实现Whisper、Whisper.cpp、API 转录buzz/widgets/— 主窗口、转录查看器等全部界面组件buzz/db/— 转录任务与分句的 SQLite 存储buzz/plugins/— AI 摘要、自动调整字幕等可扩展插件官方文档docs/含使用说明、偏好设置和 FAQ 提升效率的几个小技巧按音频时长选模型三五分钟的录音用 Base 档绰绰有余长访谈和讲座再上 Medium 以上既省时间又少幻觉。提前指定语言知道音频是什么语言就直接设置跳过自动检测速度和准确率都会更好。开启文件夹监听把固定目录设为监听目录新录音丢进去自动转录省掉每次手动加文件的动作。用快捷键切换窗口在 Shortcuts 里熟悉一遍任务表与查看器之间的切换键核对长文本时鼠标基本可以不动。嘈杂录音先做语音分离多人同说的录音开启转录前的语音分离能明显减少串词和漏字。❓ 你可能想问必须联网吗不需要。转录全程在本地完成联网只在首次下载模型时用到。中文识别准不准清晰的中文用 Medium 档模型基本可以直接用背景嘈杂时建议先做语音分离再转录。能导出哪些格式TXT、SRT、VTT 三种后两种自带时间戳做字幕可以直接用。视频文件能转录吗可以。MP4、MOV 等视频格式直接导入Buzz 会提取音轨处理。没有显卡能跑吗能。纯 CPU 环境全流程可用只是大模型速度会慢一些可换小模型提速。打开终端装一下几分钟就能看到第一份转录结果。仓库里积压的录音文件可以开始慢慢消化了。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考