ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

Buzz 离线语音转录实操手册:从安装到字幕导出的完整指南

Buzz 离线语音转录实操手册:从安装到字幕导出的完整指南 Buzz 离线语音转录实操手册从安装到字幕导出的完整指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz三小时的访谈录音还躺在硬盘里明早就要交文字稿——这时候你最不需要的就是把敏感音频传到某个云端服务去排队。Buzz 是一个基于 OpenAI Whisper 的离线语音转录工具所有识别都在你自己的电脑上完成音频文件不离开本地。能力速览转录与翻译音频/视频文件模型推理全部在本地执行不经过任何外部服务内置 Whisper、Whisper.cpp、Faster Whisper 多个后端Nvidia GPU 走 CUDAWhisper.cpp 还支持 Vulkan 适配核显转录结果可导出为 TXT、SRT、VTT 三种格式导出命名模板可自定义逻辑见 transcription_service.py支持麦克风实时转录、文件夹自动监视、说话人识别插件扩展机制在 plugins/ 下从安装到第一次出结果Step 1按你的系统安装平台安装方式判断装对了Windows官网下载安装包运行未签名安全提示选更多信息→仍要运行双击图标能打开主窗口macOS下载 .dmg 拖入应用程序Apple Silicon 可直接用本地加速Linuxflatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz应用列表里出现 BuzzPython 环境pip install buzz-captions先装好 ffmpeg用 Python 3.12运行python -m buzz能出主窗口Step 2导入文件并配置点主界面左上角的选择 MP3、WAV、MP4 等文件。在弹出表单里选模型比如 Whisper.cpp 的 small、语言、任务类型转录或翻译。状态列显示 In Progress 即开始工作。Step 3拿到结果状态变为 Completed 后点任务行的展开箭头打开转录查看器逐句查看时间戳和文本从 Export 菜单挑格式保存。第一份 SRT 落盘流程就跑通了。两条核心工作流工作流一文件转录并导出字幕输入一个音频或视频文件视频会自动提取音轨关键配置模型大小小模型快large 对嘈杂录音的转写完整度明显更好语言手动指定比自动检测更稳任务类型translate 模式会把外语直接翻成目标语言输出带时间戳的 TXT / SRT / VTT 文件命名规则可在偏好里用变量模板设定详见 preferences.md工作流二把转录结果调成可用字幕Whisper 原生的分段经常一行太长或太碎。查看器工具栏的 Resize 按钮打开调整面板输入一条已完成的转录关键配置目标字幕长度字符数上限默认 42Merge by gap 按句间静音合并Split by punctuation 在标点处断句输出长度均匀、符合字幕规范的 SRT可直接导入剪辑软件进阶能力速写麦克风实时转录工具栏的录音按钮开启后说话内容实时生成文字提供追加到下方/上方/追加并校正三种模式校正模式会回头修正上一句但更吃算力。文件夹监视在偏好里指定输入目录新音频文件放进去就自动按你预设的参数转录并导出适合会开完丢文件、回头取结果的批量用法。说话人识别对多人对话自动区分并标记不同说话人导出时保留说话人标签源码在 speaker_identification_widget.py。语音分离转录前先用降噪模型分离人声嘈杂环境录音的识别率有实际改善CLI 里对应--extract-speech参数。避坑与调优转录明显慢于预期→ 多半是模型过大或默认走了 CPU换 small/base 档或在模型偏好里确认后端CUDA/Vulkan见 buzz-3.2 模型偏好页识别错成相近发音的语言→ 别留空让系统猜手动指定语言代码专业术语、人名反复拼错→ 在任务表单填初始提示词把术语列表写进去导出文件名混乱、互相覆盖→ 在偏好里用{{ input_file_name }}、{{ date_time }}等变量写命名模板大模型显存/内存吃紧→ 开启Reduce GPU RAM压缩模型或在 Whisper.cpp 下选量化版本如 q5延伸阅读docs/docs/cli.md命令行批量转录的完整参数docs/docs/preferences.md导出模板、实时转录模式、模型管理buzz/plugins/AI 摘要、导出 DOCX 等插件的实现docs/docs/faq.md常见问题的官方解答Buzz 适合所有录音必须在本地处理完的场景装上、拖文件、导出 SRT十几分钟就能进入状态。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表