ARTICLE DETAIL

资讯详情

深耕商务建站与企业官网运营的一线实战洞察。

免费离线语音转文字:Buzz 本地转录上手

免费离线语音转文字:Buzz 本地转录上手 免费离线语音转文字Buzz 本地转录上手【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz上周的评审会开了一个半小时录音还在文件夹里躺着谁也不想再听一遍。Buzz 是一个离线语音转文字工具把你的音频文件丢进去本地跑完 Whisper 模型直接出带时间戳的文字稿全程不需要联网。音频数据始终留在你自己的机器上不用注册账号不用按分钟付费。它是什么凭什么不一样Buzz 是基于 OpenAI Whisper 的开源桌面应用MIT 协议个人开发者维护。它和云端转录服务的区别在于两点全程离线音频不离开你的电脑GPU 加速NVIDIA 显卡走 CUDAAMD 和 Intel 核显走 Vulkan。此外本地模型从 tiny 到 large 随便换精度和速度由你自己拿捏。Buzz 主界面拖入文件即可开始离线语音转文字支持多任务排队从零到第一次出结果装上去Windows到发布页下载安装包双击运行。应用未签名安装时点更多信息→仍要运行。macOS下载 .dmg 文件拖到应用程序文件夹即可。Linuxflatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz。Python 环境pip install buzz-captions python -m buzz跑一遍打开 Buzz点工具栏图标或按 CtrlO选一个音频或视频文件。在面板里选任务类型转录 / 翻译成英文、语言、模型大小。点运行等状态栏变成已完成。双击那一行任务转录查看器打开里面就是带起止时间的文字稿。拿到什么你会得到一个可编辑的文字稿每段标注起止时间可以直接改错字、调时间轴。导出支持 TXT、SRT、VTT 三种格式。如果转录时开了词级时间戳还能用内置调整工具把文字重新切分成适合做字幕的短句。转录查看器支持逐段编辑、播放定位、多格式导出能干什么实时录音转录麦克风讲话屏幕上同步出文字录完自动生成完整文字稿。什么时候用开会、采访、课堂记录想边说边看到文字。怎么开点顶部录音按钮选好麦克风和语言开始说话就行。文件夹监视指定一个文件夹新文件丢进去就自动开始转录不用手动逐个导入。什么时候用每天固定收到一批录音文件想省去重复操作。怎么开偏好设置 → 文件夹监视勾选并选择目标文件夹。说话人识别转录完成后自动区分不同说话人给每句标上 Speaker 1、Speaker 2 标签还能试听 10 秒片段确认身份后改名。什么时候用多人访谈、电话会议录音需要分清谁说了什么。怎么开双击任务打开查看器点识别说话人按钮。字幕调整与导出把转录文字按最大长度、标点、静音间隙重新切分成字幕行导出 SRT 或 VTT 直接给视频用。什么时候用给视频配字幕需要控制每条字幕字数和显示时长。怎么开查看器里点调整大小设好参数后点导出。插件扩展1.4.5 起支持插件系统内置 AI 摘要生成、DeepFilterNet 降噪、导出 Word 文档等。什么时候用想在转录前自动去噪或转录后自动生成摘要存到笔记里。怎么开菜单帮助→插件勾选需要的插件并配置。模型偏好页可下载和管理不同尺寸的 Whisper 本地转录模型几个你会真实遇到的场景【给 2 小时播客剪 3 条 15 秒短视频】先跑一遍完整转录拿到带时间戳的文字稿在查看器里搜关键词定位想剪的片段把对应时间段导出 SRT 丢进剪辑软件。小技巧转录时打开词级时间戳后面调整字幕长度会灵活很多。【每天 5 封客户电话录音归档】把录音统一丢进一个文件夹开启文件夹监视Buzz 自动转录。配合跳过已转录插件同批文件重跑不会重复计算。小技巧给每个客户建子文件夹导出模板里用{filename}变量文件名自动对得上。【课堂录音转讲义】开实时录音模式老师讲课你这边同步出文字。下课后双击任务把口语化表达改写成书面语导出 TXT 当讲义底稿。小技巧在初始提示里填几个专业术语能明显减少专有名词的识别错误。【会议录音多人发言分不清】转录完点识别说话人Buzz 按声线把句子分组你可以试听片段确认是谁然后把标签改成真实姓名。小技巧保存时勾上合并同一说话人连续句子读起来更像正常对话。调优 常见问题⚙️转得太慢换小一号的模型base 或 small确认 GPU 加速已开启。长文件用 Whisper.cpp 后端比默认后端快不少。识别准确率不够手动选对语言比自动检测稳。录音有明显背景噪音的话先开 DeepFilterNet 降噪插件再转录。⚙️怎么批量处理拖多个文件进主界面排队依次跑或者开文件夹监视让文件进来自动处理。配合跳过已转录插件二次导入不会重复计算。模型文件占空间缓存在本地用户目录偏好设置→模型页可以删除不用的。tiny 约 75 MBlarge 约 3 GB按需保留。字幕调整界面控制每行字幕最大长度后导出 SRT跟同类工具比差在哪维度Buzz云端转录 API命令行 Whisper隐私✅ 全程本地❌ 需上传✅ 全程本地上手成本✅ 图形界面拖文件即用✅ 调接口❌ 需配环境实时录音✅ 支持❌ 不支持❌ 不支持费用✅ 免费开源❌ 按量计费✅ 免费选 Buzz 还是选命令行取决于你要不要图形界面和实时录音选 Buzz 还是选云端 API取决于你的音频能不能出内网。适合谁不适合谁适合需要处理敏感录音、不能上传云端的场景医疗、法务、财务有独立显卡、想利用本地算力的用户需要批量处理、自动触发、多格式导出的内容创作者不适合只偶尔转一段、不想装任何软件的轻度用户音频质量极差、多人同时抢话且无法降噪的场景需要 API 接口对接其他系统、不想维护本地环境的开发者Linux 用户直接flatpak install flathub io.github.chidiwilliams.Buzz就能跑起来其他平台在发布页下载安装包。Buzz 做的事情很单纯你的录音不离开你的电脑文字稿在本地生成免费随时可复现。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表
PREV
查看更多资讯
NEXT
返回资讯列表