一款基于 Whisper 的跨平台转录工作台,强调"本地优先"——所有计算在本地 GPU/CPU 上完成。集成了 AI 总结、批量处理与专业字幕导出功能,支持 Ollama 本地 AI 引擎和 Claude API,是处理敏感资料和制作专业字幕的理想选择。

🎯 核心功能
全线离线运行: 数据不离开设备,无需联网即可完成高质量转录,支持 GPU 加速
AI 智能联动: 支持 Ollama 本地 AI 总结和 Claude API 多语言摘要
专业级导出: 支持 SRT/VTT 字幕格式,内置 VAD 时间戳和说话人识别功能
特征🌟
🌍 翻译几乎所有语言
🔒 终极隐私:完全离线转录,任何数据都不会离开您的设备
🎨 用户友好的设计
🎙️ 转录音频/视频
🎶 从流行网站(YouTube、Vimeo、Facebook、Twitter等)转录音频的选项
📂 批量转录多个文件!
📝 支持SRT、VTT、TXT、HTML、PDF、JSON、DOCX格式
👀 实时预览
✨ 总结成绩单:使用Claude API获取快速、多语言的总结
🧠 Ollama支持:与Ollama一起进行本地AI分析和批次汇总
🌐 从任何语言翻译成英语
🖨️ 将成绩单直接打印到任何打印机
🔄 自动更新
💻 针对GPU(macOS、Windows、Linux)进行了优化
🎮 针对Nvidia/ADM/Intel GPU进行了优化!(Vulkan/CoreML)
🔧 完全自由:通过设置轻松自定义模型
⚙️ 高级用户的模型参数
⏳ 转录系统音频
🎤 从麦克风转录
🖥️ CLI支持:直接从命令行界面使用Vibe!(参见–帮助)
👥 说话人分割
🎬 字幕/电影级计时的稳定时间戳模式(VAD支持,速度较慢)
📥 从您自己的网站集成自定义模型:使用vibe://download/?url=<模型网址>
📹 选择针对视频/卷轴优化的字幕长度
⚡ 使用Swagger文档的HTTP API!(使用–server并打开http://:3022/docs获取文档)
在线网址:https://thewh1teagle.github.io/vibe
GitHub地址:https://github.com/thewh1teagle/vibe


评论0+