AI视频转写工具:开源多平台转录与AI摘要
基于Faster-Whisper和yt-dlp,支持30+平台,提供高精度转录、智能优化及多语言摘要,适合内容创作者与教育场景。
💡 快速判断这是一款开源的AI视频转录工具,支持YouTube、B站、抖音等30+平台,基于Faster-Whisper实现高效转写,并提供AI摘要与翻译。适合需要快速获取视频文字稿和摘要的用户,尤其适合内容创作者和研究者。但需注意,AI优化功能依赖OpenAI API Key,且转录速度受硬件性能影响。
AI Video Transcriber简介
AI Video Transcriber是一款开源的视频转录与摘要工具,结合Faster-Whisper实现高精度语音转写,并使用yt-dlp支持包括YouTube、Bilibili、抖音在内的30多个主流视频平台。工具提供自动纠错、句子补全、智能分段和多语言摘要功能,当所选择的摘要语言与语音检测语言不一致时,会自动调用GPT-4o进行条件式翻译。

核心功能
- 多平台支持:基于yt-dlp,兼容YouTube、抖音、B站等大量网站。
- 智能转录:采用Faster-Whisper,在速度和内存占用上表现更优,同时保持与原版Whisper相近的准确性。
- 文本优化:自动修正错别字、补全句子并智能分段,便于直接发布和检索(根据项目README描述)。
- 多语言摘要与条件式翻译:当摘要语言与检测语言不一致时,自动使用GPT-4o生成翻译和总结。
- 移动端适配:前端界面适配移动设备,支持Markdown渲染(使用Marked.js)。
快速上手
环境要求:
- Python 3.8或更高版本
- FFmpeg(用于音视频处理)
- 可选:OpenAI API密钥(用于启用AI摘要和翻译功能)
安装说明可参考项目README和FFmpeg官方仓库。
使用步骤:
- 粘贴视频链接(支持YouTube、B站、抖音等)。
- 选择输出摘要的语言。
- 点击“开始”,系统将执行以下流程:下载并解析视频 → 使用Faster-Whisper进行转写 → AI优化(纠错、补全、分段) → 生成所选语言的摘要或翻译。
- 查看转写和摘要结果,并可下载为Markdown文件保存。
技术架构
- 后端:FastAPI提供接口;yt-dlp负责下载和解析;Faster-Whisper进行转写;OpenAI API用于摘要和翻译。
- 前端:HTML5、CSS3和原生JavaScript,使用Marked.js渲染Markdown,图标库采用Font Awesome。
常见问题
- 转录速度慢? 速度受视频时长、模型大小和硬件性能影响。选择更小的模型(如tiny或base)可以提高速度。
- 支持哪些平台? 支持yt-dlp所能识别的所有平台,涵盖数千个网站及其变体。
- AI优化不可用? 如果没有配置OpenAI API密钥,则只会输出Whisper的原始转写和简化摘要。
- 环境报错或白屏? 请按照README检查虚拟环境、依赖项、
OPENAI_API_KEY/OPENAI_BASE_URL环境变量、FFmpeg安装以及端口占用情况。
适用人群与场景
- 内容创作者、运营及新媒体团队:批量转写口播视频和长视频,快速生成多语言摘要和文稿。
- 教育与会议记录:用于课程、讲座、访谈的转写和要点提炼。
- 知识整理:剪辑脚本、字幕草稿、SEO素材的沉淀与复用。