一个自动化的音视频转文本工具,支持监控文件夹中的新文件并自动进行语音识别转换。
- 🎥 支持多种音视频格式:MP4, AVI, MOV, MKV, WMV, FLV, WebM, M4V, M4A, WAV, FLAC, AAC, OGG, WMA, MP3
- 🔄 自动文件监控:监控指定文件夹,自动处理新下载的文件
- 🎯 智能过滤:自动忽略特定格式的文件(如 audio*.m4a)
- 📝 语音识别:使用 FunASR 进行高精度中文语音识别
- 🧹 自动清理:处理完成后自动清理临时文件
python auto.py启动后会自动监控 ./download 文件夹,检测到新的音视频文件时自动进行转换。
python convert.py <输入文件路径>手动转换单个音视频文件为文本。
conda create -n copywriter python=3.11
conda activate copywriter
# index-url中的版本根据`nvidia-smi`运行后的结果自行判断
pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu129
pip install -r requirement.txt
pip install -r Bili23-Downloader/requirements.txtpython auto.py- 自动启动 Bili23-Downloader GUI(如果未运行)
- 监控
./download文件夹 - 自动处理新下载的音视频文件
python convert.py C:\Users\Jagger\Downloads\video.mp4- 视频格式: MP4, AVI, MOV, MKV, WMV, FLV, WebM, M4V
- 音频格式: M4A, WAV, FLAC, AAC, OGG, WMA, MP3
CopyWriter/
├── auto.py # 主入口文件(自动监控模式)
├── convert.py # 手动转换工具
├── download/ # 监控文件夹
├── output/ # 输出文件夹
├── Bili23-Downloader/ # 下载器子模块
└── tools/ # 工具文件夹
- Bili23-Downloader: 作为 Git 子模块集成,用于视频下载功能
- 确保已安装 FFmpeg 并添加到系统路径
- 首次运行会自动下载语音识别模型
- 处理大文件时请耐心等待
- 临时文件会自动清理,无需手动删除