v3.56
jianchang512/pyvideotransv3.56Feb 22, 2025by jianchang512
AI Summary
Added Gladia.io support for speech recognition and introduced advanced parameter controls for LLMs.
Key Highlights
- Added Gladia.io support for speech recognition channels.
- Added `max_tokens`, `top_p`, and `temperature` parameters for OpenAI and Local LLMs.
New Features
- Gladia.io support
- LLM parameter controls
Full Release Notes
> 预打包版仅适用于Windows10/11,MacOS和Linux请源码部署 > MacOS/Linux升级:重新拉取源码覆盖,然后执行 > `pip3 install --upgrade openai-whisper elevenlabs` > `pip3 install --no-deps --force-reinstall "faster-whisper @ https://github.com/SYSTRAN/faster-whisper/archive/refs/heads/master.tar.gz"` ## Change - Feat: 翻译设置--OpenAI/本地大模型增加 `max_tokens/top_p/temperature` 参数设置 - Fix: 调整默认 LocalLLM 提示词 - Fix: 降低edge-tts配音速度,尝试减少403报错,未必有效,更好的解决方式是当出现限流时,切换代理节点或使用其他配音渠道 - Feat: 语音识别 `自定义API` 渠道增加对 [Gladia.io](https://pyvideotrans.com/gladia) 的支持 ## Win v3.56 完整包下载 > 如果未安装过旧版本,请在此下载完整版,如需cuda加速,需有英伟达显卡并且安装cuda12.x及cudnn9 百度网盘下载地址(含tiny/medium模型): https://pan.baidu.com/s/1vSFt259yAywdhmgSN0l3sQ?pwd=n9g8 GitHub地址: https://github.com/jianchang512/pyvideotrans/releases/download/v3.56/win-videotrans-v3.56-tiny.7z ## v3.58 补丁包190MB > 如果已安装过3.x版本,可下载补丁包后解压在sp.exe所在目录,覆盖已有sp.exe和文件夹 百度网盘下载地址: https://pan.baidu.com/s/1Ca-ukCg4OqSXp_aZJLk22g?pwd=t4dw GitHub地址: https://github.com/jianchang512/pyvideotrans/releases/download/v3.56/win-PatchUpdate-3.58.7z > 若补丁覆盖后打开提示`需下载完整包`,请升级显卡驱动、升级cuda到12.x、升级cudnn到cudnn9,并重新下载完整包 ---- ### 所有模型下载地址 为避免压缩包体积过大,预打包版只内置最小模型 tiny,识别效果不佳,效果更好的模型请点击下载 ,建议至少使用medium模型,推荐large-v2 https://github.com/jianchang512/stt/releases/tag/0.0