v3.56

jianchang512/pyvideotransv3.56Feb 22, 2025by jianchang512

AI Summary

Added Gladia.io support for speech recognition and introduced advanced parameter controls for LLMs.

Key Highlights

  • Added Gladia.io support for speech recognition channels.
  • Added `max_tokens`, `top_p`, and `temperature` parameters for OpenAI and Local LLMs.

New Features

  • Gladia.io support
  • LLM parameter controls

Full Release Notes

> 预打包版仅适用于Windows10/11,MacOS和Linux请源码部署
> MacOS/Linux升级:重新拉取源码覆盖,然后执行
>  `pip3 install --upgrade openai-whisper elevenlabs` 
>  `pip3 install --no-deps  --force-reinstall "faster-whisper @ https://github.com/SYSTRAN/faster-whisper/archive/refs/heads/master.tar.gz"`

## Change

- Feat: 翻译设置--OpenAI/本地大模型增加 `max_tokens/top_p/temperature` 参数设置
- Fix: 调整默认 LocalLLM 提示词
- Fix: 降低edge-tts配音速度,尝试减少403报错,未必有效,更好的解决方式是当出现限流时,切换代理节点或使用其他配音渠道
- Feat: 语音识别 `自定义API` 渠道增加对 [Gladia.io](https://pyvideotrans.com/gladia) 的支持


## Win v3.56 完整包下载

> 如果未安装过旧版本,请在此下载完整版,如需cuda加速,需有英伟达显卡并且安装cuda12.x及cudnn9

百度网盘下载地址(含tiny/medium模型):  https://pan.baidu.com/s/1vSFt259yAywdhmgSN0l3sQ?pwd=n9g8

GitHub地址: https://github.com/jianchang512/pyvideotrans/releases/download/v3.56/win-videotrans-v3.56-tiny.7z

 

## v3.58 补丁包190MB

> 如果已安装过3.x版本,可下载补丁包后解压在sp.exe所在目录,覆盖已有sp.exe和文件夹

百度网盘下载地址:    https://pan.baidu.com/s/1Ca-ukCg4OqSXp_aZJLk22g?pwd=t4dw

GitHub地址: https://github.com/jianchang512/pyvideotrans/releases/download/v3.56/win-PatchUpdate-3.58.7z


> 若补丁覆盖后打开提示`需下载完整包`,请升级显卡驱动、升级cuda到12.x、升级cudnn到cudnn9,并重新下载完整包


----

### 所有模型下载地址

为避免压缩包体积过大,预打包版只内置最小模型 tiny,识别效果不佳,效果更好的模型请点击下载 ,建议至少使用medium模型,推荐large-v2

https://github.com/jianchang512/stt/releases/tag/0.0