v1.5.0
xorbitsai/inferencev1.5.0Apr 19, 2025by XprobeBot
AI Summary
Major release introducing InternVL3 and Megatts3 models, AWQ quantization, and UI improvements for progress tracking.
Key Highlights
- Support for InternVL3 and Megatts3 models
- AWQ quantization support for InternVL3
- UI progress bar and model launch cancellation
- Thinking process display in Gradio chat interface
New Features
- Megatts3 model support
- InternVL3 model support
- Paraformer-zh model support
- SeaLLMs-v3 support
- Download progress and cancellation support
- Thinking process display in Gradio chat
- GLM4-0414 support
- Min/max_pixels parameters for vision models
- Skywork-OR1-preview support
- UI progress bar and functionality to cancel model launch
- AWQ quantization support for InternVL3
- Virtualenv support for models
- Qwen2.5-omni support
- Compatibility with latest xllamacpp
- Xllamacpp as default
- Updated Gradio interface for chat models
- Gradio default concurrency set to CPU count
- Transformers model registration simplification
Full Release Notes
# What's new in 1.5.0 (2025-04-19) These are the changes in inference v1.5.0. ## New features * FEAT: Support megatts3 by @codingl2k1 in https://github.com/xorbitsai/inference/pull/3224 * FEAT: InternVL3 by @Minamiyama in https://github.com/xorbitsai/inference/pull/3235 * FEAT: support paraformer-zh by @qinxuye in https://github.com/xorbitsai/inference/pull/3236 * FEAT:support SeaLLMs-v3 by @Jun-Howie in https://github.com/xorbitsai/inference/pull/3248 * FEAT: support getting download progress and cancel download by @qinxuye in https://github.com/xorbitsai/inference/pull/3233 * FEAT: add thinking process in gradio chat interface by @amumu96 in https://github.com/xorbitsai/inference/pull/3245 * FEAT: support glm4-0414 by @Jun-Howie in https://github.com/xorbitsai/inference/pull/3251 * FEAT: support min/max_pixels params for vision model by @amumu96 in https://github.com/xorbitsai/inference/pull/3242 * FEAT: support skywork-or1-preview by @Jun-Howie in https://github.com/xorbitsai/inference/pull/3274 * FEAT: [UI] progress bar and functionality to cancel model launch. by @yiboyasss in https://github.com/xorbitsai/inference/pull/3276 * FEAT:Add AWQ quantization support for InternVL3 by @Jun-Howie in https://github.com/xorbitsai/inference/pull/3285 * FEAT: Support virtualenv for models by @qinxuye in https://github.com/xorbitsai/inference/pull/3241 * FEAT: support qwen2.5-omni by @qinxuye in https://github.com/xorbitsai/inference/pull/3279 ## Enhancements * ENH: Compatible with latest xllamacpp by @codingl2k1 in https://github.com/xorbitsai/inference/pull/3181 * ENH: Use xllamacpp by default by @codingl2k1 in https://github.com/xorbitsai/inference/pull/3198 * ENH: update gradio interface for chat model by @amumu96 in https://github.com/xorbitsai/inference/pull/3265 * ENH: Set gradio default concurrency to cpu count by @codingl2k1 in https://github.com/xorbitsai/inference/pull/3278 * BLD: fix compatibility for mlx-lm>=0.22.3 by @qinxuye in https://github.com/xorbitsai/inference/pull/3195 * BLD: upgrade gradio version for docker by @Minamiyama in https://github.com/xorbitsai/inference/pull/3197 * BLD: fix docker build by @qinxuye in https://github.com/xorbitsai/inference/pull/3207 * BLD: remove setuptools limitation in project.toml by @qinxuye in https://github.com/xorbitsai/inference/pull/3212 * BLD: fix docker build by @amumu96 in https://github.com/xorbitsai/inference/pull/3289 * REF: simplify transformers model registration with decorators. by @Minamiyama in https://github.com/xorbitsai/inference/pull/3191 ## Bug fixes * BUG: fix stop hang for vllm engine by @qinxuye in https://github.com/xorbitsai/inference/pull/3202 * BUG: Fix qwq gguf model path by @codingl2k1 in https://github.com/xorbitsai/inference/pull/3232 * BUG: Fix llama cpp backend load model with multiple parts by @codingl2k1 in https://github.com/xorbitsai/inference/pull/3261 ## Documentation * DOC: Add usage doc for kokoro by @codingl2k1 in https://github.com/xorbitsai/inference/pull/3192 * DOC: add doc about virtual env & update models in README by @qinxuye in https://github.com/xorbitsai/inference/pull/3287 **Full Changelog**: https://github.com/xorbitsai/inference/compare/v1.4.1...v1.5.0