v1.3.10
datalab-to/markerv1.3.10Jun 19, 2026by LauraGPT
AI Summary
This release is for modelscope/FunASR repository, not datalab-to/marker. Introduces agent-friendly CLI, batched VAD-segment decoding, and various fixes for Fun-ASR-Nano and WebSocket server.
Key Highlights
- New agent-friendly CLI with structured output support
- Fun-ASR-Nano now supports batched VAD-segment decoding (~1.75× faster)
- WebSocket 2-pass server with sentence-level timestamps
- Multiple bug fixes for fp16/bf16 inference and CLI
- New vLLM server flags for VAD and speaker models
New Features
- Agent-friendly CLI with JSON output format
- Batched VAD-segment decoding for Fun-ASR-Nano
- WebSocket 2-pass server with sentence timestamps
- New --vad-model and --spk-model flags for vLLM server
- Improved CLI timestamp handling and model ID support
Full Release Notes
## FunASR v1.3.10 ### New features - **Agent-friendly CLI**: `funasr audio.wav --output-format json` for structured output - **Fun-ASR-Nano**: batched VAD-segment decoding (~1.75× faster) (#2979) - **WebSocket 2-pass server**: sentence-level timestamps - **serve_vllm.py**: new `--vad-model` / `--spk-model` flags ### Fixes - Fun-ASR-Nano: bf16/fp16 inference no longer crashes; warn on degraded fp16 (#2980) - Fun-ASR-Nano vLLM: fix CUDA crash from `repetition_penalty` - CLI: valid SRT timestamps + correct JSON durations (#2982); use `sentence_info` text (#2983); correct model id `Fun-ASR-Nano-2512` (#2984) - Clearer error for missing audio path (#2981); respect explicit VAD silence threshold; handle `None` encoder/scheduler configs ### Docs - New CLI reference; clearer vLLM install guidance **Full changelog**: https://github.com/modelscope/FunASR/compare/v1.3.9...v1.3.10