v0.1.8

Netw0rkNoob/VulnClawv0.1.8Mar 23, 2026by chonknick

AI Summary

Overhauled reranking performance through architectural improvements, resulting in a 3.3x speedup.

Key Highlights

  • Single rerank pass eliminates redundant ONNX session loads.
  • Switched to ORT format for faster model deserialization.
  • Utilizes mmap model loading for zero-copy access.
  • Enabled multi-threaded inference using half available cores.

New Features

  • Single rerank pass across packages
  • ORT format support with automatic .onnx fallback
  • mmap model loading
  • Multi-threaded inference (capped at 4 cores)

Full Release Notes

## What's Changed

### Reranking Performance Overhaul (3.3x faster)

- **Single rerank pass** — collect all FTS5 results across packages, rerank once instead of per-package (eliminates redundant ONNX session loads)
- **ORT format** — pre-optimized flatbuffer model (`reranker.ort`) for faster deserialization, with automatic fallback to `.onnx`
- **mmap model loading** — zero-copy memory-mapped file access via `commit_from_memory_directly`
- **Multi-threaded inference** — uses half available cores (capped at 4) for ONNX intra-op parallelism

### Benchmarks

| Scenario | v0.1.7 | v0.1.8 | Speedup |
|----------|--------|--------|---------|
| All packages (11) | 1.01s | **0.31s** | 3.3x |
| Single package | 0.09s | **0.04s** | 2.3x |