v0.33.3-rc2
📦 ollamaView on GitHub →
✨ 2 features🔧 3 symbols
Summary
This release introduces reporting of cached prompt tokens and ensures GGUF models respect their default parameters. It also includes updates to MLX, MLX-C, and llama.cpp.
✨ New Features
- Report cached prompt tokens
- Honor GGUF model defined default parameters