Change8

v0.33.3-rc2

📦 ollamaView on GitHub →
2 features🔧 3 symbols

Summary

This release introduces reporting of cached prompt tokens and ensures GGUF models respect their default parameters. It also includes updates to MLX, MLX-C, and llama.cpp.

✨ New Features

  • Report cached prompt tokens
  • Honor GGUF model defined default parameters

Affected Symbols