这是对官方发布说明的摘要。
Ollama v0.32.1 改进了 Gemma 4 的工具调用和多轮推理中的工具响应续接可靠性;修复了可能导致请求间内存占用增加的 MLX 模型缓存泄漏,并改善缓存快照性能。MLX 文本模型加载现会遵循 OLLAMA_LOAD_TIMEOUT。
该版本还在代理网页搜索与抓取需要认证时提示用户运行 ollama signin,为交互式代理提供当前工作目录,并修复 ollama launch 在已弃用模型的“选择其他模型”流程。
影响:这些更新主要面向使用 Ollama 代理、Gemma 4 和 MLX 后端的开发者,可改善工具调用可靠性、内存表现与使用流程。
原始来源:GitHub Releases