Ollama v0.34.3让API公布模型的思考档位与默认值
GET /api/show现在会返回每个模型的thinking参数可选项和默认值,Nemotron H视觉模型在Apple Silicon上获得MLX支持,macOS应用不再重开已关闭的窗口。
AI解读:Ollama v0.34.3这次最实用的改动,是让客户端在调用模型前就能知道它支持哪些“思考”档位。以前要设置reasoning强度,你得翻文档或试错;现在请求 /api/show就会返回可取值和默认值,比如glm-5.3-flash:cloud返回low、high、max,默认是max。
这对写前端或工具的人最直接:可以把档位做成下拉菜单,而不是硬编码。不过要注意,默认max意味着如果你不显式指定,模型会按最高思考强度跑,响应可能更慢或更贵,需要自己权衡。
另外两条是平台适配:Nemotron H视觉模型现在在Apple Silicon上通过MLX支持,Mac用户本地跑视觉模型少了一层障碍;macOS应用激活时不再重开你已经关掉的窗口,属于日常体验修复。
Ollama发布v0.34.3-rc0,主要变化是GET /api/show接口现在会公布每个模型支持的思考(thinking)档位及其默认值。
以glm-5.3-flash:cloud为例,向http://localhost:11434/api/show发送请求后,返回的thinking字段包含可选值 ["low", "high", "max"],默认值为 "max"。
该版本新增对Nemotron H视觉模型在Apple Silicon上通过MLX的支持。
Ollama的macOS应用在激活时,不再重新打开用户已经关闭的窗口。
GET /api/show新增thinking控制字段
根据发布说明,GET /api/show现在会告知每个模型可用的思考控制项和默认值。示例请求为:curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'。
示例返回的JSON中包含thinking对象,values为 ["low", "high", "max"],default为 "max"。发布说明未列出其他模型的档位或默认值。
Nemotron H与macOS应用修复
发布说明称,Nemotron H视觉模型现在在Apple Silicon上通过MLX获得支持。
Ollama的macOS应用在激活时不再重开已关闭的窗口。完整变更日志对比链接为v0.34.2到v0.34.3-rc0。