打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

Ollama v0.34.3 已发布,发布日期为 2026 年 9 月 23 日。

此次 v0.34.3 更新包含四项明确变化:模型思考控制能力及默认值可通过接口查询;部分视觉模型在 Apple Silicon 与 MLX 环境中获得支持;macOS 应用激活时不再重新打开已经关闭的窗口;从 HuggingFace 拉取模型的问题得到修复。

从本次更新内容来看,重点集中在模型能力信息展示、视觉模型支持范围、macOS 应用使用体验以及模型拉取稳定性四个方面。以下内容仅根据本次更新说明展开,不增加未提供的信息。

一、模型思考控制能力现在可通过 GET /api/show 查询

v0.34.3 的核心更新之一,是GET /api/show现在会公开每个模型所具备的思考控制能力,以及该模型默认使用的思考设置。

这意味着,当用户查询某个模型的信息时,返回结果中不仅可以看到模型本身的相关内容,还能够直接了解到该模型是否支持思考控制、支持哪些思考控制值,以及默认采用哪一种思考配置。

更新说明中将这一能力概括为:

GET /api/show now advertises each model's thinking controls and default

其中包含两个重点。

第一个重点是每个模型可用的思考控制值。

不同模型可能支持不同的思考控制选项。通过模型信息查询结果,用户可以看到该模型具体允许使用哪些值。

第二个重点是模型默认的思考设置。

除了可选值之外,接口还会返回默认值。这样一来,用户在未明确设置思考控制时,也能够知道模型默认会采用什么配置。

这一变化让模型的思考控制能力变得更加直观。对于需要查看模型配置、确认模型支持范围、了解默认行为的场景而言,GET /api/show返回的信息更加完整。

二、命令行中可通过 ollama show 查看思考控制信息

本次新增的思考控制信息同样可以在命令行中查看。

更新说明给出的示例如下:

ollama show gemma4

执行后,可以看到类似以下的思考控制信息:

thinking
levels false, true
default true

从这一示例可以看到,该模型的thinking信息中包含两个字段。

levels字段:

false, true

这表示该模型提供了两个可用的思考控制值,分别是false和true。

default字段:

true

这表示该模型的默认思考设置为true。

因此,在命令行场景下,用户可以通过:

ollama show gemma4

直接查看该模型的思考控制信息,包括可选等级和默认值。

这一展示形式很清晰:先显示thinking,再显示levels和default。其中,levels用于展示可用选项,default用于展示默认选项。

对于支持布尔型思考控制的模型,示例中呈现的结果是:

levels     false, true
default true

也就是说,模型可以使用false或true,而默认使用true。

三、API 中可获取模型思考控制值与默认值

除了命令行之外,这项能力也已经在 API 中提供。

更新说明给出的请求示例如下:

curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'

该请求用于查询指定模型的信息。

返回结果中包含thinking字段,示例如下:

{
"thinking": {
"values": ["low", "high", "max"],
"default": "max"
}
}

这一返回内容展示了思考控制的可选值和默认值。

其中:

"values": ["low", "high", "max"]

表示该模型支持三种思考控制值:

low
high
max

而:

"default": "max"

表示该模型默认使用的思考控制值为:

max

因此,通过 API 查询模型信息时,调用方能够明确知道这个模型支持的思考控制范围是:

low
high
max

并且默认值是:

max

与命令行展示形式相比,API 返回的是结构化数据。命令行中使用的是:

levels
default

而 API 返回示例中使用的是:

values
default

两者所表达的核心内容一致,都是展示模型可用的思考控制选项以及默认思考设置。

在命令行示例中,可用值为:

false, true

默认值为:

true

在 API 示例中,可用值为:

low, high, max

默认值为:

max

这说明不同模型可以具备不同形式的思考控制选项。有的模型使用false与true这样的值,有的模型则使用low、high、max这样的值。

v0.34.3 将这些信息直接暴露在模型查询结果中,使得模型支持哪些思考控制值、默认选择什么值,可以通过查询结果直接获得。

四、云端模型也可在 ollama.com 直接查看相关信息

本次更新说明还明确提到,对于云端模型,这些思考控制相关信息同样可以直接在 ollama.com 上获取。

原始说明为:

Also available on ollama.com directly for cloud models.

这意味着,针对云端模型,思考控制能力及其默认值不仅可通过本地命令行查看,也不仅可通过 API 查询,还可以在 ollama.com 上直接获取。

结合此前给出的 API 示例:

curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'

可以看到,示例中的模型带有:cloud标记。该示例返回了如下思考控制信息:

{
"thinking": {
"values": ["low", "high", "max"],
"default": "max"
}
}

对于这类云端模型,用户可以了解到其支持的思考控制值为:

low
high
max

默认值为:

max

并且,这些信息也可在 ollama.com 直接查看。

本次更新在模型信息展示方面形成了多个可查看入口:命令行可查看、API 可查询、云端模型也可在 ollama.com 直接获取相关信息。

五、不同模型可展示不同类型的思考控制选项

从本次更新给出的两个示例中,可以明确看到,模型的思考控制选项并不完全相同。

命令行示例:

ollama show gemma4

输出内容为:

thinking
levels false, true
default true

在这个示例里,模型可用的思考控制值是:

false
true

默认值是:

true

API 示例:

curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'

返回内容为:

{
"thinking": {
"values": ["low", "high", "max"],
"default": "max"
}
}

在这个示例里,模型可用的思考控制值是:

low
high
max

默认值是:

max

这两组示例分别展示了两种不同的思考控制表达方式。

第一种是布尔型选项:

false
true

第二种是多级选项:

low
high
max

v0.34.3 的变化不在于统一所有模型的思考控制值,而在于让每个模型自身支持的思考控制值和默认值能够被查询、展示和识别。

也就是说,用户不需要只依据模型名称判断思考设置,而是可以通过模型信息结果查看该模型实际公开的thinking配置。

对于gemma4,示例中显示:

levels     false, true
default true

对于glm-5.3-flash:cloud,示例中显示:

"values": ["low", "high", "max"],
"default": "max"

可用值与默认值都在模型信息中被明确展示出来。

六、Nemotron H 视觉模型现已支持 Apple Silicon 上的 MLX

本次更新的第二项内容,是 Nemotron H 视觉模型现在支持在 Apple Silicon 上使用 MLX。

更新说明中的原文为:

Nemotron H vision models are now supported on Apple Silicon with MLX

这项变化包含三个关键信息。

第一个关键信息是模型类型:

Nemotron H vision models

即 Nemotron H 视觉模型。

第二个关键信息是硬件平台:

Apple Silicon

即 Apple Silicon。

第三个关键信息是支持方式:

with MLX

即通过 MLX。

因此,v0.34.3 明确加入了 Nemotron H 视觉模型在 Apple Silicon 与 MLX 组合下的支持。

从更新说明本身可以直接确认的是:

  • • 支持对象是 Nemotron H 视觉模型。

  • • 支持平台是 Apple Silicon。

  • • 支持方式涉及 MLX。

  • • 这一支持属于 v0.34.3 的更新内容。

视觉模型支持是本次版本更新的重要组成部分。此前关于思考控制的更新,主要面向模型信息查询和模型默认配置展示;而 Nemotron H 视觉模型支持 Apple Silicon 与 MLX,则属于模型支持范围方面的变化。

这两项变化分别对应不同方向:

  • • 思考控制信息的可查询性。

  • • 视觉模型在 Apple Silicon 与 MLX 下的支持。

对于关注 Apple Silicon 环境以及 MLX 的使用者而言,v0.34.3 的这一条更新具有明确意义:Nemotron H 视觉模型已经被列入支持范围。

七、macOS 应用激活时不再重新打开已关闭窗口

本次更新的第三项内容,针对 macOS 应用窗口行为进行了优化。

更新说明为:

Ollama's macOS app will now no longer reopen windows you've closed when activating it

按照这项说明,在 macOS 应用中,当用户已经关闭某个窗口后,再次激活应用时,该应用不会重新打开此前已经关闭的窗口。

这项变化描述得非常明确,关键点包括:

  • • 使用场景是 macOS 应用。

  • • 用户已经关闭窗口。

  • • 后续再次激活应用。

  • • 应用不再重新打开已经关闭的窗口。

换句话说,v0.34.3 对 macOS 应用的窗口行为进行了调整:关闭过的窗口在应用激活时不会再次被自动打开。

这是一项围绕窗口状态的体验优化。更新说明没有增加其他窗口行为描述,只明确指出一个变化:已关闭窗口在激活应用时不会重新打开。

因此,在介绍这一项更新时,应准确保留其范围,不扩展为其他未说明的窗口功能。

可以将该项变化概括为:

macOS 应用激活后,不再重新打开用户已关闭的窗口。

这条更新与模型能力本身无关,也与模型拉取无关,而是面向 macOS 应用的窗口使用体验。

八、修复从 HuggingFace 拉取模型的问题

本次更新的第四项内容,是修复从 HuggingFace 拉取模型的问题。

更新说明为:

Fix for model pulls from HuggingFace

这表明,v0.34.3 包含了一项与模型拉取有关的修复,修复对象是从 HuggingFace 拉取模型的过程。

该项内容可以准确概括为:

修复从 HuggingFace 拉取模型的问题。

更新说明没有进一步给出问题的具体表现、触发条件、影响范围或修复细节。因此,围绕这一项内容,能够确认的信息是:

  • • 修复与模型拉取有关。

  • • 拉取来源涉及 HuggingFace。

  • • 该修复被包含在 v0.34.3 中。

模型拉取是本次更新中与使用稳定性相关的一项内容。与思考控制信息展示相比,它不涉及模型返回字段;与视觉模型支持相比,它不涉及 Apple Silicon 或 MLX;与 macOS 窗口优化相比,它不涉及应用激活行为。

它对应的是一个独立的修复方向,即:

HuggingFace 模型拉取修复。

对于依赖从 HuggingFace 拉取模型的使用场景,v0.34.3 的更新说明明确列出了这项修复。

九、v0.34.3 更新内容完整汇总

根据本次发布说明,Ollama v0.34.3 的变更内容可以归纳为以下四项。

1. 模型思考控制信息可通过 GET /api/show 获取

GET /api/show现在会公开每个模型的思考控制能力和默认值。

命令行示例:

ollama show gemma4

对应展示:

thinking
levels false, true
default true

API 示例:

curl http://localhost:11434/api/show -d '{"model": "glm-5.3-flash:cloud"}'

对应返回:

{
"thinking": {
"values": ["low", "high", "max"],
"default": "max"
}
}

云端模型的这类信息也可以在 ollama.com 直接查看。

2. Nemotron H 视觉模型支持 Apple Silicon 与 MLX

Nemotron H 视觉模型现在支持在 Apple Silicon 上通过 MLX 使用。

3. macOS 应用不再重开已关闭窗口

macOS 应用在激活时,不会再重新打开用户此前关闭的窗口。

4. 修复从 HuggingFace 拉取模型的问题

v0.34.3 修复了从 HuggingFace 拉取模型的问题。

十、结语

代码地址:github.com/ollama/ollama

本次更新最值得关注的内容,是模型思考控制信息的公开展示。现在,用户可以通过ollama show查看模型支持的思考控制选项和默认值,也可以通过GET /api/show获取结构化的thinking信息。

在命令行示例中:

levels     false, true
default true

在 API 示例中:

"values": ["low", "high", "max"],
"default": "max"

同时,云端模型也可以在 ollama.com 上直接查看相关思考控制信息。

除此之外,v0.34.3 还加入了 Nemotron H 视觉模型对 Apple Silicon 与 MLX 的支持,优化了 macOS 应用激活时重新打开已关闭窗口的问题,并修复了从 HuggingFace 拉取模型的问题。

整体来看,本次版本更新覆盖模型信息展示、视觉模型支持、macOS 窗口体验和模型拉取修复四个方面。

我们相信人工智能为普通人提供了一种“增强工具”,并致力于分享全方位的AI知识。在这里,您可以找到最新的AI科普文章、工具评测、提升效率的秘籍以及行业洞察。 欢迎关注“福大大架构师每日一题”,发消息可获得面试资料,让AI助力您的未来发展。