ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解

ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解 2026年8月11日github.com/ollama/ollama 发布 v0.32.8 版本。本次版本的核心内容是加入对 Muse Glimmer 的支持并将该模型扩展至 NVIDIA、AMD 以及更多平台。同时版本中还包含 llama.cpp 更新、VS Code 文档要求调整、上下文长度配置说明、视觉 OCR 文档测试接入以及 Windows CUDA 安装流程的下载重试改进。从变更统计看本次更新包含 4 次提交、44 个文件变更、4,967 行新增以及 49 行删除共有 2 位贡献者参与。版本发布前后的代码变更覆盖自动化工作流、集成测试、文档、模型运行时依赖版本等多个部分。一、v0.32.8 发布信息版本号v0.32.8发布日期2026年8月11日更新名称Muse Glimmer本次发布最重要的内容是Muse Glimmer 已可在全部平台使用。Muse Glimmer 可用于多类本地 AI 应用场景包括编码代理应用和长期运行的个人助手框架。公告中列出的编码代理应用包括Claude CodeCodexPi公告中列出的长期运行个人助手框架包括OpenClawHermes对于希望在本地运行 Muse Glimmer 的用户可以直接使用以下命令下载并启动模型ollama run muse-glimmer这条命令用于拉取并运行muse-glimmer模型。二、Muse Glimmer 的运行方式除了直接运行模型外v0.32.8 还给出了 Muse Glimmer 与多种应用的启动方式。如果需要通过 Claude Code 运行 Muse Glimmer需要先下载 Ollama然后执行ollama launch claude--modelmuse-glimmer这条命令通过ollama launch启动 Claude Code并指定模型为muse-glimmer。对于更轻量级的编码代理公告建议使用 Pi命令如下ollama launch pi--modelmuse-glimmer该方式同样使用ollama launch但目标应用变为 Pi模型仍为muse-glimmer。对于个人助手框架公告给出了 OpenClaw 与 Hermes 的启动命令。启动 OpenClawollama launch openclaw--modelmuse-glimmer启动 Hermesollama launch hermes--modelmuse-glimmer从这些命令可以看到Muse Glimmer 在 v0.32.8 中已被纳入多种应用启动路径。无论是直接通过 Ollama 执行模型还是通过编码代理应用、个人助手框架调用模型均可通过指定--model muse-glimmer使用该模型。三、Muse Glimmer 扩展至 NVIDIA、AMD 及更多平台本次更新中的变更说明明确指出为 Muse Glimmer 增加 NVIDIA、AMD 和其他更多平台支持。此前公告重点提到 Apple Silicon 环境下的 MLX 引擎表现而 v0.32.8 则进一步补充了 NVIDIA、AMD 以及附加平台的支持范围。该项变更是本次版本“What’s Changed”部分唯一直接列出的核心功能更新。更新内容可以概括为Muse Glimmer 支持 NVIDIA 平台Muse Glimmer 支持 AMD 平台Muse Glimmer 支持更多额外平台Muse Glimmer 已在全部平台可用四、MLX 引擎、Apple Silicon 与图像输入支持公告同时说明Ollama 的 MLX 引擎可为 Muse Glimmer 在 Apple Silicon 上提供先进性能。在 Ollama 0.32.7 起MLX 引擎已经支持以下能力DFlash图像输入也就是说v0.32.8 的 Muse Glimmer 发布信息中继续明确了 Ollama 0.32.7 已具备的 MLX 相关能力在 Apple Silicon 上模型可以结合 MLX 引擎运行并支持 DFlash 和图像输入。公告中的信息包括以下几个关键点Ollama 的 MLX 引擎面向 Apple Silicon 提供性能支持Muse Glimmer 可在该引擎能力基础上运行Ollama 0.32.7 已支持 DFlashOllama 0.32.7 已支持 image input也就是图像输入这部分内容与本次新增的跨平台支持共同构成了 Muse Glimmer 的运行支持信息Apple Silicon 环境对应 MLX 引擎能力NVIDIA、AMD 以及其他平台则在 v0.32.8 中获得支持。五、llama.cpp 版本更新v0.32.8 更新了 llama.cpp 依赖版本。LLAMA_CPP_VERSION文件中的版本号从b10242更新为b10353这意味着本次 Ollama 版本同步了新的 llama.cpp 版本标识。对应变更为 1 行删除、1 行新增。提交记录中也包含一项 llama.cpp 更新提交时间为 2026年8月11日距离发布信息所示时间约 8 小时。六、VS Code 集成要求提升至 1.127在docs/integrations/vscode.mdx文档中Visual Studio Code 的最低版本要求进行了调整。原有要求为Visual Studio Code 1.120 或更高版本更新后的要求为Visual Studio Code 1.127 或更高版本文档中的 Requirements 部分包含以下要求Visual Studio Code 1.127 或更高版本已安装并正在运行的 OllamaOllama 中至少有一个可用的本地模型或云模型文档还明确指出较早版本的 VS Code 无法可靠地取消来自语言模型提供商的请求。因此当前 VS Code 集成文档强调的版本要求是使用 Ollama 扩展进行 VS Code Chat 时应使用 Visual Studio Code 1.127 或更高版本。七、VS Code 文档新增上下文长度说明本次文档更新还新增了 Context length也就是上下文长度相关说明。文档指出VS Code 可能会显示某个模型支持的最大上下文长度但 Ollama 在实际运行时分配的上下文长度可能更小。也就是说VS Code 的界面显示与 Ollama 实际分配的上下文长度并不一定完全一致。VS Code 可能展示模型的最大支持上限而 Ollama 运行时使用的上下文长度则可能低于这一数值。对于本地模型文档给出的操作方式是打开 Ollama Settings。将 context length 设置为至少 64k。重新加载 VS Code 窗口。再次发送提示词。文档中的表述强调本地模型需要在 Ollama 设置中将上下文长度设置为至少 64k随后重新加载 VS Code 窗口并重新发送提示词。相关文档同时指向 Context length 页面以便查看上下文长度的更多信息。这部分新增内容对于在 VS Code 中使用本地模型的场景具有直接对应关系即使 VS Code 显示模型具备较大的最大上下文能力仍需关注 Ollama 实际运行时分配的上下文长度并在本地模型场景下通过 Ollama Settings 设置至少 64k 的上下文长度。八、Ollama 版本建议保持不变VS Code 集成文档中还保留了关于 Ollama 版本的说明。文档建议使用 Ollama 0.17.6 或更新版本以支持云模型登录更丰富的模型元数据同时文档也说明较旧版本仍可能与本地模型配合使用。因此文档中的版本信息可以整理为VS Code 要求为 1.127 或更高版本推荐使用 Ollama 0.17.6 或更高版本以获得云模型登录和更丰富模型元数据支持较旧的 Ollama 版本仍可能支持本地模型九、Windows CUDA 安装流程加入重试机制本次变更对两个 GitHub Actions 工作流中的 CUDA 安装流程进行了调整.github/workflows/release.yaml.github/workflows/test-llamacpp-update.yaml两个文件的改动内容一致均涉及 Windows PowerShell 环境下 CUDA 安装程序的下载。原流程中使用Invoke-WebRequest下载 CUDA 安装程序并保存为install.exe。更新后下载过程增加了重试逻辑。更新后的流程会在缓存未命中的情况下执行下载if(${{ steps.cache-install.outputs.cache-hit }}-netrue){下载部分通过循环最多尝试 3 次for($attempt 1;$attempt-le3;$attempt){每次尝试中执行Invoke-WebRequest-Uri${{ matrix.install }}-OutFileinstall.exe如果下载成功则退出循环break如果下载失败流程会判断当前是否已经是第 3 次尝试if($attempt-eq3){throw}如果不是最后一次尝试则输出下载失败提示并等待 15 秒Write-HostCUDA installer download attempt$attemptfailed:$($_.Exception.Message); retrying in 15sStart-Sleep-Seconds 15因此这部分工作流的下载逻辑具备以下明确行为CUDA 安装程序下载最多尝试 3 次下载失败后会输出失败信息非最后一次失败时等待 15 秒第 3 次仍失败时抛出错误下载成功后退出重试循环安装文件仍保存为install.exe完成下载后流程继续根据 CUDA 组件与 CUDA 版本拼接子包名称$subpackages (${{join(matrix.cuda-components,, )}})|Foreach-Object{${_}_${{ matrix.cuda-version }}}随后以静默方式启动安装程序Start-Process-FilePath.\install.exe-ArgumentList((-s)$subpackages)-NoNewWindow-Wait这部分变更同时存在于发布工作流和 llama.cpp 更新测试工作流中。十、视觉测试新增 vision-ocr-document在integration/reg_groups_test.go文件中视觉测试分组新增了一个测试项vision-ocr-document该测试项被加入TestVision所覆盖的视觉测试列表中。更新后的测试列表包含vision-detail vision-multi-image vision-description vision-ocr-document vision-split-batch vision-text其中vision-ocr-document是本次新增的视觉测试项。从命名可见该测试属于视觉 OCR 文档测试相关内容并与已有的视觉细节、多图、图像描述、分批处理、视觉文本等测试一同被纳入视觉测试范围。十一、发布回归测试调整在integration/reg_release_test.go文件中发布回归测试也进行了调整。原有固定注册的测试项中包含image-generation该项在本次变更中被移除。原有固定测试列表中涉及的内容包括create-safetensors create-gguf quantization image-generation更新后固定列表不再包含image-generation。与此同时发布回归测试新增了以下注册调用registerVisionOCRDocumentCases(testModels(releaseVisionModels))该调用用于为releaseVisionModels注册视觉 OCR 文档测试用例。更新后的模型参数化测试注册内容包括registerVisionTextCases(testModels(releaseVisionTextModels))registerToolCases(testModels(releaseToolsModels))registerToolStressCases(testModels(releaseToolsModels))registerVisionOCRDocumentCases(testModels(releaseVisionModels))registerAudioTranscriptionCases(testModels(releaseAudioModels))因此发布回归测试的调整包括两个明确部分固定测试列表中移除image-generation面向releaseVisionModels新增视觉 OCR 文档测试注册十二、新增 vision_ocr_test.go 测试文件本次更新新增了integration/vision_ocr_test.go文件。该文件的变更统计为166 行新增 0 行删除结合integration/reg_groups_test.go中新增的vision-ocr-document以及integration/reg_release_test.go中新增的registerVisionOCRDocumentCases调用可以看到视觉 OCR 文档测试已被加入集成测试和发布回归测试相关范围。十三、4 次提交记录v0.32.8 的变更对比中显示共有 4 次提交。2026年8月10日的提交Release v0.32.7提交编号 176462026年8月11日的提交docs: add VS Code context length guidance提交编号 17610docs: require VS Code 1.127提交编号 17655llama.cpp update提交编号 17659其中VS Code 上下文长度说明、VS Code 1.127 最低版本要求以及 llama.cpp 版本更新均对应本次 v0.32.8 的变更内容。十四、v0.32.8 更新内容汇总代码地址github.com/ollama/ollamaOllama v0.32.8 的内容可以归纳为以下几点Muse Glimmer 已在全部平台可用Muse Glimmer 新增 NVIDIA、AMD 和更多平台支持Muse Glimmer 可通过ollama run muse-glimmer在本地下载并运行Muse Glimmer 可与 Claude Code 配合使用Muse Glimmer 可与 Pi 配合使用Muse Glimmer 可与 OpenClaw 配合使用Muse Glimmer 可与 Hermes 配合使用Ollama MLX 引擎在 Apple Silicon 上支持 Muse GlimmerOllama 0.32.7 已支持 DFlash 和图像输入llama.cpp 版本从 b10242 更新至 b10353VS Code 最低版本要求由 1.120 提升至 1.127文档指出较早版本 VS Code 无法可靠取消语言模型提供商请求本地模型在 VS Code 中使用时Ollama context length 应设置为至少 64kWindows CUDA 下载流程增加最多 3 次的重试机制每次 CUDA 下载失败后非最终失败场景会等待 15 秒再重试视觉测试新增vision-ocr-document发布回归测试新增视觉 OCR 文档测试注册固定发布回归测试列表中移除image-generation新增integration/vision_ocr_test.go包含 166 行新增内容整体来看v0.32.8 围绕 Muse Glimmer 的全平台支持展开同时补充了 VS Code 本地模型上下文长度配置说明更新了 llama.cpp 版本并将视觉 OCR 文档测试纳入集成测试与发布回归测试范围。
返回列表