ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解

发布时间:2026/8/12 12:19:49

ollama v0.32.8正式发布:Muse Glimmer 全平台支持、MLX 图像输入与 VS Code 64k 上下文配置详解
2026年8月11日github.com/ollama/ollama 发布 v0.32.8 版本。本次版本的核心内容是加入对 Muse Glimmer 的支持并将该模型扩展至 NVIDIA、AMD 以及更多平台。同时版本中还包含 llama.cpp 更新、VS Code 文档要求调整、上下文长度配置说明、视觉 OCR 文档测试接入以及 Windows CUDA 安装流程的下载重试改进。从变更统计看本次更新包含 4 次提交、44 个文件变更、4,967 行新增以及 49 行删除共有 2 位贡献者参与。版本发布前后的代码变更覆盖自动化工作流、集成测试、文档、模型运行时依赖版本等多个部分。一、v0.32.8 发布信息版本号v0.32.8发布日期2026年8月11日更新名称Muse Glimmer本次发布最重要的内容是Muse Glimmer 已可在全部平台使用。Muse Glimmer 可用于多类本地 AI 应用场景包括编码代理应用和长期运行的个人助手框架。公告中列出的编码代理应用包括Claude CodeCodexPi公告中列出的长期运行个人助手框架包括OpenClawHermes对于希望在本地运行 Muse Glimmer 的用户可以直接使用以下命令下载并启动模型ollama run muse-glimmer这条命令用于拉取并运行muse-glimmer模型。二、Muse Glimmer 的运行方式除了直接运行模型外v0.32.8 还给出了 Muse Glimmer 与多种应用的启动方式。如果需要通过 Claude Code 运行 Muse Glimmer需要先下载 Ollama然后执行ollama launch claude--modelmuse-glimmer这条命令通过ollama launch启动 Claude Code并指定模型为muse-glimmer。对于更轻量级的编码代理公告建议使用 Pi命令如下ollama launch pi--modelmuse-glimmer该方式同样使用ollama launch但目标应用变为 Pi模型仍为muse-glimmer。对于个人助手框架公告给出了 OpenClaw 与 Hermes 的启动命令。启动 OpenClawollama launch openclaw--modelmuse-glimmer启动 Hermesollama launch hermes--modelmuse-glimmer从这些命令可以看到Muse Glimmer 在 v0.32.8 中已被纳入多种应用启动路径。无论是直接通过 Ollama 执行模型还是通过编码代理应用、个人助手框架调用模型均可通过指定--model muse-glimmer使用该模型。三、Muse Glimmer 扩展至 NVIDIA、AMD 及更多平台本次更新中的变更说明明确指出为 Muse Glimmer 增加 NVIDIA、AMD 和其他更多平台支持。此前公告重点提到 Apple Silicon 环境下的 MLX 引擎表现而 v0.32.8 则进一步补充了 NVIDIA、AMD 以及附加平台的支持范围。该项变更是本次版本“What’s Changed”部分唯一直接列出的核心功能更新。更新内容可以概括为Muse Glimmer 支持 NVIDIA 平台Muse Glimmer 支持 AMD 平台Muse Glimmer 支持更多额外平台Muse Glimmer 已在全部平台可用四、MLX 引擎、Apple Silicon 与图像输入支持公告同时说明Ollama 的 MLX 引擎可为 Muse Glimmer 在 Apple Silicon 上提供先进性能。在 Ollama 0.32.7 起MLX 引擎已经支持以下能力DFlash图像输入也就是说v0.32.8 的 Muse Glimmer 发布信息中继续明确了 Ollama 0.32.7 已具备的 MLX 相关能力在 Apple Silicon 上模型可以结合 MLX 引擎运行并支持 DFlash 和图像输入。公告中的信息包括以下几个关键点Ollama 的 MLX 引擎面向 Apple Silicon 提供性能支持Muse Glimmer 可在该引擎能力基础上运行Ollama 0.32.7 已支持 DFlashOllama 0.32.7 已支持 image input也就是图像输入这部分内容与本次新增的跨平台支持共同构成了 Muse Glimmer 的运行支持信息Apple Silicon 环境对应 MLX 引擎能力NVIDIA、AMD 以及其他平台则在 v0.32.8 中获得支持。五、llama.cpp 版本更新v0.32.8 更新了 llama.cpp 依赖版本。LLAMA_CPP_VERSION文件中的版本号从b10242更新为b10353这意味着本次 Ollama 版本同步了新的 llama.cpp 版本标识。对应变更为 1 行删除、1 行新增。提交记录中也包含一项 llama.cpp 更新提交时间为 2026年8月11日距离发布信息所示时间约 8 小时。六、VS Code 集成要求提升至 1.127在docs/integrations/vscode.mdx文档中Visual Studio Code 的最低版本要求进行了调整。原有要求为Visual Studio Code 1.120 或更高版本更新后的要求为Visual Studio Code 1.127 或更高版本文档中的 Requirements 部分包含以下要求Visual Studio Code 1.127 或更高版本已安装并正在运行的 OllamaOllama 中至少有一个可用的本地模型或云模型文档还明确指出较早版本的 VS Code 无法可靠地取消来自语言模型提供商的请求。因此当前 VS Code 集成文档强调的版本要求是使用 Ollama 扩展进行 VS Code Chat 时应使用 Visual Studio Code 1.127 或更高版本。七、VS Code 文档新增上下文长度说明本次文档更新还新增了 Context length也就是上下文长度相关说明。文档指出VS Code 可能会显示某个模型支持的最大上下文长度但 Ollama 在实际运行时分配的上下文长度可能更小。也就是说VS Code 的界面显示与 Ollama 实际分配的上下文长度并不一定完全一致。VS Code 可能展示模型的最大支持上限而 Ollama 运行时使用的上下文长度则可能低于这一数值。对于本地模型文档给出的操作方式是打开 Ollama Settings。将 context length 设置为至少 64k。重新加载 VS Code 窗口。再次发送提示词。文档中的表述强调本地模型需要在 Ollama 设置中将上下文长度设置为至少 64k随后重新加载 VS Code 窗口并重新发送提示词。相关文档同时指向 Context length 页面以便查看上下文长度的更多信息。这部分新增内容对于在 VS Code 中使用本地模型的场景具有直接对应关系即使 VS Code 显示模型具备较大的最大上下文能力仍需关注 Ollama 实际运行时分配的上下文长度并在本地模型场景下通过 Ollama Settings 设置至少 64k 的上下文长度。八、Ollama 版本建议保持不变VS Code 集成文档中还保留了关于 Ollama 版本的说明。文档建议使用 Ollama 0.17.6 或更新版本以支持云模型登录更丰富的模型元数据同时文档也说明较旧版本仍可能与本地模型配合使用。因此文档中的版本信息可以整理为VS Code 要求为 1.127 或更高版本推荐使用 Ollama 0.17.6 或更高版本以获得云模型登录和更丰富模型元数据支持较旧的 Ollama 版本仍可能支持本地模型九、Windows CUDA 安装流程加入重试机制本次变更对两个 GitHub Actions 工作流中的 CUDA 安装流程进行了调整.github/workflows/release.yaml.github/workflows/test-llamacpp-update.yaml两个文件的改动内容一致均涉及 Windows PowerShell 环境下 CUDA 安装程序的下载。原流程中使用Invoke-WebRequest下载 CUDA 安装程序并保存为install.exe。更新后下载过程增加了重试逻辑。更新后的流程会在缓存未命中的情况下执行下载if(${{ steps.cache-install.outputs.cache-hit }}-netrue){下载部分通过循环最多尝试 3 次for($attempt 1;$attempt-le3;$attempt){每次尝试中执行Invoke-WebRequest-Uri${{ matrix.install }}-OutFileinstall.exe如果下载成功则退出循环break如果下载失败流程会判断当前是否已经是第 3 次尝试if($attempt-eq3){throw}如果不是最后一次尝试则输出下载失败提示并等待 15 秒Write-HostCUDA installer download attempt$attemptfailed:$($_.Exception.Message); retrying in 15sStart-Sleep-Seconds 15因此这部分工作流的下载逻辑具备以下明确行为CUDA 安装程序下载最多尝试 3 次下载失败后会输出失败信息非最后一次失败时等待 15 秒第 3 次仍失败时抛出错误下载成功后退出重试循环安装文件仍保存为install.exe完成下载后流程继续根据 CUDA 组件与 CUDA 版本拼接子包名称$subpackages (${{join(matrix.cuda-components,, )}})|Foreach-Object{${_}_${{ matrix.cuda-version }}}随后以静默方式启动安装程序Start-Process-FilePath.\install.exe-ArgumentList((-s)$subpackages)-NoNewWindow-Wait这部分变更同时存在于发布工作流和 llama.cpp 更新测试工作流中。十、视觉测试新增 vision-ocr-document在integration/reg_groups_test.go文件中视觉测试分组新增了一个测试项vision-ocr-document该测试项被加入TestVision所覆盖的视觉测试列表中。更新后的测试列表包含vision-detail vision-multi-image vision-description vision-ocr-document vision-split-batch vision-text其中vision-ocr-document是本次新增的视觉测试项。从命名可见该测试属于视觉 OCR 文档测试相关内容并与已有的视觉细节、多图、图像描述、分批处理、视觉文本等测试一同被纳入视觉测试范围。十一、发布回归测试调整在integration/reg_release_test.go文件中发布回归测试也进行了调整。原有固定注册的测试项中包含image-generation该项在本次变更中被移除。原有固定测试列表中涉及的内容包括create-safetensors create-gguf quantization image-generation更新后固定列表不再包含image-generation。与此同时发布回归测试新增了以下注册调用registerVisionOCRDocumentCases(testModels(releaseVisionModels))该调用用于为releaseVisionModels注册视觉 OCR 文档测试用例。更新后的模型参数化测试注册内容包括registerVisionTextCases(testModels(releaseVisionTextModels))registerToolCases(testModels(releaseToolsModels))registerToolStressCases(testModels(releaseToolsModels))registerVisionOCRDocumentCases(testModels(releaseVisionModels))registerAudioTranscriptionCases(testModels(releaseAudioModels))因此发布回归测试的调整包括两个明确部分固定测试列表中移除image-generation面向releaseVisionModels新增视觉 OCR 文档测试注册十二、新增 vision_ocr_test.go 测试文件本次更新新增了integration/vision_ocr_test.go文件。该文件的变更统计为166 行新增 0 行删除结合integration/reg_groups_test.go中新增的vision-ocr-document以及integration/reg_release_test.go中新增的registerVisionOCRDocumentCases调用可以看到视觉 OCR 文档测试已被加入集成测试和发布回归测试相关范围。十三、4 次提交记录v0.32.8 的变更对比中显示共有 4 次提交。2026年8月10日的提交Release v0.32.7提交编号 176462026年8月11日的提交docs: add VS Code context length guidance提交编号 17610docs: require VS Code 1.127提交编号 17655llama.cpp update提交编号 17659其中VS Code 上下文长度说明、VS Code 1.127 最低版本要求以及 llama.cpp 版本更新均对应本次 v0.32.8 的变更内容。十四、v0.32.8 更新内容汇总代码地址github.com/ollama/ollamaOllama v0.32.8 的内容可以归纳为以下几点Muse Glimmer 已在全部平台可用Muse Glimmer 新增 NVIDIA、AMD 和更多平台支持Muse Glimmer 可通过ollama run muse-glimmer在本地下载并运行Muse Glimmer 可与 Claude Code 配合使用Muse Glimmer 可与 Pi 配合使用Muse Glimmer 可与 OpenClaw 配合使用Muse Glimmer 可与 Hermes 配合使用Ollama MLX 引擎在 Apple Silicon 上支持 Muse GlimmerOllama 0.32.7 已支持 DFlash 和图像输入llama.cpp 版本从 b10242 更新至 b10353VS Code 最低版本要求由 1.120 提升至 1.127文档指出较早版本 VS Code 无法可靠取消语言模型提供商请求本地模型在 VS Code 中使用时Ollama context length 应设置为至少 64kWindows CUDA 下载流程增加最多 3 次的重试机制每次 CUDA 下载失败后非最终失败场景会等待 15 秒再重试视觉测试新增vision-ocr-document发布回归测试新增视觉 OCR 文档测试注册固定发布回归测试列表中移除image-generation新增integration/vision_ocr_test.go包含 166 行新增内容整体来看v0.32.8 围绕 Muse Glimmer 的全平台支持展开同时补充了 VS Code 本地模型上下文长度配置说明更新了 llama.cpp 版本并将视觉 OCR 文档测试纳入集成测试与发布回归测试范围。

相关新闻

使用vcpkg管理C++依赖:从OpenCV4安装到项目集成实战

使用vcpkg管理C++依赖:从OpenCV4安装到项目集成实战

2026/8/12 12:19:49

1. 项目概述:为什么选择vcpkg来管理你的C依赖如果你在Windows、Linux或者macOS上搞过C项目,尤其是涉及到像OpenCV这种重量级的第三方库,那你一定对“依赖地狱”这个词深有体会。下载源码、配置CMake、解决各种缺失的系统库(比如Wi…

2026-08-12:统计下标的相反奇偶性得分。用go语言,给定一个整数数组,需要为数组中的每个位置计算一个分数。这个分数等于:在当前索引右侧的所有元素中,与当前元素奇偶性不同(即一个是奇数,另一个是

2026-08-12:统计下标的相反奇偶性得分。用go语言,给定一个整数数组,需要为数组中的每个位置计算一个分数。这个分数等于:在当前索引右侧的所有元素中,与当前元素奇偶性不同(即一个是奇数,另一个是

2026/8/12 12:19:49

2026-08-12:统计下标的相反奇偶性得分。用go语言,给定一个整数数组,需要为数组中的每个位置计算一个分数。这个分数等于:在当前索引右侧的所有元素中,与当前元素奇偶性不同(即一个是奇数,另一个…

Windows 10下OpenClaw与DeepSeek集成开发指南

Windows 10下OpenClaw与DeepSeek集成开发指南

2026/8/12 12:19:49

1. OpenClaw与DeepSeek集成概述OpenClaw作为一款新兴的本地化AI开发框架,近期在技术社区引发了广泛讨论。它最大的特点在于能够将各类AI模型以标准化接口形式接入到本地开发环境中。而DeepSeek作为国产大模型的代表产品,其V4版本在代码生成和自然语言处理…

IHP SG13G2开源PDK终极指南:免费掌握130nm芯片设计的完整方案

IHP SG13G2开源PDK终极指南:免费掌握130nm芯片设计的完整方案

2026/8/12 15:49:59

IHP SG13G2开源PDK终极指南:免费掌握130nm芯片设计的完整方案 【免费下载链接】IHP-Open-PDK 130nm BiCMOS Open Source PDK, dedicated for Analog, Mixed Signal and RF Design. Documentation is here: 项目地址: https://gitcode.com/gh_mirrors/ih/IHP-Open-…

InstantID插件实战:零训练实现Stable Diffusion角色一致性生成

InstantID插件实战:零训练实现Stable Diffusion角色一致性生成

2026/8/12 15:49:59

1. 项目概述:InstantID如何重塑角色一致性在AI绘画的浪潮里,Stable Diffusion以其强大的开源生态和可控性,成为了无数创作者和开发者的首选工具。然而,一个长期困扰我们的核心难题是:如何让AI在生成不同场景、不同姿态…

彻底解决生产环境偶发连接失败:TCP单边无效问题深度排查与优化

彻底解决生产环境偶发连接失败:TCP单边无效问题深度排查与优化

2026/8/12 15:49:59

最近在开发圈里,一个看似小众但实则影响深远的“玄学”问题被频繁提起:为什么我的服务在本地测试一切正常,一上生产环境就出现偶发性、难以复现的失败?日志里只留下一句模糊的“连接超时”或“请求被拒绝”,排查起来如…

Oracle 数据库连接认证方式详解

Oracle 数据库连接认证方式详解

2026/8/12 15:49:59

1. 配置文件位置 sqlnet.ora 文件位于 Oracle 安装目录的以下路径: $ORACLE_HOME/network/admin/sqlnet.ora2. 连接数据库的认证方式 SQLNET.AUTHENTICATION_SERVICES 参数用于指定连接数据库时的认证方式。 2.1 参数值说明 ALL 含义:允许所有认证方式配…

AI音视频技术演进:从信号处理到语义理解,重塑实时交互新范式

AI音视频技术演进:从信号处理到语义理解,重塑实时交互新范式

2026/8/12 15:49:59

1. 从“能听见”到“能听懂”:AI如何重塑音视频交互的底层逻辑最近和几个做社交、在线教育、远程协作产品的朋友聊天,大家不约而同地提到了一个共同的痛点:音视频通话的“天花板”似乎到了。过去十年,我们解决了“能不能通”的问题…

从零构建运动员职业生涯数据分析ETL管道:Python实战指南

从零构建运动员职业生涯数据分析ETL管道:Python实战指南

2026/8/12 15:39:59

在实际体育竞技和数据分析场景中,我们常常需要处理运动员的赛事数据、成绩波动以及公众舆论情感分析。这类数据往往结构复杂、来源多样,且蕴含着丰富的业务逻辑。以乒乓球项目为例,一位运动员的职业生涯数据可能包括历年比赛成绩、技术统计、…

比较好的亚太EMBA,问了6位校友师资差别真的挺大

比较好的亚太EMBA,问了6位校友师资差别真的挺大

2026/8/12 7:11:29

比较好的亚太EMBA核心差异先看什么?对于希望兼顾工作与系统管理能力提升的亚太区高管而言,筛选匹配度高的EMBA项目时,师资配置是决定学习体验与实际收获的核心要素之一。我们结合3-4个公开信息透明、办学历史较长的亚太区主流EMBA项目特点&am…

备考3个月对比6份资料 海外游学的亚洲EMBA面试注意点

备考3个月对比6份资料 海外游学的亚洲EMBA面试注意点

2026/8/11 8:44:43

备考海外游学的亚洲EMBA面试,核心要围绕项目国际化设计逻辑、个人跨文化管理经验匹配度两个维度准备,避免把游学模块等同于普通旅游参访的认知偏差。不少备考者花3个月对比6份资料,却容易忽略面试官对“国际视野落地能力”的考察——比如香港…

比较好的国内EMBA,问了二十位校友聊透人脉价值

比较好的国内EMBA,问了二十位校友聊透人脉价值

2026/8/11 15:57:54

比较好的国内EMBA核心差异体现在哪些方面?比较好的国内EMBA的核心长期价值,很大程度上依托于校友网络的连接质量与资源生态的活跃度,这也是不少高管在择校时优先考量的因素。我们结合3-4个市场关注度较高的项目公开信息,从课程、师…

告别模组冲突!5步掌握《神界:原罪2》模组管理的终极秘诀

告别模组冲突!5步掌握《神界:原罪2》模组管理的终极秘诀

2026/8/12 9:39:37

告别模组冲突!5步掌握《神界:原罪2》模组管理的终极秘诀 【免费下载链接】DivinityModManager A mod manager for Divinity: Original Sin - Definitive Edition. 项目地址: https://gitcode.com/gh_mirrors/di/DivinityModManager 你是否曾经为《…

如何用Charge Limiter延长MacBook电池寿命:终极保护指南

如何用Charge Limiter延长MacBook电池寿命:终极保护指南

2026/8/12 9:39:37

如何用Charge Limiter延长MacBook电池寿命:终极保护指南 【免费下载链接】charge-limiter macOS app to set battery charge limit for Intel MacBooks 项目地址: https://gitcode.com/gh_mirrors/ch/charge-limiter 还在为MacBook电池健康度下降而烦恼吗&am…

推三返一模式5.0版本系统开发

推三返一模式5.0版本系统开发

2026/8/12 9:39:37

推三返一模式5.0版本系统开发要点编辑:araolin(私域邦网络土土哥)模式核心逻辑 推三返一是一种促销或分销机制,用户推荐三人完成特定行为(如购买、注册),推荐人可获得返利或奖励。5.0版本通常在…

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

2026/8/8 5:07:31

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…

导师推荐!2026最新AI论文工具测评与实用推荐

导师推荐!2026最新AI论文工具测评与实用推荐

2026/8/9 13:42:46

2026年真正好用的AI论文工具,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

告别游戏崩溃:XCOM 2模组管理器的智能革命

告别游戏崩溃:XCOM 2模组管理器的智能革命

2026/8/8 2:30:15

告别游戏崩溃:XCOM 2模组管理器的智能革命 【免费下载链接】xcom2-launcher The Alternative Mod Launcher (AML) is a replacement for the default game launchers from XCOM 2 and XCOM Chimera Squad. 项目地址: https://gitcode.com/gh_mirrors/xc/xcom2-lau…