Ollama v0.35.1 发布,支持 Cloudflare Clef 决策模型与多模态输入
Ollama 发布 v0.35.1,通过 /v1/systemone 接口支持 Cloudflare 新开源决策模型 Clef(27B)与 Clef Flash(9B),两者均为多模态,可在请求中同时传入图像与文本状态并联合评分。
推荐理由:Ollama 新增 Cloudflare 开源决策模型支持与多模态图像输入,并扩展联网搜索次数与 Modelfile 能力声明。
Ollama 发布 v0.35.1,通过 /v1/systemone 接口支持 Cloudflare 新开源决策模型 Clef(27B)与 Clef Flash(9B),两者均为多模态,可在请求中同时传入图像与文本状态并联合评分。
推荐理由:Ollama 新增 Cloudflare 开源决策模型支持与多模态图像输入,并扩展联网搜索次数与 Modelfile 能力声明。
NVIDIA 宣布本月起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商推出搭载 64GB 统一内存的 DGX Spark,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈。
推荐理由:64GB 统一内存版本把本地智能体推理门槛降到 4999 美元,双机集群可扩展至 200B 参数模型。
Ollama 发布 v0.35.1-rc2 候选版本,该提交在 GitHub 上创建并通过签名验证。此版本主要修复了 CI 中缺失构建上下文的问题(#18742)。
Ollama 发布 v0.35.1-rc1,该版本在 models 模块新增 clef 支持(#18741)。提交 e4c0d18 已通过 GitHub 签名验证,具体性能指标与获取方式原文未披露。
Ollama 发布 v0.35.0,新增基于 TypeSafe Jev API 的决策模型支持,通过 /v1/systemone 接口返回选项、概率与分数而非文本。
推荐理由:Ollama 新增决策模型接口,以概率与置信度输出替代文本生成,可用于工单分流与模型路由等分类任务。
Ollama 发布 v0.35.1-rc0,为 Modelfile 新增 CAPABILITY 声明,并在 create 请求中加入可叠加的 capabilities 字段,该声明可在 GGUF 与 safetensors 的创建、继承及 Modelfile 导出过程中保留。
Ollama 发布 v0.35.0-rc1。该版本为 mlx 的拉取停滞重试设置上限,并允许看门狗中断这些重试(#1…)。版本已在 GitHub 打标签,提交 cc40693 通过签名验证。
Ollama 发布 v0.35.0-rc0,新增 System One 评分 API(#18606)。该版本为候选发布版,提交 ffb6f22 已通过 GitHub 签名验证。
Ollama 发布 v0.40.0-rc0 预发布版本,在 Apple Silicon 设备上,MLX 运行时支持的模型架构将自动改用 MLX 执行。该版本通过 ollama pull qwen3.8 与 ollama run qwen3.8 即可拉取并运行对应模型,预发布期间还将测试并启用更多模型。
推荐理由:Ollama 在 Apple Silicon 上默认切换到 MLX 运行时,为本地模型推理提供新的执行后端路径。
Ollama 发布 v0.34.4,思考模型的结构化输出改为单次处理,速度更快、更可靠。该版本修复了本地模型库较大时偶发的“model not found”错误。