DC娱乐网

Ollama v0.32.14:本地跑多模态模型,WebP 图片不再是坑 用本

Ollama v0.32.14:本地跑多模态模型,WebP 图片不再是坑
用本地模型看图的同学,大概率踩过这个坑:从网上下载的图片动不动就是 WebP 格式,喂给本地多模态模型,直接报不支持。要么手动转格式,要么写脚本批量处理,烦得很。

昨天发布的 v0.32.14,把这个问题修了。

WebP 图片自动转码

这次更新最重要的一条:llm 模块现在会自动把 WebP 图片转码,再传给 llama-server(Ollama 底层的推理服务)。

WebP 是谷歌推出的图片格式,压缩率高,网页上用得越来越多,但不少老工具不认它。以前想在本地模型里用 WebP 图片,得自己想办法——用 Pillow 之类的库先转成 PNG,再喂给模型。现在底层自动搞定,传图片就行,不用管格式转换。

这对处理网页素材的人来说尤其有用。Chrome 保存网页图片默认就是 WebP,没有这层转码,每次都得先手动处理一遍。

qwen 系列放宽消息顺序限制

第二条更新针对 qwen 系列模型的渲染器:现在能容忍 system 消息不在对话最开头。

懂提示词工程的人知道,很多模型对消息顺序敏感,system 指令通常要求放在最前面。但实际使用中,多轮对话、工具调用场景里,消息顺序经常不受控制。以前 qwen 模型遇到 system 消息不在开头,可能报错或者忽略指令。这次放宽了限制,容错性好多了。

小版本才是日常体验的功臣

很多人看 Ollama 更新,只盯大版本和新模型支持。但 v0.32.14 这种小版本,恰恰是最影响日常体验的。大版本更新意味着"多了一个新能力",小版本更新则是"原本别扭的地方变顺了"。WebP 转码和消息顺序容错,都属于后者。

这类改动不会出现在宣传文案里,但天天用本地模型的人,心里有数。如果你之前因为 WebP 图片卡过,升级到 v0.32.14 再试试,省掉那些转格式的重复劳动。