GitHub用户反馈
DeepSeek Harness 桌面客户端中多模态模型看图能力与视觉白名单配置不一致
用户在使用 DeepSeek Harness 桌面客户端时,已安装视觉模型并配置相关设置,但实际对话中模型仍被判定为不支持图片;多模态模型 kimi-k3 也自称无法看图,却能通过 inspect_image 工具读取图片信息。用户怀疑是视觉模型多模态白名单配置保存不上,因为输入白名单后刷新又变空。
查看原始信号github:zouyuxuan122/Deepseek-Harness-EAC
目标用户
使用 DeepSeek Harness 桌面客户端并希望让模型具备多模态看图能力的 AI agent 用户
潜在需求
用户需要一个视觉模型能力识别、白名单配置可靠保存并能真正让 agent 对话中使用图片的机制,而不是配置后不生效或模型能力与工具调用能力不一致。
发生场景
用户在 Deepseek-Harness-EAC 桌面客户端中安装了视觉模型,并尝试配置视觉模型多模态白名单,希望 agent 在对话中能直接处理图片;但实际使用 deepseek 模型时被系统提示不支持图片,使用本就多模态的 kimi-k3 看图时模型自称是文本模型看不了图片。
来源证据
用户已安装视觉模型,但使用 deepseek 模型时被告知不支持图片;多模态模型 kimi-k3 看图时自称文本模型看不了图片,却能成功调用 inspect_image 工具读取图片信息。
已安装视觉模型但告知此模型不支持图片 <img width="525" height="81" alt="Image" src="https://github.com/user-attachments/assets/f1dc1c08-34b5-4da6-9a0f-4028619ad3b4" /> 已安装完视觉模型,但使用deepseek模型时被告知此模型不支持图片, <img width="876" height="824" alt="Image" src="https://github.com/user-attachments/assets/8e797528-6b08-4fe5-8f48-9201a0985cf3" /> 用本就多模态的模型(kimi-k3)看图,被模型告知说他是文本模型看不了图片, <img width="1140" height="106" alt="Image" src="https://github.com/user-attachments/assets/401477e2-23c8-408a-a6a2-480ea09f2a98" /> 但是可以成功调取https://github.com/zouyuxuan122/Deepseek-Harness-EAC/issues/65
为什么值得留意
这不是简单的功能缺失,而是模型能力配置、多模态白名单持久化和工具调用三层之间的不一致:agent 明明能调用 inspect_image 读图,模型却说自己看不了图片。这种配置不生效的问题对 AI 客户端类工具很典型,反映出多模态能力发现与用户配置心智模型之间有缺口。
已有方案
- Deepseek-Harness-EAC 设置页可视化配置视觉模型与多模态白名单
未满足部分
- 视觉模型白名单输入后刷新即变空,疑似保存不上
- 系统对模型是否支持图片的判定与实际模型能力不一致
- 模型自称文本模型看不了图片,但 inspect_image 工具可成功读取图片信息
可能延伸 · 模型推测
- 自动探测并展示每个模型的实际多模态能力,替代手工白名单配置
- 白名单配置保存校验与失败提示,避免用户以为已保存
- 将 inspect_image 读取结果自动注入对话上下文,让模型基于图片内容作答
目前未知
- 无法确认该问题是客户端本身的 bug 还是官方 dsh 的限制
- issue 中图片内容未完整解析,无法确认错误提示的具体触发条件
继续核实
- 该白名单配置不生效的问题是否在多个用户、多平台上复现?
- 官方 deepseek-harness 是否也有相同的视觉模型白名单机制与保存问题?
- DeepSeek 系列模型当前是否真的不支持图片输入,还是客户端判定逻辑有误?
主题词
desktop client packagingagent harness plugin managementvision model whitelistportable app distribution