Best · 精选
DSH 图片搜索插件推荐
跨 Google Lens、百度、Yandex、TinEye 的反向图片搜索,以及 DeepSeek Harness 的图像理解能力。
Editor's pick
Ranking
工具与能力类插件排行
01805,900 下载/月02800 下载/月03800 下载/月04800 下载/月05800 下载/月06400 下载/月07800 下载/月08800 下载/月09800 下载/月10800 下载/月11800 下载/月12800 下载/月13800 下载/月14800 下载/月15800 下载/月16800 下载/月17800 下载/月18800 下载/月19800 下载/月20800 下载/月21800 下载/月22400 下载/月23800 下载/月24800 下载/月25800 下载/月26400 下载/月27800 下载/月28800 下载/月29800 下载/月30800 下载/月31400 下载/月32400 下载/月33400 下载/月34800 下载/月35800 下载/月36800 下载/月37800 下载/月38800 下载/月39800 下载/月40800 下载/月41800 下载/月42800 下载/月
liustack/modlens
为纯文本模型架起视觉桥梁:粘贴图片,输出结构化 JSON 证据(OCR、版面、语义)。
MicroHEROX/dsh-unsloth-hands
把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地运行的 Unsloth Desktop(Unsloth Studio)服务器:unsloth_run 与 unsloth_vision 两个工具,纯 HTTP 客户端,不拉起也不持有任何进程。
GodD6366/dsh-sub2api
将 sub2api 网关接入 DeepSeek Harness:用一个 base URL 统一管理 OpenAI / Claude / Grok / Gemini 等多供应商路由,支持按 key 发现模型、用量查询与全局视觉/图像生成工具。
jyh20030112/dsh-visual-plugin
给纯文本模型装上眼睛:把用户图片转发给任意 OpenAI 兼容的视觉模型生成描述,并在 Web UI 右侧面板展示结果。
akqwpeter-prog/dsh-media-skills
面向纯文本模型的免费视觉桥与生图:粘贴读图、GLM-4V-Flash 与 Gemini 引擎故障转移、modlens 同款结构化证据输出,并自动播种免费视觉模型路由。
ConsoleSun/Gemini-Eyes
接入 gemini.google.com 的 MCP 桥:图片/视频视觉识别、Imagen 生图、Veo 生视频与历史对话管理,复用浏览器登录态,无需 API Key。
Jamailar/beav-deepseek-harness
将 DSH 连接到本机 Beav 桌面应用,用于可恢复的自媒体内容、知识、图片、音频和视频任务,并保留审批与产物追踪。
ysr666/dsh-vision-router
为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。
moononnn/DeepSeek-Harness-biaoqingbao
表情包表达插件:让助手用表情包表达情绪,按情绪自动配图,含图库管理、AI 识图打标、方言口音、学我说话,还能点「和助手聊聊」直接调教标签。
Flyvhidbwo/dsh-vision-proxy
DeepSeek 大脑 + 自动识图:GUI 附加的每张图片自动经 OpenAI 兼容 VLM 转译成文字,再交给纯文本的 DeepSeek 作答——默认走免费匿名端点(零配置),填自己的 key 可启用付费快速通道(qwen3.7-flash,支持 DashScope/智谱/Ollama/OpenRouter)。
Einskyle/dsh-llm-vision-bridge
DeepSeek 视觉桥接:注册原生 LLM provider,聊天内粘贴的图片自动由视觉模型(pi-ai/llama.cpp 上的 Qwen3-VL)转成文字描述后交给纯文本 DeepSeek 作答——图片准入、路由与会话压缩全部走 harness 原生机制,带 LRU 描述缓存与 503 重试。
kw78/dsh-office-tools
面向 agent 的工作区安全 Office 工具集:创建/读取 Word、创建/读取/更新 Excel、创建/读取 PowerPoint,并支持 PNG/JPG/GIF 图片排版。
wulusai2333/mimo-vision
`describe_image` 视觉桥:经 opencode Zen API(凭据 `OPENCODE_GO_API_KEY`,免费线路优先、付费兜底)把图片发给 mimo-v2.5、返回文字描述给纯文本模型,原生格式直发,SVG/TIFF/HEIC 等格式经 ImageMagick 自动转码。
LeemanCheung/dsh-image-gen
GPT Image 2 `image_gen`:默认复用 Codex 订阅 OAuth,也可显式使用 API Key;显影卡片、最多 3 张 API 实时局部图、持久附件回放/灯箱/下载、纯文本模型输出和受限的凭据安全请求。
siegfly/dsh-deepseek-vision
视觉语言网关:注册支持图片输入的 DeepSeek provider 路由,图片先由可配置 VL 模型(默认 Qwen-VL)描述成文字再发送。
YZz-S/dsh-bili-summary
提供 bili_summary 工具:B 站视频元数据、字幕时间轴与 sharp 切帧配图,内置错误处理与优雅降级。
1na-ko/dsh-hdc-bridge
鸿蒙设备桥:hdc 截图/装包/日志/崩溃/UI 自动化闭环(配 read_image 看图),官方优先版本化 API 知识层(SDK .d.ts + 离线随包文档),以及 DevEco CLI 构建/签名/lint 通道。
shinjiyu/dsh-plugin-multimodal
在纯文本 DeepSeek 线路上开放贴图准入,用视觉 sidecar 把附件转成文字,原生视觉模型不改写。
kaixinbaba/dsh-vision-recognizer
视觉模型路由:把附加图片经可配置模型(15+ OpenAI 兼容与 Anthropic 供应商)转译为文字,对话仍由 DeepSeek 作答。
ZEM17/dsh-subagent-agy
把 Google Antigravity CLI(agy)接入 DSH 作为产品子代理:用 Antigravity 登录态(无需 API key)委托 Gemini 编程智能体干活,支持对话续聊、后台流式进度、按路径识图与自动弹出登录窗口。
MicroHEROX/dsh-koboldcpp-hands
给在线模型装上本地双手:koboldcpp_run 与 koboldcpp_vision 工具把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地 KoboldCpp(llama.cpp)服务器,并按需拉起与管理服务器生命周期。
GOU-GEE/deepseek-vision#plugins/dsh-plugin-deepseek-vision
面向纯文本 DeepSeek 的视觉 MCP + DSH 插件:analyze_image / analyze_clipboard / compare_images / vision_status 四个工具、可视化配置页、默认免费 GLM-4.6V-Flash、结果缓存与限流容错,Key 不入日志。
WNJXYK/dsh-codex-oauth
在 DeepSeek Harness 中使用 ChatGPT/Codex 订阅接入 GPT 模型、图像生成与 Web 搜索,并支持订阅额度显示、模型与功能控制,以及浏览器或设备码 OAuth 登录。
linenxi-ctrl/dsh-vision
外挂识图插件:鲸鱼按钮配置面板、图片识图自动回传、模型自主截图识图工具。
HuanLinOTO/dsh-plugin-mineru
向模型暴露 MineRU 文档解析工具。
PicGo/dsh-plugin
通过 PicGo 已有配置(PicGo Cloud、GitHub、S3、腾讯云 COS、七牛,或任意已安装的上传插件)把本地图片和文件上传到图床,提供 `picgo_upload` 工具与 `/picgo` 命令。
ximengxiaolan/dsh-vision-bridge
输入框贴图自动识别:由 OpenAI 兼容视觉模型转成文字描述后,再交给纯文本 DeepSeek 模型处理。
gloryxpnv/dsh-tool-vision
本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。
Elohia/dsh-plugin-mm-vision
通感编码器(Synesthesia Encoder):调用视觉模型把图片翻译成紧凑的结构化空间文字(画布/元素/百分比坐标),让纯文本 LLM 获得像素级看图能力(`mm_vision` 工具)。
corrinehu/dsh-chat-imagine
通过已配置的 OpenAI 兼容生图模型或本机 MiniMax CLI,在 DeepSeek Harness 对话中生成并展示图片。
Johnny-xuan/dsh-paste-to-path
为图片、文档、压缩包、代码及其他文件提供路径附件 Dock,文件读取交由 Agent 的当前可用工具完成。
TZHR-invest/dsh-plugins#dsh-vision-tool
Agent 可调用的视觉工具:通过你配置的任意 OpenAI 兼容视觉端点描述本地图片,支持多模型交叉核对,不内置任何密钥。
lsjspl/dsh-plugin-grok2api-media-tool
让 dsh 通过 grok2api 的 API 获得生成图片与视频能力。
good-boy4069/dsh-vision-guard
纯文本路由的透明图片护栏:贴图不再 400 卡死会话,附带 vision_analyze 工具(OCR/PDF/docx/pptx/视频)。
Anionex/dsh-vision-toolkit
让纯文本模型更好地做视觉任务:带意图的图片问答、长截图 OCR、UI 还原等。
zimai233/dsh-image-search
多引擎反向识图聚合:Google Lens、百度、Yandex、TinEye、SauceNAO、IQDB、Ascii2d。
54xkeee/dsh-youreyes
纯文本 DeepSeek 的识图工具包:模型可主动调用的 `vision` 工具、deepseek/opencode-go 包装适配器(v4 flash/pro)、反重力额度(默认,flash/pro)/ 任意 OpenAI 兼容 VLM / Gemini / 本地 Ollama 通道、证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。
SPYQWER1/dsh-codex-tools
基于 Codex 的 `web_search`、`image_gen` 与 `image_vision` 工具,复用 ChatGPT OAuth 登录态为 DeepSeek Harness 提供网页搜索、生图与识图能力。
NagasakiSoyo-ui/dsh-llm-deepseek-vision
视觉增强的 DeepSeek 适配器:由视觉模型把图片描述成文字,纯文本 DeepSeek 模型再基于描述推理。
franksong2702/dsh-codex-connect
通过 ChatGPT OAuth 将 OpenAI Codex 模型接入 DeepSeek Harness,并提供可选的搜索与图片工具。
xiaozhe7772222/dsh-draw-router
DeepSeek Harness 统一生图路由:自动识别任意 OpenAI 兼容端点的绘图模型(商汤、阶跃、Agnes、千问、Flux、SD、Imagen 等),提供 Agent 工具与 REST API。
niyongsheng/free-vision-skill
基于 macOS Vision Framework 的全本地识图插件:`ocr_image`(文字提取,表格结构+坐标)与 `view_image`(场景/人脸/二维码);web 输入框可直接粘贴多张图片,图片永不离开你的 Mac。
查看全部工具与能力类插件 工具与能力,回到排行榜 dshplugins.cc。