SEMANTIC DIRECTORY · plugin-directory-semantic-v3-18

图像理解与分析

让模型理解已有图片内容并输出语义结果:图像描述、视觉问答、截图或界面分析、物体与场景识别、图像比较及视觉模型桥接。不含以文字提取为核心的 OCR、确定性图像处理、屏幕采集与图像生成。

使用关键词搜索
来源目录 discovery.composite.2026-09-06.v1-0-5.b92b985e31df规范结构 · 823 个节点 · 14829 个插件

叶子目录成员

51 个插件

dsh-pseudo-visionDDDFXYqiming/dsh-pseudo-vision目录 已分析Local OCR, color-statistics, pixel-scan, and metadata bridge for text-only DeepSeek Harness models; no external vision API.视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号3 starsdsh-read-imageOoWJZZoO/dsh-read-image目录 已分析A plug-and-play image-reading plugin for DeepSeek Harness. After installation, DSH will no longer refuse to feed images into sessions with pure-text models; instead, the image will be mapped as [Image #N] in the session. The Agent can then invoke tools on its own to read images from the session or from specified paths.视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号2 starsdsh-Sightcransmathenia666-hash/dsh-Sight目录 已分析Give text-only DeepSeek Harness (dsh) agents vision — pasted images auto-convert to text descriptions with persistent caching, each image converted only once.视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号1 starsdsh-tool-visiongloryxpnv/dsh-tool-vision目录 已分析本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号2 starsdsh-tool-vision-readMappedinfo/dsh-tool-vision-read目录 已分析DSH plugin: vision_read — route image reading to a dedicated vision model (e.g. Kimi K3) so text-only agents can see images视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号2 starsdsh-view-imagejohnoooooo/dsh-view-image目录 已分析让 dsh 用独立的 OpenAI 兼容视觉模型读图:纯文本路由下粘贴图片自动改写为附件标记,聊天流内联显示图片(右对齐缩略图/点击放大/复制/拖拽),主对话历史只保留纯文本描述视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号0 starsdsh-visionjoyiok/dsh-vision目录 已分析DSH plugin: image_analyze tool that sends screenshots/photos to an OpenAI-compatible vision model视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号0 starsdsh-vision-bridgeXieweikang123/dsh-vision-bridge目录 已分析Give a text-only dsh model eyes: pasted images recognized into text via an OpenAI-compatible vision endpoint.视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号1 starsdsh-vision-bridgeTwistedRiCen/dsh-vision-bridge目录 已分析DSH-native Vision Evidence bridge for text-only reasoning models with native image attachments and strict multi-image validation.视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号1 starsdsh-vision-guarddsh-vision-guard目录 已分析纯文本路由的透明图片护栏:贴图不再 400 卡死会话,附带 vision_analyze 工具(OCR/PDF/docx/pptx/视频)。视觉与多模态npmGitHub兼容性DSH 0.1.2-rc.1 · web依赖审计有限审计报告 0 项制品0.1.3证据更新2026-09-07公开信号1 stars · 785 downloadsdsh-vision-helperYuuz12/dsh-vision-helper目录 已分析DeepSeek Harness Vision Helper/DeepSeek Harness 视觉辅助方案视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号2 starsdsh-vision-ocrwangxiang0605qvq/dsh-vision-ocr目录 已分析DSH 图片识别插件:输入框一键选图发送识别请求(需自备支持图像输入的模型与 API Key)视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号0 starsdsh-vision-pluginbug-huntter/dsh-vision-plugin目录 已分析为纯文本 DSH 模型增加可配置识图能力:开启后图片消息先由任意 OpenAI 兼容视觉模型转写为文字描述,再交给主模型处理;设置页可配置 Base URL、Model ID 与密钥。视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号暂无公开使用信号dsh-vision-pluginzcma11/dsh-vision-plugin目录 已分析DeepSeek Harness plugin: upload/paste images; on send transcribe via a vision model (DashScope) or offline Windows OCR. 用deepseek-harness做的,Made with the DeepSeek-harness.视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号0 starsdsh-vision-pluginwoyeshishen/dsh-vision-plugin目录 已分析DSH plugin from woyeshishen/dsh-vision-plugin视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号2 starsdsh-vision-pluginld-1101/dsh-vision-plugin目录 已分析让纯文本模型也能看图:发图自动用视觉模型描述(默认提示词),描述不足时对话模型自动生成更具体的提示词重新解析;系统模型/自定义双模式 + GUI 可视化配置、Key 脱敏安全、针对 DSH 0.1.0-rc.6 的宿主小补丁(见仓库 README)。视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号1 starsdsh-vision-routerdsh-vision-router目录 已分析为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。视觉与多模态npmGitHub兼容性DSH 0.1.2-rc.1 · web依赖审计有限审计报告 1 项制品2.1.2证据更新2026-09-06公开信号1070 stars · 51307 downloadsdsh-vision-skillGingerate/dsh-vision-skill目录 已分析让 DSH 里任何模型(包括 DeepSeek 纯文本模型)都能识别图片:识图技能 + 幂等宿主补丁,装上即用 / Let every DSH model see images: vision skill + idempotent host patch.视觉与多模态GitHub兼容性DSH 0.1.2-rc.1 · web依赖审计未测试制品未解析证据更新2026-09-10公开信号0 stars

分类属于公开语义索引事实,不是最终推荐;兼容性、权限与来源证据仍需分别核对。