OCR、版面、语义 🇨🇳
liustack/modlens
🎨 前端开发 · 用 TypeScript 写的
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。
✨ AI 亮点解析
📦 是什么
给纯文字AI模型外挂眼睛看图片的插件
🩹 解决什么
纯文本AI看不懂图片,没法处理截图和文档
🎯 适合谁
用DeepSeek写代码、想学AI的小白
暂无对标
🛠 上手成本:需装 Docker 或依赖(中等)
⚠️ 依赖第三方:需接入视觉模型API才能识别图片,可能要自己配Key
- 粘贴图片就返回结构化JSON结果
- 能识别文字、版面布局和语义
- 支持DeepSeek、GLM等纯文本模型
- 浏览器插件形态,装完即用
你给AI发张截图或文档照片,它就能看懂里面的文字和排版,帮你提取信息、整理内容,像给AI配了副眼镜。