GitHub 热搜 小白版
← 返回榜单

OCR、版面、语义 🇨🇳

liustack/modlens
★★★☆☆ 3.1/5 新手推荐度 · 中文项目 · 上手成本中等 · 热度适中 · 中文简介

🎨 前端开发  · 用 TypeScript 写的

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。
2792 热度
76 分支
+441 今日新增
去 GitHub 看看 ↗

✨ AI 亮点解析

📦 是什么
给纯文字AI模型外挂眼睛看图片的插件
🩹 解决什么
纯文本AI看不懂图片,没法处理截图和文档
🎯 适合谁
用DeepSeek写代码、想学AI的小白
暂无对标
🛠 上手成本:需装 Docker 或依赖(中等)
⚠️ 依赖第三方:需接入视觉模型API才能识别图片,可能要自己配Key
  • 粘贴图片就返回结构化JSON结果
  • 能识别文字、版面布局和语义
  • 支持DeepSeek、GLM等纯文本模型
  • 浏览器插件形态,装完即用
你给AI发张截图或文档照片,它就能看懂里面的文字和排版,帮你提取信息、整理内容,像给AI配了副眼镜。

📈 热度增长趋势