ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

graphify图像理解教程:从截图、流程图、白板照片中提取概念

2026/8/29 8:42:41 拓冰建站 浏览量
graphify图像理解教程:从截图、流程图、白板照片中提取概念 graphify图像理解教程从截图、流程图、白板照片中提取概念【免费下载链接】graphifyTurn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable knowledge graph. A /graphify skill for Claude Code, Cursor, Codex, and Gemini CLI: local deterministic AST parsing, every edge explained, no vector store.项目地址: https://gitcode.com/GitHub_Trending/graph/graphifygraphify 是一款开源知识图谱工具能把你的代码、文档、PDF 和图片一起变成可查询的知识图谱。这篇教程面向新手带你用 5 分钟上手 graphify 的图像理解能力把 UI 截图、流程图、白板照片提取成结构化的概念节点并与代码、文档连在同一个图里。30 秒安装两条命令开启图像理解先安装 CLI并把它注册到你的 AI 助手Claude Code、Cursor、Codex、Gemini CLI 等 20 平台都支持uv tool install graphifyy # 安装 CLI graphify install # 把 /graphify 技能注册给你的 AI 助手 注意PyPI 上的包名是graphifyy双 y命令仍是graphify。graphify 支持哪些图片截图、图表、白板都能读支持.png、.jpg、.webp、.gif四种格式。它做的是视觉理解而不只是 OCR——理解这张图是什么再转成图里的概念节点和关系边图片类型graphify 提取的内容UI 截图布局模式、设计决策、关键元素、用途数据图表指标名称、趋势与洞察、数据来源架构图 / 流程图各组件以及组件之间的连接关系白板 / 手写板板上的想法和箭头走向论文插图图所证明的结论、方法与结果白板照片和手写内容尤其值得注意模型对不确定的判读不会硬猜而是把该条关系标记为AMBIGUOUS待人工确认并在报告里单列出来。这种每条边都带置信度标签的设计细节可以在 docs/how-it-works.md 中查到。三步上手把截图和白板照片变成可查询的节点第一步 — 整理素材。把截图、流程图、白板照片和相关代码放进同一个文件夹例如raw/raw/ ├── architecture.png # 架构截图 ├── flow_diagram.jpg # 流程图 ├── whiteboard.jpg # 白板照片 └── auth.py # 相关代码第二步 — 一条命令建图。在 AI 助手中输入/graphify ./raw内部会走三条流水线代码由 tree-sitter 在本地做 AST 解析免费、无 API 调用图片进入视觉语义通道由模型看图并输出概念与关系。第三步 — 查看三个产物。完成后得到graphify-out/graph.html— 浏览器打开的交互图谱可点节点、过滤、搜索GRAPH_REPORT.md— 高亮内容核心概念、意外连接、建议提问graph.json— 完整图谱随时可查无需重读原始文件提取原理视觉理解、置信度与增量缓存几个值得了解的设计点提取规范见 graphify/skills/claude/references/extraction-spec.md节点可溯源从图片提取的概念节点带file_type: image标签source_file指向原图文件随时能追到这个概念来自哪张图。三级置信度EXTRACTED图中明确可见、INFERRED推断附 0–1 置信分、AMBIGUOUS不确定待复核。模型自动适配Claude、Gemini、OpenAI、Bedrock、Kimi 等视觉后端会直接发送图片像素不支持视觉的模型会自动降级为仅传文件路径避免垃圾数据进图。Ollama 本地推理可设置GRAPHIFY_OLLAMA_VISION1开启视觉。增量缓存每张图片按 SHA256 内容指纹缓存重复运行时未变化的图片直接跳过不重复消耗 token。图像视觉通道的实现与测试可参考 graphify/llm.py 和 tests/test_image_vision.py。效果验证查询与路径追踪建完图后就不用再翻文件了。试试这些命令graphify query 白板上画的鉴权流程涉及哪些组件 graphify explain RateLimiter graphify path 登录页 数据库项目内置了完整的图像理解实践worked/karpathy-repos/README.md 将 3 个代码仓库、5 篇 PDF 论文和 4 张图片训练损失曲线、计算图、决策边界图混合建图52 个文件最终让每次查询的 token 消耗比直接读原始文件降低 71.5 倍——图片节点与代码节点共同贡献了这个跨源网络。常见问题需要 API key 吗图片、文档、PDF 需要视觉模型理解在 IDE 里直接用助手会话的模型无头模式graphify extract需配置对应后端的 key。只想索引代码、跳过图片时用--code-only完全离线。隐私安全吗代码在本地解析不出机器图片会发送给视觉模型可用本地 Ollama 视觉模型保持数据不出内网无任何遥测。SVG 算图片吗SVG 本质是 XML 文本走文本通道而非像素视觉。超大图片怎么办超过大小上限的图片只生成引用节点、不发送像素每批次图片数量也有上限防止单次请求超限。 至此graphify 的图像理解就跑通了一条/graphify截图、流程图和白板照片就变成了可查询、可关联的概念节点——下次团队头脑风暴的白板也可以直接入库了。【免费下载链接】graphifyTurn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable knowledge graph. A /graphify skill for Claude Code, Cursor, Codex, and Gemini CLI: local deterministic AST parsing, every edge explained, no vector store.项目地址: https://gitcode.com/GitHub_Trending/graph/graphify创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考