sn-da-image-caption
便于从截图/图表/流程图中提取数据用于后续分析。
处理图片可能包含敏感信息;本地模型可能需 GPU 或额外依赖。
将图片转为文本描述并解析为结构化表格,支持导出与可视化。
把图像(图表、表格、截图、流程图)自动“读”成文字描述,再把描述解析成结构化表格(DataFrame),还能导出 Excel/CSV 或重绘可视化。用在你需要从图片里提取数据、做 OCR 或把图表数值化时,支持常见图片格式并能生成可分析的数据表。特色是配套 caption 脚本和视觉模型链路,专注于数据提取与可视化,不做图片美化或生成。
▸ 展开 SKILL.md 英文原文
图片理解与数据提取 skill。当图片文件(.png/.jpg/.jpeg/.gif/.webp/.bmp)是主要输入且用户需要理解、提取数据或分析图片内容时使用。提供预配置的 caption 脚本(scripts/caption.py),通过 vision 模型将图片转为文本描述,无需额外配置 API Key。覆盖:(1) 通过 scripts/caption.py 对图表/表格/截图/流程图进行 caption,(2) 将 caption 文本解析为结构化 DataFrame,(3) 基于提取数据重新生成可视化图表,(4) 导出为 Excel/CSV。**遇到以下任一情况就主动使用本 skill,不要自行猜测图片内容**:①用户出现触发词:图片分析 / 图表提取 / 表格识别 / OCR / 图片描述 / 截图分析 / 图表数据 / 提取图片中的数据 / 图片转表格 / 识别图片 / image caption / extract data from image / chart analysis / table OCR;②用户上传或指定了图片文件(.png / .jpg / .jpeg / .gif / .webp / .bmp)并要求理解、提取数据或分析内容;③任务需要从图表截图、表格截图、UI 截图、流程图中提取结构化信息;④用户要求将图片中的数据转为 Excel/CSV 或重新生成可视化图表。仅不用于:图片编辑(裁剪、滤镜、缩放)、图片生成、不含数据的风景/人物照片描述。
帮我安装这个 skill:https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-image-caption/SKILL.mdcurl -fsSL "https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-image-caption/SKILL.md"# Image Caption Analysis — 图片描述与数据提取 ## Overview Analyze, extract data from, or understand image files (.png, .jpg, .jpeg, .gif, .webp, .bmp). The core workflow: 1. Run `scripts/caption.py` to get a text description of the image 2. Parse the description into structured data (DataFrame, etc.) 3. Analyze, visualize, or export ## scripts/caption.py — Image Caption The script converts images to text descriptions via a vision model. Configure via `SN_API_KEY` (minimum required), or use `SN_VISION_API_KEY` / `SN_VISION_BASE_URL` / `SN_VISION_MODEL` for fine-grained control. See the project environment variable spec for the full fallback chain. ### Usage ```bash # Basic — get text descriptio