ppt-analysis

仓库创建 2026年4月14日最近提交 3 天前SkillHot 收录 20 天前
▸ 精选理由

便于将幻灯片批量结构化为可检索数据,并支持旧 .ppt 转换流程。

▸ 风险提示

旧 .ppt 转换可能依赖 libreoffice 等外部工具

这个 Skill 做什么

全量解析 .pptx/.ppt 幻灯片,提取文本、表格、图表与图片说明。

把 PPT(.pptx/.ppt)里的每页内容拆解成结构化数据:文本、表格、图表、图片说明甚至纯图片页的识别都能提取。适合做演示稿内容迁移、批量审查或把幻灯片内容转成报告、数据库时用。能同时识别图表标签和图片说明,比只抓文字要全面。

▸ 展开 SKILL.md 英文原文

PPT (.pptx/.ppt) 全量解析。覆盖:所有 slide 文本/表格/图表提取、嵌入图片 caption、纯图片 slide 渲染识别、数据标签提取。

办公文档PPT解析图表提取图片OCR表格抽取通用
4.8k
Stars
331
Forks
40
仓库内 Skill
+141
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-non-spreadsheet-analysis/capability/ppt-analysis/SKILL.md
或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-non-spreadsheet-analysis/capability/ppt-analysis/SKILL.md"
SKILL.MD 节选查看完整文件 ↗
# PPT Analysis — .pptx / .ppt

## Environment

```python
from pptx import Presentation
from pptx.util import Inches
import os, subprocess, json

# python-pptx is available
# For .ppt (old binary format): convert via libreoffice
def load_pptx(path):
    if path.lower().endswith('.ppt'):
        import subprocess
        out_dir = os.path.dirname(path)
        subprocess.run(
            ['libreoffice', '--headless', '--convert-to', 'pptx', '--outdir', out_dir, path],
            check=True, capture_output=True
        )
        path = path.rsplit('.', 1)[0] + '.pptx'
    return Presentation(path), path
```

---

## Core Method 1: Full Text Extraction (ALL slides)

```python
def extract_all_sl
via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有