ppt-analysis
仓库创建 2026年4月14日最近提交 3 天前SkillHot 收录 20 天前
▸ 精选理由
便于将幻灯片批量结构化为可检索数据,并支持旧 .ppt 转换流程。
▸ 风险提示
旧 .ppt 转换可能依赖 libreoffice 等外部工具
这个 Skill 做什么
全量解析 .pptx/.ppt 幻灯片,提取文本、表格、图表与图片说明。
把 PPT(.pptx/.ppt)里的每页内容拆解成结构化数据:文本、表格、图表、图片说明甚至纯图片页的识别都能提取。适合做演示稿内容迁移、批量审查或把幻灯片内容转成报告、数据库时用。能同时识别图表标签和图片说明,比只抓文字要全面。
▸ 展开 SKILL.md 英文原文
PPT (.pptx/.ppt) 全量解析。覆盖:所有 slide 文本/表格/图表提取、嵌入图片 caption、纯图片 slide 渲染识别、数据标签提取。
4.8k
Stars
331
Forks
40
仓库内 Skill
+141
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-non-spreadsheet-analysis/capability/ppt-analysis/SKILL.md或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-non-spreadsheet-analysis/capability/ppt-analysis/SKILL.md"SKILL.MD 节选查看完整文件 ↗
# PPT Analysis — .pptx / .ppt
## Environment
```python
from pptx import Presentation
from pptx.util import Inches
import os, subprocess, json
# python-pptx is available
# For .ppt (old binary format): convert via libreoffice
def load_pptx(path):
if path.lower().endswith('.ppt'):
import subprocess
out_dir = os.path.dirname(path)
subprocess.run(
['libreoffice', '--headless', '--convert-to', 'pptx', '--outdir', out_dir, path],
check=True, capture_output=True
)
path = path.rsplit('.', 1)[0] + '.pptx'
return Presentation(path), path
```
---
## Core Method 1: Full Text Extraction (ALL slides)
```python
def extract_all_slvia SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有