categorical-comparison-analysis

仓库创建 2026年4月14日最近提交 4 天前SkillHot 收录 20 天前
▸ 精选理由

快速产出分类差异分析图表,便于洞察类别分布与比例关系。

这个 Skill 做什么

对两类或多类分类数据进行数量/比例对比并生成可视化图表。

把两类或多类的分类数据拿来比数量和占比,然后画出直观的图表帮你看差异和趋势。适合做分组对比、用户分段或分类指标的可视化汇报。特点是既统计精确又能直接输出易读的可视化结果,方便快速判断哪个类别更重要。

▸ 展开 SKILL.md 英文原文

对两类分类数据进行对比分析,统计数量差异与比例关系并生成可视化图表。

数据与抓取分类对比计数统计可视化通用
4.8k
Stars
331
Forks
40
仓库内 Skill
+141
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-excel-workflow/capability/excel-data-analysis/comparison-analysis/SKILL.md
或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-excel-workflow/capability/excel-data-analysis/comparison-analysis/SKILL.md"
SKILL.MD 节选查看完整文件 ↗
# categorical-comparison-analysis

> This sub-skill covers one capability of the Excel workflow. For reading/counting/Parquet optimization, see the parent workflow SKILL.md.

Step1 读取文件并统计所有 sheet 的总行数,评估是否需要进行大文件优化处理。
```python
import pandas as pd
from pandas import read_excel
from pathlib import Path

# 统计所有 sheet 的行数以决定处理策略
file_path = "input_data.xlsx"
sheet_names = pd.ExcelFile(file_path).sheet_names
total_rows = 0
for sheet in sheet_names:
    # 仅读取行索引以快速计数
    df_tmp = read_excel(file_path, sheet_name=sheet, usecols=[0])
    total_rows += len(df_tmp)

print(f"Total rows across all sheets: {total_rows}")
```

Step2 提取对比维度的分类信息,执行数据清洗,包括去除空值、处理合并单元格填充以及排除非数据行。
```python
# 定义目标列名
target_
via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有