categorical-comparison-analysis
仓库创建 2026年4月14日最近提交 4 天前SkillHot 收录 20 天前
▸ 精选理由
快速产出分类差异分析图表,便于洞察类别分布与比例关系。
这个 Skill 做什么
对两类或多类分类数据进行数量/比例对比并生成可视化图表。
把两类或多类的分类数据拿来比数量和占比,然后画出直观的图表帮你看差异和趋势。适合做分组对比、用户分段或分类指标的可视化汇报。特点是既统计精确又能直接输出易读的可视化结果,方便快速判断哪个类别更重要。
▸ 展开 SKILL.md 英文原文
对两类分类数据进行对比分析,统计数量差异与比例关系并生成可视化图表。
4.8k
Stars
331
Forks
40
仓库内 Skill
+141
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-excel-workflow/capability/excel-data-analysis/comparison-analysis/SKILL.md或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/OpenSenseNova/SenseNova-Skills/main/skills/sn-da-excel-workflow/capability/excel-data-analysis/comparison-analysis/SKILL.md"SKILL.MD 节选查看完整文件 ↗
# categorical-comparison-analysis
> This sub-skill covers one capability of the Excel workflow. For reading/counting/Parquet optimization, see the parent workflow SKILL.md.
Step1 读取文件并统计所有 sheet 的总行数,评估是否需要进行大文件优化处理。
```python
import pandas as pd
from pandas import read_excel
from pathlib import Path
# 统计所有 sheet 的行数以决定处理策略
file_path = "input_data.xlsx"
sheet_names = pd.ExcelFile(file_path).sheet_names
total_rows = 0
for sheet in sheet_names:
# 仅读取行索引以快速计数
df_tmp = read_excel(file_path, sheet_name=sheet, usecols=[0])
total_rows += len(df_tmp)
print(f"Total rows across all sheets: {total_rows}")
```
Step2 提取对比维度的分类信息,执行数据清洗,包括去除空值、处理合并单元格填充以及排除非数据行。
```python
# 定义目标列名
target_via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有