web-scraper

仓库创建 2026年5月22日最近提交 16 小时前SkillHot 收录 20 天前
▸ 精选理由

适合定期抽取站点表格/列表/价格等数据并自动化导出分析流程。

▸ 风险提示

会发起外部网络请求并处理第三方页面,可能涉及反爬或版权/隐私合规风险。

这个 Skill 做什么

多策略智能抓取网页结构化数据,支持分页、监控并导出为 CSV/JSON/MD。

用多策略智能抓取网页的结构化数据(表格、列表、价格等),支持翻页、持续监控并能导出 CSV/JSON/Markdown。当你需要批量采集网站内容、做数据汇总或定期监控变化时就会用到。特别之处在于策略自适应、分页处理和监控导出,适合电商、行情或内容抓取场景。

▸ 展开 SKILL.md 英文原文

Smart web data extraction capability with various scraping strategies, pagination support, monitoring, and export / Kemampuan ekstraksi data web cerdas dengan berbagai strategi scraping, dukungan paginasi, pemantauan, serta ekspor.

数据与抓取网页抓取分页支持导出通用
41
Stars
7
Forks
40
仓库内 Skill
+0
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/roedyrustam/vibes-plug/main/skills/web-scraper/SKILL.md
或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/roedyrustam/vibes-plug/main/skills/web-scraper/SKILL.md"
SKILL.MD 节选查看完整文件 ↗
# Web Scraper

[English](#english) | [Bahasa Indonesia](#bahasa-indonesia)

---

<a name="english"></a>
## English

### Overview
Smart web data extraction using a multi-strategy approach. Extracts structured data from web pages (tables, lists, prices). Supports pagination, monitoring, and exporting to CSV/JSON/Markdown.

### Trigger Conditions
Use this skill when:
- The user mentions "scraper", "scraping", "web scraping", or "web data extraction".
- The user requests to "gather data from a website" or "collect site details".

### Workflow (Phases)
```
1. CLARIFY  ->  2. RECON  ->  3. STRATEGY  ->  4. EXTRACT  ->  5. TRANSFORM  ->  6. VALIDATE  ->  7. FORMAT
```

#### Phase 1: Clarify
Establi
via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有