reading-deduction-cert

仓库创建 2026年2月11日最近提交 4 个月前SkillHot 收录 20 天前
▸ 精选理由

自动化提取保险/地震等控除数据,节省手动录入。

▸ 风险提示

需要本地文件与 CLI 权限,可能涉及敏感财务数据。

这个 Skill 做什么

从控除证明书图片提取并返回结构化税务信息。

把生命保険料、地震保険料等控除証明書的 PDF 或图片读成结构化税务数据,产出可直接写入系统的字段(比如保険料額、証明額等)。上传扫描件或需要把纸质证明电子化、用于报税时就用,PDF 先尝试文本抽取,不行再做 OCR(PNG 转换)。特别在于采用文本抽取+图像 OCR 的双轨验证流程,提高识别准确率并输出规范化结果。

▸ 展开 SKILL.md 英文原文

控除証明書(生命保険料・地震保険料等)の画像を読み取り構造化データを返す。 他のスキルから呼び出されるほか、直接ユーザーが呼び出すことも可能。

数据与抓取OCR税务控除证明通用
348
Stars
34
Forks
24
仓库内 Skill
+1
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/kazukinagata/shinkoku/main/skills/reading-deduction-cert/SKILL.md
或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/kazukinagata/shinkoku/main/skills/reading-deduction-cert/SKILL.md"
SKILL.MD 节选查看完整文件 ↗
# 控除証明書 画像読み取り

控除証明書(生命保険料控除証明書、地震保険料控除証明書、社会保険料控除証明書等)の画像を読み取り、構造化データとして返すスキル。

## PDF ファイルの場合

ファイルが PDF(`.pdf`)の場合、画像 OCR の前にテキスト抽出を試みる。

1. `shinkoku pdf extract-text --file-path <path>` を実行する
2. 抽出テキストに必要な情報(保険料額・証明額等)が含まれていれば、テキストから構造化データを生成する
3. テキストが不十分(スキャン PDF 等)の場合は `shinkoku pdf to-image --file-path <path> --output-dir <dir>` で PNG に変換し、以下の画像読み取りフローに進む

## 画像読み取り方法

### 推奨: デュアル検証(並列2コンテキスト)

精度を高めるため、同じ画像を2つの独立したコンテキストで並列に読み取り、結果を照合する。

1. **2つの独立した読み取りを実行する:**
   サブエージェントが使える環境では、2つのサブエージェントを並列で起動し、それぞれ独立に画像を読み取る。
   各サブエージェントには以下の「基本ルール」と「出力フォーマット」をプロンプトとして渡し、画像ファイルパスを指定する。

2. **結果照合:** 両方の読み取り結果から主要フィールド(金額等)を比較する。

3. **一致の場合:** そのまま採用。「2つの独立した読み取りで結果が一致しました」と報告する。

4. **不
via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有