reading-invoice

仓库创建 2026年2月11日最近提交 4 个月前SkillHot 收录 20 天前
▸ 精选理由

适合自动记账与报销流程,减少人工录入。

▸ 风险提示

需要本地文件与 CLI 权限,可能涉及敏感财务数据。

这个 Skill 做什么

从发票图片或 PDF 提取字段并输出结构化数据。

把发票的 PDF 或图片读成结构化字段(供应方、金额、日期、发票号等),先尝试从 PDF 提取文字,不行再转成图片做 OCR,并用并行双重验证提高准确率。可被其他流程调用也可直接使用,适合发票批量录入、报销或会计自动化场景。特色是先用文本抽取加速解析,减少 OCR 错误并输出规范化数据。

▸ 展开 SKILL.md 英文原文

請求書の画像を読み取り構造化データを返す。 他のスキルから呼び出されるほか、直接ユーザーが呼び出すことも可能。

数据与抓取发票OCR费用凭证通用
348
Stars
34
Forks
24
仓库内 Skill
+1
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/kazukinagata/shinkoku/main/skills/reading-invoice/SKILL.md
或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/kazukinagata/shinkoku/main/skills/reading-invoice/SKILL.md"
SKILL.MD 节选查看完整文件 ↗
# 請求書 画像読み取り

請求書の画像を読み取り、構造化データとして返すスキル。

## PDF ファイルの場合

ファイルが PDF(`.pdf`)の場合、画像 OCR の前にテキスト抽出を試みる。

1. `shinkoku pdf extract-text --file-path <path>` を実行する
2. 抽出テキストに必要な情報(金額・日付・請求元等)が含まれていれば、テキストから構造化データを生成する
3. テキストが不十分(スキャン PDF 等)の場合は `shinkoku pdf to-image --file-path <path> --output-dir <dir>` で PNG に変換し、以下の画像読み取りフローに進む

## 画像読み取り方法

### 推奨: デュアル検証(並列2コンテキスト)

精度を高めるため、同じ画像を2つの独立したコンテキストで並列に読み取り、結果を照合する。

1. **2つの独立した読み取りを実行する:**
   サブエージェントが使える環境では、2つのサブエージェントを並列で起動し、それぞれ独立に画像を読み取る。
   各サブエージェントには以下の「基本ルール」と「出力フォーマット」をプロンプトとして渡し、画像ファイルパスを指定する。

2. **結果照合:** 両方の読み取り結果から主要フィールド(金額等)を比較する。

3. **一致の場合:** そのまま採用。「2つの独立した読み取りで結果が一致しました」と報告する。

4. **不一致の場合:** ユーザーに元画像パスと両方の結果を提示し、正しい方を選択し
via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有