paper-digger-evaluate

仓库创建 2026年7月27日最近提交 2 天前SkillHot 收录 2 天前
▸ 精选理由

聚焦价值与诚信审查,适合内部红队与质量把关流程。

▸ 风险提示

会加载本地 scripts 并可能访问外部资源,存在代码或数据泄露风险。

这个 Skill 做什么

对研究工作做多维对抗式评估并给出可执行的 go/revise/stop 判定。

把正在做的研究项目拿去做一次内部红队式审查,从价值、新颖性、严谨度到证据完整性和防造假几方面给出可执行的 go/revise/stop 判定。适合研究期想决定要继续推进、改方向还是停掉时用,能抓出自欺或可疑证据链。特别之处是多维对抗思路,输出的是直接可执行的决策而不是笼统结论。

▸ 展开 SKILL.md 英文原文

Use when issuing a research go/revise/pivot/stop verdict from value, novelty, rigor, evidence integrity, and anti-fabrication checks. Triggers on 价值评估, 诚信稽核, research red-team, go/no-go.

研究检索研究评估诚信稽核红队通用
0
Stars
0
Forks
7
仓库内 Skill
+0
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/Iu1ky/paper-digger/main/plugins/paper-digger/skills/paper-digger-evaluate/SKILL.md
或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/Iu1ky/paper-digger/main/plugins/paper-digger/skills/paper-digger-evaluate/SKILL.md"
SKILL.MD 节选查看完整文件 ↗
# Paper Digger Evaluate — 研究期价值与诚信红队

在 4 个节点对「当前工作」做**对抗式、多维度**评价,回答:*这值得做/做得够好吗?* 和 *我们是不是在自欺/造假?* —— 输出可执行 verdict。**区别于** Phase 8 的投稿期外部审稿模拟,这是**研究期内部红队**。

## 运行时

定位同级 `paper-digger` skill。调用 `paper_digger.*` API 前,把它的 `scripts/` 目录加入 Python `sys.path` 或 `PYTHONPATH`;不要依赖全局安装。向 lens 只提供 claim、指标摘要、路径、哈希和必要片段,不内联原始日志或大数组。

## 两轴 rubric

**Axis A — 价值与水平**
- A1 价值/意义("so what?",抓无意义的工作)· A2 新颖性(抓低水平/增量)· A3 严谨与逻辑(抓逻辑问题)· A4 水平/雄心 · A5 证据充分性(随节点)

**Axis B — 诚信与认知失效**
- B1 数据伪造 · B2 方法虚构 · B3 引用幻觉 · B4 思维固定(主动生成 ≥2 个反框架/竞争解释,检验 tunnel vision)

## 4 个节点(逐节点换侧重,见 `NODE_FOCUS`)

- 节点 ① idea 确定:重 A1 价值 / A2 新颖 / B4 思维固定 → 立项 / 改框架 / 换题
- 节点 ② 最小验证完成:重 A5 证据 / B1 伪造 / B2 方法虚构 → 继续 / 修正 / kill-
via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有