尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

claude-obsidian 的 autoresearch 默认研究计划:预算控制、五态证据评估与停止条件设计

发布时间:2026/9/14 19:17:39

资讯中心
01
ARTICLE

claude-obsidian 的 autoresearch 默认研究计划:预算控制、五态证据评估与停止条件设计

claude-obsidian 的 autoresearch 默认研究计划:预算控制、五态证据评估与停止条件设计
claude-obsidian 的 autoresearch 默认研究计划预算控制、五态证据评估与停止条件设计【免费下载链接】claude-obsidianSelf-organizing AI second brain for Obsidian Claude Code. Drop any source and Claude reads, links, and files it into one connected knowledge graph of plain Markdown you own. AI note-taking, personal knowledge management (PKM), and an open-source Notion alternative. Based on Karpathys LLM Wiki pattern.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-obsidian在 claude-obsidian 的自动研究技能autoresearch中references/program.md是内置的默认研究计划它规定了自主研究循环的目标、默认预算上限、证据评估的五种状态、按领域划分的来源选择策略、输出风格与停止条件。读懂这份计划你就能掌握如何让 Claude Code 在 Obsidian 仓库中执行有界、可溯源、可审计的深度研究读完本文你可以为一次研究任务设定明确的轮次/来源/页面配额用 source-ledger 与 claim-ledger 的证据状态accepted、provisional、contested、unsupported、deprecated而不是主观措辞来判定结论可信度并在触发停止条件时正确终止并如实报告边界。一、默认研究计划的定位与优先级默认研究计划 在文档开头就明确了它在整个约束体系中的位置This is the bounded default forautoresearch. User-supplied limits may make it stricter. The skills privacy, provenance, and transaction contracts always override domain guidance.也就是说这份计划是autoresearch技能的有界默认值其优先级关系是技能级契约最高隐私privacy、溯源provenance、事务transaction三类契约永远优先于这份计划里的任何领域性指导domain guidance。SKILL.md 中规定的网页结果、抓取页面、片段、元数据、worker 草稿一律视为不可信证据等安全规则就是这份计划必须服从的上层约束用户限制只能收紧、不能放松用户提供的限制rounds、fetches、页数、时间、成本可以比默认预算更严格但不能更宽松计划本身是默认它保证即使用户没有逐项确认研究契约研究循环也有一个明确的上限基线可以执行。这个分层设计对应了 SKILL.md 中建立研究契约一节的要求与用户确认精确主题与排除项、是否批准公网出网egress、允许的域名或来源类别、最大轮次/搜索/抓取/时长/草稿页数、停止条件以及用户审查后是否需要归档到仓库。未获得出网授权时只允许研究已选 vault 内内容与用户提供的来源并明确标注这一边界。二、研究目标回答精确问题而不是收集主题计划中 Objectives 一节列出了六条目标完整继承如下回答一个精确的研究问题answer a precise research question而不是无差别地收集一个主题collecting a topic indiscriminately优先一手与官方来源其次才是高质量的独立分析提取可证伪的声明falsifiable claims以及实体、概念、机制与决策主动寻找反证、矛盾、来源依赖关系与开放缺口将来源直接陈述与推断和建议严格分开当新增来源只是重复已知证据、或无法改变答案时停止。这六条目标与 SKILL.md 中草稿研究循环的六个步骤是一一对应的先读wiki/hot.md、wiki/index.md、来源/声明账本和一组有界的相关页面弄清已知什么、什么会改变它把主题分解为若干独立问题并包含一个合理的反方立场优先官方与一手来源并记录 URL、标题、作者/发布者、发布与检索日期、权威性、新鲜度、可用时的 payload 哈希与独立性键用精确的证据定位器提取可证伪声明搜索缺口与矛盾而不是主流观点的更多例子每轮结束后报告预算消耗并评估停止条件。提取可证伪声明这一点在代码层面有直接落点claim-ledger 中的每条声明必须通过校验其text字段被要求是non-empty falsifiable claimlocation必须指向 vault 内真实存在的wiki/页面路径锚点必须在该页面真实存在见 声明校验。也就是说可证伪、有定位器不只是写作风格要求而是账本校验器强制执行的硬约束。三、默认预算三轮、每轮五个来源、十五个草稿页计划给出的默认预算Default budget如下表这是用户未提供更严格限制时的执行基线预算项默认上限说明搜索轮次Search rounds最多 3 轮每轮是一次检索—评估—决策循环每轮抓取来源Fetched sources per round最多 5 个控制单轮出网抓取面草稿页面Drafted pages最多 15 个只计草稿不代表最终入库页数并行 worker不超过宿主机可用的安全并发数从源码结构看这依赖宿主环境探测计划本身不硬编码具体数值在出网egress之前计划还要求与用户就已用时长、成本、域名范围、隐私限制达成约定每轮结束后报告预算使用情况。原文特别强调了一条反凑数原则Reaching a page target is not a reason to invent content; record skipped questions and stop.即达到页数目标绝不是编造内容的理由被跳过的研究问题应当被记录下来然后停止。SKILL.md 用更直白的措辞重申了同一条红线Never fabricate an answer to satisfy a depth target.永不为了达到深度目标而编造答案。需要说明的适用前提这些数字是技能内嵌的默认值写在这份 program.md 中供研究循环加载用户在任何时刻都可以用更小的值覆盖它们例如把研究限制为单轮、3 个来源。默认预算的存在意义是即使契约没有逐项谈妥循环也有可执行的边界。四、证据评估五态模型与账本而不是措辞上的信心这是计划的技术核心。原文明确要求Use the source and claim ledgers, not a prose confidence label alone.即用账本做证据评估而不是仅靠一段我比较有信心之类的措辞。计划定义了五种声明评估状态claim assessment states状态语义账本侧的硬性要求accepted被至少一个**新鲜的fresh、活跃的active、非合成的non-synthetic**来源支持高风险high-risk的 accepted 声明必须被两个独立来源支持provisional有用但支持尚不完整无额外强制contested可信证据之间存在分歧必须存在矛盾证据contradictory evidence或裁决说明notesunsupported没有充分证据是无数据的规范状态应显式写出而不是回避deprecated已被取代为历史保留通过supersedes指向被取代记录这套五态不是文档里的概念装饰而是代码里的白名单常量 CLAIM_ASSESSMENTS。与之配套的还有来源权威性等级 AUTHORITIESofficial、primary、secondary、community、synthetic、unknown来源审查状态 SOURCE_STATUSESunreviewed、active、superseded、rejected声明风险等级 CLAIM_RISKSnormal、high证据关系 EVIDENCE_RELATIONSsupports、contradicts、context。两份账本分别位于 vault 内 来源账本 所述的路径wiki/meta/ledgers/source-ledger.json稳定来源身份、权威性、SHA-256、检索/新鲜度、审查状态、关联页面与wiki/meta/ledgers/claim-ledger.json可证伪声明、笔记位置、支持、矛盾、置信度、风险、审查状态。溯源契约明确告诫不要用一份账本同时承担三种职责ingestion 状态、来源证据、声明评估要分开。4.1 新鲜度是按领域和声明判定的不存在统一时效截线计划中 Freshness 一节的要点新鲜度是领域相关、声明相关的domain- and claim-specific已知时记录发布日期、检索日期、审查日期设置合适的refresh_due刷新截止日绝不对奠基性资料foundational work套用统一的年龄截线。这与 溯源契约 中的规则一致Compute staleness fromrefresh_due; do not store a second stale flag.从refresh_due计算陈旧度不要另存一个 stale 标志。代码实现上陈旧度判定函数 source_is_stale 的语义是refresh_due缺失、观测日期缺失、观测日期晚于审计日期或refresh_due早于审计日期——任一成立即视为陈旧。而账本校验器会强制active来源必须有显式refresh_due且不得早于检索/摄取日期校验逻辑retrieved_at也不得晚于审计日期。也就是说为每个活跃来源设置 refresh_due在计划里是建议在校验器里是硬错误。4.2 独立性independence_key 与两个独立来源的机器判定高风险 accepted 声明需要两个独立来源这条规则其独立二字在实现中有一个相当严格的判定。溯源契约规定共享同一个independence_key的来源不构成独立佐证解析到同一规范化 URL 来源地的来源不因 IPv6 写法、IDN、Unicode、dot-segment、默认端口或百分号编码的差异而算独立被转义的保留路径/查询字节则保持区分因为它们可能标识不同资源。在 claude_obsidian/ledgers.py 中_independent_group_count 用并查集union-find把相互依赖的支持来源传递性地合并成独立性组两个来源只要满足下列任一条件就被视为同一组——同一 source id、同一规范化 originkind locator、相同的内容 SHA-256 字节、或声明了相同经 NFC 规范化与小写折叠后的independence_key。函数注释说得很清楚Collapse duplicate origins, bytes, or declared publishers transitively.传递性地折叠重复的来源地、字节或声明的发布者。据此高风险 accepted 需要两个独立来源的校验规则是支持证据的独立性组数量 2即报错high-risk acceptance requires two independent sources校验逻辑。这意味着同一篇报道被三家媒体转载在账本层面只算一个来源——这正是计划中对联合发行syndicated来源去重、对同源依赖报道记录共享independence_key一条的落地形态。independence_key字段本身的校验是非空文本或 null校验逻辑。此外accepted与contested之间的状态一致性也会被机器检查accepted声明若存在新鲜的矛盾证据要么改为contested要么在notes中给出裁决说明否则校验失败校验逻辑——对应计划把来源直接陈述与推断分开、寻找矛盾的目标contested声明必须真有contradicts关系的证据条目或至少留下说明文字校验逻辑。4.3 来源身份的稳定性SHA-256 与 src- 前缀 ID计划要求来源记录携带检索日期、权威性等信息溯源契约 进一步规定新来源身份与增量检查一律使用 SHA-256。实现上stable_source_id 由kind \0 规范化locator \0 内容哈希做 SHA-256 后取前 20 位十六进制生成src-前缀的稳定 ID校验器会强制要求账本中的 source id 与该规范化身份相等校验逻辑。这保证了同一来源即使被多轮抓取、多次写入在账本中仍保持同一身份——这是预算每轮 5 个来源跨轮次去重、以及 dossier 归档可审计的基础。五、来源选择权威性取决于问题类型计划中 Source selection 一节按领域给出了权威性的判定标准完整继承如下软件与产品当前官方文档、源码仓库、规范specifications、可复现的测试学术研究原始论文、数据集、方法、勘误corrections、在合适的场景下的系统性综述商业与市场申报文件filings、官方披露、一手数据集、独立报道宣传性材料必须显式标注医疗、法律、金融当前权威指引与一手证据且必须显式声明管辖范围jurisdiction、适用人群population与局限limitations。计划还划定了一条社区来源的红线Community posts and social media can identify experiences or leads but do not become high-authority evidence automatically.社区帖子与社媒内容可以识别经验或线索但不会自动升级为高权威证据。这与账本权威性枚举里的community等级是呼应的而识别线索对应的是证据关系中的context而非supports。对 syndicated联合发行/转载来源要执行去重并记录共享的independence_key——如前所述这直接决定两个独立来源规则能否通过机器校验。对 claude-obsidian 这类软件 知识管理工具本身的研究第一条最常用以当前官方文档、源码仓库与可复现测试为准——本仓库中的 Makefile、tests/目录与各config/契约文件就是这种可复现证据的形态。六、输出风格直白、带引证、显式承认未知计划 Output style 一节的七条要求逐条完整继承语言直白但保留必要的不确定性表述每个重要的、非显而易见的声明都必须引用到具体的来源记录source record与定位器locator使用短而聚焦的页面当按概念拆分能改善检索时就按概念拆页用unknown、unsupported、contested显式说明而不是把缺口填平引用必须逐字保留且尽量简短其余情况改写paraphrase永不编造作者、日期、URL、页码、测量值或引文。最后两条在 SKILL.md 的评估章节有对应强化当证据无法支持所要求的结论时给出有依据的拒绝grounded refusal并指明缺少的证据是什么。这与溯源契约中 unsupported是规范的无数据状态有依据的拒绝优于自信地编造 完全一致。从检索工程角度看短页面 按概念拆分 每声明可定位的组合正是为了让 dossier 中的每条断言都能被 BM25/重排这类检索管线精确定位到——仓库中 retrieve.py、bm25-index.py 等脚本构成了这条链路的检索侧。七、停止条件七种情形与边界即产出计划 Stop conditions 一节列出了七种必须停止并报告边界的情形完整继承如下约定的研究问题已获得充分支持预算耗尽轮次、来源数、页数、时长、成本任一用户叫停或收窄了工作范围剩余检索结果重复依赖性证据repeat dependent evidence出网将超出已批准的域名范围或会暴露私有上下文关键声明无法被验证来源需要用户未提供的访问权限或权利。注意这里的设计取向停止不是失败报告边界本身就是义务。每触发一种情形研究循环都要把没做完什么、为什么停如实写入报告——这与第三节的记录被跳过的问题、第六节的写 unsupported 而不是填平缺口是同一套诚实性原则的三个切面。计划的最后一句划定了研究的归档边界Research output remains a reviewable dossier. Merging it into canonical pages is a separate approved transaction.研究产出在性质上始终是一份可审查的 dossier卷宗把它合并进规范页面是另一次、单独批准的事务。这与 SKILL.md 的事务流程严格对应dossier 归档构建一个operation_type: autoresearch的claude-obsidian.transaction.v1包可捆绑实际获得到的不可变文本捕获create-only text captures、带引用的来源页与一份研究综合页、来源/声明账本更新、manifest 与地址请求、以及暴露 dossier 所需的 index/log/hot 变更对每个目标记录 SHA-256 前置条件先 inspect 审查再applypython3 $CORE transaction inspect /path/to/research-bundle.json --vault /path/to/vault # Set APPROVAL_SHA256 to the inspect results approval_sha256 after review. python3 $CORE transaction apply /path/to/research-bundle.json --vault /path/to/vault \ --approved-plan-sha256 $APPROVAL_SHA256合并之后对既有概念/实体/决策页的任何更新必须作为第二笔独立审查、独立批准的事务提出用户可以接受、收窄、推迟或拒绝这次合并而不损失研究产物本身。只有用户明确要求时才创建 Git 检查点python3 $CORE checkpoint OPERATION_ID --vault /path/to/vault。八、小结一份可机器校验的研究伦理把 program.md 放回它所处的体系中看它的价值在于把通常只存在于提示词里的研究纪律变成了默认预算 五态账本 领域权威标准 显式停止条件的可执行契约预算数字来自计划本身证据状态、独立性与新鲜度由 claude_obsidian/ledgers.py 的校验器强制执行出网与归档边界由 SKILL.md 的隐私/溯源/事务契约兜底。对使用者而言实操上只需要记住三步开工前与研究循环确认契约与预算默认 3 轮 / 每轮 5 源 / 15 草稿页可被用户收紧过程中按五态评估声明并如实标注unknown/unsupported/contested触发七种停止条件之一时停止、报告边界再决定 dossier 是否归档与是否发起第二笔合并事务。相关文档与实现入口默认研究计划skills/autoresearch/references/program.md技能入口与安全边界skills/autoresearch/SKILL.md溯源契约账本规则、SHA-256 身份、independence_key、URL 规范化skills/wiki/references/provenance.md事务契约dossier 归档与二次合并skills/wiki/references/operation-transactions.md账本校验实现claude_obsidian/ledgers.py状态白名单 L41-L49、陈旧度判定 L752-L758、独立性分组 L797-L837账本行为测试tests/test_ledgers.py【免费下载链接】claude-obsidianSelf-organizing AI second brain for Obsidian Claude Code. Drop any source and Claude reads, links, and files it into one connected knowledge graph of plain Markdown you own. AI note-taking, personal knowledge management (PKM), and an open-source Notion alternative. Based on Karpathys LLM Wiki pattern.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-obsidian创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。