AI 原生系列 · 知识策展
我的新仓库抓到的第一个 bug,就是我自己。
一分钟速览——你能带走什么
我宣称我的新仓库收录了 31 个仓库。机器说是 30 个。GodView-anything 是一个营销形容词必须能编译通过的知识仓库:「comprehensive(全面)」是一个指标,「up to date(保持更新)」是每周测量一次的同步,「in-depth(深度)」是一项 SHA 锚定摘要的硬性要求。
GodView-anything——一个营销形容词必须能编译通过的知识仓库。种子来自 2026 年增速最快的仓库。约 6 分钟读完。
我宣称我的新仓库收录了 31 个仓库。机器说是 30 个。
这个多算一个的低级错误,是我自己的质量闸门抓到的第一个 bug——罪魁祸首正是我,跟凑整零花钱的小孩没什么两样。这一刻正是整件事的关键,值得好好说一说。
心智模型:一张藏宝图,每个 X 标记之前都要先核实。 GitHub 上大多数策展类知识,都是靠传闻画出来的地图:有人听说那座岛上有金子,于是画上一个 X,却从没人回去验证过。GodView-anything 是另一种地图:只有真的挖到了,X 才会被标上,而且这张地图每周都会重新核查那次挖掘是否还站得住。
为什么是现在:2026 年增速最快的仓库教会了我这套模式
World Monitor 在约六个半月里从零涨到 74,461 星——一个实时的、Palantir 风格的世界仪表盘:500+ 新闻源、65+ 数据提供方、AI 合成简报呈现在 3D 地球上。我逐个 commit 地摘要了它(锚定在 88bfbac,2026-07-26),而它教给我的最深一课,跟地图本身没什么关系:
它从不承诺新鲜度——它只测量新鲜度。 它的 500+ 信息源被归入 35 个来源分组,每组都有过期检测。过期的来源是系统检测出来的,不是失望的用户发现的。
现在用这个视角重新看一眼知识整理这个圈子。 The Book of Secret Knowledge ——235,000 星的运维与安全智慧合集——自 2024 年 11 月起就一直沉寂。 public-apis ——452,000 星——至今仍活跃,并持续通过 CI 校验。同一个类型,同样的名气。差别不在维护者的热情,而在这个仓库是否会自我审查。
于是我把这条原则从一个世界监控系统里偷了过来,用在了知识本身上。
GodView-anything 到底是什么
一个研究高星仓库的元仓库,把每一个都提炼成三大支柱,每一条都锚定证据来源:
- 可迁移的知识 ——星标之下的系统设计、决策模式、反模式与第一性原理。仅从种子摘要里就能看到:智能体原生的产品界面(MCP + REST + CLI + SDK +
/llms.txt与人类界面一同发布)、本地优先的 AI 兜底方案(核心功能在 Ollama 上无需密钥即可运行;云端 LLM 只是升级选项)、衍生指数即产品(原始数据是大宗商品,Country Instability Index 才是护城河)。 - 智能体化工具 ——技能、插件、钩子、工作流、MCP 服务器——都打上了信任标签,因为这个生态里已经出现了刷星的克隆仓库。我发现的一个「技能」仓库有 26,600 星,贡献者名单却稀稀落落,冷清得像座空城。它被我记录在注册表里,标注为
rejected:,理由也一并存档。 - 社区 ——是人。Elie Habib 一个人每天提交约 25 次 commit,撑起一个 7.4 万星的项目(贡献者名单里甚至有个名字直接叫
claude,提交了 52 次——智能体已经上桌了)。Kalev Leetaru 的 GDELT project,它的事件数据支撑着地球上一半的冲突地图,但客户端库却从没超过约 300 星。还有 Sindre Sorhus,他的 awesome-lint 在「用 linter 做知识整理」这件事变酷的十年前,就已经悄悄发明了它。
第一天的普查数据,全部经机器验证:3 大类共 30 个卫星仓库、16 条知识条目、12 条工具条目、18 个社区节点、16 项测试,自我审计得分为 16/16 项运营原则。make check ——离线运行、结果确定——是唯一能判定「完成」的裁判。
机制:把形容词变成计算题
再往深一层,说说这里的门道。每个知识仓库都用同样那三个形容词来营销自己,于是我把这些形容词编译成了检查项:
- 「全面」 =一个北极星指标:已消化仓库数 × 有证据支撑的条目数。今天这个数字是 17。不大,但每一分都挣得干净——而且它只能照着最初的方式,一点点长大。
- 「保持更新」 =一项每周任务,刷新每个仓库的星标数、SHA 和推送日期,标记出过时的部分,并开一个必须由人类合并的 pull request。新鲜度是被测量出来的,从不是被承诺出来的。
- 「深度」 =一个仓库只有在经过一份指定 SHA 的摘要提炼出为什么它行之有效之后,才能被收录——而其中任何未经核实的内容都会被标记为 UNCONFIRMED,绝不含糊带过。
校验器不放过任何空壳仓库:如果你把某个仓库标记为「已消化」,却没有在摘要文件里写明确切的 SHA,构建就会失败。它同样会强制执行许可证防火墙——World Monitor 采用 AGPL 双重授权,所以它只能以指针形式被索引,绝不能被直接纳入仓库本体。我的闸门在诞生几分钟之内就抓到了一个真实案例:我把一个 CC-BY 许可的项目错误地归到了宽松许可政策之下,构建一直是红色,直到我把文书改正过来。接着,它又抓到了那个「31 还是 30」的问题。
我造了一台测谎仪,结果它上岗第一件事,就是两次抓到自己的作者说谎。这并不丢人——这恰恰说明产品在正常工作。如今,这幅地图拒绝画出任何未经核实的 X,即便握笔的那只手是我自己的。
它目前还做不到的事
- 只有一份摘要。 三十个卫星仓库里,只有 World Monitor 得到了完整的、SHA 锁定的深度处理。其余 29 个都只是「已验证候选」——元数据是真实的,但还没有真正深挖。
- 每周同步机制还没能撑过一整周 ——它确实存在,也确实会开 PR,但要证明这个节奏成立,需要连续几个周一都成功合并,而目前一个周一都还没经历过。
- 关键人物只有一个。 目前,我就是整个策展委员会——这恰恰是前面提到的那种失效模式。「闸门争议」的 issue 模板已经开放。
- 一份摘要只是一张快照。 事实在锁定的那个 commit 上成立;同步机制只会标记出漂移,并不会重新核实其中的文字内容。
前沿
大家都爱点星标的仓库,其实早就把一切教给了我们——架构、许可策略、社区运作机制——只是只讲给那些以读 commit 为乐的人听。我一直在想一个问题:如果 README 里每个形容词都必须能跑通编译,你的仓库会说出什么?
GodView-anything 采用 MIT 协议,开源,接受 PR 提名——候选门槛写在 registry 文件里,没错,机器也会检查你的作业。
相关文章
Paul Jialiang Wu · AI-Native Series · 2026-07-26 · 更多文章 →