DeepSeek 开源的智能体框架 Harness 官方对插件只写了两句话指引。截至 2026 08 25 快照,1.1 万个 dsh plugin(DeepSeek Harness 插件)标签仓库过滤后剩 1100 个真插件,真正给 AI 加上新能力(工具、记忆、视觉、语音、工作流)的不到 4%。
DeepSeek 开源的智能体框架 Harness 官方对插件生态的全部指引,是 README.zh.md 和 CONTRIBUTING 里各一句话:给仓库打个 dsh-plugin 标签。但 GitHub 上挂着这个标签的仓库 已经超过 1.1 万个。
这两句话与 1.1 万之间的落差,是 2026-08-25 这次 全量审计 的起点。作者把这一万多个仓库逐个拆开,按 dsh 打包规则(必须有 dsh.bundle 声明、声明 dsh 依赖、有可被发现的 skill 目录)逐层过滤,得到一条典型的三层漏斗:1.1 万 → 1,883 条拒稿 → 不到 1,100 条真插件 → 不到 4% 真正给 AI 加上新能力。
每一层漏斗过滤掉的具体内容,差异极大。1.1 万个标签仓库到 1,883 条 拒稿 的 81% 落差里,藏着的是「仓库」和「插件」的距离:很多人建了一个 GitHub 仓库、打了 dsh-plugin 标签,但根本就没把代码按 dsh 规范打包。社区聚合的 awesome-dsh-plugins 数据集 显示,1,883 条拒稿里 93%(1,752 条)是因为不符合打包规则,没有 dsh.bundle 声明、没声明 dsh 依赖、找不到 skill 目录。
从这堆拒稿里随机抽 50 个看体积:1 个不到 5KB(只有一个 README 的空壳),中位数 407KB,12 个超过 5MB(最大 336MB)。语言分布里大约 30% 用的是「在 npm 分发路径上根本无法跑成插件」的语言,TypeScript、JavaScript、Python、Rust、PowerShell、C、C++、Swift、Go、Shell 都被观察到。三类典型人群:1 个空壳、有真代码但没按规范打包的、不相干项目也来蹭 dsh-plugin 标签的。
第二层漏斗(1,883 → 1,100)剔除的是那些声称是插件但根本没把代码摆到安装命令能拿到的地方的仓库。有些仓库主人写了完整的 host/browser 两半工作代码,但漏了那一行 dsh.bundle 声明,也从没发布到 npm,于是 官方安装流程 根本找不到它们。
第三层才是真正考验生态质量的关口:剩下的 1,100 个真插件里,能给 AI 加上新能力(工具、记忆、视觉、语音、工作流)的不到 4%。其余大致按三股力量分布:铲子层(市场、计费、文档、开发辅助)、娱乐层(主题、桌宠、UI 皮肤)、能力扩展层。下载量前三全是市场和 UI,能力扩展层排第一的(modlens,视觉)只到 #4。
把同一套分类法搬到 Anthropic 官方运营的 2,282 个 Claude Code 插件上(按 Leiphone 2026-09-01 报道 的统计),得到几乎一模一样的比例:扩能力约 55%,铲子加娱乐约 40.2%。两家生态、数千条插件、同一道分层。
为什么是这种形状?因为 DeepSeek Harness 当前的入口成本是「打一个 GitHub 标签」,零审批,零签名,零安全上报通道,没有官方目录,没有官方搜索,没有版本兼容矩阵,没有官方推荐清单。GitHub topic 的本质是任何人都能贴的便签。当发现层没有门槛、打包层只有社区规则、签名层不存在时,市场会自动把生态切成两堆:谁来卖铲子(让别的开发者更好做插件的生意)、谁来娱乐(让普通用户桌面更花哨)。扩能力插件在每一家都是少数派。
这个漏斗给读者一把可以随时拿出来审计「X 万插件」宣传的尺子:入口成本(一个标签?一个 PR 审批?一次签名?)、中间层过滤率(仓库到真插件漏掉多少)、扩能力占比(剩下多少真给 AI 加新能力)。这把尺子对 OpenAI 的 GPTs、Google 的 AI 插件市场、未来的任何一家都同样适用。如果在另一家有目录、有签名、有版本矩阵的插件生态里 55/40 的分层消失了,那 DeepSeek 的「无治理」就是孤立问题;如果分层还在,那这就是 AI 插件市场的结构性形状,和谁做 Harness、谁做 Harness 的竞争对手无关。
最具体的下一步,是 DeepSeek 官方是否补齐基础设施:一个目录页、一份能用的搜索、一个版本兼容矩阵、一条签名或校验流程、一个安全上报通道、一份官方推荐清单。Harness 官方仓库 目前对插件生态的描述,仍然只是那两句话。