评审标准

过程即证明。荔选的全部评审标准公开如下,与内部评审员手册同源。

收录范围与口径

"Skill 严选"收录 Agent 扩展物全集:技能(skill)、命令(command)、子代理(subagent)、钩子(hook)、MCP 服务、合集(bundle)——由条目的"形态"字段精确区分。实测结论只对测过的平台与版本负责;条目标注"宣称兼容(未实测)"的平台未经我们验证。

三条红线(发布卡点,构建强制校验)

  1. 无实测记录不发布——实测结果与截图/录屏证据必填,缺失的条目停留在草稿态
  2. 无"不适用场景"不发布——适用与不适用各至少 2 条;敢写"你别用"才是信任来源,不适用栏不许写凑数项
  3. 安全审查未完成不发布——安全结论 fail 的条目不上架(可转入淘汰公示并说明原因)

评级判据(S / A / B / C)

含义判据
S强烈推荐实测全通过 + 安全 pass + 显著效率提升(省 3 步以上或不可替代)+ 维护活跃
A推荐实测通过 + 安全 pass + 明确有用,但有替代品或轻微瑕疵
B可用实测部分通过或场景很窄;安全 pass/warn(warn 必在正文说明)
C不推荐但收录能跑但价值低或有更优替代——收录以帮你避坑,正文必给替代指引

评级答辩规则:任何一条评级,评审员要能当面向读者复述判据;拿不准就低不就高。

安全检查五步

  1. 指令审读:通读全部指令文本,标记要求隐瞒行为、外发数据、越权操作的语句
  2. 权限对照:列出声明权限(读文件/写文件/联网/执行),逐项对照功能必要性
  3. 运行抓包:隔离环境试运行,确认无未声明的网络外发
  4. 供应链:安装脚本与依赖是否拉取不明来源代码
  5. 结论三级:pass(无发现)/ warn(风险可控,正文必写风险与规避)/ fail(不上架)

按形态差异化侧重:钩子(hook)重点查工具调用拦截与越权;MCP 服务重点查常驻网络行为与间接注入;命令(command)重点查提示词注入;合集(bundle)逐件抽查加整体冲突。

持续复检

每条默认 30 天复检周期;条目自身发新版本、所属平台发大版本、或收到用户失效上报,均自动触发复检。失效条目当周处理:修复验证,或下架并进淘汰公示。下架页面保留、给替代指引,不做 404。

中立性声明

荔选不向任何开发者收取上架费、推荐费;商业内容(如有)只出现在标注"赞助"的框架位,永不进入条目、评级与排序。

免责声明

可用性与安全结论基于检查当日的特定版本与环境,不构成持续担保;最新状态以条目页的版本与复检时间线为准。转载须署名(CC BY-NC-SA 4.0),商业使用请联系授权。

订阅荔选更新

新收录 · 失效警报 · 每周合刊(数据存自有服务器,随时退订)