评审标准
过程即证明。荔选的全部评审标准公开如下,与内部评审员手册同源。
收录范围与口径
"Skill 严选"收录 Agent 扩展物全集:技能(skill)、命令(command)、子代理(subagent)、钩子(hook)、MCP 服务、合集(bundle)——由条目的"形态"字段精确区分。实测结论只对测过的平台与版本负责;条目标注"宣称兼容(未实测)"的平台未经我们验证。
三条红线(发布卡点,构建强制校验)
- 无实测记录不发布——实测结果与截图/录屏证据必填,缺失的条目停留在草稿态
- 无"不适用场景"不发布——适用与不适用各至少 2 条;敢写"你别用"才是信任来源,不适用栏不许写凑数项
- 安全审查未完成不发布——安全结论 fail 的条目不上架(可转入淘汰公示并说明原因)
评级判据(S / A / B / C)
| 级 | 含义 | 判据 |
|---|---|---|
| S | 强烈推荐 | 实测全通过 + 安全 pass + 显著效率提升(省 3 步以上或不可替代)+ 维护活跃 |
| A | 推荐 | 实测通过 + 安全 pass + 明确有用,但有替代品或轻微瑕疵 |
| B | 可用 | 实测部分通过或场景很窄;安全 pass/warn(warn 必在正文说明) |
| C | 不推荐但收录 | 能跑但价值低或有更优替代——收录以帮你避坑,正文必给替代指引 |
评级答辩规则:任何一条评级,评审员要能当面向读者复述判据;拿不准就低不就高。
安全检查五步
- 指令审读:通读全部指令文本,标记要求隐瞒行为、外发数据、越权操作的语句
- 权限对照:列出声明权限(读文件/写文件/联网/执行),逐项对照功能必要性
- 运行抓包:隔离环境试运行,确认无未声明的网络外发
- 供应链:安装脚本与依赖是否拉取不明来源代码
- 结论三级:pass(无发现)/ warn(风险可控,正文必写风险与规避)/ fail(不上架)
按形态差异化侧重:钩子(hook)重点查工具调用拦截与越权;MCP 服务重点查常驻网络行为与间接注入;命令(command)重点查提示词注入;合集(bundle)逐件抽查加整体冲突。
持续复检
每条默认 30 天复检周期;条目自身发新版本、所属平台发大版本、或收到用户失效上报,均自动触发复检。失效条目当周处理:修复验证,或下架并进淘汰公示。下架页面保留、给替代指引,不做 404。
中立性声明
荔选不向任何开发者收取上架费、推荐费;商业内容(如有)只出现在标注"赞助"的框架位,永不进入条目、评级与排序。
免责声明
可用性与安全结论基于检查当日的特定版本与环境,不构成持续担保;最新状态以条目页的版本与复检时间线为准。转载须署名(CC BY-NC-SA 4.0),商业使用请联系授权。