目录 / 模型评测
SKILL
未评级
已上架
模型评测
模型评测建立可复现、可对比、可回归的模型效果评测体系。 也适用于以下说法:LLM 评测、模型评估、效果评测、大模型评测、模型 benchmark。 覆盖链路:目标对齐 → 维度设计 → 数据集 → 自动+人工 → 回归 → 报告。 内置方法论:维度稳定法、数据集固定法、自动筛人工判、回归守护法。 能力模块:目标对齐、维度设计、数据集构建、自动+人工、回归机制、报告规范。 输出可直接交付,全流程附卡点自救与合规护栏
模型生成摘要(rules/v1 · 2026-09-21 20:55):模型评测建立可复现、可对比、可回归的模型效果评测体系
这是模型对公开材料的总结,不是官方声明,请以原链内容为准。
这是模型对公开材料的总结,不是官方声明,请以原链内容为准。
存档时间线
| 版本 | 存档时间 | 内容哈希 | 内容 |
|---|---|---|---|
| v1 | 2026-09-21 20:53 | 062b2940 | 可取 |
版本索引永久保留;内容副本只保留最近 2 版,更早版本仅留索引与哈希(存档时间线的证据链不会因此断裂)。
纠错与举报(发现条目失效、署名有误或涉及侵权?)
提交举报 / 纠错
侵权举报经核验成立后,我们会即时下线该条目并删除已存的内容副本。