评测方法论
我们如何评测 AI 工具 —— 公开标准,接受质疑。
核心原则
AI 评测站坚持三项原则:
- 实测优先:所有结论基于实际测试,而非厂商宣传稿。
- 标注依据:每篇评测注明测试日期、样本量、测试环境。
- 公开透明:公开评分维度与权重,接受复核与质疑。
评分维度
| 维度 | 权重 | 说明 |
|---|---|---|
| 核心能力 | 30% | 该工具最核心的功能表现 |
| 中文适配 | 20% | 中文输入输出质量、中文文档支持 |
| 成本性价比 | 20% | 价格、免费额度、长期成本 |
| 易用性 | 15% | 上手难度、界面体验 |
| 生态与支持 | 15% | API、集成、社区、文档 |
工具目录评分规则
工具目录中每一款工具都有 0-5 星评分:深度评测文章给出人工精评分;批量收录的工具由脚本按以下保守基准初评,随评测文章补写后切换为精评分并人工复核。
- 知名品牌手名单:4.0 ~ 4.7(依据公开口碑与评测,见
scripts/fill_ratings.py) - 类别基准:chat/coding 3.8、主流创作类 3.7、长尾/垂直类 3.5-3.6(宁低勿高,避免虚标)
- 规则:初评不覆盖精评分;目录评分每季度由回归脚本校验覆盖完整性
国内直连的判定标准
"国内直连"标记表示该工具在中国大陆网络环境下可直接访问和使用,无需代理。该信息我们会定期复测,并在内容页标注最近核验日期。
信息核验机制
价格、免费额度、API 限制等易变信息,均以官方页面为准,并标注"最近核验日期"。发现变更会及时更新并记录。
独立性与商业关系
本站在评测上保持独立。若存在厂商合作、赞助或广告关系,会在相应页面明确标注。厂商付费不会影响评分与结论。