ToolBrief
菜单

评测方法

本方法公开证据强度、范围、时间、限制与审核责任,帮助读者在实际语境中判断每项建议。

三种证据等级

每款工具都会展示证据等级:

  • 基于资料研究: 已查阅当前官方来源,核验产品范围、价格、重要限制、数据处理和可用性,但不声称完成了受控质量实测。
  • 已实测: 在资料研究基础上增加有记录的任务、平台与日期、输入、预期结果、可安全保存的证据材料和观察到的限制。
  • 深度评测: 在更广评估中比较可重复工作流、困难案例、替代工具、总成本与故障恢复。

证据等级说明我们核验了什么,不代表产品流行度或质量。基于资料研究的页面可以很详细、很实用,但不会伪装成已经实测。

来源流程

审核人从官网、产品和帮助文档、价格、条款、隐私和安全资料、许可证、状态信息和当前所有权开始。每条结构化来源都记录访问日期,并标注重要的方案、地区、账号、API 与消费者/商业版本差异。

第三方来源可以帮助发现停机、争议或疑问,但重大产品陈述应关联当前官方来源,或者明确标记为尚未解决。官方资料相互冲突时,评测会披露差异。

工作流评估

比较产品前先定义任务。标准可以包括输入输出格式、来源可追踪、编辑与导出、协作、权限、计费单位、隐私路径、错误恢复和人工复核时间。

测试会采用有代表性且困难的案例,而不只运行精美演示。对于 Agent,可能测试权限、部分失败、提示注入、重复动作、成本上限和员工离职;对于生成工具,可能测试权利、可编辑性、导出、无来源陈述和复核投入。

一次成功提示不能被泛化成可靠性声明。测试结论只适用于记录的日期、方案、模型、平台、设置和输入。

价格与总成本

在资料允许时,价格会记录币种、计费周期、年度折合与灵活月付差异、包含用量、超额、席位、点数、任务、API 调用、存储和重要附加项。公开价格只是时间快照,不是报价。

建议会考虑得到已审核成果的成本,包括重试、导出清理、实施、维护、闲置席位和人工验证。“免费”和“不限量”也会同时披露重要限制与公平使用边界。

隐私、安全、权利与风险

评测会拆开模型训练、推理、留存、日志、反馈、子处理者、分享和删除。Enterprise 的方案级声明不会被外推到消费者方案,认证与加密也会按范围呈现,不作为完整安全保证。

需要时还会记录商业使用权、所有权、来源许可证、人脸或声音同意、代码和数据访问,以及高影响用途限制。收录不等于法律或安全批准。

本地化与内部审核

英文是源记录。简体中文与繁体中文版本会保留完整决策指南,同时调整术语、示例和链接。每种批准语言都有审核人,并必须通过内容结构、元数据、内部链接和语言路径检查。

发布前,自动检查覆盖必填字段、元数据长度、内容图谱、关联页面、社交元数据、结构化数据、重复关键词、孤儿页、sitemap 一致性、类型、代码规范、测试和生产构建。自动化用于发现问题,但最终结论仍由人负责。

更新与纠错

可见核验或更新日期表示最后一次重大复核。高流量和变化快的工具会接受更频繁检查;价格、所有权、停运、模型或供应商、隐私条款、安全事故和重大产品变化都可能触发即时复核。

证据过时或无法确认时,工具可能降低展示优先级、标为归档或停止服务,或移出推荐。读者可以通过联系页面提交当前官方来源申请纠错。