一次探测,只代表它的观测条件
初期从 NAS · CN 探针发出请求。每条测量保留区域、模型、协议、时间、样本数和采样覆盖。国内单点的延迟与失败可能包含本地线路影响,不能等同于服务商全球表现。
把成功、失败和缺测分开
仅返回有效生成结果的受控请求计为成功。HTTP 200、网站首页可访问或 /models 能返回,都不足以证明模型可用。失败重试不会覆盖首次失败。
覆盖率 = 已执行样本 ÷ 已记录的计划时隙
无密钥、预算不足、探针中断等计为缺测,不冒充成功。覆盖率仅针对已记录计划时隙,不包括任务禁用期或首次调度之前的时间,并非全天连续覆盖。默认展示最近 24 小时聚合,首 Token 延迟为成功生成请求的中位数。
比较实付成本,保留报价条件
报价分别记录输入、输出、缓存等计费项目,并保留币种、单位、来源和核验时间。当前价格排序仅在指定模型且存在 7 天内核验价格时生效;场景固定为 100 万输入 + 100 万输出 Token,按记录汇率折算为人民币。缓存、活动、分组倍率和充值折扣需要单独说明。
公开报价不等于已完成扣费核验。余额变化、账单和响应 usage 一致后,才可将某项实付成本标记为已验证。
异常提示,需要可复核证据
Token 注水与计费倍率检测需要专用测试账户、已知输入、完整响应 usage、对应分词器或官方计数工具,以及调用前后的余额或账单。隐藏推理、缓存、工具定义和协议封装会影响 Token 数;只看可见文本长度不能证明注水。
当前版本尚未提供自动注水判定。未经过受控审计的服务一律显示“尚未验证”;未来异常结果将包含测试方法、证据和置信范围。模型自报名称也不能证明真实上游身份。
先满足比较条件,再谈名次
可以按可用率、首 Token 延迟、指定模型价格、用户评分单项排序。综合评分仅在至少 20 次有效探测、覆盖率不低于 80%、至少 3 条已发布评价、指定模型存在 7 天内价格且延迟完整时生成;否则显示未知。
延迟分与价格分按当前符合条件的服务组计算,数值越低百分位得分越高;组内只有一个服务时为 50 分。用户评分先从 1–5 星映射为 0–100 分。样本组变化会影响相对得分。
每位用户对每个服务只能保留一条可更新评价,评价经审核后参与展示。付费收录或推广不应改变测量值与排序公式;自营服务将明确标记并应用相同规则。
数据会过时,来源必须保留
资料来源、核验时间、最近探测时间各自展示。支付方式、发票政策和接入配置由来源支撑,无法确认时明确写未知。收录仅代表目录中存在这项服务,不构成服务质量保证。
补充或提交服务资料 →