ModelTrust
菜单

独立 AI API 验证

先验证 AI API,再决定是否信任。

独立检查第三方 AI 接口的稳定性、协议完整性与行为一致性。

LEVEL 1 / AVAILABLE● 已上线

L1

运行完整性

三次有限请求,输出可用率、延迟、结构、标识与 Usage 的直接观测证据。

不提供模型身份结论 · 不提供总分

从端点到证据

01

安全提交

提供公开 HTTPS Base URL、声明模型与仅用于本次运行的 API key。

02

运行有限探针

Level 1 发送三次小型请求,并设置严格超时与响应上限。

03

查看实际证据

检查可用率、延迟、结构、模型标识、结束原因与 Usage 遥测。

当前检查覆盖什么

  • 端点可达性
  • 重复请求可靠性
  • 延迟范围与中位数
  • 响应结构完整性
  • 返回的模型标识
  • Usage 与结束原因一致性

帮助你判断第三方 AI 接口是否值得接入

开发团队

在上线前确认接口的实际表现。

采购团队

不只看模型名称,更要求可核验的证据。

AI 平台

用一致标准筛查兼容端点。

研究人员

使用有版本、边界清晰的方法。

API 服务商

了解客户能够实际观测到什么。

LEVEL 1 · AVAILABLE

当前可用能力

Level 1 运行完整性已经上线。它测量外部可观察的端点行为,但不会把这些数据包装成模型身份结论或总信任分。

REPORT / NORMALIZED EVIDENCE

证据可查看,边界写清楚

临时无密钥报告保存标准化测量数据与基准版本,不保存 API key 或完整响应正文。

查看示例报告

成熟度公开的验证体系

L0可达性可用
L1运行完整性可用
L2行为一致性研究预览
L3模型身份置信研究中
L4持续监测未来

有版本的方法,不靠黑箱评分

每份报告都标明采样方式、超时、证据字段与评估器成熟度。Level 2 在真实官方参考端点与候选端点完成生产审查前,始终属于实验性研究。

INDEPENDENCE

结构上保持独立

为测试付费,绝不为排名付费。服务商无法购买更有利的方法论待遇;观测差异是证据,不是指控。

常见问题

ModelTrust 能证明实际调用的是哪个模型吗?

不能。黑箱端点测试可以提供概率性证据,但无法证明实际使用的是哪一组底层模型权重。

ModelTrust 会保存 API key 吗?

不会。密钥只在服务端用于本次运行,不会被保存、写入日志、返回或发送给分析服务。

行为一致性已经可以使用了吗?

比较架构与评估器已经存在,但真实官方参考/候选生产运行通过发布门槛前,Level 2 仍是研究预览。

公开检查会发送多少次请求?

当前可用的 Level 1 检查发送三次有限请求,每次最多 10 秒。

报告会保留多久?

临时报告只保留标准化、无密钥证据,30 分钟后过期。

在业务依赖接口之前,先检查它。

先运行当前可用的 Level 1 检查,再判断你的场景还需要哪些额外证据。

检查 API