TestAI.vip 公告:交流群即将开放,后续这里会展示最新检测动态与站点通知。

Scoring Rules

检测原理与评分规则

用少量可复核探针,判断中转站有没有换模型、改协议、缩水能力或隐藏风险。

12Claude
8OpenAI
7Gemini

总体流程

01探针执行

协议、身份、能力、安全、性能并行采样。

02加权平均

跳过项不计分,权重按有效项重分配。

03风险修正

critical 异常会限制最终结论。

04报告复核

每个扣分项都展示证据来源。

total_score = Σ(score × effective_weight) / Σ(effective_weight)
verdict = passed / marginal / failed
critical_issue = passed → marginal

探针权重表

normalized sum = 100
T120
Claude thinking signature

服务端签名型 thinking 证据

T212
行为指纹

模型回答习惯和边界特征

T312
长上下文

needle recall 与上下文保持

T412
协议字段

id、object、finish_reason、usage

T510
工具调用

function call / tool_use 链路

T610
结构化输出

JSON schema 与格式稳定性

T710
usage 指纹

异源 token 字段和计数异常

T86
文档能力

PDF / 文件理解探针

T94
身份一致

模型回显和基础身份核对

T104
完整性

空响应、截断、异常包装

协议专项

real detectors
Clauderaw weight 125

核心是 thinking signature。它不是普通文本风格判断,而是 Anthropic 服务端返回的签名型证据。

  • thinking_signature 25
  • behavioral_signature 15
  • long_context 15
  • structured_output 12
OpenAIraw weight 115

重点识别“OpenAI 外壳,其他后端”的情况,尤其看 usage 字段和协议结构。

  • protocol 15
  • model_consistency 15
  • function_calling 15
  • token_billing 10
Geminiraw weight 100

重点验证 OpenAI 兼容层是否真实可用,是否正确转发 Gemini 的模型和能力。

  • model_info 15
  • function_calling 15
  • structured_output 15
  • token_usage 10

风险修正规则

critical signals
信号影响触发含义
usage 异源字段passed → marginal

OpenAI 响应里出现 Claude / Gemini 后端痕迹。

thinking 证据缺失强异常

Claude 检测中,该有签名型 thinking 却没有出现。

协议结构破损大幅扣分

字段缺失、枚举非法、usage 总数不一致。

模型不可用检测无效

余额不足、模型未开通、无可用渠道,不计为质量分。

报告里能看到什么

每份报告会展示总分、最终结论、检测项状态、扣分原因和脱敏证据。API Key 只用于本次检测,不写入报告,不保存用户正文。

Key 不落库 正文不留存 证据可复核 报告可分享