协议、身份、能力、安全、性能并行采样。
Scoring Rules
检测原理与评分规则
用少量可复核探针,判断中转站有没有换模型、改协议、缩水能力或隐藏风险。
12Claude
8OpenAI
7Gemini
总体流程
跳过项不计分,权重按有效项重分配。
critical 异常会限制最终结论。
每个扣分项都展示证据来源。
total_score = Σ(score × effective_weight) / Σ(effective_weight)
verdict = passed / marginal / failed
critical_issue = passed → marginal
探针权重表
normalized sum = 100T120
Claude thinking signature服务端签名型 thinking 证据
T212
行为指纹模型回答习惯和边界特征
T312
长上下文needle recall 与上下文保持
T412
协议字段id、object、finish_reason、usage
T510
工具调用function call / tool_use 链路
T610
结构化输出JSON schema 与格式稳定性
T710
usage 指纹异源 token 字段和计数异常
T86
文档能力PDF / 文件理解探针
T94
身份一致模型回显和基础身份核对
T104
完整性空响应、截断、异常包装
协议专项
real detectors核心是 thinking signature。它不是普通文本风格判断,而是 Anthropic 服务端返回的签名型证据。
- thinking_signature 25
- behavioral_signature 15
- long_context 15
- structured_output 12
重点识别“OpenAI 外壳,其他后端”的情况,尤其看 usage 字段和协议结构。
- protocol 15
- model_consistency 15
- function_calling 15
- token_billing 10
重点验证 OpenAI 兼容层是否真实可用,是否正确转发 Gemini 的模型和能力。
- model_info 15
- function_calling 15
- structured_output 15
- token_usage 10
风险修正规则
critical signals信号影响触发含义
usage 异源字段passed → marginal
OpenAI 响应里出现 Claude / Gemini 后端痕迹。
thinking 证据缺失强异常
Claude 检测中,该有签名型 thinking 却没有出现。
协议结构破损大幅扣分
字段缺失、枚举非法、usage 总数不一致。
模型不可用检测无效
余额不足、模型未开通、无可用渠道,不计为质量分。
报告里能看到什么
每份报告会展示总分、最终结论、检测项状态、扣分原因和脱敏证据。API Key 只用于本次检测,不写入报告,不保存用户正文。