综合等级
待定≥5 次后评级
中位分
77σ 21.8 · 4 次
7 日在线率
—
0 次探测
平均延迟
—
趋势(近 10 次 vs 之前)
样本不足
结论一致率
50%
出现严重问题
3 / 4 次
检测过的模型
3 个
适用场景
编程 / Claude CodeFunction Calling · Prompt Caching · 流式响应合规58%
复杂推理推理 Token 计量 · 身份与确定性63%
PDF / 文档分析未测—
长上下文长上下文召回75%
结构化输出 / AgentStructured Output · Function Calling75%
日常聊天身份与确定性 · Token 用量与注入 · 协议字段合规33%
软肋
- 协议字段合规失败 3 / 4 次
- Token 用量与注入失败 3 / 4 次
- Prompt Caching失败 1 / 4 次
各检测项通过率(4 次检测)
协议字段合规0%4次
Token 用量与注入25%4次
Prompt Caching25%4次
推理 Token 计量50%4次
流式响应合规75%4次
Function Calling75%4次
Structured Output75%4次
身份与确定性75%4次
长上下文召回75%4次
按厂商汇总
OpenAI77
4 次检测 · 3 个模型 · 通过率 25%
最近 7 小时前
检测历史
检测这个站| 时间 | 协议 | 模型 | 模式 | 分数 | 结论 | 扣分项 | |
|---|---|---|---|---|---|---|---|
| 09/22 03:57 | OpenAI | GPT-5.6 Terra | full | 86 | 通过 | 协议字段合规、Prompt Caching(轻微) | 查看报告 → |
| 09/22 03:57 | OpenAI | GPT-5.6 Sol | full | 77 | 存在风险 | 协议字段合规、Token 用量与注入、推理 Token 计量(轻微) | 查看报告 → |
| 09/22 03:57 | OpenAI | GPT-5.6 | full | 31 | 未达标 | 协议字段合规(轻微)、流式响应合规、Function Calling、Structured Output、Token 用量与注入、身份与确定性(轻微)、推理 Token 计量(轻微)、Prompt Caching、长上下文召回 | 查看报告 → |
| 09/22 03:28 | OpenAI | GPT-5.6 Sol | standard | 77 | 存在风险 | 协议字段合规、Token 用量与注入、Prompt Caching(轻微) | 查看报告 → |