综合等级
待定≥5 次后评级
中位分
54σ 2.8 · 2 次
7 日在线率
—
0 次探测
平均延迟
—
趋势(近 10 次 vs 之前)
样本不足
结论一致率
100%
出现严重问题
2 / 2 次
检测过的模型
1 个
适用场景
编程 / Claude CodeFunction Calling · Prompt Caching · 流式响应合规67%
复杂推理推理 Token 计量 · 身份与确定性25%
PDF / 文档分析未测—
长上下文长上下文召回50%
结构化输出 / AgentStructured Output · Function Calling100%
日常聊天身份与确定性 · 隐藏 System Prompt 探测 · Token 用量与注入 · 协议字段合规13%
软肋
- 协议字段合规失败 2 / 2 次
- Token 用量与注入失败 2 / 2 次
- 推理 Token 计量失败 2 / 2 次
各检测项通过率(2 次检测)
协议字段合规0%2次
Token 用量与注入0%2次
隐藏 System Prompt 探测0%2次
推理 Token 计量0%2次
流式响应合规50%2次
身份与确定性50%2次
Prompt Caching50%2次
长上下文召回50%2次
Function Calling100%2次
Structured Output100%2次
按厂商汇总
OpenAI54
2 次检测 · 1 个模型 · 通过率 0%
最近 5 小时前
检测历史
检测这个站| 时间 | 协议 | 模型 | 模式 | 分数 | 结论 | 扣分项 | |
|---|---|---|---|---|---|---|---|
| 09/13 11:14 | OpenAI | GPT-5.6 Sol | standard | 57 | 存在风险 | 协议字段合规、流式响应合规(轻微)、Token 用量与注入、隐藏 System Prompt 探测(轻微)、身份与确定性、推理 Token 计量 | 查看报告 → |
| 09/13 11:07 | OpenAI | GPT-5.6 Sol | full | 51 | 存在风险 | 协议字段合规、Token 用量与注入、隐藏 System Prompt 探测(轻微)、推理 Token 计量、Prompt Caching、长上下文召回(轻微) | 查看报告 → |