综合等级
待定≥5 次后评级
中位分
70σ 9.9 · 4 次
7 日在线率
—
0 次探测
平均延迟
—
趋势(近 10 次 vs 之前)
样本不足
结论一致率
100%
出现严重问题
3 / 4 次
检测过的模型
3 个
适用场景
编程 / Claude CodeFunction Calling · Prompt Caching · 流式响应合规83%
复杂推理推理 Token 计量 · 身份与确定性63%
PDF / 文档分析未测—
长上下文长上下文召回100%
结构化输出 / AgentStructured Output · Function Calling100%
日常聊天身份与确定性 · 隐藏 System Prompt 探测 · Token 用量与注入 · 协议字段合规38%
软肋
- Token 用量与注入失败 4 / 4 次
- 协议字段合规失败 3 / 4 次
- 推理 Token 计量失败 3 / 4 次
各检测项通过率(4 次检测)
Token 用量与注入0%4次
协议字段合规25%4次
隐藏 System Prompt 探测25%4次
推理 Token 计量25%4次
Prompt Caching50%4次
流式响应合规100%4次
Function Calling100%4次
Structured Output100%4次
身份与确定性100%4次
长上下文召回100%4次
按厂商汇总
检测历史
检测这个站| 时间 | 协议 | 模型 | 模式 | 分数 | 结论 | 扣分项 | |
|---|---|---|---|---|---|---|---|
| 09/13 15:55 | OpenAI | GPT-5.6 Terra | full | 68 | 存在风险 | 协议字段合规、Token 用量与注入、隐藏 System Prompt 探测(轻微)、推理 Token 计量、Prompt Caching | 查看报告 → |
| 09/13 15:29 | OpenAI | Grok 4.6 | full | 91 | 存在风险 | Token 用量与注入 | 查看报告 → |
| 09/13 14:08 | OpenAI | GPT-5.6 Sol | standard | 73 | 存在风险 | 协议字段合规、Token 用量与注入、隐藏 System Prompt 探测(轻微)、推理 Token 计量 | 查看报告 → |
| 09/13 10:51 | OpenAI | GPT-5.6 Sol | full | 67 | 存在风险 | 协议字段合规、Token 用量与注入、隐藏 System Prompt 探测(轻微)、推理 Token 计量、Prompt Caching | 查看报告 → |