OpenAIOpenAI (Chat Completions)
apinebula.ai
Grok 4.5 (grok-4.5) · 标准模式 · 08/29 11:37 · 耗时 33s
存在 1 项严重问题,即使总分较高也不建议重度使用
- ⚠Token 用量与注入:一句话提示消耗 214 prompt tokens(官方约 12):注入了隐藏指令或虚报用量
73
存在风险
首 token 1.04s · 往返 2.03s
失败协议字段合规usage 混入 Anthropic 风格字段(input_tokens,output_tokens,claude_cache_creation_5_m_tokens,claude_cache_creation_1_h_tokens):响应不是官方原样透传。若身份或 logprobs 项同时失败,底层大概率是 Claude 经协议转换伪装成 GPT权重 12 · 30›
usage 混入 Anthropic 风格字段(input_tokens,output_tokens,claude_cache_creation_5_m_tokens,claude_cache_creation_1_h_tokens):响应不是官方原样透传。若身份或 logprobs 项同时失败,底层大概率是 Claude 经协议转换伪装成 GPT
{
"status": 200,
"id": "ac4ef7b0-525e-9509-9cf3-f47a65f84cdd",
"model": "grok-4.5-build",
"system_fingerprint": "",
"usage": {
"prompt_tokens": 214,
"completion_tokens": 48,
"total_tokens": 262,
"prompt_tokens_details": {
"cached_tokens": 128,
"text_tokens": 0,
"audio_tokens": 0,
"image_tokens": 0
},
"completion_tokens_details": {
"text_tokens": 1,
"audio_tokens": 0,
"image_tokens": 0,
"reasoning_tokens": 47
},
"input_tokens": 0,
"output_tokens": 0,
"input_tokens_details": null,
"claude_cache_creation_5_m_tokens": 0,
"claude_cache_creation_1_h_tokens": 0
},
"topKeys": [
"id",
"object",
"created",
"model",
"choices",
"usage",
"system_fingerprint"
],
"finish_reason": "stop",
"latencyMs": 2029,
"content": "OK"
}耗时 2.0s · 严重度 major
注意流式响应合规流式 usage 同样混入 Anthropic 风格字段(已在协议项计分,此处不重复扣分)权重 8 · 70›
流式 usage 同样混入 Anthropic 风格字段(已在协议项计分,此处不重复扣分)
{
"status": 200,
"ttftMs": 1043,
"chunks": 33,
"done": true,
"distinctIds": 1,
"objects": [
"chat.completion.chunk"
],
"usage": {
"prompt_tokens": 221,
"completion_tokens": 99,
"total_tokens": 320,
"prompt_tokens_details": {
"cached_tokens": 0,
"text_tokens": 0,
"audio_tokens": 0,
"image_tokens": 0
},
"completion_tokens_details": {
"text_tokens": 0,
"audio_tokens": 0,
"image_tokens": 0,
"reasoning_tokens": 86
},
"input_tokens": 0,
"output_tokens": 0,
"input_tokens_details": null,
"claude_cache_creation_5_m_tokens": 0,
"claude_cache_creation_1_h_tokens": 0
}
}耗时 3.3s · 严重度 minor
注意Function Callingtool_call id 前缀非官方 call_:call-923ca493-3f8a-4fa3-8ddc-1d232a417938-0权重 10 · 65›
tool_call id 前缀非官方 call_:call-923ca493-3f8a-4fa3-8ddc-1d232a417938-0
{
"finish_reason": "tool_calls",
"toolCall": {
"id": "call-923ca493-3f8a-4fa3-8ddc-1d232a417938-0",
"type": "function",
"function": {
"name": "get_weather",
"arguments": "{\"city\":\"Tokyo\",\"unit\":\"c\"}"
}
},
"content": ""
}耗时 2.6s · 严重度 minor
通过Structured Output严格 JSON Schema 输出正确权重 8 · 100›
严格 JSON Schema 输出正确
{
"content": "{\"city\":\"Tokyo\",\"population_millions\":14}"
}耗时 3.7s · 严重度 info
跳过logprobs 支持推理模型不支持 logprobs权重 6 · —›
推理模型不支持 logprobs
耗时 0.0s · 严重度 info
失败Token 用量与注入一句话提示消耗 214 prompt tokens(官方约 12):注入了隐藏指令或虚报用量权重 8 · 15›
一句话提示消耗 214 prompt tokens(官方约 12):注入了隐藏指令或虚报用量
{
"prompt_tokens": [
214,
214
],
"completion_tokens": [
66,
53
],
"expectedApprox": "10-16"
}耗时 2.2s · 严重度 critical
通过隐藏 System Prompt 探测模型确认无隐藏指令权重 5 · 100›
模型确认无隐藏指令
{
"reply": "NONE"
}耗时 3.2s · 严重度 info
通过身份与确定性身份为 xAI,输出稳定权重 6 · 100›
身份为 xAI,输出稳定
{
"who": "xAI",
"math": [
"391",
"391"
],
"models": [
"grok-4.5-build",
"grok-4.5-build",
"grok-4.5-build"
],
"fingerprints": [
"",
""
]
}耗时 2.7s · 严重度 info
通过推理 Token 计量推理正常,消耗 171 reasoning tokens权重 6 · 100›
推理正常,消耗 171 reasoning tokens
{
"reasoning_tokens": 171,
"completion_tokens": 172,
"answer": "5"
}耗时 3.8s · 严重度 info
通过Prompt Caching第二次请求命中缓存 128 tokens权重 6 · 100›
第二次请求命中缓存 128 tokens
{
"first": {
"prompt": 1978,
"cached": 128
},
"second": {
"prompt": 1975,
"cached": 128
}
}耗时 3.9s · 严重度 info
通过长上下文召回长上下文召回全部通过(最高 32k)权重 10 · 100›
长上下文召回全部通过(最高 32k)
{
"tiers": [
{
"tokens": 32000,
"ok": true,
"status": 200,
"latencyMs": 5182,
"promptTokens": 18915
}
]
}耗时 5.2s · 严重度 info
这份报告对你有帮助吗?
评分 = Σ(单项分 × 权重) / Σ权重(跳过项不计)。≥70 通过,50–69 存在风险,<50 未达标;出现任一严重问题时结论封顶为「存在风险」。单次检测受网络与上游波动影响,建议结合该域名的历史记录判断。