OpenAIOpenAI (Chat Completions)
apinebula.ai
Grok 4.3 (grok-4.3) · 标准模式 · 08/29 11:37 · 耗时 31s
存在 1 项严重问题,即使总分较高也不建议重度使用
- ⚠Token 用量与注入:一句话提示消耗 200 prompt tokens(官方约 12):注入了隐藏指令或虚报用量
73
存在风险
首 token 0.96s · 往返 1.70s
失败协议字段合规usage 混入 Anthropic 风格字段(input_tokens,output_tokens,claude_cache_creation_5_m_tokens,claude_cache_creation_1_h_tokens):响应不是官方原样透传。若身份或 logprobs 项同时失败,底层大概率是 Claude 经协议转换伪装成 GPT权重 12 · 30›
usage 混入 Anthropic 风格字段(input_tokens,output_tokens,claude_cache_creation_5_m_tokens,claude_cache_creation_1_h_tokens):响应不是官方原样透传。若身份或 logprobs 项同时失败,底层大概率是 Claude 经协议转换伪装成 GPT
{
"status": 200,
"id": "ea82ef29-3cab-9800-89b8-e6607cab480c",
"model": "grok-4.3",
"system_fingerprint": "",
"usage": {
"prompt_tokens": 200,
"completion_tokens": 79,
"total_tokens": 279,
"prompt_tokens_details": {
"cached_tokens": 128,
"text_tokens": 0,
"audio_tokens": 0,
"image_tokens": 0
},
"completion_tokens_details": {
"text_tokens": 1,
"audio_tokens": 0,
"image_tokens": 0,
"reasoning_tokens": 78
},
"input_tokens": 0,
"output_tokens": 0,
"input_tokens_details": null,
"claude_cache_creation_5_m_tokens": 0,
"claude_cache_creation_1_h_tokens": 0
},
"topKeys": [
"id",
"object",
"created",
"model",
"choices",
"usage",
"system_fingerprint"
],
"finish_reason": "stop",
"latencyMs": 1697,
"content": "OK"
}耗时 1.7s · 严重度 major
注意流式响应合规流式 usage 同样混入 Anthropic 风格字段(已在协议项计分,此处不重复扣分)权重 8 · 70›
流式 usage 同样混入 Anthropic 风格字段(已在协议项计分,此处不重复扣分)
{
"status": 200,
"ttftMs": 965,
"chunks": 32,
"done": true,
"distinctIds": 1,
"objects": [
"chat.completion.chunk"
],
"usage": {
"prompt_tokens": 207,
"completion_tokens": 193,
"total_tokens": 400,
"prompt_tokens_details": {
"cached_tokens": 128,
"text_tokens": 0,
"audio_tokens": 0,
"image_tokens": 0
},
"completion_tokens_details": {
"text_tokens": 0,
"audio_tokens": 0,
"image_tokens": 0,
"reasoning_tokens": 180
},
"input_tokens": 0,
"output_tokens": 0,
"input_tokens_details": null,
"claude_cache_creation_5_m_tokens": 0,
"claude_cache_creation_1_h_tokens": 0
}
}耗时 2.4s · 严重度 minor
注意Function Callingtool_call id 前缀非官方 call_:call-adc18005-1b1d-4a2e-9135-06cfa20c5a9b-0权重 10 · 65›
tool_call id 前缀非官方 call_:call-adc18005-1b1d-4a2e-9135-06cfa20c5a9b-0
{
"finish_reason": "tool_calls",
"toolCall": {
"id": "call-adc18005-1b1d-4a2e-9135-06cfa20c5a9b-0",
"type": "function",
"function": {
"name": "get_weather",
"arguments": "{\"city\":\"Tokyo\",\"unit\":\"c\"}"
}
},
"content": ""
}耗时 3.0s · 严重度 minor
通过Structured Output严格 JSON Schema 输出正确权重 8 · 100›
严格 JSON Schema 输出正确
{
"content": "{\"city\":\"Tokyo\",\"population_millions\":14}"
}耗时 4.1s · 严重度 info
跳过logprobs 支持推理模型不支持 logprobs权重 6 · —›
推理模型不支持 logprobs
耗时 0.0s · 严重度 info
失败Token 用量与注入一句话提示消耗 200 prompt tokens(官方约 12):注入了隐藏指令或虚报用量权重 8 · 15›
一句话提示消耗 200 prompt tokens(官方约 12):注入了隐藏指令或虚报用量
{
"prompt_tokens": [
200,
200
],
"completion_tokens": [
69,
98
],
"expectedApprox": "10-16"
}耗时 1.7s · 严重度 critical
通过隐藏 System Prompt 探测模型确认无隐藏指令权重 5 · 100›
模型确认无隐藏指令
{
"reply": "NONE"
}耗时 4.1s · 严重度 info
通过身份与确定性身份为 xAI,输出稳定权重 6 · 100›
身份为 xAI,输出稳定
{
"who": "xAI",
"math": [
"391",
"391"
],
"models": [
"grok-4.3",
"grok-4.3",
"grok-4.3"
],
"fingerprints": [
"",
""
]
}耗时 2.0s · 严重度 info
通过推理 Token 计量推理正常,消耗 471 reasoning tokens权重 6 · 100›
推理正常,消耗 471 reasoning tokens
{
"reasoning_tokens": 471,
"completion_tokens": 580,
"answer": "5\nThe correct solution is found by setti…"
}耗时 4.9s · 严重度 info
通过Prompt Caching第二次请求命中缓存 192 tokens权重 6 · 100›
第二次请求命中缓存 192 tokens
{
"first": {
"prompt": 1964,
"cached": 128
},
"second": {
"prompt": 1964,
"cached": 192
}
}耗时 4.0s · 严重度 info
通过长上下文召回长上下文召回全部通过(最高 32k)权重 10 · 100›
长上下文召回全部通过(最高 32k)
{
"tiers": [
{
"tokens": 32000,
"ok": true,
"status": 200,
"latencyMs": 2943,
"promptTokens": 18903
}
]
}耗时 2.9s · 严重度 info
这份报告对你有帮助吗?
评分 = Σ(单项分 × 权重) / Σ权重(跳过项不计)。≥70 通过,50–69 存在风险,<50 未达标;出现任一严重问题时结论封顶为「存在风险」。单次检测受网络与上游波动影响,建议结合该域名的历史记录判断。