prompt_cache_key 是什么特性,模型选择“首选可用”,配置了 1 个账号,有多个上游,现在一直命中第一个,即使第一个返回错误,也没有切到第二个上游。用 docker 部署的 latest
这是上游的 response:
{
"type": "response.failed",
"response": {
"id": "resp_05213572943d5c61016aa794c408a887d0b53591e0b90bc990",
"object": "response",
"created_at": 1789367492,
"status": "failed",
"background": false,
"completed_at": null,
"error": {
"code": "server_error",
"message": "Our servers are currently overloaded. Please try again later."
},
"frequency_penalty": 0,
"max_tool_calls": null,
"model": "gpt-5.6-terra",
"moderation": null,
"presence_penalty": 0,
"previous_response_id": null,
"prompt_cache_key": "3ac9a2e42f9ce975",
"prompt_cache_retention": "24h",
"safety_identifier": "user-FUNwHz0HFakp",
"service_tier": "default",
"store": false,
"temperature": 1,
"tool_usage": {
"image_gen": {
"input_tokens": 0,
"input_tokens_details": {
"image_tokens": 0,
"text_tokens": 0
},
"output_tokens": 0,
"output_tokens_details": {
"image_tokens": 0,
"text_tokens": 0
},
"total_tokens": 0
},
"web_search": {
"num_requests": 0
}
},
"top_logprobs": 0,
"top_p": 0.98,
"user": null
},
"sequence_number": 4
}