取消 OpenAI 请求仍需支付完整费用
如果您在 OpenAI 请求进行到一半时取消,您仍需支付整个响应的费用,而不是仅为您已读取的部分付费。而对于 Anthropic 或 Google 模型,在您取消请求时,费用会停止在您取消的那一刻。 当我们直接调用 Anthropic 或 Google 模型时,取消请求会停止计费。但如果您通过 Bedrock 或 Vertex 使用 Anthropic 或 Google 模型,我们会像处理 OpenAI 请求一样,将其读取到最后,这意味着取消请求不会停止计费。 取消请求会立即终止您与我们的连接,因此您的应用程序不会再接收到任何流式数据。然而,OpenAI 端的生成过程会继续进行,您仍需为此付费。OpenAI 没有提供停止流式响应的方法,也不会报告提前停止的请求的使用量,因此我们无法准确地为您提供替代的计费方式。我们正在开发一种解决方案,本页内容将在方案落地后进行更新。 您的日志会将已停止的请求显示为 Canceled。其 token 计数是提供商在您停止之前报告的数值。 在此期间,有两点建议可以帮助您。一是设置max_output_tokens,以确保即使取消请求,其运行长度也不会超出您可接受的范围。二是当停止计费比模型选择更重要时,请使用 Anthropic 或 Google 模型。