Eine abgebrochene OpenAI-Anfrage kostet die volle Antwort
Brechen Sie eine OpenAI-Anfrage vorzeitig ab, zahlen Sie für die gesamte Antwort. Sie zahlen nicht nur für den Teil, den Sie gelesen haben. Ein vergleichbarer Abbruch bei einem Anthropic- oder Google-Modell stoppt die Abrechnung an der Stelle, an der Sie abgebrochen haben. Dies gilt, wenn wir Anthropic oder Google selbst aufrufen. Wenn Sie eine Anfrage an Bedrock oder Vertex pinnen, lesen wir sie bis zum Ende, genau wie bei OpenAI. Der Abbruch beendet Ihre Verbindung sofort, sodass nichts mehr an Ihre Anwendung gestreamt wird. Die Generierung bei OpenAI läuft jedoch weiter, und Sie zahlen dafür. OpenAI bietet uns keine Möglichkeit, eine Streaming-Antwort zu stoppen, und meldet keine Nutzung für eine vorzeitig beendete Antwort, sodass wir Ihnen stattdessen nichts Genaues in Rechnung stellen können. Wir arbeiten an einer Alternative, und diese Seite wird aktualisiert, sobald diese verfügbar ist. Ihre Logs zeigen eine abgebrochene Anfrage als Canceled an. Die Token-Zahlen entsprechen denen, die der Provider gemeldet hat, bevor Sie die Anfrage gestoppt haben. Zwei Dinge helfen in der Zwischenzeit. Setzen Siemax_output_tokens, damit eine abgebrochene Anfrage eine von Ihnen akzeptierte Länge nicht überschreiten kann. Verwenden Sie Anthropic- oder Google-Modelle, wenn der Abbruch wichtiger ist als die Modellwahl.