Tokenpreise(USD je 1 Mio. Tokens)

USD / 1 Mio. Tokens
ModellEingabeAusgabeZwischengespeicherte EingabeQuelle
deepseek-flashDeepSeek 0,30 $1,20 $0,006 $Quelle 10. Okt.
deepseek-v4-proDeepSeek 1,32 $3,96 $0,044 $Quelle 10. Okt.

Übliche API-Preise. Steuern, Tools und Abos sind nicht enthalten.

Kontext

deepseek-flash · Preis zur Spitzenzeit. Außerhalb der Spitzenzeiten gilt der halbe Preis; offizielle UTC-Zeiten beachten.

deepseek-v4-pro · Preis zur Spitzenzeit. Außerhalb der Spitzenzeiten gilt der halbe Preis; offizielle UTC-Zeiten beachten.

Tokenkosten schätzen

Geschätzte Kosten—

Schätzung nur für Tokens, keine tatsächliche Aufgabenrechnung. Zusätzliche Tool-Aufrufe und Wiederholungen sind nicht enthalten.

Preis-Leistung →

Häufig gestellte Fragen

Mehr
In welcher Einheit werden KI-Tokenpreise angegeben?

Die Preise sind in US-Dollar je eine Million Tokens angegeben. Eingabe, Ausgabe und Cache-Eingabe haben getrennte Tarife. Es handelt sich um API-Preise, nicht um Abogebühren für ChatGPT, Claude oder Grok.

Wie werden die Kosten einer API-Anfrage berechnet?

Multipliziere jede Tokenanzahl mit dem passenden Tarif, addiere die Beträge und teile das Ergebnis durch eine Million. Cache-Eingabe ersetzt einen Teil der Eingabe und wird nicht doppelt gezählt. Der Rechner nutzt verifizierte Tarife und zeigt „unbekannt“ an, wenn ein erforderlicher Tarif fehlt.

Ändert ein Modellwechsel die Tabellenreihenfolge?

In der Vergleichstabelle auf der Startseite ändert die Modellauswahl nur die Zeile dieses Anbieters. Klicke auf den Pfeil in der Eingabe- oder Ausgabespalte, um ausdrücklich zu sortieren. Ein niedriger Eingabepreis bedeutet nicht unbedingt niedrige Gesamtkosten.

Kann ich davon ausgehen, dass jedes Eingabetoken zum Cache-Preis abgerechnet wird?

Nein. Ein angegebener Cache-Tarif garantiert keinen Cache-Treffer. Verwende die Cache-Abrechnung nur für Eingaben, die von den Cache-Regeln des Anbieters abgedeckt sind. Der Rechner verlangt, dass die Cache-Eingabe höchstens der Gesamteingabe entspricht, und nimmt keinen Rabatt an, wenn der Tarif unbekannt ist.

Kann sich der Tokenpreis bei langem Kontext ändern?

Manche veröffentlichten Preisbedingungen unterscheiden zwischen Kontextlängen oder anderen Anfrageeinstellungen. Prüfe die Kontexthinweise und die Quelle für das ausgewählte Modell. Wenn verfügbar, verwendet der Rechner einen erfassten Tarif für langen Kontext; fehlende Tarife werden nicht erfunden.

Ist das Modell mit dem günstigsten Eingabepreis immer insgesamt am günstigsten?

Nein. Die Gesamtkosten hängen von Eingabe, Ausgabe und gegebenenfalls Cache-Tokens ab. Ein Modell mit günstiger Eingabe, aber teurer Ausgabe kann bei einer langen Antwort mehr kosten. Gib die erwartete Tokenanzahl in den Rechner ein und vergleiche die Tarife getrennt.