TokenCheck

Für Teams ab etwa 3.000 US-Dollar API-Kosten im Monat

Zahlen Sie zu viel für Ihre KI-API? Wir zeigen es Ihnen auf derselben Rechnung.

Laden Sie den Nutzungsexport von OpenAI oder Anthropic hoch. Der Rechner rechnet in Ihrem Browser, die Datei verlässt Ihren Rechner nicht. Sie sehen in Sekunden, was Batch, Prompt-Caching, Modellupdates und Routing bei Ihrer Nutzung sparen können.

Rechner

Unterstützt werden der Nutzungsexport von platform.openai.com (Usage, Export CSV, gruppiert nach Modell und Batch), der Kostenexport von OpenAI und die Usage-Exporte der Anthropic Console und der Anthropic Admin API. Kostenexporte ohne Tokenzahlen werden als Schätzung ausgewertet.

CSV hier ablegen oder klicken. Mehrere Dateien möglich, etwa OpenAI und Anthropic zusammen.

Alles läuft lokal in Ihrem Browser. Es wird nichts hochgeladen.

Zum Ausprobieren: Beispiel OpenAI-Export · Beispiel Anthropic-Export

Zahlen manuell eingeben (ohne Datei)

Tragen Sie je Modell die Tokens eines typischen Monats ein. Die Werte stehen im Usage-Dashboard des Anbieters.

ModellInput-TokensOutput-Tokensdavon gecachtBatchAktion

Ablauf

  1. Export senden. Sie schicken uns den Nutzungsexport der letzten drei Monate (nur Tokenzahlen je Modell, keine Inhalte) und beantworten fünf Fragen zu Ihren Workloads. Dauer auf Ihrer Seite: 20 Minuten.
  2. Bericht in 48 Stunden. Je Endpunkt: was heute kostet, was Batch, Caching, Modellupdate und Routing sparen, in welcher Reihenfolge umgestellt wird und was das Risiko je Schritt ist.
  3. Umsetzung mit Ihrem Team oder durch uns. Die meisten Umstellungen sind Konfiguration und wenige Zeilen Code. Wir liefern Diffs, Ihr Team gibt frei. Vor jeder Umstellung läuft ein Regressionsset aus 200 echten Fällen aus Ihrem System.
  4. Nachweis auf der Rechnung. Wir vergleichen die Anbieterrechnung vor und nach der Umstellung, normiert auf das Anfragevolumen. Nur was dort steht, wird abgerechnet.

Was wir prüfen

Modellupdate

Ältere Modelle kosten oft mehr als ihre Nachfolger bei gleicher Stufe. Beispiel Listenpreis je Million Tokens: Sonnet 4.6 (3/15 USD), Sonnet 5 (2/10 USD). Bei gleicher Tokenmenge wäre das ein Drittel weniger; weil Claude ab Version 4.7 einen neuen Tokenizer mit laut Anthropic bis zu 35 % mehr Tokens für denselben Text nutzt, rechnet der Rechner mit 20 % mehr Tokens und zeigt rund ein Fünftel Ersparnis. Den echten Wert messen wir vor der Umstellung an Ihren Prompts, die Qualität mit einem Regressionslauf. Dazu Pflichtmigrationen vor Abschaltterminen.

Batch

Alles, was nicht in Sekunden antworten muss, kostet über die Batch-Schnittstelle bei fast allen Modellen die Hälfte (Ausnahme sind Pro-Modelle wie GPT-5.5 Pro und o3-pro). Nachtläufe, Klassifikation, Berichte, Embeddings.

Prompt-Caching

System-Prompt, Tool-Definitionen und Dokumente wiederholen sich bei jeder Anfrage. Gecachte Tokens kosten bei den aktuellen GPT- und Claude-Modellen ein Zehntel des Eingabepreises, bei GPT-4.1, o3 und o4-mini ein Viertel, bei GPT-4o die Hälfte. Die meisten Integrationen nutzen das nicht oder brechen den Cache unbemerkt.

Routing

Ein Teil der Anfragen braucht das größte Modell nicht. Ein Router mit Evaluierungsset schickt sie eine Stufe kleiner, mit Nachweis, dass die Qualität hält.

Zusätzlich im Bericht: Preisrisiken (Aktionspreise mit Mindestdauer, Abschaltungen), Long-Context-Aufschläge, verfallende Guthaben, Doppelabos.

Preis

Erfolgsbeteiligung

30 %

der nachgewiesenen Ersparnis über zwölf Monate ab Umstellung. Keine Ersparnis, keine Rechnung. Abrechnung monatlich gegen die Anbieterrechnung, Laufzeit zwölf Monate.

Festpreis

bis 30.000 USD API-Kosten je Monat8.000 EUR
bis 100.000 USD15.000 EUR
bis 300.000 USD25.000 EUR
darüber40.000 EUR

Bericht plus Umsetzungsbegleitung, netto. Umsetzung durch uns optional zum Tagessatz. Unter 3.000 USD je Monat: Bericht ohne Begleitung für 2.500 EUR.

Kostenlos sind der Rechner auf dieser Seite und ein Gespräch von 30 Minuten, in dem wir Ihren Export gemeinsam ansehen.

Prüfung anfragen

Mitgesendet werden die Summenwerte des Rechners (aktuelle Kosten, geschätzte Ersparnis, Modellnamen), sofern Sie ihn genutzt haben. Rohdaten aus Ihrer Datei nicht.