Für Teams ab etwa 3.000 US-Dollar API-Kosten im Monat
Ihre KI-Rechnung ist zu hoch. Wir zeigen es Ihnen auf derselben Rechnung.
Laden Sie den Nutzungsexport von OpenAI oder Anthropic hoch. Der Rechner rechnet in Ihrem Browser, die Datei verlässt Ihren Rechner nicht. Sie sehen in Sekunden, was Batch, Prompt-Caching, Modellupdates und Routing bei Ihrer Nutzung sparen können.
- Auf Wunsch nur aus der Ersparnis bezahlt
- Nachweis auf der Anbieterrechnung, nicht auf Folien
- Rechner ohne Upload: Ihre Datei bleibt im Browser
Rechner
Unterstützt werden der Nutzungsexport von platform.openai.com (Usage, Export CSV, gruppiert nach Modell und Batch), der Kostenexport von OpenAI und die Usage-Exporte der Anthropic Console und der Anthropic Admin API. Kostenexporte ohne Tokenzahlen werden als Schätzung ausgewertet.
CSV hier ablegen oder klicken. Mehrere Dateien möglich, etwa OpenAI und Anthropic zusammen.
Alles läuft lokal in Ihrem Browser. Es wird nichts hochgeladen.
Zum Ausprobieren: Beispiel OpenAI-Export · Beispiel Anthropic-Export
Spalten zuordnen
Die Spalten wurden nicht sicher erkannt. Bitte zuordnen.
Zahlen manuell eingeben (ohne Datei)
Tragen Sie je Modell die Tokens eines typischen Monats ein. Die Werte stehen im Usage-Dashboard des Anbieters.
| Modell | Input-Tokens | Output-Tokens | davon gecacht | Batch | Aktion |
|---|
Annahmen
Startwerte aus unserer Erfahrung. Schieben Sie die Regler auf Ihre Situation, das Ergebnis rechnet sofort neu.
Ergebnis
Woher die Ersparnis kommt
Je Modell
| Modell | Kosten/Monat | Anteil | Cache heute | Modellupdate | Batch | Caching | Routing |
|---|
Was die Prüfung kostet
Erfolgsbeteiligung: 30 Prozent der nachgewiesenen Ersparnis über zwölf Monate, abgerechnet monatlich gegen die tatsächliche Anbieterrechnung. Bei Ihren Zahlen wären das –. Sie behalten –. Alternativ Festpreis, siehe unten.
Unter etwa US-Dollar je Monat lohnt eine begleitete Prüfung meist nicht. Die Maßnahmen aus dem Ergebnis oben können Sie selbst umsetzen; wenn Sie trotzdem Unterstützung möchten, bieten wir einen Bericht ohne Begleitung zum Festpreis an.
Grundlage: Listenpreise der Anbieter mit Stand . Die Zahlen oben sind eine Schätzung aus Ihren Daten und den gewählten Annahmen. Abgerechnet wird nur die Ersparnis, die auf Ihrer Anbieterrechnung nachweisbar ist. Honorar in Euro, Umrechnung zum Kurs am Rechnungstag.
Prüfung anfragenAblauf
- Export senden. Sie schicken uns den Nutzungsexport der letzten drei Monate (nur Tokenzahlen je Modell, keine Inhalte) und beantworten fünf Fragen zu Ihren Workloads. Dauer auf Ihrer Seite: 20 Minuten.
- Bericht in 48 Stunden. Je Endpunkt: was heute kostet, was Batch, Caching, Modellupdate und Routing sparen, in welcher Reihenfolge umgestellt wird und was das Risiko je Schritt ist.
- Umsetzung mit Ihrem Team oder durch uns. Die meisten Umstellungen sind Konfiguration und wenige Zeilen Code. Wir liefern Diffs, Ihr Team gibt frei. Vor jeder Umstellung läuft ein Regressionsset aus 200 echten Fällen aus Ihrem System.
- Nachweis auf der Rechnung. Wir vergleichen die Anbieterrechnung vor und nach der Umstellung, normiert auf das Anfragevolumen. Nur was dort steht, wird abgerechnet.
Was wir prüfen
Modellupdate
Ältere Modelle kosten oft mehr als ihre Nachfolger bei gleicher Stufe. Beispiel Listenpreis: Sonnet 4.6 (3/15 USD) auf Sonnet 5 (2/10 USD) senkt die Tokenkosten um ein Drittel. Ob die Qualität hält, prüfen wir vor jeder Umstellung mit einem Regressionslauf. Dazu Pflichtmigrationen vor Abschaltterminen.
Batch
Alles, was nicht in Sekunden antworten muss, kostet über die Batch-Schnittstelle bei fast allen Modellen die Hälfte (Ausnahme sind Pro-Modelle wie GPT-5.5 Pro und o3-pro). Nachtläufe, Klassifikation, Berichte, Embeddings.
Prompt-Caching
System-Prompt, Tool-Definitionen und Dokumente wiederholen sich bei jeder Anfrage. Gecachte Tokens kosten bei den aktuellen GPT- und Claude-Modellen ein Zehntel des Eingabepreises, bei GPT-4.1, o3 und o4-mini ein Viertel, bei GPT-4o die Hälfte. Die meisten Integrationen nutzen das nicht oder brechen den Cache unbemerkt.
Routing
Ein Teil der Anfragen braucht das größte Modell nicht. Ein Router mit Evaluierungsset schickt sie eine Stufe kleiner, mit Nachweis, dass die Qualität hält.
Zusätzlich im Bericht: Preisrisiken (Aktionspreise mit Enddatum, Abschaltungen), Long-Context-Aufschläge, verfallende Guthaben, Doppelabos.
Preis
Erfolgsbeteiligung
30 %
der nachgewiesenen Ersparnis über zwölf Monate ab Umstellung. Keine Ersparnis, keine Rechnung. Abrechnung monatlich gegen die Anbieterrechnung, Laufzeit zwölf Monate.
Festpreis
| bis 30.000 USD API-Kosten je Monat | 8.000 EUR |
| bis 100.000 USD | 15.000 EUR |
| bis 300.000 USD | 25.000 EUR |
| darüber | 40.000 EUR |
Bericht plus Umsetzungsbegleitung, netto. Umsetzung durch uns optional zum Tagessatz. Unter 3.000 USD je Monat: Bericht ohne Begleitung für 2.500 EUR.
Kostenlos sind der Rechner auf dieser Seite und ein Gespräch von 30 Minuten, in dem wir Ihren Export gemeinsam ansehen.