DESTINYDeutschland TokenCheck Prüfung anfragen

Methodik: Wie der Rechner rechnet

Der Rechner läuft vollständig in Ihrem Browser, bewertet jede Zeile Ihres Nutzungsexports zu Listenpreisen mit Stand 17.09.2026 und rechnet vier Maßnahmen durch. Das Ergebnis ist ein Szenario, kein Nachweis. Die Engine (calc.js, prices.js) ist unverschleiertes JavaScript im Seitenquelltext.

Eingaben

Gelesen werden CSV-Dateien mit Komma, Semikolon oder Tabulator, deutsche und englische Zahlen- und Datumsformate (auch Unix-Zeitstempel) sowie Titelzeilen vor der Kopfzeile. Drei Formate: Tokenspalten je Zeile (OpenAI Usage-Export nach Modell und Batch, Anthropic Console und Admin API), Langformat mit Nutzungsart und Tokenanzahl (Anthropic Console) sowie Kostenexporte ohne Tokenzahlen (OpenAI Costs), die nur als gekennzeichnete Schätzung ohne Modellupdate ausgewertet werden.

Spalten werden über die Kopfzeile erkannt: Modell, Input-, Output-, Cache-Lese- und Cache-Schreib-Tokens, Batch-Kennzeichen (batch, is_batch, service_tier), Anfragen, Datum, Kosten; sonst erscheint ein Dialog zur manuellen Zuordnung. Modellnamen werden normalisiert, auch Bedrock-Präfixe wie eu.anthropic.claude-sonnet-4-5-20250929-v1:0. Ein Modell ohne hinterlegten Preis wird nicht geraten, sondern als nicht bewertet ausgewiesen.

Cache-Tokens bei OpenAI und Anthropic

Bei OpenAI sind gecachte Tokens (input_cached_tokens) eine Teilmenge der Input-Tokens. Bei Anthropic enthält input_tokens nur den ungecachten Anteil; cache_read_input_tokens und cache_creation_input_tokens kommen hinzu. Der Rechner erkennt das Anthropic-Schema an Spaltennamen oder Anbieter und addiert die Cache-Tokens auf den Input, so dass beide Anbieter intern gleich behandelt werden. Übersteigen Cache-Tokens die Input-Tokens, erscheint ein Hinweis zur Cache-Semantik.

Kosten je Zeile = ungecachter Input mal Inputpreis plus Cache-Lesen mal Cache-Lesepreis plus Cache-Schreiben mal Cache-Schreibpreis plus Output mal Outputpreis, je Million Tokens; Batch-Zeilen mit Faktor 0,5, Modelle ohne Batch-Angebot (GPT-5.5 Pro, o3-pro, o1-pro) zum vollen Preis.

Zeitraum

Alle Summen werden auf 30 Tage normiert. Zeitraum = letzter Tag minus erster Tag plus Bucket-Breite; die Breite ist ein Tag, bei gleichmäßigen Abständen von sieben oder 28 bis 31 Tagen die Wochen- oder Monatsbreite (fünf Wochenbuckets ergeben 35 Tage). Doppelte Tage zählen einmal. Ohne Datumsspalte gelten 30 Tage; das Feld „Zeitraum der Daten in Tagen“ überschreibt beides.

Die vier Hebel

Je Modell in fester Reihenfolge; jeder Hebel rechnet auf dem Rest des vorherigen.

1. Modellupdate

Hat ein Modell einen hinterlegten Nachfolger gleicher oder besserer Stufe (Sonnet 4.6 auf Sonnet 5, GPT-5.5 auf GPT-5.6 Sol), wird jede Zeile mit dessen Preisen neu bewertet, inklusive Batch-Kennzeichen: Ersparnis = heutige Kosten minus Kosten beim Nachfolger. Ist der Nachfolger teurer, bleibt das Modell und die Mehrkosten werden gemeldet. Claude 4.7 und neuer (Sonnet 5, Opus 5, Fable 5) nutzen einen neuen Tokenizer, der laut Anthropic für denselben Text bis zu 35 Prozent mehr Tokens erzeugen kann; beim Wechsel von einem älteren Claude-Modell rechnet der Rechner deshalb mit Faktor 1,2 auf alle Tokens. Beispiel: 1 Mio. Input- und 0,2 Mio. Output-Tokens kosten auf Sonnet 4.6 6,00 USD, auf Sonnet 5 4,00 USD mal 1,2 = 4,80 USD; ausgewiesen werden 1,20 USD (20 Prozent), nicht ein Drittel. Den echten Faktor messen wir vor der Umstellung mit count_tokens an Ihren Prompts.

2. Batch

Ersparnis = Kosten der Zeilen, die heute nicht über Batch laufen (kostengewichtet, also ihre tatsächlichen Kosten statt ihres Tokenanteils; nach einem Update anteilig verringert) mal Batch-Anteil mal 0,5.

3. Prompt-Caching

Vom noch ungecachten Input gilt der eingestellte Anteil als cachefähig; davon zählen 85 Prozent als Cache-Treffer, 15 Prozent als Schreibvorgänge. Ersparnis = Treffer mal (Inputpreis minus Cache-Lesepreis) minus Schreibvorgänge mal Schreibaufschlag. Der Aufschlag ist Cache-Schreibpreis minus Inputpreis: bei Anthropic, GPT-6 Astra und GPT-5.6 das 1,25-fache des Inputpreises, bei älteren OpenAI-Modellen null. Danach die Batch-Überschneidung: Tokens, die bereits im Batch laufen, zählen mit 0,5, die übrigen mit 1 minus Batch-Anteil mal 0,5, weil ein Cache-Treffer in einer halbierten Batch-Anfrage nur die Hälfte spart.

4. Routing

Hat ein Modell eine hinterlegte kleinere Stufe (Opus 5 auf Sonnet 5, Sonnet 5 auf Haiku 4.5, GPT-5.6 Sol auf Terra): Ersparnis = Rest nach Update, Batch und Caching mal Routing-Anteil mal (1 minus Preisverhältnis). Das Preisverhältnis bewertet den echten Mix des Modells aus ungecachtem Input, Cache-Lesen, Cache-Schreiben und Output zu den Preisen der kleineren Stufe, geteilt durch dieselbe Bewertung zu heutigen Preisen, bei Tokenizer-Wechsel mal 1,2. Nur ohne Tokenmengen gilt ein Verhältnis von vier Input- zu einem Output-Token.

Summe und konservativer Wert

Rechnerische Ersparnis je Monat = Summe der vier Hebel; der konservative Wert ist die Hälfte, weil nicht jede Maßnahme den Regressionslauf besteht oder vollständig umgesetzt wird. Jahreswerte sind das Zwölffache zu heutigen Preisen; die Honorarzeile zeigt 30 Prozent dieser Spanne, abgerechnet wird nur nach der Nachweisregel unten. Unter 3.000 USD Monatskosten weist der Rechner darauf hin, dass eine begleitete Prüfung meist nicht lohnt.

Annahmen und Regler

Die Startwerte sind Erfahrungswerte für Integrationen mit System-Prompt, Tool-Definitionen und wiederkehrenden Dokumenten, keine Messung Ihres Systems; im Bericht ersetzen wir sie durch Ihre Angaben zu Latenzbedarf, Promptgröße und Evaluierungsset.

Preisrisiken und Hinweise

Was der Rechner nicht ist

Ein Szenario zu heutigen Listenpreisen. Modellwechsel werden mit gleicher Tokenmenge gerechnet, nicht mit gleichem Text oder gleicher Qualität; ob ein anderes Modell Ihre Aufgabe gleich gut löst, zeigt nur ein Regressionslauf auf mindestens 200 echten Fällen aus Ihrem System. Individuelle Rabatte, Commitments und Long-Context-Aufschläge kennt er nicht. Jahres- und Honorarwerte sind Rechenbeispiele, keine Preisprognose und keine Abrechnungsgrundlage. Ihre Datei verlässt den Browser nicht; nur Summenwerte gehen mit dem Formular an uns.

Nachweisregel aus dem Vertrag

Abgerechnet wird nur die nach § 5 des Vertrags auf der Anbieterrechnung nachgewiesene Ersparnis. Basismonat ist der Durchschnitt der drei vollen Kalendermonate vor der ersten Umstellung. Einheit ist die Zahl der Anfragen je Anbieter, ersatzweise die Summe der Input- und Output-Tokens. Basiskosten je Einheit = Kosten des Basismonats zu dessen Listenpreisen geteilt durch dessen Einheiten; aktuelle Kosten je Einheit = Nutzung des Abrechnungsmonats zu den Listenpreisen des Basismonats geteilt durch die Einheiten des Abrechnungsmonats. Ersparnis = (Basiskosten je Einheit minus aktuelle Kosten je Einheit) mal Einheiten des Abrechnungsmonats; negative Werte gelten als null und werden nicht vorgetragen. Preisänderungen der Anbieter und Volumenänderungen bleiben so ohne Einfluss; individuelle Rabatte werden mit den rabattierten Preisen des Basismonats angesetzt; Ersparnisse allein durch abgeschaltete Funktionen oder gesunkene Nutzung zählen nicht.

Rechenbeispiel aus Anlage 1: Basismonat 40.000 USD bei 2.000.000 Anfragen = 0,0200 USD je Anfrage. November nach Umstellung (Batch für Nachtläufe, Caching des System-Prompts, Sonnet 4.6 auf Sonnet 5): 30.000 USD zu Basismonatspreisen bei 2.400.000 Anfragen = 0,0125 USD je Anfrage. Ersparnis = (0,0200 minus 0,0125) mal 2.400.000 = 18.000 USD; Honorar 30 Prozent = 5.400 USD, umgerechnet zum EZB-Referenzkurs am Rechnungstag, zuzüglich Umsatzsteuer. Eine Preiserhöhung um 20 Prozent im November änderte daran nichts; bei nur 1.000.000 Anfragen betrüge die Ersparnis 7.500 USD.

Preistabelle, Stand 17.09.2026

USD je 1 Mio. Tokens, Listenpreise ohne Rabatte; Batch halbiert alle Preise außer bei den gekennzeichneten Pro-Modellen. „wie Input“: kein eigener Schreibpreis, das Anlegen des Caches kostet den Inputpreis. Anthropic-Preise gegen die Referenz vom 24.06.2026 geprüft, am 17.09.2026 unverändert. Abgleich vierteljährlich.

ModellInputCache-LesenCache-SchreibenOutputHinweis
GPT-6 Astra10,001,0012,5050,00
GPT-5.6 Sol4,000,405,0020,00Aktionspreis mindestens bis 21.11.2026, vorher 5,00 / 0,50 / 6,25 / 30,00
GPT-5.6 Terra2,000,202,5012,00
GPT-5.6 Luna0,200,020,251,20
GPT-5.55,000,50wie Input30,00
GPT-5.5 Pro30,003,00wie Input180,00kein Batch
GPT-5.42,500,25wie Input15,00
GPT-5.4 mini0,750,075wie Input4,50
GPT-5.4 nano0,200,02wie Input1,25
GPT-51,250,125wie Input10,00Abschaltung 11.12.2026
GPT-5 mini0,250,025wie Input2,00Abschaltung 11.12.2026
GPT-5 nano0,050,005wie Input0,40Abschaltung 11.12.2026
o32,000,50wie Input8,00Abschaltung 11.12.2026
o3-pro20,002,00wie Input80,00kein Batch
o3-mini1,100,55wie Input4,40
o4-mini1,100,275wie Input4,40
o115,007,50wie Input60,00
o1-mini1,100,55wie Input4,40
o1-pro150,00150,00wie Input600,00kein Batch
GPT-4.12,000,50wie Input8,00
GPT-4.1 mini0,400,10wie Input1,60
GPT-4.1 nano0,100,025wie Input0,40
GPT-4o2,501,25wie Input10,00
GPT-4o mini0,150,075wie Input0,60
GPT-4 Turbo10,0010,00wie Input30,00
Claude Fable 5.110,000,2512,5050,00neuer Tokenizer
Claude Fable 510,001,0012,5050,00neuer Tokenizer
Claude Opus 55,000,506,2525,00neuer Tokenizer
Claude Opus 4.85,000,506,2525,00neuer Tokenizer
Claude Opus 4.75,000,506,2525,00neuer Tokenizer
Claude Opus 4.65,000,506,2525,00
Claude Opus 4.55,000,506,2525,00
Claude Opus 4.115,001,5018,7575,00
Claude Opus 415,001,5018,7575,00
Claude Opus 315,001,5018,7575,00abgeschaltet seit 05.01.2026
Claude Sonnet 52,000,202,5010,00neuer Tokenizer
Claude Sonnet 4.63,000,303,7515,00
Claude Sonnet 4.53,000,303,7515,00
Claude Sonnet 43,000,303,7515,00
Claude Sonnet 3.73,000,303,7515,00abgeschaltet seit 19.02.2026
Claude Sonnet 3.53,000,303,7515,00abgeschaltet seit 22.10.2025
Claude Haiku 4.51,000,101,255,00
Claude Haiku 3.50,800,081,004,00
Claude Haiku 30,250,030,301,25

Quellen