Über uns
TokenCheck ist ein Angebot von Destiny Deutschland, Inhaber Malek Serhan, Essen. Wir prüfen die OpenAI- und Anthropic-API-Rechnungen von Software- und KI-Unternehmen auf vier Hebel: Batch-Verarbeitung, Prompt-Caching, Modellupdates und Anfragerouting. Diese Seite beschreibt, wer dahintersteht, warum es das Werkzeug gibt und wie Analyse, Bericht und Umsetzung entstehen, damit Sie uns vor einem Gespräch einordnen können.
Wer wir sind
Destiny Deutschland ist ein Einzelunternehmen mit Sitz in Essen. Inhaber ist Malek Serhan. Die vollständigen Angaben mit Umsatzsteuer-Identifikationsnummer stehen im Impressum.
Unser Hauptgeschäft ist laut Firmenseite destinydeutschland.com "AI infrastructure for e-commerce automation": Rohe Produktdaten werden mit Bilderkennung und KI-Textgenerierung zu Listings in mehr als zwölf Sprachen verarbeitet und auf Kaufland, eBay und Amazon veröffentlicht. Die Firmenseite nennt dazu "10,000+ Products Processed" und "5,400+ Live Listings on Kaufland" (Stand 17.09.2026). Wir übernehmen diese Angaben hier so, wie sie dort stehen; sie stammen aus unserem eigenen Betrieb und sind nicht von Dritten geprüft. Als Gründungsjahr nennt die Seite 2024.
TokenCheck ist im September 2026 gestartet. Referenzkunden, Fallstudien oder Auszeichnungen gibt es für dieses Angebot noch nicht, und wir werden hier keine nennen, bevor ein Kunde der Nennung in Textform zugestimmt hat. So steht es auch in unserem Vertragsentwurf (§ 9 Abs. 3). Eine Teamgröße nennen wir nicht, weil sie sich mit jedem Auftrag ändert und keine Aussage über die Qualität der Prüfung erlaubt.
Warum TokenCheck
Die Listing-Pipeline läuft über die APIs von OpenAI und Anthropic. Das erzeugt jeden Monat eine Rechnung, auf der dieselben Posten stehen wie bei Ihnen: Input-Tokens, Output-Tokens, Cache-Lesen, Cache-Schreiben, je Modell. Um diese Rechnung zu senken, haben wir für den eigenen Betrieb gebaut, was wir heute bei Kunden einsetzen: Warteschlangen für alles ohne Echtzeitbedarf über die Batch-Schnittstellen (beide Anbieter berechnen dafür die Hälfte), stabile Prompt-Präfixe für das Caching (gecachte Input-Tokens kosten bei den aktuellen Modellen beider Anbieter ein Zehntel des Eingabepreises), ein Evaluierungsset für den Wechsel auf ein günstigeres Modell und einen Router, der einfache Anfragen eine Modellstufe kleiner schickt.
TokenCheck fasst diese Werkzeuge zu einer Prüfung zusammen: ein Rechner, der Ihren Nutzungsexport im Browser auswertet, ein Prüfskript, das daraus den Bericht erzeugt, und ein Nachweisverfahren, das die Ersparnis auf Ihrer Anbieterrechnung misst. Die Startwerte der Regler im Rechner (30 Prozent batchfähig, 40 Prozent cachefähig, 25 Prozent routbar) sind Erfahrungswerte aus unserem eigenen Betrieb, keine Messwerte für Ihren. Deshalb sind sie verstellbar, und deshalb zeigt der Rechner eine Spanne und keine Zusage.
Wie wir arbeiten
Wir sagen offen, womit die Arbeit entsteht. Die Auswertung Ihres Exports, der Bericht, die Umsetzungsvorschläge und die Briefe, mit denen wir Unternehmen anschreiben, werden mit KI-Agenten erstellt; wir arbeiten dafür mit Claude Code von Anthropic. Auch das Review des Rechners vor der Veröffentlichung lief so: 45 bestätigte Befunde wurden behoben, darunter das Lesen deutscher Zahlen- und Datumsformate aus Excel-Exporten, die unterschiedliche Bedeutung der Spalte für Input-Tokens bei OpenAI (enthält die gecachten Tokens) und bei Anthropic (enthält sie nicht) und die Trennung von Aktionspreis und dauerhafter Ersparnis bei einem Modellupdate.
Jede Zahl, die ein Agent in einen Bericht schreibt, wird gegen die Quelle des Anbieters geprüft. Die Preistabelle des Rechners trägt ein Datum, wird vierteljährlich gegen die Preisseiten von OpenAI und Anthropic abgeglichen, und die Quellen stehen am Ende dieser Seite. Zwei Beispiele dafür, warum das nötig ist: OpenAI führt GPT-5.6 Sol mit einem Aktionspreis, der mindestens bis zum 21.11.2026 zugesagt ist; der Rechner weist den Teil der Ersparnis, der von diesem Preis abhängt, getrennt aus. Anthropic nennt für den neuen Tokenizer ab Claude 4.7 je nach Dokument unterschiedliche Größenordnungen: in der Ankündigung von Opus 4.7 das 1,0- bis 1,35-fache an Tokens für denselben Text, auf der Preisseite und in der Dokumentation zum Tokenzählen etwa 30 Prozent mehr. Der Rechner rechnet einen solchen Modellwechsel deshalb mit einem Aufschlag von 20 Prozent auf die Tokenmenge und weist das im Ergebnis aus; vor der Umstellung zählen wir Ihre echten Prompts über den Zählendpunkt des Anbieters nach, statt eine der Prozentzahlen zu übernehmen.
Was Menschen entscheiden, ist im Vertrag festgelegt und lässt sich nicht an einen Agenten delegieren:
| Schritt | Wer arbeitet | Wer entscheidet |
|---|---|---|
| Export lesen, Kosten je Modell berechnen | Rechner in Ihrem Browser oder unser Prüfskript | niemand, es wird nur gerechnet |
| Bericht mit Hebeln, Reihenfolge und Risiken | KI-Agent erstellt den Entwurf | Malek Serhan prüft die Zahlen gegen die Anbieterquellen und gibt den Bericht frei |
| Diffs und Konfigurationsvorschläge | KI-Agent | Ihr Team prüft und übernimmt sie oder lehnt sie ab |
| Regressionslauf mit mindestens 200 echten Fällen | Skript, Ergebnis wird dokumentiert | Sie legen die Schwelle fest, die erreicht sein muss |
| Umstellung im Produktivsystem | Ihr Team, oder wir nach gesonderter Beauftragung | Sie geben jede Umstellung frei |
| Nachweis und Rechnung | Berechnung nach § 5 des Vertrags, Aufstellung je Anbieter und Modell | Sie können innerhalb von zehn Werktagen mit Belegen widersprechen |
| Vertrag, Preis, Haftung | Vorlage von uns | Malek Serhan und Sie, beide unterschreiben |
Für den Bericht brauchen wir nur Nutzungsdaten: Modellnamen, Tokenzahlen, Anfragezahlen, Kosten und Zeiträume. Prompts, Ausgaben oder andere Inhalte Ihrer Anwendung übergeben Sie uns nicht (§ 10 des Vertrags). Der Rechner auf der Startseite lädt nichts hoch; die Datei bleibt in Ihrem Browser, wie in den Datenschutzhinweisen beschrieben.
Wenn Sie einen Brief von uns erhalten haben
Wir schreiben Unternehmen an, bei denen die Nutzung von OpenAI oder Anthropic öffentlich belegt ist: in der Datenschutzerklärung oder Subprozessorenliste, auf der Preisseite mit Modellnamen, in einer Kundenreferenz des Anbieters oder im eigenen Blog. Den Beleg und den Anlass nennen wir im Brief, und wir formulieren ihn als Prüfangebot, nicht als Behauptung, Ihre Rechnung sei falsch. Wir verwenden dafür nur die Angaben aus Ihrem Impressum und reichern keine Daten aus sozialen Netzwerken an. Werbung per E-Mail ohne Einwilligung verschicken wir nicht (§ 7 Abs. 2 Nr. 2 UWG); eine E-Mail von uns bekommen Sie erst, wenn Sie darum gebeten haben. Wenn Sie keine Post von uns möchten, genügt eine Zeile an die unten genannte Adresse, dann streichen wir Sie.
Was wir nicht tun
- Keine Prozentzusage vor dem Bericht. Der Rechner zeigt ein Szenario zu heutigen Listenpreisen, der Bericht zeigt Zahlen aus Ihrem Export, abgerechnet wird nur, was auf der Anbieterrechnung nachweisbar ist.
- Keine Umstellung ohne bestandenen Regressionslauf und ohne Ihre Freigabe.
- Keine Rechts- oder Steuerberatung und keine Bewertung Ihrer Verträge mit OpenAI, Anthropic oder anderen Anbietern (§ 1 Abs. 2 des Vertrags).
- Keine Nennung von Kunden, Branchen oder Ersparnissen ohne Zustimmung in Textform.
- Keine Verbindung zu OpenAI oder Anthropic. Wir sind Kunde beider Anbieter, nicht Partner. OpenAI, GPT, Anthropic und Claude sind Marken der jeweiligen Inhaber.
Kontakt
Destiny Deutschland, Inhaber Malek Serhan
Zimmerstraße 8, 45127 Essen
E-Mail: [email protected]
Auf Anfragen antworten wir innerhalb eines Werktags mit einem Terminvorschlag. Kostenlos sind der Rechner und ein Gespräch von 30 Minuten, in dem wir Ihren Export gemeinsam ansehen. Die Konditionen der Prüfung stehen unter Preis.
Quellen
- Destiny Deutschland, Firmenseite: destinydeutschland.com, Kennzahlen und Unternehmensbeschreibung, abgerufen am 17.09.2026
- OpenAI, Pricing: developers.openai.com/api/docs/pricing, abgerufen am 17.09.2026
- OpenAI, Batch API: developers.openai.com/api/docs/guides/batch, 50 Prozent Nachlass, Bearbeitung innerhalb von 24 Stunden, abgerufen am 17.09.2026
- OpenAI, Prompt caching: developers.openai.com/api/docs/guides/prompt-caching, Cache-Lesepreis 0,1-fach ab GPT-5.6, abgerufen am 17.09.2026
- OpenAI, Deprecations: developers.openai.com/api/docs/deprecations, Abschaltung älterer GPT-5- und o3-Snapshots am 11.12.2026, abgerufen am 17.09.2026
- Anthropic, Pricing: platform.claude.com/docs/en/about-claude/pricing, Listenpreise, Batch-Nachlass 50 Prozent, Cache-Lesen 0,1-fach, Cache-Schreiben 1,25-fach, Hinweis zum Tokenizer ab Claude 4.7, abgerufen am 17.09.2026
- Anthropic, Introducing Claude Opus 4.7: anthropic.com/news/claude-opus-4-7, neuer Tokenizer mit dem 1,0- bis 1,35-fachen an Tokens je nach Inhalt, abgerufen am 17.09.2026
- Anthropic, Token counting: platform.claude.com/docs/en/build-with-claude/token-counting, etwa 30 Prozent mehr Tokens ab Claude 4.7, Zählendpunkt count_tokens, abgerufen am 17.09.2026
- Anthropic, Prompt caching: platform.claude.com/docs/en/build-with-claude/prompt-caching, abgerufen am 17.09.2026
- Anthropic, Batch processing: platform.claude.com/docs/en/build-with-claude/batch-processing, abgerufen am 17.09.2026
- Gesetz gegen den unlauteren Wettbewerb, § 7 Unzumutbare Belästigungen: gesetze-im-internet.de/uwg_2004/__7.html
- TokenCheck, Impressum und Datenschutzhinweise; Vertragsvorlage mit den zitierten Paragraphen auf Anfrage