Modell-Atlas · KI-Beratung und digitale Transformation
KI-API-Kosten schätzen: Vorlage für den Monatsbedarf
Kurz gesagt
KI-Schnittstellen rechnen nach Tokens ab, also nach Textmenge für Eingabe und Ausgabe. Sie schätzen die Anfragen pro Monat, die durchschnittliche Länge und multiplizieren mit dem Preis aus der aktuellen Preisliste des Anbieters. Planen Sie einen Puffer für Tests und Wiederholungen ein.
Das Problem
Ihr Betrieb möchte KI in eine eigene Anwendung einbauen, zum Beispiel in eine Website, ein Formular oder ein internes Werkzeug. Dafür nutzt man eine sogenannte API, eine Schnittstelle, über die Ihr Programm automatisch Anfragen an ein KI-Modell sendet. Die Anbieter verlangen dafür kein festes Monatsabo, sondern rechnen nach Verbrauch ab.
Das klingt günstig, wird aber schnell unübersichtlich. Auf den Preisseiten stehen Beträge pro Million Tokens, oft getrennt für Eingabe und Ausgabe, und Sie sollen daraus einen Monatsbetrag ableiten. Wer das nicht vorher schätzt, erlebt eine Überraschung auf der Rechnung, oder umgekehrt: Er verzichtet auf ein sinnvolles Vorhaben, weil er die Kosten überschätzt.
Mit einer einfachen Vorlage rechnen Sie in einer halben Stunde ein realistisches Budget aus. Sie brauchen dazu keine Programmierkenntnisse, nur eine Preisliste und ein paar Annahmen.
So lösen Sie es mit KI – Schritt für Schritt
- Anwendungsfall beschreiben: Schreiben Sie in einem Satz auf, was die KI tun soll, zum Beispiel «Kundenanfragen per Mail kategorisieren und einen Antwortentwurf erstellen».
- Anfragen pro Monat schätzen: Wie viele Vorgänge fallen an? Zählen Sie den Durchschnitt der letzten Monate und rechnen Sie Spitzen mit ein.
- Länge der Eingabe bestimmen: Wie viel Text geht pro Anfrage hinein: die Kundenmail, Ihre Anweisung, eventuell Zusatzinformationen? Schätzen Sie die Zeichenzahl und rechnen Sie in Tokens um (siehe Kasten unten).
- Länge der Ausgabe bestimmen: Wie lang ist die Antwort der KI typischerweise? Ausgabe-Tokens sind bei vielen Anbietern teurer als Eingabe-Tokens.
- Preise einsetzen: Öffnen Sie die offizielle Preisseite des gewählten Anbieters und notieren Sie den Preis pro Million Tokens für Eingabe und Ausgabe des gewählten Modells. Notieren Sie auch das Abrufdatum.
- Rechnen: Nutzen Sie die Vorlage unten. Das Ergebnis ist der Grundbetrag.
- Puffer addieren: Rechnen Sie Tests, Wiederholungen, Fehler und Wachstum mit zusätzlichen 30 bis 50 Prozent ein. Das ist eine Faustregel, kein Naturgesetz.
- Limit setzen: Richten Sie beim Anbieter ein Ausgabenlimit oder Benachrichtigungen ein. Siehe Kostenlimit bei der KI-API.
Vorlage zum Kopieren
Diese Tabelle können Sie in Excel oder auf Papier ausfüllen. Die Preise tragen Sie selbst von der Preisseite ein:
Anwendungsfall: [Beschreibung]
Anfragen pro Monat: [A]
Eingabe pro Anfrage in Tokens: [E] (Faustregel: Zeichen ÷ 3 bis 4)
Ausgabe pro Anfrage in Tokens: [S]
Preis Eingabe pro Million Tokens: [PE] CHF/USD (Datum: [Datum], Quelle: [URL])
Preis Ausgabe pro Million Tokens: [PS] CHF/USD
Eingabekosten pro Monat = A × E ÷ 1'000'000 × PE
Ausgabekosten pro Monat = A × S ÷ 1'000'000 × PS
Grundbetrag = Eingabekosten + Ausgabekosten
Budget = Grundbetrag × 1,5 (Puffer)Passen Sie den Puffer an Ihre Lage an. Bei Dollarpreisen rechnen Sie mit dem aktuellen Wechselkurs und denken an Kartengebühren.
| Grösse | Was sie bedeutet | Wo Sie sie finden |
|---|---|---|
| Token | Textbaustein, grob drei bis vier Zeichen | Hilfe des Anbieters |
| Eingabe-Tokens | Alles, was Sie senden | Ihre Anfrage plus Anweisungen |
| Ausgabe-Tokens | Was die KI zurückschreibt | Antwortlänge |
| Preis pro Million | Tarif des Anbieters | Preisseite |
Worauf Sie achten müssen
- Preise ändern sich. Nutzen Sie nur die aktuelle Preisseite und halten Sie das Abrufdatum fest. Zahlen aus Artikeln, auch aus diesem, genügen nicht.
- Schätzung der Tokens: Die Umrechnung ist eine Faustregel. Messen Sie mit echten Beispielen nach, vielleicht mit dem Zähler des Anbieters.
- Versteckter Kontext: Bei Gesprächen wird oft der ganze bisherige Verlauf bei jeder Anfrage erneut mitgesendet. Das vervielfacht die Eingabe-Tokens.
- Zusatzfunktionen: Websuche, Dateiverarbeitung oder Bildanalyse können gesondert berechnet werden. Siehe versteckte Zusatzkosten.
- Datenschutz: Kosten sind nicht alles. Klären Sie, wo Daten verarbeitet werden und was vertraglich zugesichert ist.
- Entwicklungskosten: Die Rechnung des Anbieters ist nur ein Teil. Programmierung, Betrieb und Wartung kommen dazu, siehe Integrationskosten schätzen.
- Wechselkurs: Viele Anbieter rechnen in Dollar ab. Schwankungen ändern den Betrag in Franken.
Ein Beispiel aus der Praxis
Ein Beispiel: Ein Treuhandbüro in Winterthur möchte eingehende Kundenmails automatisch nach Thema sortieren lassen und einen Antwortentwurf vorbereiten.
Vorher: Der Geschäftsführer hört «ein paar Rappen pro Anfrage» und gibt grünes Licht, ohne je gerechnet zu haben.
Nachher: Das Büro zählt, dass im Schnitt zweihundert Mails pro Woche eintreffen, und schätzt die Länge von Mail und Anweisung sowie des Antwortentwurfs. Mit den Preisen von der Anbieterseite rechnet es den Grundbetrag aus und schlägt einen Puffer drauf. Ausserdem richtet es ein monatliches Limit beim Anbieter ein. Nach dem ersten Monat vergleicht es Schätzung und Rechnung und passt die Annahmen an.
(Die Zahlen sind hier bewusst weggelassen, weil die tatsächlichen Preise vom Anbieter und vom Zeitpunkt abhängen.)
So hilft Ihnen Alpasana
Wenn Sie die Anbindung an eine KI nicht allein planen möchten, kann Alpasana bei der Einordnung helfen. Die KI-Beratung und digitale Transformation umfasst laut Beschreibung Prozessaufnahme, KI-Potenzialanalyse, das Integrieren von KI-Agenten mit Anwendungsfall, Pilot und Einsatzregeln sowie Schnittstellen zwischen Systemen. Projekte werden individuell offeriert.
Häufige Fragen
Wie viele Tokens hat eine A4-Seite?
Das hängt von Sprache und Inhalt ab. Als grobe Schätzung gelten für deutschen Fliesstext einige Hundert bis über tausend Tokens pro Seite. Messen Sie mit einer echten Seite nach. Mehr dazu in Kontextfenster: Seiten abschätzen.
Ist die API günstiger als ein Abo?
Das kommt auf die Nutzung an. Bei geringer, unregelmässiger Nutzung kann Abrechnung nach Verbrauch günstiger sein, bei häufiger Nutzung ein Abo. Siehe Abo oder nach Verbrauch.
Kann ich die Kosten begrenzen?
Ja, die meisten Anbieter bieten Limits oder Benachrichtigungen. Richten Sie diese ein, bevor Sie live gehen.
Was, wenn die Schätzung nicht stimmt?
Das ist normal. Vergleichen Sie nach dem ersten Monat die Rechnung mit der Schätzung und passen Sie die Annahmen an. Die Vorlage ist ein Werkzeug zum Lernen, kein Versprechen.
Erstellt mit KI-Unterstützung, redaktionell verantwortet von der Alpasana GmbH · 10.10.2026. Fehler entdeckt? Melden Sie es uns.
Quellen
Weiterlesen in der Galaxie
- Was bedeutet der Preis pro Token bei KI?Was bedeutet der Preis pro Token bei KI? Eingabe- und Ausgabetokens einfach erklärt, mit Rechenweg und Vorlage zur Kostenschätzung für Ihre Textmenge.
- Warum kosten KI-Eingaben und Antworten unterschiedlich viel?KI Input Output Kosten: Warum Eingabe und Antwort pro Token verschieden viel kosten, wie Sie Kosten abschätzen und was Sie selbst steuern können.
- KI-Verbrauch begrenzen: Wie schütze ich mein Budget?KI API Kostenlimit: Checkliste, mit der Sie Budgetgrenzen, Verbrauchswarnungen und Kontrollen einrichten, damit nutzungsabhängige KI-Kosten nicht unbemerkt steigen.
- KI-Kosten pro erledigter Aufgabe vergleichenKI Wirtschaftlichkeit: Mit einer Vorlage rechnen Sie Kosten pro erledigter Aufgabe inklusive Nachbearbeitung und Arbeitszeit und sehen, ob KI sich lohnt.
- Was verteuert die Anbindung von KI an bestehende Software?KI Integration Kosten: Warum die Anbindung von KI an Ihre Programme aufwendig sein kann, was Schnittstellen und Altsysteme verteuert und wie Sie schätzen.