Für diesen Vergleich habe ich am 21. September 2026 die Nutzungsbedingungen, Datenschutzhinweise und Dokumentationen von sieben Anbietern gelesen, deren KI-API sich kostenlos nutzen lässt. Die Grenzen, also wie viele Anfragen pro Minute oder pro Tag gehen, sind dabei schnell verglichen. Für eine Firma zählt eine andere Frage mehr. Wer darf die Eingaben speichern, wer darf sie lesen, wer darf damit ein Modell trainieren und was ändert sich daran, sobald man bezahlt?
Im Juli habe ich Hetzners kostenlose Inferenz-API vorgestellt, die auf diese Fragen eine sehr kurze Antwort hat. Bei anderen Anbietern fällt sie länger aus. Bei Google hängt sie sogar davon ab, wo du sitzt.
Sieben kostenlose KI-APIs im Überblick
Die Tabelle fasst zusammen, was die Anbieter selbst schreiben. Wo eine Angabe fehlt, steht „keine Angabe“. AVV steht für Auftragsverarbeitungsvertrag, also den Vertrag, mit dem sich ein Dienstleister nach Art. 28 DSGVO verpflichtet, personenbezogene Daten nur nach deinen Weisungen zu verarbeiten.
| Anbieter | Was kostenlos ist | Speicherung der Inhalte | Training | Menschliche Prüfung | Standort | AVV |
|---|---|---|---|---|---|---|
| Google Gemini API | Kontingent je Modell und Projekt, Grenzen nur in AI Studio einsehbar | außerhalb EWR zur Produktverbesserung, im EWR 55 Tage zur Missbrauchserkennung | außerhalb EWR ja, im EWR nein | außerhalb EWR ja, im EWR nur bei Missbrauchsverdacht | keine feste Region | über die Paid-Regeln, im EWR auch kostenlos |
| Hetzner Inference | alles, solange Experiment; 10 Anfragen pro Minute je Schlüssel | keine Inhalte, nur Zeitstempel und Token-Zahlen | nein | nein | EU (laut Hetzner) | in der Doku nicht genannt |
| Mistral (Free mode) | Studio-API mit den niedrigsten Grenzen | 30 Tage zur Missbrauchserkennung | ja, abschaltbar | keine Angabe | EU (Standard) | ja |
| OpenRouter (:free) | 20 Anfragen pro Minute, 50 pro Tag, ab 10 gekauften Credits 1.000 | OpenRouter nur nach Opt-in, Anbieter je nach Modell | je nach Anbieter | keine Angabe | je nach Anbieter, EU-Routing nur Enterprise | ja (OpenRouter), Anbieter separat |
| Groq (Free Plan) | z. B. gpt-oss-120b mit 1.000 Anfragen und 200.000 Token pro Tag | standardmäßig nein, bis 30 Tage bei Fehlern und Missbrauch | nein | keine Angabe | USA | ja |
| Cloudflare Workers AI | 10.000 Neurons pro Tag | nein, außer mit eigenem Speicherdienst | nein | keine Angabe | keine Angabe | ja |
| Scaleway Generative APIs | einmalig die ersten 1.000.000 Token | Zero Data Retention, bei Fehlern bis 2 Wochen | nein | nur bei Fehlern und Missbrauch | Paris | ja |
Zwei Namen, die in Listen kostenloser KI-APIs häufig genannt werden, fehlen hier. GitHub Models ist laut GitHub seit dem 30. Juli 2026 vollständig eingestellt. Cerebras bietet laut eigener Dokumentation keinen dauerhaft kostenlosen Zugang mehr, sondern ein Startguthaben von 5 Dollar, das nach 30 Tagen verfällt und eine hinterlegte Zahlungsmethode voraussetzt.
Bei Google entscheidet der Standort über die Datenregeln
Google trennt in den Gemini API Additional Terms of Service, gültig seit dem 23. März 2026, zwischen unbezahlten und bezahlten Diensten. Für die unbezahlten gilt, dass Google Eingaben und Antworten verwendet, um Produkte und Machine-Learning-Technik zu verbessern und weiterzuentwickeln. Prüferinnen und Prüfer dürfen Ein- und Ausgaben lesen und annotieren, nachdem die Daten von Konto, API-Schlüssel und Projekt getrennt wurden. Google rät selbst davon ab, sensible, vertrauliche oder personenbezogene Informationen über das kostenlose Kontingent zu schicken.
Direkt darunter steht der Satz, auf den es für Firmen in Deutschland ankommt. Wer sich im Europäischen Wirtschaftsraum, in der Schweiz oder im Vereinigten Königreich befindet, für den gelten die Datenregeln aus dem Abschnitt für bezahlte Dienste auch dann, wenn nichts bezahlt wird. Laut Wortlaut betrifft das „all Services, including Google AI Studio and unpaid quota in the Gemini API“.
Foto: Miguel Á. Padriñán / Pexels
Was das konkret bedeutet, steht im bezahlten Abschnitt. Prompts und Antworten werden nicht zur Produktverbesserung verwendet, die Verarbeitung läuft nach Googles Data Processing Addendum, in dem Google als Auftragsverarbeiter auftritt. Protokolliert wird nur zur Erkennung von Missbrauch, laut Googles Seite zum Abuse Monitoring für 55 Tage. Menschen sehen diese Daten nur, wenn Sicherheitsfilter einen Inhalt markiert haben. Einen festen Standort gibt es nicht, zwischengespeichert werden darf in jedem Land, in dem Google Einrichtungen betreibt.
Auf der Preisseite ist das kostenlose Kontingent trotzdem pauschal mit einem Ja in der Zeile zur Produktverbesserung markiert. Die Sonderregel für Europa steht nur in den Bedingungen.
Einen Haken hat die Regel. Dieselben Bedingungen erlauben für Anwendungen, die Nutzerinnen und Nutzern im EWR, in der Schweiz oder im Vereinigten Königreich zur Verfügung stehen, ausschließlich bezahlte Dienste. Für eigene Tests und Prototypen reicht das kostenlose Kontingent. Sobald ein Chatbot auf der Website oder ein Kundenportal mit Gemini dahinter anderen Menschen offensteht, verlangt Google ein Projekt mit aktivem Abrechnungskonto. Die genauen kostenlosen Grenzen veröffentlicht Google nicht als Tabelle, sie stehen je Projekt in AI Studio und sind ausdrücklich nicht garantiert.
Mistral und OpenRouter lassen Training zu, aber du kannst es abschalten
Mistral schreibt in seiner Hilfe offen, dass Eingaben und Ausgaben im kostenlosen Free mode von Mistral Studio für das Training der eigenen Modelle verwendet werden dürfen. Das ist bei der Anmeldung so vereinbart und lässt sich jederzeit abschalten. Der Schalter liegt im Admin-Bereich unter Privacy im Abschnitt Anonymous improvement data. Er ist unabhängig vom Schalter für den Chat Vibe, wer nur einen der beiden umlegt, hat beim anderen das Training weiter an. Für das Training tritt Mistral laut seinem Auftragsverarbeitungsvertrag als eigener Verantwortlicher auf, solange du nicht widersprochen hast. Auch deshalb gehört der Schalter vor den ersten echten Datensatz.
Unabhängig davon bewahrt Mistral Ein- und Ausgaben der API laut Datenschutzerklärung 30 Tage zur Missbrauchserkennung auf. Zero Data Retention gibt es nur mit Pay-as-you-go, auf Antrag mit Begründung und nach Ermessen von Mistral. Die Daten liegen standardmäßig in der EU. Ob der Trainingsschalter beim Wechsel auf Pay-as-you-go von selbst umspringt, geht aus der Hilfe nicht eindeutig hervor. Ein Blick in die Einstellung ist schneller als jede Auslegung.
Foto: Sora Shimazaki / Pexels
OpenRouter betreibt selbst keine Modelle, sondern leitet Anfragen an viele Anbieter weiter. OpenRouter speichert Prompts und Antworten laut Dokumentation nur, wenn du das Protokollieren ausdrücklich einschaltest. Was beim Modellanbieter passiert, regelt dessen eigene Richtlinie.
Wie das bei den kostenlosen Modellen aussieht, habe ich am 21. September 2026 über OpenRouters öffentliche Schnittstelle nachgezählt. Es gab 21 Modelle mit der Endung :free, jedes lief über genau einen Anbieter. Bei fünf davon steht dieser Endpunkt in OpenRouters Liste für Zero Data Retention. Bei acht gehört der Anbieter laut OpenRouters Anbieterliste zu denen, deren Standardregel das Training mit Prompts erlaubt, darunter fünf Nemotron-Modelle von Nvidia. 14 der 21 Modelle laufen bei Anbietern mit Sitz in den USA, zwei in China, bei fünf nennt die Liste keinen Sitz. Für einzelne Endpunkte kann eine andere Regel gelten als für den Anbieter insgesamt. Ist die Lage unklar, stuft OpenRouter einen Endpunkt nach eigener Aussage so ein, als würde er speichern und trainieren.
In den Datenschutzeinstellungen gibt es getrennte Schalter für bezahlte und kostenlose Modelle. Schaltest du das Training bei den kostenlosen ab, leitet OpenRouter keine Anfragen mehr an Anbieter weiter, die trainieren. Die betroffenen Gratismodelle stehen dir dann schlicht nicht mehr zur Verfügung. Ein Routing, das Daten in der EU hält, bietet OpenRouter nur im Enterprise-Tarif an.
Hetzner, Groq, Cloudflare und Scaleway trainieren nicht
Hetzner speichert laut Dokumentation weder Anfragen noch Antworten, sondern nur Zeitstempel und Token-Zahlen für die Nutzungserfassung und eine spätere Abrechnung. Das ist die knappste Datenregel im Vergleich. Einen AVV nennt die Doku zum Experiment nicht, ein Service Level Agreement gibt es ebenfalls nicht. Hetzner rät außerdem ausdrücklich vom Produktivbetrieb ab. Pro Schlüssel sind 10 Anfragen, 4 Millionen Eingabe-Token und 100.000 Ausgabe-Token pro Minute erlaubt. Kostenlos bleibt es, solange der Status experimentell ist, eine Änderung kündigt Hetzner vorab per E-Mail an.
Groq behält Eingaben laut Dokumentation standardmäßig nicht. Ausnahmen sind Fehlersuche und Missbrauchsverdacht, dann bis zu 30 Tage. Im Bereich Data Controls lässt sich Zero Data Retention einschalten, laut Groq steht das allen Kundinnen und Kunden offen. Der Dienstleistungsvertrag schließt Training mit Ein- und Ausgaben aus, sofern du es nicht ausdrücklich erlaubst. Gespeicherte Daten liegen in Google-Cloud-Speichern in den USA, für die Übermittlung gelten Standardvertragsklauseln.
Cloudflare verwendet Inhalte aus Workers AI weder zum Training der angebotenen Modelle noch zur Verbesserung eigener oder fremder Dienste, es sei denn, du stimmst ausdrücklich zu. Gespeichert wird nur, wenn du selbst einen Speicherdienst wie R2 oder KV dazuschaltest. Kostenlos sind 10.000 Neurons pro Tag, das ist Cloudflares eigene Recheneinheit, deren Verbrauch je Modell unterschiedlich ausfällt. Einen Serverstandort nennt die Seite zu Workers AI nicht.
Foto: Brett Sayles / Pexels
Scaleway wendet laut Datenschutzhinweis zu den Generative APIs standardmäßig Zero Data Retention an und nutzt Inhalte nicht für das Training. Nur wenn Anfragen den Dienst stören, etwa bei einem Serverfehler mit Statuscode 500, speichert Scaleway den vollständigen Inhalt bis zu zwei Wochen für die Fehlersuche. Die Modelle laufen in einem Rechenzentrum in Paris. Kostenlos sind allerdings nur die ersten 1.000.000 Token und 60 Minuten Transkription, danach wird regulär abgerechnet. Scaleway ist damit eher ein Probierkontingent als ein Gratiszugang. Einen Überblick über KI-APIs mit Rechenzentrum in Deutschland und der EU findest du in meinem Vergleich der EU-Anbieter.
Was sich ändert, wenn du bezahlst
Bei vier der sieben Anbieter ändert ein bezahltes Konto an der Datennutzung nichts. Hetzner hat noch gar keine Bezahlvariante. Groq, Cloudflare und Scaleway behandeln Daten kostenlos wie bezahlt gleich, dort kaufst du mit Geld nur höhere Grenzen.
Deutlich wird der Unterschied bei Google außerhalb des EWR. Dort entscheidet das Abrechnungskonto darüber, ob Eingaben in die Produktverbesserung fließen und Menschen mitlesen dürfen. Im EWR sind die Datenregeln schon kostenlos auf dem Stand der bezahlten Nutzung, das Geld schaltet hier vor allem frei, dass du Anwendungen für andere Menschen betreiben darfst. Bei Mistral öffnet Pay-as-you-go den Weg zu Zero Data Retention, beim Training bleibt es beim Schalter. Bei OpenRouter ist die bezahlte Variante eines Modells ein eigener Katalogeintrag mit eigenen Endpunkten und damit womöglich eigenen Regeln.
Drei der sieben Anbieter behalten sich unabhängig vom Tarif vor, Inhalte zur Missbrauchserkennung aufzubewahren. Google tut das 55 Tage lang, Mistral und Groq bis zu 30 Tage. Wie das bei den großen US-Anbietern aussieht und wo es Ausnahmen gibt, habe ich im Artikel über Zero Data Retention bei KI-Anbietern aufgeschrieben.
Eine praktische Regel für Firmen
Über eine kostenlose KI-API schicke ich nur Inhalte, bei denen es egal wäre, wenn Fremde sie lesen. Dazu gehören öffentliche Website-Texte, eigene Produktbeschreibungen, Code ohne Zugangsdaten und ausgedachte Beispiele. Nicht dazu gehören Kundenanfragen mit Namen, E-Mail-Adressen, Verträge, Daten von Beschäftigten und alles, was nach einem Passwort oder Schlüssel aussieht.
Für einen Prototyp brauchst du keine echten Kundendaten. Zwanzig ausgedachte Anfragen, die so klingen wie deine echten, zeigen genauso gut, ob eine Klassifizierung oder eine Zusammenfassung funktioniert. Der Ablauf bleibt identisch, nur die Daten tauschst du später aus. Weil viele dieser Anbieter das OpenAI-Format verstehen, ist auch ein späterer Anbieterwechsel meist eine Frage der Basis-URL.
Bevor echte personenbezogene Daten fließen, prüfe ich drei Dinge. Gibt es einen AVV? Wie lange bleiben Inhalte gespeichert? Ist das Training ausgeschlossen oder abgeschaltet? Nach ihren Unterlagen bringen Groq, Cloudflare und Scaleway alle drei Punkte schon im kostenlosen Zugang mit. Bei Mistral fehlt nur der umgelegte Schalter, bei Hetzner der Vertrag. Bei Google im EWR stimmen die Datenregeln, für eine Anwendung mit echten Nutzerinnen und Nutzern brauchst du trotzdem ein bezahltes Projekt.
Ein letzter Punkt, der gern untergeht. Die Einstellungen gelten je Konto oder Organisation. Legt jemand im Team für einen schnellen Test ein eigenes Konto an, startet es wieder mit den Standardwerten, bei Mistral also mit eingeschaltetem Training.
Wenn du gerade einen Prototyp auf einer kostenlosen KI-API baust und klären willst, welcher Anbieter für den Betrieb mit echten Kundendaten in Frage kommt, schreib mir gerne.
Häufige Fragen
Verwendet Google meine Eingaben in der kostenlosen Gemini API für das Training?+
Das hängt davon ab, wo du dich befindest. Außerhalb des EWR, der Schweiz und des Vereinigten Königreichs nutzt Google Eingaben und Antworten aus dem kostenlosen Kontingent zur Produktverbesserung. Prüferinnen und Prüfer dürfen sie lesen. Innerhalb dieser Gebiete gelten laut den Gemini API Additional Terms auch kostenlos die Regeln der bezahlten Nutzung, dort werden Eingaben nicht zur Produktverbesserung verwendet. Für Anwendungen, die anderen Menschen im EWR zur Verfügung stehen, verlangt Google allerdings ein bezahltes Projekt.
Welche kostenlose KI-API speichert meine Eingaben nicht?+
Hetzner speichert laut Dokumentation weder Anfragen noch Antworten, nur Zeitstempel und Token-Zahlen. Scaleway wendet standardmäßig Zero Data Retention an und hebt Inhalte nur bei Fehlern bis zu zwei Wochen auf. Groq speichert standardmäßig nichts, behält sich Protokolle für Fehlersuche und Missbrauch bis 30 Tage vor und lässt sich per Schalter auf Zero Data Retention stellen. Cloudflare speichert Inhalte aus Workers AI nur, wenn du selbst einen Speicherdienst dazuschaltest.
Darf ich Kundendaten über eine kostenlose KI-API schicken?+
Bevor personenbezogene Daten fließen, sollten ein Auftragsverarbeitungsvertrag, eine bekannte Aufbewahrungsfrist und ein ausgeschlossenes Training feststehen. Groq, Cloudflare und Scaleway bringen nach ihren Unterlagen alle drei Punkte schon im kostenlosen Zugang mit, bei Hetzner fehlt der Vertrag, bei Mistral muss das Training erst abgeschaltet werden. Für Prototypen reichen ausgedachte Testdaten völlig, die echten Daten tauschst du erst ein, wenn die Bedingungen passen.
Ändert ein bezahltes Konto etwas an der Datennutzung?+
Bei Hetzner, Groq, Cloudflare und Scaleway nicht, dort kaufst du mit Geld nur höhere Grenzen. Bei Google außerhalb des EWR entscheidet das Abrechnungskonto darüber, ob Eingaben ins Training fließen. Bei Mistral öffnet Pay-as-you-go den Weg zu Zero Data Retention auf Antrag, das Training regelt weiterhin ein eigener Schalter.
Du willst mehr erfahren?
In einem kostenlosen Erstgespräch besprechen wir, wie du diese Themen für dein Unternehmen nutzen kannst. Kein Verkaufsgespräch, sondern eine ehrliche Einschätzung.
Kostenloses Erstgespräch vereinbaren



