LLM-Vergleich 2026: Modelle und Preise im Überblick
Eine Tabelle mit Modellen von Anthropic, OpenAI, Google und Mistral: Veröffentlichung, API-Preis je 1 Mio. Token und Quelle, Stand 6. Oktober 2026.
Dieser LLM Vergleich 2026 ist eine Seite, die wir einmal im Monat aktualisieren. Im Kern steht eine Tabelle mit den Modellen von Anthropic, OpenAI, Google und Mistral, so wie die Anbieter sie am 6. Oktober 2026 auf ihren eigenen Modell- und Preisseiten führen. Jede Zeile nennt Veröffentlichung, API-Preis je 1 Mio. Token und die Quelle mit Datum.
Die Seite sortiert nichts nach "besser" oder "schlechter". Sie sagt dir, was es gibt, was es kostet und wo die Anbieter selbst die Modelle einordnen. Was für deine Aufgaben taugt, zeigt nur ein Test mit deinen Daten.
Stand: 6. Oktober 2026
TL;DR
- Die Preisspanne je 1 Mio. Input- plus 1 Mio. Output-Token reicht laut Listenpreisen vom 6. Oktober 2026 von 0,60 USD (GPT-6 Luna) bis 60 USD (GPT-6 Astra und Claude Fable 5.1), also um den Faktor 100.
- Im September sind zehn Modelle auf den Anbieterseiten erschienen oder angekündigt worden, darunter Claude Opus 5.5 und Sonnet 5.5, GPT-6 Astra, GPT-6.1 Sol und Gemini 3.8 Flash. Gemini 4 Argon ist angekündigt, aber nur für ausgewählte Cyber-Verteidiger freigegeben.
- Prüfe vor dem Einsatz Preisdatum, Datenstandort und Auslaufdatum: Der Einführungspreis von Gemini 3.8 Flash endet am 31. Dezember 2026, und Claude Sonnet 4.5 ist laut Anthropic für die Claude API zum 30. November 2026 zur Abschaltung vorgesehen.
Die Tabelle: Modelle und Preise im Oktober 2026
Alle Preise stammen von den Seiten der Anbieter, abgerufen am 6. Oktober 2026, und stehen in der Währung, die dort steht. Anthropic, OpenAI und Google nennen US-Dollar, Mistral zeigt auf den Modellseiten ebenfalls ein Dollarzeichen. Wir rechnen die Währungen nicht um; die dargestellten Preise verstehen sich ohne Steuern. "Input / Output" bedeutet Preis je 1 Mio. Token im Standardbetrieb ohne Rabatte für Batch oder Caching.
| Anbieter | Modell | Veröffentlicht | API-Preis Input / Output je 1 Mio. Token | Verfügbarkeit und Hinweis | Quelle (Stand 6.10.2026) |
|---|---|---|---|---|---|
| Anthropic | Claude Fable 5.1 | 1. September 2026 | 10 / 50 USD (Cache-Lesen 0,25 USD) | Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, Microsoft Foundry; 1 Mio. Token Kontext | Modellübersicht, Release Notes |
| Anthropic | Claude Opus 5.5 | 22. September 2026 | 4 / 20 USD (Cache-Lesen 0,20 USD) | gleiche Plattformen wie Fable 5.1; Opus 5 kostet laut Anthropic 5 / 25 USD | Modellübersicht, Release Notes |
| Anthropic | Claude Sonnet 5.5 | 28. September 2026 | 2 / 10 USD | gleiche Plattformen; Einstellung frühestens 28. September 2027 | Modellübersicht, Release Notes |
| Anthropic | Claude Haiku 4.5 | 15. Oktober 2025 | 1 / 5 USD | 200.000 Token Kontext; Einstellung frühestens 15. Oktober 2026 | Modellübersicht, Release Notes, Deprecations |
| Anthropic | Claude Mythos 5.1 | 1. September 2026 | laut Release Notes wie Fable 5.1: 10 / 50 USD | nur eingeschränkter Zugang: Stand 6. Oktober 2026 nur für ausgewählte US-Organisationen über Trusted-Access-Programme | Release Notes, Anthropic |
| OpenAI | GPT-6 Astra | September 2026 (laut API-Changelog) | 10 / 50 USD | 1,05 Mio. Token Kontext; Fast mode mit EU-Datenresidenz nicht verfügbar | Modellseite, Changelog |
| OpenAI | GPT-6.1 Sol | 29. September 2026 | 2 / 10 USD | unterstützt US- und EU-Datenresidenz | Modellseite, Changelog |
| OpenAI | GPT-6 Sol | 22. September 2026 | 2 / 10 USD | EU-Datenresidenz in Standard, Flex und Batch; OpenAI verweist auf GPT-6.1 Sol als neueres Sol-Modell | Modellseite, Changelog |
| OpenAI | GPT-6 Luna | 22. September 2026 | 0,10 / 0,50 USD | EU-Datenresidenz in Standard, Flex und Batch | Modellseite, Changelog |
| OpenAI | GPT-5.6 Sol | 9. Juli 2026 | 4 / 20 USD (Aktionspreis, laut OpenAI mindestens bis 21. November 2026) | steht weiter in der Preisliste | Preisseite, Changelog |
| OpenAI | GPT-5.6 Terra | 9. Juli 2026 | 2 / 12 USD | steht weiter in der Preisliste | Preisseite, Changelog |
| OpenAI | GPT-5.6 Luna | 9. Juli 2026 | 0,20 / 1,20 USD | steht weiter in der Preisliste | Preisseite, Changelog |
| Gemini 3.8 Flash | 2. September 2026 | 0,75 / 3,75 USD bis 31. Dezember 2026 (Einführungspreis), ab 1. Januar 2027 1,50 / 7,50 USD | Gemini API, allgemein verfügbar (Paid Tier) | Preisseite, Changelog | |
| Gemini 3.1 Pro Preview | 19. Februar 2026 | 2,00 / 12,00 USD bei Prompts bis 200.000 Token, darüber 4,00 / 18,00 USD | Preview-Status | Preisseite, Changelog | |
| Gemini 4 Argon | 30. September 2026 angekündigt | Einführungspreis laut Google 2 / 10 USD, sobald verfügbar | nur für ausgewählte Cyber-Verteidiger freigegeben (Fairwind Program), nicht allgemein verfügbar | ||
| Mistral | Mistral Medium 3.5 | 28. April 2026 (laut Modellseite) | 1,5 / 7,5 USD | 256.000 Token Kontext; Open Weights unter Modified MIT | Modellseite |
| Mistral | Mistral Large 3 | 2. Dezember 2025 (laut Modellseite) | 0,5 / 1,5 USD | 256.000 Token Kontext; Open Weights unter Apache 2.0 | Modellseite |
| Mistral | Mistral Small 4 | 16. März 2026 (laut Modellseite) | 0,15 / 0,6 USD | 256.000 Token Kontext; Open Weights unter Apache 2.0 | Modellseite |
Langkontext bei OpenAI: Für alle sieben OpenAI-Zeilen gelten laut der jeweiligen Modellseite die genannten Preise bis 272.000 Input-Token pro Anfrage. Darüber werden Input mit dem Doppelten und Output mit dem Anderthalbfachen berechnet, für die ganze Anfrage. Bei Gemini 3.1 Pro Preview steht der Aufschlag oberhalb von 200.000 Token in der Zeile. Für die Anthropic-Modelle Fable 5.1, Opus 5.5 und Sonnet 5.5 nennt Anthropic den vollen Kontext von 1 Mio. Token zum Standardpreis, für Gemini 3.8 Flash und die Mistral-Modelle nennen die Preis- und Modellseiten keinen Aufschlag (Anthropic Preise).
Nicht in der Tabelle stehen Modelle, bei denen wir Veröffentlichungsdatum oder Preis nicht auf der Anbieterseite bestätigen konnten, etwa Claude Haiku 5.5 (laut Anthropic angekündigt, in der Modellübersicht vom 6. Oktober 2026 noch nicht gelistet).
Was sich im September geändert hat
Die Liste folgt dem Datum, jeder Eintrag nennt seine Quelle.
- 1. September: Anthropic veröffentlicht Claude Fable 5.1 und Claude Mythos 5.1. Der Preis bleibt bei 10 / 50 USD, die Cache-Lesepreise sinken auf 0,25 USD. Laut Anthropic kostet Fable 5.1 bei typischen Workloads geschätzt 25 Prozent weniger als Fable 5 (Anthropic, Release Notes).
- 2. September: Gemini 3.8 Flash ist laut Google-Changelog allgemein verfügbar (Gemini API Changelog).
- 3. September: Laut API-Changelog von OpenAI ist GPT-6 Astra veröffentlicht (OpenAI Changelog).
- 18. September: Google schränkt den Zugang zu den Gemini-2.5-Modellen auf Nutzer ein, die sie bereits verwendet haben. Die Modelle sind nicht abgekündigt, für neue Projekte empfiehlt Google 3.5 Flash-Lite oder 3.8 Flash (Gemini API Changelog).
- 22. September: Anthropic veröffentlicht Claude Opus 5.5 für 4 / 20 USD, Opus 5 kostet 5 / 25 USD. Am selben Tag erscheinen laut OpenAI GPT-6 Sol und GPT-6 Luna (Anthropic, OpenAI Changelog).
- 28. September: Anthropic veröffentlicht Claude Sonnet 5.5 für 2 / 10 USD. Laut Release Notes können Code und Konfiguration, die für Sonnet 5 geschrieben wurden, an fünf Stellen brechen, etwa bei erzwungener Tool-Nutzung (Release Notes).
- 29. September: OpenAI veröffentlicht GPT-6.1 Sol, laut OpenAI mit "near-Astra performance" zu einem Fünftel von Astras Standardpreis (Modellseite, OpenAI News).
- 30. September: Google kündigt Gemini 4 Argon an, zunächst für ausgewählte Cyber-Verteidiger. Am selben Tag kündigt Anthropic an, Claude Sonnet 4.5 (
claude-sonnet-4-5-20250929) am 30. November 2026 in der Claude API abzuschalten und empfiehlt Sonnet 5.5 (Google, Release Notes).
Wer ein Modell fest eingetragen hat, sollte die Auslaufdaten kennen: Claude Haiku 4.5 wird laut Anthropic frühestens am 15. Oktober 2026 eingestellt, Claude Sonnet 4.5 ist für die Claude API zum 30. November 2026 zur Abschaltung vorgesehen (Deprecations).
Messbar machen
Woran du erkennst, ob KI wirkt
Wie die Anbieter ihre Modelle einordnen
Dieser Abschnitt gibt wieder, wie die Anbieter ihre Modelle selbst beschreiben. Es ist keine Rangfolge, und die Beschreibungen sind Marketing- und Dokumentationstext der jeweiligen Anbieter.
Anthropic. Die Modellübersicht beschreibt Fable 5.1 als Modell "for demanding reasoning and long-horizon agentic work", Opus 5.5 "for long-running agentic coding and knowledge work", Sonnet 5.5 als "the best combination of speed and intelligence" und Haiku 4.5 als "the fastest model with near-frontier intelligence". Anthropic empfiehlt dort, bei Unsicherheit mit Opus 5.5 zu beginnen und Fable 5.1 zu nehmen, wenn die eigenen Tests mit Opus 5.5 auch bei höherem Effort nicht genügen (Anthropic Modellübersicht). Mythos 5.1 ist laut Anthropic dasselbe Modell wie Fable 5.1 mit anderen Schutzmaßnahmen und nur über Trusted-Access-Programme verfügbar, derzeit nur für ausgewählte US-Organisationen (Anthropic).
OpenAI. GPT-6 Astra ist laut Modellseite "our most capable model for the most demanding work". GPT-6.1 Sol liefert laut OpenAI "near-Astra performance at a lower cost", mit dem Hinweis, es auf den eigenen Aufgaben mit Astra zu vergleichen. GPT-6 Sol ist "built for complex coding and agentic workflows", GPT-6 Luna ist "our most efficient model for focused, high-volume tasks" (Astra, GPT-6.1 Sol, GPT-6 Sol, GPT-6 Luna). Die GPT-5.6-Familie nennt OpenAI im Changelog: Sol für Spitzenfähigkeit, Terra für ein Gleichgewicht aus Intelligenz und Kosten, Luna für effiziente Aufgaben mit hohem Volumen (Changelog).
Google. Gemini 3.8 Flash ist laut Google das "most intelligent Flash model", gebaut für Software-Engineering über lange Zeiträume, autonome Agenten und komplexe Unternehmens-Workflows. Gemini 3.1 Pro Preview beschreibt Google als Pro-Modell der dritten Generation für multimodales Verständnis, Agentenfähigkeiten und "vibe-coding" (Preisseite). Für Gemini 4 Argon nennt Google tiefes Schlussfolgern über lange Arbeitsabläufe und ein Output-Tokenlimit von einer Million Token (Google).
Mistral. Medium 3.5 ist laut Mistral ein multimodales Modell der Frontier-Klasse, optimiert für Agenten- und Coding-Einsätze. Large 3 ist ein offenes Allzweck-Modell mit Mixture-of-Experts-Architektur und 675 Milliarden Parametern insgesamt, davon 41 Milliarden aktiv. Small 4 vereint Instruct, Reasoning und Coding in einem Modell mit 119 Milliarden Parametern, davon 6,5 Milliarden aktiv (Medium 3.5, Large 3, Small 4).
Was die Preise für ein Team bedeuten
Listenpreise je Token sagen noch nichts über deine Rechnung. Sie hängt davon ab, wie viele Token deine Aufgaben brauchen, ob Caching greift und wie oft ein Agent Schleifen dreht. Die folgende Rechnung ist reine Arithmetik auf Listenpreisen vom 6. Oktober 2026, kein Angebot und keine Prognose. Sie nimmt für jedes Modell 1 Mio. Input-Token plus 1 Mio. Output-Token an, ohne Caching, Batch-Rabatt und ohne Aufschläge für lange Prompts.
| Modell | Input | Output | Summe für 1 Mio. + 1 Mio. Token |
|---|---|---|---|
| GPT-6 Astra | 10 USD | 50 USD | 60 USD |
| Claude Opus 5.5 | 4 USD | 20 USD | 24 USD |
| Gemini 3.8 Flash (Einführungspreis bis 31. Dezember 2026) | 0,75 USD | 3,75 USD | 4,50 USD |
| Gemini 3.8 Flash (ab 1. Januar 2027) | 1,50 USD | 7,50 USD | 9,00 USD |
Drei Dinge lassen sich daraus ablesen, ohne etwas über Qualität zu sagen. Erstens liegt zwischen Astra und dem Einführungspreis von Gemini 3.8 Flash bei dieser Annahme der Faktor 13,3 (60 geteilt durch 4,50). Zweitens verdoppelt sich der Gemini-Preis laut Google zum Jahreswechsel, wer dort mit dem Einführungspreis plant, braucht für Januar einen Schritt im Budget. Drittens kosten GPT-6.1 Sol und Claude Sonnet 5.5 beide 2 / 10 USD, also 12 USD für dieselbe Annahme, und liegen damit bei der Hälfte von Claude Opus 5.5.
Ob ein günstigeres Modell deine Aufgabe ausreichend gut erledigt, entscheidet ein Test mit deinen Beispielen. Die Einordnung der Anbieter im vorigen Abschnitt hilft dir, die Kandidaten für diesen Test zu wählen. Wie Sitzpreise, Nutzung und Einführung zusammen eine Teamrechnung ergeben, steht in Was kostet KI im Team 2026?. Und wenn du noch nicht weißt, wo dein Unternehmen steht, hilft der kostenlose AI-Readiness-Check mit 12 Fragen in etwa 5 Minuten.
Verfügbarkeit in der EU und im Unternehmen
Hier stehen nur Aussagen, die auf den Anbieterseiten belegt sind. Sie ersetzen keine Prüfung durch eure Datenschutz- und Rechtsabteilung.
- Anthropic: Fable 5.1, Opus 5.5 und Sonnet 5.5 sind laut Release Notes in der Claude API, in Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry verfügbar. Die Modellübersicht listet für Haiku 4.5 ebenfalls IDs bei allen fünf Plattformen. Für Fable 5.1 nennt Anthropic: Bis das neue System Enterprise Frontier Safeguards verfügbar ist, können berechtigte Kunden Fable 5.1 mit Zero Data Retention nutzen (Anthropic, Release Notes). Mit Opus 5.5 hat Anthropic außerdem die Fünf-Stunden-Nutzungslimits auf den Plänen Pro, Max, Team und sitzbasiertem Enterprise erhöht (Anthropic).
- OpenAI: GPT-6.1 Sol, GPT-6 Sol und GPT-6 Luna unterstützen laut OpenAI EU-Datenresidenz in Standard, Flex und Batch, GPT-6.1 Sol nur US und EU. Fast mode gibt es mit EU-Datenresidenz bei Astra, GPT-6.1 Sol, GPT-6 Sol und GPT-6 Luna nicht, und der am 29. September eingeführte Ultrafast-Modus für Astra läuft nur mit globaler Verarbeitung und US-Datenresidenz. Für Endpunkte mit regionaler Verarbeitung berechnet OpenAI einen Aufschlag von 10 Prozent. Die Datenresidenz-Funktion ist laut OpenAI nicht für jeden Account offen: Der Anbieter verweist auf seinen Vertrieb, und für Regionen außerhalb der USA braucht es eine Freigabe für Abuse-Monitoring-Kontrollen und einen Zusatz zur Datenspeicherung (Data-Residency-Leitfaden, Preisseite). Die Modellseite von GPT-6 Astra enthält keine Aussage zur EU-Residenz; die Tabelle im Leitfaden führt
gpt-6-astrabei Responses, Chat Completions und Batch für die Regionen USA und Europa, lies sie für deinen Fall selbst nach. - Google: Gemini 3.8 Flash ist in der Gemini API allgemein verfügbar. Laut Preisseite werden Inhalte im Paid Tier nicht zur Verbesserung der Produkte genutzt, im kostenlosen Tier schon. Für Nutzer im EWR, in der Schweiz und im Vereinigten Königreich gelten laut den Nutzungsbedingungen die Datenschutzbedingungen der Paid Services dagegen auch für kostenlose Dienste und unbezahlte API-Kontingente (Preisseite, Nutzungsbedingungen). Gemini 4 Argon ist nicht allgemein verfügbar: Google will es "as soon as possible" für Entwickler, Unternehmen und Verbraucher öffnen und nennt kein Datum (Google).
- Mistral: Mistral bietet regionale Inferenz über einen eigenen EU-Endpunkt (
api.eu.mistral.ai) mit einem Aufschlag von 10 Prozent auf den Listenpreis. Wer den globalen Endpunkt nutzt, bekommt laut Mistral keine Zusage zu einem bestimmten Verarbeitungsort. Kontrollebene-Daten wie Kontoeinstellungen, API-Schlüssel und Abrechnung können laut Mistral weiterhin außerhalb der gewählten Region verarbeitet werden (Regional inference). Large 3 und Small 4 stehen als Open Weights unter Apache 2.0 zur Verfügung, Medium 3.5 unter Modified MIT (Modellseiten).
Für den Alltag im Team zählt neben dem Modell auch der Plan, über den es angeboten wird. Den Vergleich der Enterprise-Pläne von ChatGPT, Copilot und Claude (aktualisiert im Oktober 2026) findest du in ChatGPT, Copilot und Claude im Enterprise-Vergleich. Wenn dich vor allem das Arbeiten mit einem Coding-Agenten interessiert: Was ist Claude Code?
Wie wir diese Seite pflegen
Wir aktualisieren die Tabelle monatlich; jede Zeile trägt ihr Quellendatum. Die nächste Aktualisierung ist für November 2026 geplant. Dabei gelten drei Regeln:
- Eine Zeile kommt nur in die Tabelle, wenn Veröffentlichungsdatum und Preis auf der Anbieterseite stehen. Fehlt eines von beiden, lassen wir das Modell weg.
- Preise stehen in der Währung der Anbieterseite, ohne Umrechnung. Aktionspreise nennen ihr bestätigtes Enddatum oder ihre zugesicherte Mindestlaufzeit.
- Wir sortieren nicht nach Leistung und übernehmen keine Benchmark-Ranglisten. Beschreibungen der Anbieter geben wir als solche wieder.
FAQ
Welches KI-Modell ist das beste?
Darauf gibt es keine allgemeine Antwort. Es hängt von der Aufgabe ab, vom Preis, den du pro Anfrage tragen willst, und davon, welche Anforderungen du an Datenstandort und Datenverarbeitung stellst. Die Anbieter ordnen ihre Modelle selbst nach Aufgaben ein, und Anthropic schreibt in der Opus-5.5-Ankündigung, dass Benchmark-Abstände bei diesem Leistungsniveau ein weniger verlässlicher Maßstab für reale Unterschiede geworden sind. Prüfe deshalb zwei oder drei Kandidaten mit deinen eigenen Beispielen.
Was kostet GPT-6 Astra?
Laut OpenAI-Modellseite vom 6. Oktober 2026 kostet GPT-6 Astra 10 USD je 1 Mio. Input-Token und 50 USD je 1 Mio. Output-Token (Standard). Gecachter Input kostet 1 USD je 1 Mio. Token. Bei Prompts über 272.000 Input-Token gilt für die ganze Anfrage das Doppelte beim Input und das Anderthalbfache beim Output, Batch und Flex kosten die Hälfte.
Was ist Claude Fable 5.1?
Claude Fable 5.1 ist laut Anthropic das Nachfolgemodell von Fable 5, veröffentlicht am 1. September 2026, für anspruchsvolles Schlussfolgern und lange agentische Arbeit. Es kostet 10 USD Input und 50 USD Output je 1 Mio. Token, Cache-Lesen 0,25 USD. Claude Mythos 5.1 ist laut Anthropic dasselbe Modell mit anderen Schutzmaßnahmen und nur über Trusted-Access-Programme zugänglich, derzeit nur für ausgewählte US-Organisationen.
Was ist der Unterschied zwischen Opus 5.5 und Sonnet 5.5?
Beide haben laut Anthropic 1 Mio. Token Kontext und bis zu 128.000 Token Ausgabe. Opus 5.5 kostet 4 / 20 USD je 1 Mio. Token und wird für langlaufende agentische Coding- und Wissensarbeit beschrieben, Sonnet 5.5 kostet 2 / 10 USD und wird als beste Kombination aus Geschwindigkeit und Intelligenz beschrieben. Anthropic empfiehlt, bei Unsicherheit mit Opus 5.5 zu beginnen. Welches Modell zu deinen Aufgaben passt, zeigt ein Test.
Ist Gemini 4 verfügbar?
Nicht allgemein. Google hat Gemini 4 Argon am 30. September 2026 angekündigt und öffnet es zunächst nur für ausgewählte Cyber-Verteidiger über das Fairwind Program. Für den späteren Start nennt Google einen Einführungspreis von 2 USD Input und 10 USD Output je 1 Mio. Token, aber kein Datum für die breite Verfügbarkeit.
Welche KI-Modelle gibt es 2026?
Die Tabelle oben führt 18 Einträge von vier Anbietern, die Anthropic, OpenAI, Google und Mistral Anfang Oktober 2026 mit Datum und Preis nennen: bei Anthropic die Reihe Fable, Opus, Sonnet, Haiku, bei OpenAI die GPT-6-Modelle Astra, Sol und Luna sowie die GPT-5.6-Familie, bei Google Gemini 3.8 Flash und 3.1 Pro Preview, bei Mistral Medium 3.5, Large 3 und Small 4. Daneben gibt es weitere Anbieter und Modelle, die wir hier bewusst nicht führen, weil wir Datum und Preis nicht bestätigen konnten.
Quellen
Alle Quellen wurden am 6. Oktober 2026 abgerufen.
- Anthropic, Models overview: platform.claude.com/docs/en/models/overview
- Anthropic, Release notes: platform.claude.com/docs/en/release-notes/overview
- Anthropic, Model deprecations: platform.claude.com/docs/en/about-claude/model-deprecations
- Anthropic, Introducing Claude Fable 5.1 and Claude Mythos 5.1 (1. September 2026): anthropic.com/claude-fable-and-mythos-5-1
- Anthropic, Claude Opus 5.5 (22. September 2026): anthropic.com/news/claude-opus-5-5
- OpenAI, API Changelog: developers.openai.com/api/docs/changelog
- OpenAI, API Pricing: developers.openai.com/api/docs/pricing
- OpenAI, Data residency (Your data): developers.openai.com/api/docs/guides/your-data
- OpenAI, Modellseiten: GPT-6 Astra, GPT-6.1 Sol, GPT-6 Sol, GPT-6 Luna, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna
- OpenAI, News-Feed (Introducing GPT-6.1 Sol, 29. September 2026): openai.com/news/rss.xml
- Google, Gemini API Pricing: ai.google.dev/gemini-api/docs/pricing
- Google, Gemini API Terms: ai.google.dev/gemini-api/terms
- Anthropic, Pricing: platform.claude.com/docs/en/about-claude/pricing
- Google, Gemini API Changelog: ai.google.dev/gemini-api/docs/changelog
- Google, Gemini 4 Argon (30. September 2026): blog.google/.../gemini-4-argon
- Mistral, Modellseiten: Medium 3.5, Large 3, Small 4
- Mistral, Regional inference: docs.mistral.ai/inference/regional-inference
Messbar machen
Woran du erkennst, ob KI wirkt
Das KPI-Framework zeigt, mit welchen Kennzahlen du KI-Adoption und Produktivität messbar machst. Kostenlos als PDF per E-Mail.
Über den Autor
Co-Founder · Business & Content Lead
Co-Founder von Sentient Dynamics. 15+ Jahre Business-Strategie (u.a. SAP), MBA. Schreibt über AI-Act-Compliance, ROI-Messung und wie Mittelstand-CTOs agentische KI tatsächlich einführen.