Änderungsprotokoll
Wichtige Änderungen an AI Foundation Services — neue Modelle, Funktionsupdates und Deprecations.
v1.2.2 — 2026-09
Abschnitt betitelt „v1.2.2 — 2026-09“Bringt die Dokumentation in Übereinstimmung mit der Leistungsbeschreibung v1.23 (31. August 2026), die für alle folgenden Punkte die verbindliche Quelle ist.
Hinzugefügt
Abschnitt betitelt „Hinzugefügt“- Neues Preview-Modell im Test-Katalog: GLM 5.3 Flash — nativ multimodal, kostenlos mit jedem aktiven Tarif. Siehe Test- / Vorschau-Modelle.
- Neue Modelle in den Tarifen Essential, Professional und Agentic: GPT-5.6 Terra und GPT-5.6 Luna. Siehe Tarife & Preise.
- Gemini 3.1 Pro wird nun nach Kontextlänge bepreist.
- Preise für zwischengespeicherte Input-Tokens bei T-Cloud-gehosteten Modellen. Siehe Prefix Caching.
Geändert
Abschnitt betitelt „Geändert“- Die Mindestverfügbarkeit beträgt 99,5 %, nicht die zuvor ausgewiesenen 99,9 %.
- GLM 5.2 — Token-Preise gesenkt, und das Modell wurde in das Tier Standard überführt.
- GPT-Image-2 — Preise korrigiert.
- Prefix Caching ist bei T-Cloud-gehosteten Modellen standardmäßig aktiv, nicht Opt-in.
- Serverstandort und Datenverarbeitung der Gemini-3-Familie werden nun als Worldwide ausgewiesen statt als Europa. Siehe Enterprise Trust.
- Die Anthropic-Modelle sind mit GCP / Azure gekennzeichnet.
- Die mit der Dokumentation ausgelieferte Leistungsbeschreibung liegt nun als v1.23 vor.
- Enterprise Trust, Kategorie 1, führt nun die Modelle auf, die die Leistungsbeschreibung nennt.
Entfernt
Abschnitt betitelt „Entfernt“- Llama 3.3 70B, Claude 4.5 Sonnet und Claude 4.5 Opus haben ihr Stilllegungsdatum erreicht. Ersatzmodelle siehe Stillgelegte Modelle.
Behoben
Abschnitt betitelt „Behoben“- GLM 5.2 erscheint wieder unter Coding-Modelle.
- OpenCode: Die Authentifizierungs-URL in der Plugin-Anleitung wurde korrigiert.
/category/model-servingleitet nun auf die Anleitungen weiter statt einen 404 zu liefern.
v1.2.1 — 2026-08
Abschnitt betitelt „v1.2.1 — 2026-08“Hinzugefügt
Abschnitt betitelt „Hinzugefügt“- Neues Preview-Modell im Test-Katalog: Qwen 3.8 27B FP8 — nativ multimodal, kostenlos mit jedem aktiven Tarif. Siehe Test- / Vorschau-Modelle.
v1.2.0 — 2026-07
Abschnitt betitelt „v1.2.0 — 2026-07“Hinzugefügt
Abschnitt betitelt „Hinzugefügt“- Neue Modelle in den Tarifen Essential, Professional und Agentic: GPT-5.4, GPT-5.4 mini, GPT-5.5 und GPT-Image-2 (OpenAI); Gemini 3.1 Pro und Gemini 3.5 Flash (Google). Claude 4.8 Opus (Anthropic) in Professional und Agentic. Siehe Tarife & Preise.
- Mistral Small 4 und Gemma 4 sind jetzt allgemein verfügbar, zuvor nur als Preview. Siehe Tarife & Preise.
- Neues Preview-Modell im Test-Katalog: GLM 5.2 — kostenlos mit jedem aktiven Tarif. Siehe Test- / Vorschau-Modelle.
Veraltet
Abschnitt betitelt „Veraltet“- Modelle der Familien GPT-4.1, GPT-4o, o-Serie, Qwen3, Gemini 2.5, Gemini 3 und Claude Sonnet / Opus sind zur Stilllegung am 01.08.2026 vorgesehen, ebenso Mistral Small 3 und GPT Image 1. Siehe Zur Stilllegung vorgesehen für die Tabelle und die Ersatzmodelle.
v1.1.0 — 2026-05
Abschnitt betitelt „v1.1.0 — 2026-05“Archivierter Stand: v1.1.0.
Hinzugefügt
Abschnitt betitelt „Hinzugefügt“- Neuer Bereich Modelle auf oberster Ebene mit einer Vergleichsseite für jedes gehostete Modell — Kontextfenster, Preise, Cloud, Modalitäten, Tarifverfügbarkeit und OpenAI-kompatible Endpunkt-Referenz. Bild-fähige Modelle erscheinen zusätzlich auf der dedizierten Vision-Seite über einen Capability-Filter.
- Seite Änderungsprotokoll (die Sie gerade lesen).
- Zwei neue Preview-Modelle im Test-Katalog:
Mistral Small 4(Mistral-Small-4-119B-2603-Preview) undGemma 4(gemma-4-31B-it-FP8-preview). Siehe Rate-Limits für die Richtlinie zu Preview-Modellen.
Entfernt
Abschnitt betitelt „Entfernt“- Fine-Tuning-API-Dokumentation. Aufrufe von
/guides/fine-tuningwerden nun auf die optionalen Leistungen umgeleitet. Überholt: Feintuning wird als optionale Leistung auf Anfrage angeboten — siehe § 3.4.2 der Leistungsbeschreibung. Die Self-Service-API-Dokumentation bleibt zurückgezogen.
Archivierter Stand: v1.0.0 — der ursprünglich veröffentlichte Stand der Dokumentation, bevor das Änderungsprotokoll eingeführt wurde.