Coding Models
Dieser Inhalt ist für v1.1.0. Geh zur neuesten Version, um die aktuellste Dokumentation zu bekommen.
Dieser Inhalt ist noch nicht in deiner Sprache verfügbar.
Models tuned for code completion, refactoring, and review. Stronger on programming benchmarks than general LLMs of similar parameter count, while remaining usable through the standard Chat Completions endpoint.
Zeige 2 von 2 Modellen
| Token-für-Token-Ausgabe via Server-Sent Events. Geeignet für niedrige Latenz und Echtzeit-UI. | Funktions-/Tool-Aufrufe (OpenAI-kompatibel). Das Modell kann strukturierte Tool-Aufrufe zurückgeben. | Preis pro Million Prompt-Tokens, die aus dem Prefix-Cache bedient werden: 15 % des normalen Eingabepreises. Gilt nur für T-Cloud-gehostete Modelle — für externe Anbieter wird die Cache-Preisgestaltung später ergänzt. | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Qwen 3.8 27B FP8 | | Gehostet auf T-Cloud Public — der souveränen Infrastruktur der Telekom in Deutschland. | Text, Bild | Text | ✓ | ✓ | 256K | — | — | — | Test | |
| GPT-5 Codex | | Gehostet auf Microsoft Azure (EU-Regionen). | Text, Bild | Text | ✓ | ✓ | 400K | €1.10 | €8.70 | n. v. | EssentialProfessionalAgentic | |
| Keine Modelle entsprechen den Filtern. | ||||||||||||