Coding-Modelle
Modelle, die auf Code-Vervollständigung, Refactoring und Review optimiert sind. Bei Programmier-Benchmarks stärker als allgemeine LLMs ähnlicher Parameteranzahl und gleichzeitig über den Standard-Chat-Completions-Endpunkt nutzbar.
Zeige 2 von 2 Modellen
| Token-für-Token-Ausgabe via Server-Sent Events. Geeignet für niedrige Latenz und Echtzeit-UI. | Funktions-/Tool-Aufrufe (OpenAI-kompatibel). Das Modell kann strukturierte Tool-Aufrufe zurückgeben. | Preis pro Million Prompt-Tokens, die aus dem Prefix-Cache bedient werden: 15 % des normalen Eingabepreises. Gilt nur für T-Cloud-gehostete Modelle — für externe Anbieter wird die Cache-Preisgestaltung später ergänzt. | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Qwen 3.8 27B FP8 | | Gehostet auf T-Cloud Public — der souveränen Infrastruktur der Telekom in Deutschland. | Text, Bild | Text | ✓ | ✓ | 256K | — | — | — | Test | |
| GPT-5 Codex | | Gehostet auf Microsoft Azure (EU-Regionen). | Text, Bild | Text | ✓ | ✓ | 400K | €1.10 | €8.70 | n. v. | EssentialProfessionalAgentic | |
| Keine Modelle entsprechen den Filtern. | ||||||||||||