Embedding-Modelle
Wandeln Text in dichte Vektoren um, für semantische Suche, Clustering und Retrieval-Augmented Generation. Verfügbar über den Endpunkt POST /embeddings.
Zeige 3 von 3 Modellen
| Token-für-Token-Ausgabe via Server-Sent Events. Geeignet für niedrige Latenz und Echtzeit-UI. | Funktions-/Tool-Aufrufe (OpenAI-kompatibel). Das Modell kann strukturierte Tool-Aufrufe zurückgeben. | Preis pro Million Prompt-Tokens, die aus dem Prefix-Cache bedient werden: 15 % des normalen Eingabepreises. Gilt nur für T-Cloud-gehostete Modelle — für externe Anbieter wird die Cache-Preisgestaltung später ergänzt. | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| BGE-M3 | | Gehostet auf T-Cloud Public — der souveränen Infrastruktur der Telekom in Deutschland. | Text | Vektor | ✗ | ✗ | 8K | €0.05 | €0.05 | €0.0075 | EssentialProfessionalAgentic | |
| Jina Embeddings v2 Base DE | | Gehostet auf T-Cloud Public — der souveränen Infrastruktur der Telekom in Deutschland. | Text | Vektor | ✗ | ✗ | 8K | €0.05 | €0.05 | €0.0075 | EssentialProfessionalAgentic | |
| Ada Text Embedding | | Gehostet auf Microsoft Azure (EU-Regionen). | Text | Vektor | ✗ | ✗ | 8K | €0.11 | €0.11 | n. v. | EssentialProfessionalAgentic | |
| Keine Modelle entsprechen den Filtern. | ||||||||||||