AI Hosting: Diese Modelle stehen dir zur Verfügung
Der Fokus liegt darauf, dass sich die Modelle sinnvoll einsetzen lassen: für Features in Webprojekten, zur Prozessoptimierung oder für clevere Automatisierungen. Der Vorteil: Alles läuft in unserer eigenen Infrastruktur in unserem Rechenzentrum in Deutschland, ganz ohne externe Dienstleister oder US-Firmen. Stichwort: Digitale Souveränität. So bleiben deine Daten geschützt – und deine Nerven auch. Damit deine Buchhaltung nicht ins Schwitzen kommt, planen wir zudem ein transparentes, einfaches Abrechnungsmodell.
Welche Modelle du zur Zeit bei uns verwenden kannst und was sie dir für Vorteile bringen, habe ich dir hier einmal aufgelistet.
AI Hosting: Aktuell verfügbare Modelle
Update September 2026: Unser AI Hosting entwickelt sich kontinuierlich weiter – und damit auch die Auswahl der verfügbaren Modelle. Neue Modelle kommen hinzu, andere werden im Rahmen unseres Modell-Lifecycles ersetzt.
Aktuell reicht die Auswahl von kleinen, schnellen Modellen bis hin zu leistungsfähigen Reasoning-, Coding- und Vision-Modellen sowie spezialisierten Modellen für OCR, Embeddings, Reranking, Speech-to-Text und Text-to-Speech.
Zu den aktuell verfügbaren Modellen gehören unter anderem:
- gpt-oss-120b – für komplexe Text-, Reasoning- und agentische Aufgaben
- Qwen3.5-122B-A10B-FP8 – großes Modell für Reasoning und Vision
- Qwen3.6-35B-A3B-FP8 – leistungsfähiges Modell für Reasoning, Vision und lange Kontexte
- Qwen3.8-27B-NVFP4 – besonders interessant für Coding, Tool-Loops und agentische Workflows
- Ministral-3-14B-Instruct-2512 – kompaktes Allround-Modell für Text und Vision
- Qwen3.5-0.8B – kleines und schnelles Modell für Routing, Klassifizierung und einfache Aufgaben
- Qwen3-Embedding-8B und Qwen3-VL-Reranker-2B – für Suche und RAG-Anwendungen
- GLM-OCR – zur strukturierten Verarbeitung von Dokumenten und Bildern
- Whisper-Large-V3-Turbo – für Speech-to-Text
- Qwen3-TTS-12Hz-1.7B-CustomVoice – für Text-to-Speech
Da sich unser Modellportfolio regelmäßig weiterentwickelt, findest du die vollständige und jeweils aktuelle Modellübersicht mit Kontextgrößen, Modalitäten und Lizenzen in unserem Developer Portal.
Einfach über eine OpenAI-kompatible API nutzen.
Alle Modelle lassen sich über unsere OpenAI-kompatible API in Anwendungen, Automationen und bestehende AI-Workflows integrieren. In vielen Fällen reicht es aus, Base-URL, API-Key und Modell anzupassen.
Für die Nutzung benötigst du einen mStudio-Zugang, eine Organisation und einen aktiven AI-Hosting-Tarif. Ein zusätzliches Webhosting- oder vServer-Paket ist nicht erforderlich.
Jetzt aber mal reinfolgen!
Abonniere Tipps für CMS und Dev-Tools, Hosting Hacks und den ein oder anderen Gag. Unsere schnellen Takes für dich per E-Mail.
Jetzt unser AI Hosting testen
Hat eins der Modelle dein Interesse geweckt? Dann probier es doch mal aus!
Hast du einen vServer? Dann richten wir dir auf Wunsch direkt einen vorkonfigurierten OpenWebUI-Container ein – und du kannst sofort mit dem Modell chatten.
Unsere Modelle sprechen über eine OpenAI-API-kompatible Schnittstelle. Heißt für dich: Hast du schon eine KI-Anwendung, musst du nur Host und API-Key tauschen. Fertig ist dein Drop-In-Replacement – und die Datenschutzsorgen schrumpfen.
Schau mal in unsere Doku im Developer Portal.
Zusammen mit unserem Container Hosting hast du damit eine starke Plattform, um digital souverän durchzustarten.
Wichtig: Dein Feedback
Hast du Ideen oder Wünsche? Immer her damit! Im mStudio besteht in der unteren, rechten Ecke des Bildschirms die Möglichkeit, uns Feedback zu unserem AI Hosting zu geben. Natürlich kannst du dich aber auch jederzeit gerne bei unserem Kundenservice melden. Wir freuen uns auf deine Nachricht!