AI Hosting: Diese Modelle stehen dir zur Verfügung

|
Porträt von Reidar Janssen mit dem Schriftzug "AI-Hosting: Welche Modelle du in unserer Beta testen kannst
Mit dem AI Hosting bekommst du bei uns die Möglichkeit, Modelle direkt in deinen Projekten einzusetzen. Unser Ansatz ist praxisnah – abgestimmt auf die Bedürfnisse, die im Agenturalltag und bei Web-Projekten wirklich zählen. 

Der Fokus liegt darauf, dass sich die Modelle sinnvoll einsetzen lassen: für Features in Webprojekten, zur Prozessoptimierung oder für clevere Automatisierungen. Der Vorteil: Alles läuft in unserer eigenen Infrastruktur in unserem Rechenzentrum in Deutschland, ganz ohne externe Dienstleister oder US-Firmen. Stichwort: Digitale Souveränität. So bleiben deine Daten geschützt – und deine Nerven auch. Damit deine Buchhaltung nicht ins Schwitzen kommt, planen wir zudem ein transparentes, einfaches Abrechnungsmodell

Welche Modelle du zur Zeit bei uns verwenden kannst und was sie dir für Vorteile bringen, habe ich dir hier einmal aufgelistet.

AI Hosting: Aktuell verfügbare Modelle

Update September 2026: Unser AI Hosting entwickelt sich kontinuierlich weiter – und damit auch die Auswahl der verfügbaren Modelle. Neue Modelle kommen hinzu, andere werden im Rahmen unseres Modell-Lifecycles ersetzt.

Aktuell reicht die Auswahl von kleinen, schnellen Modellen bis hin zu leistungsfähigen Reasoning-, Coding- und Vision-Modellen sowie spezialisierten Modellen für OCR, Embeddings, Reranking, Speech-to-Text und Text-to-Speech.

Zu den aktuell verfügbaren Modellen gehören unter anderem:

  • gpt-oss-120b – für komplexe Text-, Reasoning- und agentische Aufgaben
  • Qwen3.5-122B-A10B-FP8 – großes Modell für Reasoning und Vision
  • Qwen3.6-35B-A3B-FP8 – leistungsfähiges Modell für Reasoning, Vision und lange Kontexte
  • Qwen3.8-27B-NVFP4 – besonders interessant für Coding, Tool-Loops und agentische Workflows
  • Ministral-3-14B-Instruct-2512 – kompaktes Allround-Modell für Text und Vision
  • Qwen3.5-0.8B – kleines und schnelles Modell für Routing, Klassifizierung und einfache Aufgaben
  • Qwen3-Embedding-8B und Qwen3-VL-Reranker-2B – für Suche und RAG-Anwendungen
  • GLM-OCR – zur strukturierten Verarbeitung von Dokumenten und Bildern
  • Whisper-Large-V3-Turbo – für Speech-to-Text
  • Qwen3-TTS-12Hz-1.7B-CustomVoice – für Text-to-Speech

 

Da sich unser Modellportfolio regelmäßig weiterentwickelt, findest du die vollständige und jeweils aktuelle Modellübersicht mit Kontextgrößen, Modalitäten und Lizenzen in unserem Developer Portal.
Einfach über eine OpenAI-kompatible API nutzen.

Alle Modelle lassen sich über unsere OpenAI-kompatible API in Anwendungen, Automationen und bestehende AI-Workflows integrieren. In vielen Fällen reicht es aus, Base-URL, API-Key und Modell anzupassen.

Für die Nutzung benötigst du einen mStudio-Zugang, eine Organisation und einen aktiven AI-Hosting-Tarif. Ein zusätzliches Webhosting- oder vServer-Paket ist nicht erforderlich.

Jetzt aber mal reinfolgen!

Abonniere Tipps für CMS und Dev-Tools, Hosting Hacks und den ein oder anderen Gag. Unsere schnellen Takes für dich per E-Mail.

Wie dürfen wir dich ansprechen?

Jetzt unser AI Hosting testen 

Hat eins der Modelle dein Interesse geweckt? Dann probier es doch mal aus!

Hast du einen vServer? Dann richten wir dir auf Wunsch direkt einen vorkonfigurierten OpenWebUI-Container ein – und du kannst sofort mit dem Modell chatten. 

Unsere Modelle sprechen über eine OpenAI-API-kompatible Schnittstelle. Heißt für dich: Hast du schon eine KI-Anwendung, musst du nur Host und API-Key tauschen. Fertig ist dein Drop-In-Replacement – und die Datenschutzsorgen schrumpfen. 

Schau mal in unsere Doku im Developer Portal.

Zusammen mit unserem Container Hosting hast du damit eine starke Plattform, um digital souverän durchzustarten. 

Wichtig: Dein Feedback

Hast du Ideen oder Wünsche? Immer her damit! Im mStudio besteht in der unteren, rechten Ecke des Bildschirms die Möglichkeit, uns Feedback zu unserem AI Hosting zu geben. Natürlich kannst du dich aber auch jederzeit gerne bei unserem Kundenservice melden. Wir freuen uns auf deine Nachricht!

Ähnliche Artikel:

Container auf dem Root-Server? Was managed Hosting dir abnimmt

Container 101 (4): Container auf dem Root Server? Was Managed Hosting dir abnimmt

Container auf dem Root Server oder managed Hosting? Wir zeigen dir, wo deine Zeit hinfließt und was mittwald dir bei Sicherheit, Updates und Backups abnimmt.

Container 101 (3): Volumes, Umgebungsvariablen & Portfreigaben

Basiswissen für Agenturen: Wie Volumes Daten erhalten, Umgebungsvariablen die Konfiguration liefern und Portfreigaben den Container erreichbar machen.

Rust Token Killer (RTK): Token-Optimierung für Claude Code, Cursor & Co.

Bis zu 90 % weniger Token im KI-Kontext: So macht RTK Deine Coding-Agents schlanker – und kompatibel mit dem mittwald AI Hosting.

wp2shell: Als der Support-Posteingang wegen einer WordPress Sicherheitslücke explodierte

Mitte Juli explodierte unser Support-Posteingang: Die Fakten zur WordPress Sicherheitslücke wp2shell und wie sie sich bei mittwald bemerkbar machte.

Container 101 (2): So hängen Image und Registry zusammen

Basiswissen für Agenturen: Wie Docker-Images entstehen, wo sie gespeichert werden und wie Deployment darauf aufbaut.