Coding
Agenten
OCR
Embeddings
und viele weitere AI-Anwendungen
kompatible API
digital souverän
Für Berufsgeheimnisträger geeignet
bis zum ersten Token
Finde das passende Modell für deinen Anwendungsfall – von schnellen Chat- und Coding-Modellen bis hin zu Vision, OCR und Embeddings. Alle Modelle sind über dieselbe OpenAI-kompatible API verfügbar.
AI Hosting entwickelt sich kontinuierlich weiter. Stimme über neue Features ab, teile deine Ideen auf GitHub und verfolge transparent, woran wir als Nächstes arbeiten.
Für deine Projekte von morgen
Mit dem AI Hosting baust du schon heute die Lösungen der Zukunft.
Was unsere Kunden sagen
"Wir nutzen AI Hosting sowohl für einen interaktiven Dokumentations-Bot als auch direkt in unseren Entwicklungs-Workflows über GitHub Copilot. So können wir KI flexibel in unsere tägliche Arbeit integrieren und neue Ideen deutlich schneller umsetzen."
Alexander Jahnk, nuonic digital
“Das spart uns enorm viel Zeit – Zeit, die wir in eine persönlichere und intensivere Betreuung unserer Kunden investieren.”
Thomas Löbel, The Web Designer
Unsere 5 beliebtesten Modelle
Modell
gpt-oss-120b
Qwen3.6-35B
Qwen3-Embedding-8B
Ministral-3-14B
Qwen3.5-122B
Anwendung
Text, Tool Calling
Text, Bild, Tool Calling
Text > Vektor
Chat + Vision
Chat + Reasoning + Vision
Kontext
131k
256k
32k
256k
256k
GPU Power aus Deutschland
Gehosted in unserem Rechenzentrum
Unsere Infrastruktur ist ISO 27001 zertifiziert und erfüllt höchste Sicherheitsstandards.
Keine Speicherung von Trainingsdaten
Unsere Infrastruktur ist ISO 27001 zertifiziert und erfüllt höchste Sicherheitsstandards.
§203 StGB-konform
Anwälte, Ärzte und Steuerberater können Mandats-, Patienten- und Beratungsdaten rechtssicher verarbeiten.
AI in deinem persönlichen Workflow
So arbeitest du mit deinen KI Modellen.
Integriert in deine Arbeit
Du betreibst das AI Hosting eingebettet in deine ganz persönlichen Workflows. Dafür stehen dir mehrere Arbeitsweisen zur Verfügung:
Verlass dich auf uns
Dein Setup hakt? Dein Modell gibt dir nicht die gewünschten Ergebnisse? Wir unterstützen dich. Damit deine Kunden das beste KI-Erlebnis haben.
Und wenn du dir nicht sicher bist, welche Ressourcen du für deine Projekte benötigst oder welcher unserer Hosting Tarife der richtige für dich ist, dann melde dich! Unter +49 5772 293 150 stehen wir dir gerne zur Seite.
Connect
AI jetzt ausprobieren
Teste jetzt alle verfügbaren AI Modelle im mittwald Playground:
AI Community
Du willst mit unserer AI Community im Kontakt bleiben? Du möchtest mit unseren AI Engineers diskutieren oder dich mit anderen Entwicklungsagenturen austauschen? Dann komm jetzt in unsere Discord Community:
Hier bekommst du Antworten
Im AI Hosting kannst du pro Organisation im mStudio einen oder mehrere OpenAI-kompatible APIKeys generieren. Mit diesen API-Keys kannst du unsere aktuell verfügbaren fünf KI-Modelle direkt ansprechen und in eigene Anwendungen, Workflows oder Systeme integrieren.
Zusätzlich hast du die Möglichkeit, automatisch einen Open WebUI-Container zu erstellen. Dieser eignet sich ideal, um die Modelle direkt über eine grafische Oberfläche zu testen, mit ihnen zu chatten oder Prototypen zu entwickeln.
Darüber hinaus kannst du im Container Hosting weitere AI-nahe Services betreiben und mit dem AI Hosting kombinieren, zum Beispiel:
- Vektordatenbanken
- Agenten-Frameworks
- eigene Inferenz- oder Orchestrierungsdienste
Die eingesetzten Modelle sind öffentlich verfügbar und stammen aus Open-Source-Communities oder aus frei nutzbaren Projekten. Es handelt sich dabei um sogenannte Open-Weight-Modelle, die transparent einsetzbar sind und sich problemlos in eigene Anwendungen integrieren lassen.
Um AI Hosting zu nutzen, benötigst du:
- einen Zugang zum mStudio
- eine angelegte Organisation im mStudio
- einen aktiven Paid Plan für AI Hosting
Ein klassisches Hosting-Paket (z. B. Webhosting, vServer oder Dedicated Server) ist nicht erforderlich. Diese Voraussetzung galt ausschließlich während der Beta-Phase.
Sobald deine Organisation angelegt und ein Paid Plan aktiviert ist, kannst du ein Projekt erstellen und im Bereich AI Hosting einen oder mehrere API-Keys generieren.
Die aktuell verfügbaren Modelle findest du jederzeit im Developer Portal. Zum Start stehen folgende Modelle zur Verfügung:
- OSS‑120B (OpenAI)
Open‑Weight‑Modell mit starkem Reasoning und sehr guten agentischen Fähigkeiten. Geeignet für komplexe Aufgaben, Analysen und anspruchsvolle Workflows. - Whisper‑Large‑V3‑Turbo
Leistungsfähiges Speech‑to‑Text‑Modell für Transkription, Voice‑Interfaces und Audio‑Workflows. - Qwen3‑Embedding‑8B
Embedding‑Modell für semantische Suche, Textähnlichkeit, RAG‑Setups und Empfehlungssysteme. - Devstral‑Small‑2‑24B
Speziell optimiert für agentenbasierte Coding‑Aufgaben, Code‑Generierung, Refactoring und Debugging. - Ministral 3 14B
Vielseitiges Sprachmodell für allgemeine Text‑, Chat‑ und Reasoning‑Aufgaben.
Weitere Modelle werden sukzessive ergänzt.
Ja. Alle Anfragen werden ausschließlich innerhalb unserer eigenen Infrastruktur verarbeitet. Es findet kein Datentransfer außerhalb Deutschlands statt – auch nicht in Drittstaaten wie die USA. Eingaben werden nicht zum Training der Modelle verwendet. Alle Prozesse erfüllen die Anforderungen der DSGVO.
Inhalte wie Texteingaben oder Prompts werden nicht dauerhaft gespeichert. Sie dienen ausschließlich der unmittelbaren Verarbeitung und werden anschließend verworfen.
Die eingesetzten Modelle sind nicht lernfähig im Sinne eines Trainings auf Nutzerdaten. Deine Eingaben haben keinen Einfluss auf zukünftige Antworten.
Viele CMS wie TYPO3 CMS oder WordPress unterstützen Plugins oder Extensions mit OpenAI-kompatibler API-Anbindung. Dort kannst du einfach deinen mittwald-AI Hosting-API-Key hinterlegen und die Funktionalität direkt nutzen.
Open WebUI ist eine benutzerfreundliche Open-Source-Oberfläche für die Arbeit mit Sprachmodellen. Du kannst dort:
- direkt mit den mittwald-Modellen chatten
- eigene API-Keys (z. B. von OpenAI) verwenden
- Modelle vergleichen und testen
Der Container lässt sich im mStudio mit wenigen Klicks automatisch erstellen. Um Open WebUI zu betreiben, benötigst du einen vServer oder Dedicated Server.
Ja. Die jeweils geltenden Limits sind transparent in der Tariftabelle einsehbar.
Aktuell gibt es keinen harten Cut, wenn du dein Token-Limit überschreitest:
- Bei 75 % Auslastung erhältst du einen Hinweis im mStudio.
- Bei 90 % Auslastung wirst du zusätzlich per E-Mail informiert.
Sollten wir feststellen, dass du deine Limits regelmäßig überschreitest, kommen wir aktiv auf dich zu, um gemeinsam eine passende Lösung zu finden.
Diese Regelung ist eine temporäre Lösung zum Start. Perspektivisch sind Modelle wie Pay-per-Token oder ein automatisches Stoppen der API ab einer bestimmten Überschreitung vorgesehen.
Das lässt sich im Voraus nie zu 100 % exakt bestimmen – der Tokenverbrauch hängt stark vom Use Case, vom gewählten Modell sowie von Länge und Anzahl der Anfragen ab.
So gehst du am besten vor:
- Wenn du bereits APIs wie z. B. OpenAI nutzt, kannst du dich an deinem bisherigen Tokenverbrauch orientieren.
- Alternativ startest du mit einem Tarif und beobachtest deinen tatsächlichen Verbrauch.
- Deinen aktuellen Tokenverbrauch kannst du jederzeit transparent im mStudio einsehen.
- Alle Tarife haben monatliche Laufzeiten, sodass du flexibel upgraden oder downgraden kannst.
Token-Zahlen sind abstrakt. Die folgende Übersicht zeigt Näherungswerte, was du mit den jeweiligen Tarifen konkret umsetzen kannst. Die Angaben basieren auf dem OSS‑120B‑Modell und dienen ausschließlich zur Orientierung. Der tatsächliche Verbrauch kann je nach Prompt und Antwort variieren.
Eine Übersicht für typische Nutzungsszenarien findest du hier.
Unser Support‑Team steht dir während der regulären Supportzeiten per Ticket, Telefon oder Live‑Chat zur Verfügung.
Zusätzlich findest du im Developer Portal ausführliche technische Dokumentation, Code‑Beispiele und Hinweise zur API‑Nutzung, zu Modellen sowie zu typischen Integrationsszenarien rund um AI‑Hosting.
Darüber hinaus kannst du dich im Agentur Hub mit anderen Agenturen sowie Entwicklerinnen und Entwicklern austauschen.
Aktuell gibt es keine separate Test‑ oder Trial‑Funktion für AI Hosting.
Du kannst jedoch den kleinsten verfügbaren Tarif buchen, AI Hosting einen Monat lang nutzen und anschließend direkt wieder kündigen. Es gibt dabei keine Mindestlaufzeit über den gebuchten Zeitraum hinaus.
So kannst du AI Hosting realistisch im Produktivbetrieb testen – inklusive API‑Keys, Modellen und Limits.