Managed AI Hosting

KI für deine Anwendungen

KI-Modelle für Agenturen, SaaS und Unternehmen. 
Volle Kontrolle über deine Daten. 100% digital souverän.

Für deine Projekte von morgen

Mit dem AI Hosting baust du schon heute die Lösungen der Zukunft.

RAG
Automation
Coding
Content-Generierung
RAG

Files verarbeiten

Daten mit KI in deinem abgegrenzten Bereich bearbeiten, das machst du mit einem RAG-System. Perfekt für deine Kunden, die etwa interne Dokumentationen durchsuchen wollen.

Passende Modelle:

Qwen-VL-Reranker

Qwen3-Embedding-8B

gpt-oss-120b

Lächelnder Produktmanager im Interview zum Thema Features
Automation

KI arbeiten lassen 

Für Automationen nutzt du unser komplettes Ökosystem. n8n und Vektordatenbanken betreibst du im Docker Container. Content Generierung und embedding löst du über AI.

Passende Modelle:

gpt-oss-120b

Qwen3-Embedding-8B

Ministral-3-14B-Instruct-2512

“Wir entwickeln im Austausch mit Agenturen und Entwicklern, um für diese echten Mehrwert zu schaffen.”

Maik Behring, Product Manager AI Hosting bei mittwald

Steht für moderne Technologien, effiziente Workflows und ein starkes Entwickler-Team.
Coding

Entwicklungs-Booster

Vergiss Boilerplate. Du sagst, wie dein Code aussehen muss, die KI schreibt ihn für dich. So entwickelst du spürbar schneller, nutzt deine Zeit effizienter und kannst mehr Jobs abrechnen.

Passende Modelle:

Qwen3.6-35B-A3B-FP8

gpt-oss-120b

Qwen3-Embedding-8B

Content-Generierung

Text, Bild und Video

Lass dir deinen Content generieren. Passend zu deiner Zielgruppe, in jedem Format und in den Variationen, die du brauchst. Für mehr Produktionsgeschwindigkeit und Kosteneffizienz.

Passende Modelle:

Qwen3.6-35B-A3B-FP8

gpt-oss-120b

whisper-large-v3-turbo

Steht für moderne Technologien, effiziente Workflows und ein starkes Entwickler-Team.

Was unsere Kunden sagen

"Wir nutzen AI Hosting sowohl für einen interaktiven Dokumentations-Bot als auch direkt in unseren Entwicklungs-Workflows über GitHub Copilot. So können wir KI flexibel in unsere tägliche Arbeit integrieren und neue Ideen deutlich schneller umsetzen."

Alexander Jahnk, nuonic digital

Das spart uns enorm viel Zeit – Zeit, die wir in eine persönlichere und intensivere Betreuung unserer Kunden investieren.”

Thomas Löbel,  The Web Designer

Für jeden Case das richtige Modell

Wähle aus unterschiedlichen Modellen. Alle open Weight, alle digital souverän.  

Unsere 5 beliebtesten Modelle

Modell

gpt-oss-120b

Qwen3.6-35B
 

Qwen3-Embedding-8B

Ministral-3-14B

Qwen3.5-122B

Anwendung

Text, Tool Calling

Text, Bild, Tool Calling

Text > Vektor
  

Chat + Vision

Chat + Reasoning + Vision

Kontext

131k

256k
 

32k
 

256k

256k

GPU Power aus Deutschland

Gehosted in unserem Rechenzentrum

Unsere Infrastruktur ist ISO 27001 zertifiziert und erfüllt höchste Sicherheitsstandards.

Keine Speicherung von Trainingsdaten

Unsere Infrastruktur ist ISO 27001 zertifiziert und erfüllt höchste Sicherheitsstandards.

§203 StGB-konform

Anwälte, Ärzte und Steuerberater können Mandats-, Patienten- und Beratungsdaten rechtssicher verarbeiten.

AI in deinem persönlichen Workflow

So arbeitest du mit deinen KI Modellen.

Flexible Arbeitsweisen

Integriert in deine Arbeit

Du betreibst das AI Hosting eingebettet in deine ganz persönlichen Workflows. Dafür stehen dir mehrere Arbeitsweisen zur Verfügung:

One-Click Applications

AI Setups, die sofort laufen

Vorlagen machen dir das Leben leicht. So startest du komplexe Systeme wie ein RAG-System mit einem Klick:

RAG mit AnythingLLM

Automatisierung mit n8n

Vektordatenbanken mit Chroma oder Qdrant

One-Click Open WebUI Instanz

Die Kombination aus vServer und AI Hosting ermöglicht einen Projektstart im Handumdrehen.

Support + Beratung

Verlass dich auf uns

Dein Setup hakt? Dein Modell gibt dir nicht die gewünschten Ergebnisse? Wir unterstützen dich. Damit deine Kunden das beste KI-Erlebnis haben. 

Zertifizierter Support

Persönliche Ansprechpartner

Austausch mit anderen Agenturen und Entwicklern

Und wenn du dir nicht sicher bist, welche Ressourcen du für deine Projekte benötigst oder welcher unserer Hosting Tarife der richtige für dich ist, dann melde dich! Unter +49 5772 293 150 stehen wir dir gerne zur Seite.

AI Hosting Tarife

Wähle das perfekte Setup für deine Anforderungen

ab 9 €

pro Monat zzgl. USt.*

Managed
Starter

Perfekt zum Testen und Experimentieren

5 Mio. Tokens/Monat

30 Requests/Minute

5 parallele Requests

Empfohlen
ab 39 €

pro Monat zzgl. USt.*

Managed
Pro

Für Agenturen und Produktiveinsatz

 

75 Mio. Tokens/Monat

60 Requests/Minute

10 parallele Requests

ab 149 €

pro Monat zzgl. USt.*

Managed
Business

Für größere Teams und Projekte

 

300 Mio. Tokens/Monat

150 Requests/Minute

20 parallele Requests

Enterprise
ab 999 €

pro Monat zzgl. USt.*

Managed Dedicated

Eigene GPU-Ressourcen

 

Milliarden Tokens/Monat

Eigene RTX PRO 6000

Custom-Deployments möglich

Technischer Ansprechpartner

Bleib' nicht ratlos!

Welche Ressourcen braucht Dein Vorhaben und welcher Tarif rechnet sich wirklich? Welches Modell eignet sich für welche Aufgabe? Wir helfen Dir weiter, im direkten Beratungsgespräch oder per Chat.

AI jetzt ausprobieren

Teste jetzt alle verfügbaren AI Modelle im mittwald Playground:

Keine Anmeldung nötig

Alle Modelle verfügbar

Nutzen für deinen Case sofort prüfbar

AI Community

Du willst mit unserer AI Community im Kontakt bleiben? Du möchtest mit unseren AI Engineers diskutieren oder dich mit anderen Entwicklungsagenturen austauschen? Dann komm jetzt in unsere Discord Community:

AI und Nachhaltigkeit

KI ist die Technologie der Zukunft. Wir stellen dir alles zur Verfügung, damit du sie verantwortungsvoll und nachhaltig nutzen kannst.

Nachhaltige Webentwicklung bei mittwald mit verantwortungsvoller Unternehmenskultur

KI verantwortungsvoll einsetzen

KI benötigt Rechenleistung. Deshalb legen wir Wert darauf, eine Bandbreite unterschiedlicher Modellgrößen bereitzustellen. So kannst du das Modell auswählen, das die beste Balance zwischen Ergebnisqualität, Geschwindigkeit und CO₂-Footprint bietet. Für viele Anwendungen reichen schon kleine Modelle. Komplexe Anfragen kannst du gezielt an größere Modelle weiterleiten, um Energieverbrauch, Kosten und Antwortzeiten zu reduzieren.

Hier bekommst du Antworten

Im AI Hosting kannst du pro Organisation im mStudio einen oder mehrere OpenAI-kompatible APIKeys generieren. Mit diesen API-Keys kannst du unsere aktuell verfügbaren fünf KI-Modelle direkt ansprechen und in eigene Anwendungen, Workflows oder Systeme integrieren. 

Zusätzlich hast du die Möglichkeit, automatisch einen Open WebUI-Container zu erstellen. Dieser eignet sich ideal, um die Modelle direkt über eine grafische Oberfläche zu testen, mit ihnen zu chatten oder Prototypen zu entwickeln. 

Darüber hinaus kannst du im Container Hosting weitere AI-nahe Services betreiben und mit dem AI Hosting kombinieren, zum Beispiel: 

  • Vektordatenbanken
  • Agenten-Frameworks
  • eigene Inferenz- oder Orchestrierungsdienste

Die eingesetzten Modelle sind öffentlich verfügbar und stammen aus Open-Source-Communities oder aus frei nutzbaren Projekten. Es handelt sich dabei um sogenannte Open-Weight-Modelle, die transparent einsetzbar sind und sich problemlos in eigene Anwendungen integrieren lassen.

Um AI Hosting zu nutzen, benötigst du:

  • einen Zugang zum mStudio
  • eine angelegte Organisation im mStudio
  • einen aktiven Paid Plan für AI Hosting

Ein klassisches Hosting-Paket (z. B. Webhosting, vServer oder Dedicated Server) ist nicht erforderlich. Diese Voraussetzung galt ausschließlich während der Beta-Phase. 

Sobald deine Organisation angelegt und ein Paid Plan aktiviert ist, kannst du ein Projekt erstellen und im Bereich AI Hosting einen oder mehrere API-Keys generieren.

Die aktuell verfügbaren Modelle findest du jederzeit im Developer Portal. Zum Start stehen folgende Modelle zur Verfügung:

  • OSS‑120B (OpenAI) 
    Open‑Weight‑Modell mit starkem Reasoning und sehr guten agentischen Fähigkeiten. Geeignet für komplexe Aufgaben, Analysen und anspruchsvolle Workflows. 
  • Whisper‑Large‑V3‑Turbo 
    Leistungsfähiges Speech‑to‑Text‑Modell für Transkription, Voice‑Interfaces und Audio‑Workflows. 
  • Qwen3‑Embedding‑8B
    Embedding‑Modell für semantische Suche, Textähnlichkeit, RAG‑Setups und Empfehlungssysteme. 
  • Devstral‑Small‑2‑24B
    Speziell optimiert für agentenbasierte Coding‑Aufgaben, Code‑Generierung, Refactoring und Debugging.
  • Ministral 3 14B
    Vielseitiges Sprachmodell für allgemeine Text‑, Chat‑ und Reasoning‑Aufgaben. 

Weitere Modelle werden sukzessive ergänzt.

Ja. Alle Anfragen werden ausschließlich innerhalb unserer eigenen Infrastruktur verarbeitet. Es findet kein Datentransfer außerhalb Deutschlands statt – auch nicht in Drittstaaten wie die USA. Eingaben werden nicht zum Training der Modelle verwendet. Alle Prozesse erfüllen die Anforderungen der DSGVO.

Inhalte wie Texteingaben oder Prompts werden nicht dauerhaft gespeichert. Sie dienen ausschließlich der unmittelbaren Verarbeitung und werden anschließend verworfen. 

Die eingesetzten Modelle sind nicht lernfähig im Sinne eines Trainings auf Nutzerdaten. Deine Eingaben haben keinen Einfluss auf zukünftige Antworten.

Viele CMS wie TYPO3 CMS oder WordPress unterstützen Plugins oder Extensions mit OpenAI-kompatibler API-Anbindung. Dort kannst du einfach deinen mittwald-AI Hosting-API-Key hinterlegen und die Funktionalität direkt nutzen.

Open WebUI ist eine benutzerfreundliche Open-Source-Oberfläche für die Arbeit mit Sprachmodellen. Du kannst dort:

  • direkt mit den mittwald-Modellen chatten
  • eigene API-Keys (z. B. von OpenAI) verwenden
  • Modelle vergleichen und testen 

Der Container lässt sich im mStudio mit wenigen Klicks automatisch erstellen. Um Open WebUI zu betreiben, benötigst du einen vServer oder Dedicated Server.

Ja. Die jeweils geltenden Limits sind transparent in der Tariftabelle einsehbar. 

Aktuell gibt es keinen harten Cut, wenn du dein Token-Limit überschreitest: 

  • Bei 75 % Auslastung erhältst du einen Hinweis im mStudio.
  • Bei 90 % Auslastung wirst du zusätzlich per E-Mail informiert. 

Sollten wir feststellen, dass du deine Limits regelmäßig überschreitest, kommen wir aktiv auf dich zu, um gemeinsam eine passende Lösung zu finden. 

Diese Regelung ist eine temporäre Lösung zum Start. Perspektivisch sind Modelle wie Pay-per-Token oder ein automatisches Stoppen der API ab einer bestimmten Überschreitung vorgesehen.

Das lässt sich im Voraus nie zu 100 % exakt bestimmen – der Tokenverbrauch hängt stark vom Use Case, vom gewählten Modell sowie von Länge und Anzahl der Anfragen ab. 

So gehst du am besten vor: 

  • Wenn du bereits APIs wie z. B. OpenAI nutzt, kannst du dich an deinem bisherigen Tokenverbrauch orientieren. 
  • Alternativ startest du mit einem Tarif und beobachtest deinen tatsächlichen Verbrauch. 
  • Deinen aktuellen Tokenverbrauch kannst du jederzeit transparent im mStudio einsehen. 
  • Alle Tarife haben monatliche Laufzeiten, sodass du flexibel upgraden oder downgraden kannst.

Token-Zahlen sind abstrakt. Die folgende Übersicht zeigt Näherungswerte, was du mit den jeweiligen Tarifen konkret umsetzen kannst. Die Angaben basieren auf dem OSS‑120B‑Modell und dienen ausschließlich zur Orientierung. Der tatsächliche Verbrauch kann je nach Prompt und Antwort variieren.

Eine Übersicht für typische Nutzungsszenarien findest du hier.

Unser Support‑Team steht dir während der regulären Supportzeiten per Ticket, Telefon oder Live‑Chat zur Verfügung. 

Zusätzlich findest du im Developer Portal ausführliche technische Dokumentation, Code‑Beispiele und Hinweise zur API‑Nutzung, zu Modellen sowie zu typischen Integrationsszenarien rund um AI‑Hosting. 

Darüber hinaus kannst du dich im Agentur Hub  mit anderen Agenturen sowie Entwicklerinnen und Entwicklern austauschen.

Aktuell gibt es keine separate Test‑ oder Trial‑Funktion für AI Hosting. 

Du kannst jedoch den kleinsten verfügbaren Tarif buchen, AI Hosting einen Monat lang nutzen und anschließend direkt wieder kündigen. Es gibt dabei keine Mindestlaufzeit über den gebuchten Zeitraum hinaus. 

So kannst du AI Hosting realistisch im Produktivbetrieb testen – inklusive API‑Keys, Modellen und Limits.

Dein persönlicher Support

Wir sind für dich am Start. Unter +49 5772 293 100 erreichst du uns persönlich – mit weniger als 90 Sekunden Wartezeit. Egal ob bei Hosting, CMS oder Shop – auf unseren zertifizierten Support kannst du dich verlassen.

Judi
Sales