Mein redaktionelles Urteil: Ich würde „AI Hosting“ nicht als ein undefiniertes Paket kaufen. Ich würde das System zunächst in fünf Schichten aufteilen und dann jeden Vorschlag ablehnen, der nicht benennen kann, wer jede Schicht betreibt und was ihre Grenzen überschreitet.
Was hosten Sie eigentlich?
Sie beherbergen selten nur ein Model. Sie weisen fünf verbundenen Schichten ein Operating Home zu. IBM beschreibt KI-Infrastruktur als die Hardware und Software, die für die Entwicklung und Bereitstellung von KI-Anwendungen erforderlich ist, einschließlich Rechenleistung, Datenspeicherung, Netzwerk und Softwareressourcen (IBM KI-Infrastruktur, überprüft am 18. August 2026). Dieser breite Anwendungsbereich ist der Grund, warum eine GPU-Hosting-Seite oder ein Modell-Endpunkt für sich genommen kein vollständiger Agent-Hosting-Plan ist.
Die folgende fünfschichtige Karte ist ein Kaufrahmen. Es wird nicht behauptet, dass jedes Produkt diese Etiketten trägt.
- Modellendpunkt. Dies ist der Dienst oder die Laufzeit, der beziehungsweise die eine Inferenzanfrage empfängt. Hugging Face beschreibt Inference Endpoints als verwalteten Dienst, der Modelle auf vollständig verwalteter Infrastruktur bereitstellt (Hugging Face Inference Endpoints, verifiziert am 18. August 2026).
- Agenten- oder Anwendungslaufzeit. Sie enthält die Workflow-Logik und entscheidet, wann ein Modell oder Tool aufgerufen wird. n8n dokumentiert Self-Hosting auf eigener Infrastruktur, einschließlich On-Premises- oder Private-Cloud-Infrastruktur, mit Bereitstellungsmethoden für npm, Docker und Serverplattformen (n8n-Hosting, verifiziert am 18. August 2026).
- Status und Daten. Dazu gehören die Arbeitsdatensätze, Dateien, Abrufspeicher, Ausgaben und andere Daten, die die Laufzeit verwendet. IBM bezieht Datenspeicherung und -verwaltung in seine Beschreibung der KI-Infrastruktur ein (IBM KI-Infrastruktur, überprüft am 18. August 2026).
- Tools und Aktionen. Dies sind die externen Systeme, die die Laufzeit abfragen oder ändern kann. Die aktuelle Sicherheitsübersicht von n8n behandelt SSL, SSO und Benutzerkontrollen, Einschränkungen für Nodes und die öffentliche API, Sicherheitsaudits und Härtung für das eigene Produkt (n8n-Sicherheit, verifiziert am 18. August 2026).
- Kontrolle und Beobachtbarkeit. Diese Ebene umfasst administrativen Zugriff, Protokolle, Überwachung, Konfiguration und Betriebsnachweise. In der Null-Vertrauens-Veröffentlichung des NIST heißt es, dass sich Null-Vertrauen auf den Schutz von Ressourcen konzentriert und kein implizites Vertrauen gewährt, das nur auf dem physischen Standort oder dem Netzwerkstandort basiert (NIST SP 800-207). Es handelt sich um eine allgemeine Architekturreferenz und nicht um einen Beweis dafür, dass ein Hostingprodukt sicher oder konform ist.
Grenzprüfung: Ein Dashboard kann lokal sein, während sein Modellaufruf extern ist. Ein Modell kann lokal sein, während Identität, Aktualisierungen oder Telemetrie extern bleiben. Zeichnen Sie jeden Pfad auf, anstatt die Bezeichnung einer Ebene auf das gesamte System zu übertragen.
Für angrenzende Eigentumsfragen verwenden Sie den Box-versus-SaaS-Leitfaden und den Private AI Boundary Guide.
Wem gehört die jeweilige AI-Hosting-Grenze?
Ownership bedeutet, sowohl den Entscheidungseigentümer als auch den Operator zu benennen. Die Matrix ist ein Arbeitsblatt und keine Aussage darüber, dass sich jeder Dienst gleich verhält. Füllen Sie jede Zelle mit der aktuellen Produktdokumentation, Konfiguration, Verträgen und Betriebsaufzeichnungen.
| Schicht | Zu erfassende Grenze | Zuweisungsberechtigung | Nachweise anzufordern |
|---|---|---|---|
| Modellendpunkt | Wohin Inferenzanfragen gehen und welcher Endpunkt ausgewählt wird | Wer kann das Modell und den Endpunkt auswählen oder ändern | Endpunktkonfiguration und anwendbare Herstellerdokumentation (Hugging Face, überprüft am 18. August 2026) |
| Agent/runtime | Wo die Workflow-Logik ausgeführt wird | Wer kann es bereitstellen, stoppen und aktualisieren? | Laufzeitkonfiguration und benannter Wartungseigentümer (n8n-Hosting, überprüft am 18. August 2026) |
| Zustand/data | Wo sich Arbeitsunterlagen, Dateien und Speicher befinden | Wer gewährt Zugriff und definiert den Sicherungsumfang | Speicherzuordnung, Zugriffsrollen und Sicherungskonfiguration (IBM AI-Infrastruktur, überprüft am 18. August 2026) |
| Werkzeuge/actions | Welche Systeme können Anfragen oder Änderungen empfangen | Wer genehmigt Anmeldeinformationen, Bereiche und Aktionen | Tool-Zulassungsliste, Anmeldeinformationsinhaber und Genehmigungsdatensatz (n8n security, überprüft am 18. August 2026) |
| Control/observability | Wo Konfiguration, Protokolle und Verwaltungsrouten leben | Wer kann das System prüfen, verwalten oder unterstützen? | Rollenliste, Protokollierungskonfiguration und Support-Zugriffsroute (NIST SP 800-207) |
Die Matrix macht geteilte Eigentumsverhältnisse sichtbar. IBM beschreibt eine Private Cloud als eine Einzelkundenumgebung und sagt, dass eine Managed Private Cloud das Infrastrukturmanagement an einen Dritten auslagert (IBM Private Cloud, verifiziert am 18. August 2026). Diese Aussagen unterstützen eine Unterscheidung zwischen Mietverhältnis und Verantwortung. Sie lokalisieren nicht jeden Modellaufruf, jede Toolverbindung, jedes Protokoll oder jeden Administrator.
Wie vergleichen sich die vier AI-Hosting-Kategorien?
Die Kategorien unterscheiden sich durch die Standardbetriebsgrenze und nicht durch einen universellen Qualitätsrang. Eine echte Bereitstellung kann sie kombinieren. Behandeln Sie jede der folgenden Kategorien als gleichgewichteten Ausgangspunkt und überprüfen Sie den tatsächlichen Service.
Verwalteter Modellendpunkt
Ein verwalteter Endpunkt platziert die Modellbereitstellung auf einer vom Anbieter betriebenen Infrastruktur. Hugging Face beschreibt seine eigenen Inference Endpoints als verwalteten Dienst auf vollständig verwalteter Infrastruktur (Hugging Face Inference Endpoints, verifiziert am 18. August 2026). Diese Quelle stützt nur das Bereitstellungsmodell von Hugging Face; sie legt weder das Verhalten anderer Anbieter noch die Laufzeit-, Daten-, Tool- und Steuerungsebenen rund um den Endpunkt fest.
Verwenden Sie diese Kategorie, wenn der Endpunkt die zu überprüfende Grenze ist. Fragen Sie, welche Anfrage die Laufzeit sendet, wer den Endpunkt ändern kann, wo sich endpunktbezogene Protokolle befinden und wie der Endpunkt aus dem Workflow entfernt wird.
Verwaltete Anwendungs- oder Agentenlaufzeit
Eine verwaltete Laufzeit übergibt den Anwendungsbetrieb gemäß den erklärten Verantwortlichkeiten dieses Dienstes an einen Anbieter. Diese Kategorie beschreibt eine zu prüfende Grenze und keine allgemeine Garantie für verwaltete Agentenplattformen.
Verwenden Sie diese Kategorie, wenn Sie den Anbieterbetrieb der Workflow-Ebene untersuchen möchten. Ordnen Sie weiterhin externe Endpunkte, verbundene Tools, Datenspeicher, Verwaltungsrollen, Protokolle, Backups, Updates und Exportbereiche separat zu.
BYOC oder private Cloud
Gemäß der Definition von IBM ist eine private Cloud einem Kunden gewidmet, während eine verwaltete private Cloud das Infrastrukturmanagement an einen Dritten auslagert (IBM Private Cloud, verifiziert am 18. August 2026). BYOC wird in der zitierten Quelle nicht definiert. Behandeln Sie es daher als angebotsspezifischen Begriff und fordern Sie die genaue Aufteilung der Verantwortung an.
Verwenden Sie diese Kategorie, wenn die zugewiesene Cloud-Umgebung wichtig ist. Überprüfen Sie, welche Steuerungsebenendienste außerhalb dieser Umgebung verbleiben, wer über Bedienerzugriff verfügt, welche Dienste gemeinsam genutzt werden und wer für Updates und Wiederherstellung zuständig ist. Der Leitfaden zur KI-Agentenplattform erweitert diese Überprüfung auf Komponentenebene.
Selbstgehostet oder vor Ort
n8n dokumentiert Self-Hosting auf eigener Infrastruktur, einschließlich On-Premises- oder Private-Cloud-Infrastruktur, und listet Bereitstellungsmethoden für npm, Docker und Serverplattformen auf (n8n-Hosting, verifiziert am 18. August 2026).
Verwenden Sie diese Kategorie, wenn der direkte Betrieb der Infrastruktur Teil der Anforderung ist. Daraus sollte nicht geschlossen werden, dass jede Abhängigkeit lokal ist. Überprüfen Sie Modellendpunkte, Identität, Softwarequellen, Toolverbindungen, Protokolle, Supportrouten und Backups als separate Pfade.
Keine Kategorie gewinnt nach Label: Managed entbindet den Käufer nicht von der Verantwortung, Private Cloud beschreibt nicht den gesamten Datenpfad und Self-Hosted beweist keine Isolation. Diese Schlussfolgerungen erfordern Beweise von der ausgewählten Architektur und ihren Betreibern.
Was sollte ein AI-Hosting-Käufer überprüfen?
Ein Käufer sollte die Bewertung mit sieben schriftlichen Antworten und Nachweisen für jede einzelne verlassen. Laut NIST ist das AI Risk Management Framework freiwillig und soll Organisationen dabei helfen, KI-Risiken zu verwalten (NIST AI RMF). Die folgende Checkliste ist eine Beschaffungshilfe und keine AI RMF-Bewertung, Sicherheitszertifizierung oder rechtliche Schlussfolgerung.
- Datenpfad: Zeichnen Sie die Route von der Eingabe über Laufzeit, Modellendpunkt, Statusspeicher, Tools, Ausgabe, Protokolle und Sicherungen. Fügen Sie das aktuelle Konfigurations- oder Anbieterdokument bei, das jede Kreuzung unterstützt (IBM AI-Infrastruktur, überprüft am 18. August 2026).
- Autorität: Benennen Sie, wer die Laufzeit, den Endpunkt, den Speicher, die Anmeldeinformationen und die Aktionen starten, stoppen, ändern oder genehmigen kann. NIST Zero Trust lehnt implizites Vertrauen nur basierend auf dem Netzwerk oder dem physischen Standort ab, zertifiziert jedoch kein Produkt oder keine Bereitstellung (NIST SP 800-207).
- Protokolle: Halten Sie fest, was das System protokolliert, wohin es geht und wer es lesen kann. Die n8n-Sicherheitsseite stützt nur die eigene Anleitung, nicht das Verhalten jedes Anbieters (n8n-Sicherheit, verifiziert am 18. August 2026).
- Backups: Geben Sie an, welche Komponenten in den Backup-Bereich aufgenommen werden, wer den Prozess ausführt und wer für die Wiederherstellung verantwortlich ist. IBM bezieht Speicher in die KI-Infrastruktur ein, während das tatsächliche Sicherungsverhalten einsatzspezifisch bleibt (IBM KI-Infrastruktur, überprüft am 18. August 2026).
- Bedienerzugriff: Listen Sie Kunden-, Anbieter-, Support-, Automatisierungs- und Notfallrollen auf, die eine Ressource verwalten können. NIST SP 800-207 bietet allgemeine Leitlinien für eine Zero-Trust-Architektur, keinen Beweis dafür, dass diese Rollen korrekt konfiguriert sind (NIST SP 800-207).
- Aktualisierungen: Weisen Sie die Aktualisierungsaufgaben für Host, Laufzeit, Modell, Connector und Konfiguration zu.
- Beenden: Listen Sie auf, was der Käufer abrufen oder widerrufen will, und prüfen Sie die Dienstbedingungen. Das NIST AI RMF ist eine allgemeine Anleitung und belegt kein Migrations- oder Austrittsergebnis (NIST AI RMF).
Markieren Sie eine Antwort als „unbekannt“, wenn der Beweis fehlt. Das ist nützlicher, als aus einem Produktetikett eine nicht unterstützte Aussage zu machen.
Ist kostenloses oder günstiges AI-Hosting der richtige Ausgangspunkt?
Nein – nicht für diese Grenzentscheidung. Beginnen Sie mit der Arbeitslast und der Betriebskarte. Die Bezeichnung „kostenlos“, „billig“, „GPU“ oder „KI-Cloud-Hosting“ identifiziert weder die fünf Ebenen noch weist sie ihre Aufgaben zu. Die zitierten Quellen beschreiben den Umfang der Infrastruktur, spezifische Bereitstellungsmodelle von Anbietern, Verantwortungsmuster für private Clouds und Risiko-Frameworks. Sie unterstützen keinen herstellerübergreifenden Preis-, Leistungs-, Verfügbarkeits-, Vertraulichkeits-, Migrations- oder Gesamtkostenvergleich (IBM AI-Infrastruktur; Hugging Face; n8n-Hosting, alle Anbieterdaten überprüft am 18. August 2026).
Vergleichen Sie Geschäftsbedingungen erst, nachdem die Kandidaten das gleiche Grenzarbeitsblatt bestanden haben. Dieser Leitfaden erhebt bewusst keinen Anspruch auf Rentabilität, Wert oder den kostengünstigsten Anbieter.
Wie sollte ein kleines Unternehmen wählen?
Wählen Sie die kleinste Betriebsgrenze, die dem Unternehmen noch einen benannten Eigentümer und akzeptable Beweise für jede erforderliche Ebene gibt. Dies ist eine redaktionelle Entscheidungsregel, keine technische Tatsache. Ein Einzelbetreiber, der keine Serveraufgaben möchte, sollte diese Aufgaben nicht als gelöst bezeichnen, nur weil ein Modellendpunkt verwaltet wird. Ein Unternehmen, das eine zugewiesene Cloud-Umgebung benötigt, sollte nicht davon ausgehen, dass die umgebende Steuerungsebene diese Grenze teilt. Ein Selbsthosting-Team sollte nicht davon ausgehen, dass durch die Installation von Software auch Updates, Wiederherstellung oder Support zugewiesen werden.
Nehmen Sie die ausgefüllte Matrix in das Gespräch mit dem Anbieter ein. Fordern Sie spezifische Antworten an, erfassen Sie Unbekannte und vergleichen Sie alle vier Kategorien mit denselben Fragen. Dann sehen Sie das AI Jungle OS-Cockpit als einen operativen Ansatz, nicht als Ranglistensieger oder Eignungsnachweis.
Können Sie die Karte mit einem echten Job testen?
Ja. Wählen Sie einen kleinen Auftrag aus und zeichnen Sie ihn auf Papier nach. Beginnen Sie nicht mit einem Produkt. Beginnen Sie mit der Arbeit. Ein Einzeleigentümer könnte einen E-Mail-Entwurf wählen. Ein kleines Unternehmen könnte sich für eine Zusammenfassung einer Kundenakte entscheiden. Verwenden Sie eine Aufgabe, die das Team gut kennt.
Schreiben Sie die erste Eingabe am linken Rand. Nennen Sie die Person, die es sendet. Benennen Sie die App, die es empfängt. Wenn eine Datei hinzugefügt wird, zeichnen Sie auch diesen Pfad ein. Stoppen Sie, wenn der Standort oder Eigentümer nicht bekannt ist. Schreiben Sie „unbekannt“ neben diesen Schritt.
Zeichnen Sie nun den Modellaufruf. Benennen Sie den Endpunkt. Schreiben Sie nicht nur „Cloud“. Fügen Sie den Dienst und den Kontoinhaber hinzu. Markieren Sie dann, wer diesen Endpunkt ändern kann. Wenn es niemand weiß, behalten Sie die Lücke auf der Seite.
Gehen Sie zurück zur Laufzeit. Fragen Sie, wer damit beginnen kann. Fragen Sie, wer es stoppen kann. Fragen Sie, wer seine Regeln ändern kann. Fügen Sie für jede Antwort einen Namen oder eine Rolle hinzu. Vermeiden Sie „das Team“. Es verbirgt den Besitzer.
Verfolgen Sie als Nächstes den Status. Markieren Sie Eingabeaufforderung, Datei, Arbeitsnotiz und endgültige Ausgabe. Bei einigen Jobs wird nicht jedes Element verwendet. Streichen Sie durch, was nicht zutrifft. Geben Sie für jedes verbleibende Element seinen Shop- und Zugriffseigentümer an.
Verfolgen Sie dann den Werkzeugweg. Ein Entwurf kann keine Aktion enthalten. Ein Sendeschritt reicht aus. Markieren Sie, wo die Genehmigung vor der Aktion steht. Benennen Sie den Inhaber der Anmeldeinformationen. Nennen Sie die Person, die es widerrufen kann. Behalten Sie den Modellaufruf und die Werkzeugaktion als zwei separate Pfade bei.
Beenden Sie mit der Kontrollschicht. Markieren Sie das Protokollziel. Markieren Sie den Backup-Bereich. Markieren Sie die Admin-Route. Markieren Sie den Update-Besitzer. Markieren Sie den Ausgangspunkt. Jede Markierung sollte auf eine Einstellung, ein Dokument, eine Rolle oder einen Datensatz verweisen.
Führen Sie für jede Hosting-Kategorie den gleichen Papiertest durch. Halten Sie die Aufgabe fest. Ändern Sie nur die vorgeschlagene Grenze. Dadurch erhält jede Option die gleichen Fragen. Dadurch bleibt das Gespräch auch an den Job gebunden.
Füllen Sie keine Lücken mit einer Vermutung aus. Fragen Sie den Anbieter oder Betreiber. Speichern Sie die Antwort mit ihrer Quelle. Fügen Sie das Scheckdatum hinzu. Wenn die Antwort von einer Einstellung abhängt, benennen Sie diese Einstellung. Wenn es auf einen Vertrag ankommt, benennen Sie dieses Dokument.
Lesen Sie am Ende die Karte von links nach rechts. Dann lesen Sie es von rechts nach links. Der erste Durchgang folgt der Arbeit. Im zweiten Durchgang wird geprüft, wer jedes Teil ändern, prüfen, wiederherstellen oder entfernen kann. Eine kurze Karte mit deutlichen Lücken ist hilfreich. Eine übersichtliche Karte mit erratenen Antworten gibt es nicht.
Diese Übung stellt keinen Beweis für Sicherheit, Datenschutz oder Compliance dar. Es gibt dem Käufer klare Fragen. Verwenden Sie die NIST-Quellen nur als allgemeine Risiko- und Architekturanleitung innerhalb ihres angegebenen Umfangs (NIST AI RMF; NIST SP 800-207).
Häufig gestellte Fragen
Was ist AI-Hosting?
KI-Hosting ist die Betriebsvereinbarung für die Ebenen Modellendpunkt, Agentenlaufzeit, Status und Daten, Tools und Aktionen sowie Steuerung und Beobachtbarkeit. Dies ist die praktische Definition, die in diesem Leitfaden verwendet wird.
Ist AI-Modell-Hosting dasselbe wie AI-Hosting?
Nein. Das Modellhosting deckt den Endpunkt oder die Laufzeit ab, die der Inferenz dient. Eine funktionierende KI-Anwendung kann auch über eine Agentenlaufzeit, Statusspeicher, Tools, Protokolle, Sicherungen und Verwaltungszugriff verfügen (IBM KI-Infrastruktur, verifiziert am 18. August 2026).
Bedeutet Private Cloud, dass jede KI-Komponente privat ist?
Nein. Die Private-Cloud-Definition von IBM sieht eine Einzelkundenumgebung vor, aber der Käufer muss dennoch externe Endpunkte, Tools, Protokolle, Supportrouten und Control-Plane-Services lokalisieren (IBM Private Cloud, verifiziert am 18. August 2026).
Beweist selbstgehostete KI Sicherheit oder Compliance?
Nein. Self-Hosting belegt an sich kein Sicherheits- oder Compliance-Ergebnis. Die Zero-Trust- und AI-RMF-Veröffentlichungen des NIST bleiben allgemeine Leitlinien und keine Produktzertifizierung (NIST SP 800-207; NIST AI RMF).
Written by Tileo, who operates a portfolio of internet businesses on this same cockpit.

