Tanagra Akademie

Lokale KI im Produktionsbetrieb: vLLM, GPU-Sizing und Enterprise-Deployment

Kategorie: Lokale KI Niveau: Profi Dauer: 1 Std Sprache: Deutsch Zugang: im Abo enthalten

Herausgegeben von der Tanagra Akademie · Zuletzt aktualisiert am

Alle Inhalte sind mit Hilfe von KI entstanden.

Die Entscheidung zwischen Cloud-APIs und lokaler KI-Inferenz war lange eine rein technische Abwägung. Im Jahr 2026 ist sie zu einer strategischen Frage geworden. Drei Kräfte treiben diese Entwicklung.

Sketchnote zum Kurs Lokale KI im Produktionsbetrieb: vLLM, GPU-Sizing und Enterprise-Deployment

Auf einen Blick

KategorieLokale KI
NiveauProfi
Dauer1 Std
SpracheDeutsch
Zugangim Abo enthalten
Zuletzt aktualisiert

Inhalt des Kurses

  1. Lektion 1: Warum lokale Inferenz 2026 zum strategischen Differenzierungsmerkmal wird
  2. Lektion 2: Hardware-Sizing, wie Sie die richtige GPU-Konfiguration berechnen
  3. Lektion 3: Quantisierung verstehen, FP8, AWQ, GPTQ und GGUF im Vergleich
  4. Lektion 4: vLLM vs. Ollama, die richtige Engine für den richtigen Einsatz
  5. Lektion 5: Production-Deployment, vom Docker-Container zum Enterprise-Stack
  6. Lektion 6: DSGVO-konformes Deployment und EU-AI-Act-Compliance
  7. Gesamtzusammenfassung
  8. Quellenverzeichnis

Quellen und weiterführende Links

Worauf sich dieser Kurs stützt:

Vollständiger Kurs

Dieser Kurs ist Teil des Akademie-Abos. Enthalten sind alle Kurse des Katalogs, laufende Aktualisierungen und neue Kurse während der Laufzeit.

Zugang freischalten   Anmelden