Zum Hauptinhalt springen
S-EDV news
Schritt für Schritt

Anleitungen: Künstliche Intelligenz

Künstliche Intelligenz verändert, wie wir arbeiten – vom automatisierten Kundenservice bis zur Code-Generierung. Hier findest du verständliche Anleitungen, aktuelle News und ehrliche Tool-Tests rund um KI im Unternehmens- und IT-Alltag. Ohne Hype, mit Fokus auf das, was in der Praxis wirklich funktioniert.

Langflow mit Docker installieren: Visueller Low-Code-Builder für RAG-Pipelines und LLM-Agenten mit Docker-Container, Flow-Builder und Terminal-Konfiguration. KI-generiert
Künstliche Intelligenz· 20.08.2026 ·11 min

Langflow mit Docker installieren: Visueller Low-Code-Builder für RAG-Pipelines und LLM-Agenten

Langflow ist ein Open-Source-Builder mit Drag-and-Drop-Oberfläche, mit dem du RAG-Pipelines und LLM-Agenten visuell zusammenstellen kannst – ganz ohne tiefe Python-Kenntnisse. Diese Anleitung zeigt den kompletten Weg von der compose.yaml bis zum ersten Flow im Browser.

text-generation-webui mit Docker installieren, moderne Web-UI für lokale LLMs mit Unterstützung für llama.cpp, ExLlama und Transformers KI-generiert
Künstliche Intelligenz· 18.08.2026 ·10 min

text-generation-webui mit Docker installieren: Umfassende Web-UI für lokale LLMs (llama.cpp, ExLlama, Transformers)

text-generation-webui ist die universelle Steuerzentrale fürs lokale LLM-Hosting: GGUF, GPTQ, AWQ, EXL2 und eine OpenAI-kompatible API inklusive. Diese Anleitung zeigt den vollständigen Docker-Weg – vom Repository-Clone bis zum ersten Chat.

LiteLLM mit Docker installieren: Selbstgehosteter KI Gateway für 100+ LLM Provider mit zentralem Modellzugriff, Provider Verwaltung, Kostenüberwachung, Sicherheit, Monitoring, Docker Container und Server Infrastruktur. KI-generiert
Künstliche Intelligenz· 14.08.2026 ·11 min

LiteLLM mit Docker installieren: Selbstgehosteter KI-Gateway für 100+ LLM-Provider

LiteLLM vereint OpenAI, Anthropic, Azure und 100+ KI-Provider hinter einer OpenAI-kompatiblen API. Diese Anleitung zeigt den produktionsreifen Setup mit Docker Compose, PostgreSQL, Key-Management und Cost-Tracking in 25 Minuten.

Khoj mit Docker installieren: Selbstgehosteter KI Assistent für eigene Notizen und Dokumente mit semantischer Suche, Dateiverwaltung, privater Datenhaltung, Docker Container und Server Infrastruktur. KI-generiert
Künstliche Intelligenz· 14.08.2026 ·10 min

Khoj mit Docker installieren: Selbstgehosteter KI-Assistent für eigene Notizen und Dokumente

Khoj ist ein selbstgehosteter KI-Assistent, der eigene PDFs, Markdown-Dateien, Word-Dokumente und Webseiten indiziert und per Chat durchsuchbar macht – vollständig lokal mit Ollama, ohne Cloud-Zwang. Diese Anleitung führt dich Schritt für Schritt durch den Docker-Compose-Setup.

SillyTavern mit Docker installieren, Feature reiches LLM Frontend für Power User mit Chat, Plugins, Skripten, mehreren LLM Backends und Docker Container auf einem Server. KI-generiert
Künstliche Intelligenz· 14.08.2026 ·10 min

SillyTavern mit Docker installieren: Das Feature-reichste LLM-Frontend für Power-User

SillyTavern (29k+ Stars) ist das umfangreichste Open-Source-LLM-Frontend. Diese Anleitung zeigt die Docker-Installation per compose.yaml und .env – inklusive Anbindung an Ollama, OpenAI und weitere Backends.

Illustration zur Installation von Tabby mit Docker. Das Bild zeigt einen selbstgehosteten KI Coding Assistenten mit Code Editor, Docker Containern, Server Infrastruktur und KI gestützter Code Vervollständigung als Open Source Alternative zu GitHub Copilot KI-generiert
Künstliche Intelligenz· 03.08.2026 ·10 min

Tabby mit Docker installieren: Selbstgehosteter KI-Coding-Assistent als Copilot-Ersatz

Tabby ist ein vollständig selbst gehosteter KI-Coding-Assistent mit über 33.000 GitHub-Stars – datenschutzkonform, OpenAI-kompatibel und per Docker in 25 Minuten betriebsbereit. Diese Anleitung zeigt dir den kompletten Weg vom leeren Server zum laufenden Copilot-Ersatz.

DeepSeek R1 lokal betreiben: Modellwahl, Quantisierung und VRAM-Bedarf KI-generiert
Künstliche Intelligenz· 26.06.2026 ·10 min

DeepSeek R1 lokal betreiben: Modellwahl, Quantisierung und VRAM-Bedarf

Welches DeepSeek-R1-Distillat passt zu deiner GPU? Konkrete VRAM-Tabellen für 1,5B bis 32B, Q4_K_M GGUF vs. AWQ erklärt und Ollama-Setup in unter 20 Minuten – ohne Cloud, ohne Abo.

Qwen3 lokal betreiben mit 4B bis 32B Modellen, Ollama und vLLM, Thinking Mode, lokaler GPU Inferenz, Modellverwaltung und API Nutzung. KI-generiert
Künstliche Intelligenz· 26.06.2026 ·9 min

Qwen3 lokal betreiben: 4B bis 32B per Ollama und vLLM mit Thinking-Mode

Alibabas Qwen3 bietet einen schaltbaren Thinking-Mode: Ein Modell wechselt per /think zwischen Chain-of-Thought-Reasoning und direkten Antworten. Diese Anleitung zeigt Deployment per Ollama oder vLLM auf Consumer-GPUs – mit VRAM-Tabelle für 4B bis 32B.

Microsoft Phi 4 lokal betreiben als 14B Reasoning Modell auf einer Consumer GPU mit Modell Download, lokaler Inferenz, Chat Test und API Nutzung. KI-generiert
Künstliche Intelligenz· 26.06.2026 ·10 min

Microsoft Phi-4 lokal betreiben: 14B Reasoning-Modell auf Consumer-GPU

Phi-4 von Microsoft schlägt GPT-4o auf Mathe- und Wissenschafts-Benchmarks – und läuft per Ollama oder Microsoft Foundry Local auf einer einzigen RTX 3080. Diese Anleitung zeigt beide Deploymentwege, erklärt die Quantisierungswahl für 8–12 GB VRAM und nennt die häufigsten Fallstricke.

QLoRA Fine Tuning mit Unsloth auf einer Consumer GPU mit Trainings Dashboard, Datensatz Vorbereitung, Adapter Training und lokaler API Bereitstellung für ein spezialisiertes LLM. KI-generiert
Künstliche Intelligenz· 26.06.2026 ·11 min

QLoRA Fine-Tuning mit Unsloth: Eigenes LLM auf einer Consumer-GPU spezialisieren

Wer bereits ein lokales Llama- oder Qwen-Modell per Ollama betreibt, kann es mit QLoRA und Unsloth auf eigene Firmendaten spezialisieren – auf einer RTX 3060 oder RTX 4060 mit 8 GB VRAM, vollständig lokal und ohne Cloud-Abhängigkeit.