Anleitungen: Künstliche Intelligenz
Künstliche Intelligenz verändert, wie wir arbeiten – vom automatisierten Kundenservice bis zur Code-Generierung. Hier findest du verständliche Anleitungen, aktuelle News und ehrliche Tool-Tests rund um KI im Unternehmens- und IT-Alltag. Ohne Hype, mit Fokus auf das, was in der Praxis wirklich funktioniert.
KI-generiert Langflow mit Docker installieren: Visueller Low-Code-Builder für RAG-Pipelines und LLM-Agenten
Langflow ist ein Open-Source-Builder mit Drag-and-Drop-Oberfläche, mit dem du RAG-Pipelines und LLM-Agenten visuell zusammenstellen kannst – ganz ohne tiefe Python-Kenntnisse. Diese Anleitung zeigt den kompletten Weg von der compose.yaml bis zum ersten Flow im Browser.
KI-generiert text-generation-webui mit Docker installieren: Umfassende Web-UI für lokale LLMs (llama.cpp, ExLlama, Transformers)
text-generation-webui ist die universelle Steuerzentrale fürs lokale LLM-Hosting: GGUF, GPTQ, AWQ, EXL2 und eine OpenAI-kompatible API inklusive. Diese Anleitung zeigt den vollständigen Docker-Weg – vom Repository-Clone bis zum ersten Chat.
KI-generiert LiteLLM mit Docker installieren: Selbstgehosteter KI-Gateway für 100+ LLM-Provider
LiteLLM vereint OpenAI, Anthropic, Azure und 100+ KI-Provider hinter einer OpenAI-kompatiblen API. Diese Anleitung zeigt den produktionsreifen Setup mit Docker Compose, PostgreSQL, Key-Management und Cost-Tracking in 25 Minuten.
KI-generiert Khoj mit Docker installieren: Selbstgehosteter KI-Assistent für eigene Notizen und Dokumente
Khoj ist ein selbstgehosteter KI-Assistent, der eigene PDFs, Markdown-Dateien, Word-Dokumente und Webseiten indiziert und per Chat durchsuchbar macht – vollständig lokal mit Ollama, ohne Cloud-Zwang. Diese Anleitung führt dich Schritt für Schritt durch den Docker-Compose-Setup.
KI-generiert SillyTavern mit Docker installieren: Das Feature-reichste LLM-Frontend für Power-User
SillyTavern (29k+ Stars) ist das umfangreichste Open-Source-LLM-Frontend. Diese Anleitung zeigt die Docker-Installation per compose.yaml und .env – inklusive Anbindung an Ollama, OpenAI und weitere Backends.
KI-generiert Tabby mit Docker installieren: Selbstgehosteter KI-Coding-Assistent als Copilot-Ersatz
Tabby ist ein vollständig selbst gehosteter KI-Coding-Assistent mit über 33.000 GitHub-Stars – datenschutzkonform, OpenAI-kompatibel und per Docker in 25 Minuten betriebsbereit. Diese Anleitung zeigt dir den kompletten Weg vom leeren Server zum laufenden Copilot-Ersatz.
KI-generiert DeepSeek R1 lokal betreiben: Modellwahl, Quantisierung und VRAM-Bedarf
Welches DeepSeek-R1-Distillat passt zu deiner GPU? Konkrete VRAM-Tabellen für 1,5B bis 32B, Q4_K_M GGUF vs. AWQ erklärt und Ollama-Setup in unter 20 Minuten – ohne Cloud, ohne Abo.
KI-generiert Qwen3 lokal betreiben: 4B bis 32B per Ollama und vLLM mit Thinking-Mode
Alibabas Qwen3 bietet einen schaltbaren Thinking-Mode: Ein Modell wechselt per /think zwischen Chain-of-Thought-Reasoning und direkten Antworten. Diese Anleitung zeigt Deployment per Ollama oder vLLM auf Consumer-GPUs – mit VRAM-Tabelle für 4B bis 32B.
KI-generiert Microsoft Phi-4 lokal betreiben: 14B Reasoning-Modell auf Consumer-GPU
Phi-4 von Microsoft schlägt GPT-4o auf Mathe- und Wissenschafts-Benchmarks – und läuft per Ollama oder Microsoft Foundry Local auf einer einzigen RTX 3080. Diese Anleitung zeigt beide Deploymentwege, erklärt die Quantisierungswahl für 8–12 GB VRAM und nennt die häufigsten Fallstricke.
KI-generiert QLoRA Fine-Tuning mit Unsloth: Eigenes LLM auf einer Consumer-GPU spezialisieren
Wer bereits ein lokales Llama- oder Qwen-Modell per Ollama betreibt, kann es mit QLoRA und Unsloth auf eigene Firmendaten spezialisieren – auf einer RTX 3060 oder RTX 4060 mit 8 GB VRAM, vollständig lokal und ohne Cloud-Abhängigkeit.