Anleitungen aus der Praxis
Getestete Schritt-für-Schritt-Anleitungen aus realen Kundenumgebungen — sicher, dokumentiert, nachvollziehbar.
KI-generiert OpenSign mit Docker installieren: Kostenlose DocuSign-Alternative für rechtssichere E-Signaturen
OpenSign ist die quelloffene Alternative zu DocuSign und Adobe Sign – mit kryptografischen Audit-Trails, Multi-Party-Workflows und Templates. Diese Anleitung zeigt, wie du den kompletten Stack per Docker Compose in 20 Minuten auf deinem eigenen Server deployst.
KI-generiert Owncast mit Docker installieren: Selbstgehostete Live-Streaming-Plattform mit integriertem Chat
Owncast ist die quelloffene Twitch-Alternative als Docker-Container: RTMP-Ingest, HLS-Transcodierung, Webplayer und Chat ohne externe Datenbank. Diese Anleitung zeigt dir, wie du in 15 Minuten deinen eigenen Live-Stream-Server auf einem Linux-Host produktionsbereit aufsetzt.
KI-generiert Solidtime mit Docker installieren: Modernes Open-Source-Zeiterfassungstool für Agenturen und Freelancer
Solidtime: DSGVO-konformes Open-Source-Zeiterfassungstool mit Projekten, Kunden, abrechenbaren Stunden und Toggl/Clockify-Import – self-hosted per Docker Compose. Anleitung mit allen drei Pflicht-Containern, Key-Generierung und erstem Admin.
KI-generiert DeepSeek R1 lokal betreiben: Modellwahl, Quantisierung und VRAM-Bedarf
Welches DeepSeek-R1-Distillat passt zu deiner GPU? Konkrete VRAM-Tabellen für 1,5B bis 32B, Q4_K_M GGUF vs. AWQ erklärt und Ollama-Setup in unter 20 Minuten – ohne Cloud, ohne Abo.
KI-generiert Qwen3 lokal betreiben: 4B bis 32B per Ollama und vLLM mit Thinking-Mode
Alibabas Qwen3 bietet einen schaltbaren Thinking-Mode: Ein Modell wechselt per /think zwischen Chain-of-Thought-Reasoning und direkten Antworten. Diese Anleitung zeigt Deployment per Ollama oder vLLM auf Consumer-GPUs – mit VRAM-Tabelle für 4B bis 32B.
KI-generiert Microsoft Phi-4 lokal betreiben: 14B Reasoning-Modell auf Consumer-GPU
Phi-4 von Microsoft schlägt GPT-4o auf Mathe- und Wissenschafts-Benchmarks – und läuft per Ollama oder Microsoft Foundry Local auf einer einzigen RTX 3080. Diese Anleitung zeigt beide Deploymentwege, erklärt die Quantisierungswahl für 8–12 GB VRAM und nennt die häufigsten Fallstricke.
KI-generiert QLoRA Fine-Tuning mit Unsloth: Eigenes LLM auf einer Consumer-GPU spezialisieren
Wer bereits ein lokales Llama- oder Qwen-Modell per Ollama betreibt, kann es mit QLoRA und Unsloth auf eigene Firmendaten spezialisieren – auf einer RTX 3060 oder RTX 4060 mit 8 GB VRAM, vollständig lokal und ohne Cloud-Abhängigkeit.
KI-generiert LM Studio als lokale KI-Workstation einrichten: Modelle verwalten, testen und per API bereitstellen
LM Studio ist die grafische Alternative zu Ollama für Windows-KMU ohne Docker-Kenntnisse: Modelle aus Hugging Face herunterladen, GGUF-Quantisierungen vergleichen und in 20 Minuten einen lokalen OpenAI-kompatiblen API-Server starten – komplett offline und kostenlos.
KI-generiert Continue.dev: GitHub Copilot selbst hosten in VS Code und JetBrains mit Ollama
Continue.dev ersetzt das kostenpflichtige GitHub-Copilot-Abo durch eine datenschutzkonforme, lokale Alternative. Mit Ollama als Inferenz-Engine läuft alles auf deiner eigenen Hardware – kein Code verlässt dein Netzwerk, keine Cloud-Abhängigkeit, null laufende Lizenzkosten.
KI-generiert Embedding-Server lokal betreiben: sentence-transformers und FastEmbed mit Qdrant
Qdrant läuft, aber was erzeugt die Vektoren? Diese Anleitung zeigt FastEmbed (direkt im qdrant-client, ONNX, keine GPU-Pflicht) und den Infinity Embedding Server (Docker, OpenAI-API) – DSGVO-konform auf eigener Hardware.