Anleitungen aus der Praxis
Getestete Schritt-für-Schritt-Anleitungen aus realen Kundenumgebungen — sicher, dokumentiert, nachvollziehbar.
KI-generiert Strukturierte JSON-Ausgaben aus lokalen LLMs: Grammar-Constraints und JSON-Mode für zuverlässige Automatisierungen
Wer lokale LLMs in n8n-Workflows oder PowerShell-Skripte einbinden will, scheitert oft an unzuverlässigen Ausgaben. Mit Grammar-Sampling in llama.cpp und dem nativen JSON-Schema-Mode von Ollama erzwingst du exakt strukturierte JSON-Antworten – ohne manuelle Nachbearbeitung.
KI-generiert Open WebUI absichern: Benutzergruppen, RBAC und Modell-Zugriffssteuerung für den KI-Firmen-Chat
Open WebUI bringt ein vollständiges RBAC-System mit – Rollen, Gruppen, granulare Permissions und SSO-Integration. So verwandelst du das Einzel-Admin-Tool in eine sichere Team-Plattform, bei der jeder Mitarbeiter nur sieht und kann, was er soll.
KI-generiert CUDA-Umgebung korrekt aufsetzen: Treiber, Toolkit, cuDNN und PyTorch auf Ubuntu
Treiber zuerst, Toolkit danach, PyTorch zuletzt – wer die Reihenfolge ignoriert, kämpft mit rätselhaften Fehlern. Diese Anleitung führt dich Schritt für Schritt vom frischen Ubuntu-Server zur funktionsfähigen CUDA-Umgebung für PyTorch 2.7.0 und erklärt die häufigsten Fehlerquellen.
KI-generiert GGUF, AWQ und GPTQ erklärt: Welches Quantisierungsformat für welchen Zweck
GGUF, AWQ oder GPTQ – die Wahl des richtigen Quantisierungsformats entscheidet darüber, wie schnell und effizient dein lokales LLM läuft. Dieser Vergleich zeigt dir anhand konkreter Benchmarks und eines klaren Entscheidungsbaums, welches Format zu deiner Hardware und deinem Use-Case passt.
KI-generiert Langfuse selbst hosten: LLM-Observability und Audit-Logging für KI-Anwendungen
Langfuse ist die selbst gehostete Observability-Plattform für LLM-Anwendungen: vollständige Traces, Kosten- und Qualitätsmetriken sowie DSGVO-konformes Audit-Logging – als logische Ergänzung zu LiteLLM-Proxy und Ollama.
KI-generiert OpenHands als selbst gehosteten KI-Coding-Agenten einrichten (Docker + Ollama)
OpenHands löst GitHub-Issues selbstständig, schreibt Tests und erstellt Pull Requests – alles in einem Docker-Container, wahlweise mit lokalem Ollama-Backend ohne Cloud-Abhängigkeit. Diese Anleitung zeigt, wie du den KI-Coding-Agenten in 30 Minuten einrichtest.
KI-generiert Open WebUI erweitern: Tools, Functions und Pipelines selbst bauen und einbinden
Von der Chat-Oberfläche zur KI-Plattform: Eigene Python-Tools für Kalenderabfragen, GLPI-Tickets und SearXNG-Suche in Open WebUI einbinden – Schritt für Schritt, ohne Cloud-Abhängigkeit.
KI-generiert Letta selbst hosten: KI-Agenten mit persistentem Langzeitgedächtnis per Docker
Zustandslose Chatbots vergessen nach jedem Gespräch alles – Letta (ehemals MemGPT) löst das mit einem selbstverwalteten Drei-Stufen-Gedächtnis. Diese Anleitung zeigt, wie du den Letta-Server per Docker on-premise betreibst.
KI-generiert GPU für lokale KI auswählen: VRAM-Bedarf, RTX-5000-Generationen und Budget-Empfehlungen 2026
Welche GPU reicht für welches Sprachmodell? Diese Anleitung erklärt die VRAM-Kalkulator-Logik, liefert gemessene Werte für aktuelle LLMs und gibt konkrete Kaufempfehlungen von RTX 5060 bis RTX 5090 – ehrlich mit echten Straßenpreisen und typischen Fallstricken.
KI-generiert Windows LAPS mit Entra ID und Intune: Lokale Adminpasswörter sicher verwalten
Windows LAPS rotiert lokale Administratorpasswörter auf allen Windows-Clients automatisch und speichert sie sicher in Entra ID – ausrollbar via Intune ohne zusätzliche Software. Lateral-Movement-Angriffe verlieren damit ihre wichtigste Grundlage.