Zum Hauptinhalt springen
S-EDV news
Schritt für Schritt

Anleitungen aus der Praxis

Getestete Schritt-für-Schritt-Anleitungen aus realen Kundenumgebungen — sicher, dokumentiert, nachvollziehbar.

Moderne IT Grafik zu strukturierten JSON Ausgaben aus lokalen LLMs mit Grammar Constraints, JSON Mode und zuverlässiger Automatisierung für KI Workflows. KI-generiert
Künstliche Intelligenz· 25.06.2026 ·10 min

Strukturierte JSON-Ausgaben aus lokalen LLMs: Grammar-Constraints und JSON-Mode für zuverlässige Automatisierungen

Wer lokale LLMs in n8n-Workflows oder PowerShell-Skripte einbinden will, scheitert oft an unzuverlässigen Ausgaben. Mit Grammar-Sampling in llama.cpp und dem nativen JSON-Schema-Mode von Ollama erzwingst du exakt strukturierte JSON-Antworten – ohne manuelle Nachbearbeitung.

Moderne IT Grafik zur Absicherung von Open WebUI mit Benutzergruppen, RBAC Rollen und Modell Zugriffssteuerung für einen sicheren KI Firmen Chat. KI-generiert
Künstliche Intelligenz· 25.06.2026 ·10 min

Open WebUI absichern: Benutzergruppen, RBAC und Modell-Zugriffssteuerung für den KI-Firmen-Chat

Open WebUI bringt ein vollständiges RBAC-System mit – Rollen, Gruppen, granulare Permissions und SSO-Integration. So verwandelst du das Einzel-Admin-Tool in eine sichere Team-Plattform, bei der jeder Mitarbeiter nur sieht und kann, was er soll.

Grafik zur Einrichtung einer CUDA Umgebung auf Ubuntu mit NVIDIA Treiber, CUDA Toolkit, cuDNN und PyTorch für GPU beschleunigte KI Anwendungen. KI-generiert
Künstliche Intelligenz· 25.06.2026 ·9 min

CUDA-Umgebung korrekt aufsetzen: Treiber, Toolkit, cuDNN und PyTorch auf Ubuntu

Treiber zuerst, Toolkit danach, PyTorch zuletzt – wer die Reihenfolge ignoriert, kämpft mit rätselhaften Fehlern. Diese Anleitung führt dich Schritt für Schritt vom frischen Ubuntu-Server zur funktionsfähigen CUDA-Umgebung für PyTorch 2.7.0 und erklärt die häufigsten Fehlerquellen.

Moderne Vergleichsgrafik zu GGUF, AWQ und GPTQ als Quantisierungsformate für KI Modelle mit Fokus auf Speicherbedarf, Geschwindigkeit, Kompatibilität und Einsatzbereich. KI-generiert
Künstliche Intelligenz· 24.06.2026 ·11 min

GGUF, AWQ und GPTQ erklärt: Welches Quantisierungsformat für welchen Zweck

GGUF, AWQ oder GPTQ – die Wahl des richtigen Quantisierungsformats entscheidet darüber, wie schnell und effizient dein lokales LLM läuft. Dieser Vergleich zeigt dir anhand konkreter Benchmarks und eines klaren Entscheidungsbaums, welches Format zu deiner Hardware und deinem Use-Case passt.

Moderne Server und Dashboard Grafik für selbst gehostetes Langfuse mit LLM Observability, Trace Analyse, Audit Logging und KI Anwendungsüberwachung. KI-generiert
Künstliche Intelligenz· 24.06.2026 ·9 min

Langfuse selbst hosten: LLM-Observability und Audit-Logging für KI-Anwendungen

Langfuse ist die selbst gehostete Observability-Plattform für LLM-Anwendungen: vollständige Traces, Kosten- und Qualitätsmetriken sowie DSGVO-konformes Audit-Logging – als logische Ergänzung zu LiteLLM-Proxy und Ollama.

OpenHands als selbst gehosteten KI-Coding-Agenten einrichten (Docker + Ollama) KI-generiert
Künstliche Intelligenz· 20.06.2026 ·10 min

OpenHands als selbst gehosteten KI-Coding-Agenten einrichten (Docker + Ollama)

OpenHands löst GitHub-Issues selbstständig, schreibt Tests und erstellt Pull Requests – alles in einem Docker-Container, wahlweise mit lokalem Ollama-Backend ohne Cloud-Abhängigkeit. Diese Anleitung zeigt, wie du den KI-Coding-Agenten in 30 Minuten einrichtest.

Moderne IT Grafik zur Erweiterung von Open WebUI mit eigenen Tools, Functions und Pipelines. Darstellung einer technischen Oberfläche mit Code Beispiel, Integrationen, Workflow Symbolen und sicherer lokaler KI Umgebung. KI-generiert
Künstliche Intelligenz· 17.06.2026 ·11 min

Open WebUI erweitern: Tools, Functions und Pipelines selbst bauen und einbinden

Von der Chat-Oberfläche zur KI-Plattform: Eigene Python-Tools für Kalenderabfragen, GLPI-Tickets und SearXNG-Suche in Open WebUI einbinden – Schritt für Schritt, ohne Cloud-Abhängigkeit.

Moderne IT Grafik zum Selbsthosten von Letta per Docker mit KI Agenten, persistentem Langzeitgedächtnis, Speicher Architektur, Container Komponenten und lokaler Server Umgebung für sichere KI Workflows. KI-generiert
Künstliche Intelligenz· 17.06.2026 ·10 min

Letta selbst hosten: KI-Agenten mit persistentem Langzeitgedächtnis per Docker

Zustandslose Chatbots vergessen nach jedem Gespräch alles – Letta (ehemals MemGPT) löst das mit einem selbstverwalteten Drei-Stufen-Gedächtnis. Diese Anleitung zeigt, wie du den Letta-Server per Docker on-premise betreibst.

Moderne IT Grafik zur Auswahl einer GPU für lokale KI mit Fokus auf VRAM Bedarf, RTX 5000 Generationen, Leistung und Budget Empfehlungen für 2026. Darstellung mit Grafikkarte, KI Symbolen und übersichtlichen Vergleichsbereichen für lokale KI Modelle. KI-generiert
Hardware· 17.06.2026 ·11 min

GPU für lokale KI auswählen: VRAM-Bedarf, RTX-5000-Generationen und Budget-Empfehlungen 2026

Welche GPU reicht für welches Sprachmodell? Diese Anleitung erklärt die VRAM-Kalkulator-Logik, liefert gemessene Werte für aktuelle LLMs und gibt konkrete Kaufempfehlungen von RTX 5060 bis RTX 5090 – ehrlich mit echten Straßenpreisen und typischen Fallstricken.

Moderne IT Grafik zu Windows LAPS mit Entra ID und Intune zur sicheren Verwaltung lokaler Administratorpasswörter auf Windows Geräten. KI-generiert
Windows Server· 17.06.2026 ·9 min

Windows LAPS mit Entra ID und Intune: Lokale Adminpasswörter sicher verwalten

Windows LAPS rotiert lokale Administratorpasswörter auf allen Windows-Clients automatisch und speichert sie sicher in Entra ID – ausrollbar via Intune ohne zusätzliche Software. Lateral-Movement-Angriffe verlieren damit ihre wichtigste Grundlage.