Back to Tags

#Local AI & On-Device Models

Deploying, quantizing, and running language models directly on local client hardware with full privacy and zero cloud dependency.

✍️Blog Posts7

All Posts →
Skill Evolution im Vergleich: Dr. Georg Hackenberg analysiert die modulare Runtime-Kuratierung des Hermes Agent und das kristalline Wissensarchiv von Google WikiSkills

Skill Evolution im Vergleich: Wie Nous Research (Hermes Agent) und Google (WikiSkills) das Gedächtnis autonomer Agenten transformieren

Eine softwaretechnische Vergleichsanalyse: Die pragmatische Runtime-Kuratierung des Hermes Agent trifft auf die formale 3-Schichten-Entkopplung von Google WikiSkills. Wie sich Optimization Amnesia, Progressive Disclosure und Continuous Learning in modernen Enterprise-Architekturen vereinen lassen.

LiteLLM: Zentrales AI Gateway und Proxy-Router für das souveräne Multi-Model Ökosystem

Architektur und Funktionsweise von LiteLLM: Universelle Modell-Abstraktion, dynamisches Routing, Multi-Provider Fallbacks und Enterprise-Governance

Eine softwaretechnische Tiefenanalyse von LiteLLM: Wie die universelle Abstraktionsschicht 100+ LLMs vereinheitlicht, wie intelligentes Routing und kaskadierende Fallbacks Ausfallsicherheit garantieren, warum Multilevel-Caching Latenzen minimiert und wie Enterprise-Governance via Keycloak und Virtual Keys funktioniert.

Open WebUI: Mensch-Maschine-Schnittstelle und kollaborative Kontrollzentrale für das souveräne KI-Ökosystem

Architektur und Funktionsweise von Open WebUI: Entkoppelte Human-in-the-Loop Orchestrierung, In-Process Functions, hybrides RAG und Enterprise Governance

Eine softwaretechnische Tiefenanalyse von Open WebUI: Wie die Entkopplung von SvelteKit und FastAPI echte Multi-Model-Souveränität schafft, warum In-Process Functions externe Pipelines ablösen, wie hybrides RAG mit BM25 und Cross-Encoder Präzision garantiert und welche Rolle die Plattform in Lehre, Forschung und Unternehmen einnimmt.

Hermes Agent: Ein sympathischer, modularer KI-Gefährte mit Body-Brain-Entkopplung, Bounded Memory und Progressive Skills

Architektur und Funktionsweise des Hermes Agent: Body-Brain-Entkopplung, Bounded Context, Progressive Skills und der Curator-Lifecycle

Eine softwaretechnische Tiefenanalyse des Hermes Agent von Nous Research: Wie die Trennung von Body und Brain echte Modellagnostik schafft, warum Bounded Memory KV-Caches schützt, wie Progressive Disclosure Token spart und wie der Curator Skill Sprawl verhindert.

🚀Software Projects1

All Projects →

Delta Dynamics

Ecosystem Simulator

Low-poly ecosystem simulator featuring real-time dynamic terrain, GPU-accelerated water flow, resource management, and local LLM-driven AI behaviors.

💼Business Services1

All Services →

Intelligence Engineering

Sovereign Agent Architectures, Enterprise Infrastructure & Autonomous Workflows

End-to-end consulting for sovereign enterprise AI systems. From private model serving and hybrid knowledge retrieval to standardized tool protocols and stateful multi-agent orchestration.