AUTONOME KI-AGENTEN · ON-PREMISE

KI-Agenten, die für Sie arbeiten – auf Ihrer eigenen Hardware.

Ein KI-Agent beantwortet nicht nur Fragen, er erledigt Aufgaben: Er plant, nutzt Werkzeuge und arbeitet mehrere Schritte selbständig ab – angebunden an Ihre Systeme, mit einem lokalen LLM-Backend. Wir bauen ihn quelloffen in Ihrem Haus: kein Cloud-Zwang, keine Abrechnung pro Anfrage, kein Datum verlässt Ihr Netz. Sie lernen, ihn selbst zu betreiben – oder wir richten Ihre Agenten ein und schulen Ihr Team.

On-Premise

auf Ihrer eigenen Hardware

0 € / Anfrage

keine Cloud-Abrechnung

100 % Open Source

kein Vendor-Lock-in

Abstrakte KI-Visualisierung – autonome Agenten, die Aufgaben planen und Werkzeuge nutzen
Läuft auf Ihrer Hardware – auch offline

WAS SIE IM WORKSHOP AUFBAUEN

Eigene KI-Agenten – ganz ohne Cloud

Wir setzen einen kompletten, quelloffenen Agenten-Stack auf Ihrer Hardware auf und machen Ihr Team damit produktiv. Zwei Wege: Sie lernen, alles selbst zu betreiben – oder wir übernehmen Einrichtung und Wartung und schulen die Anwender.

Agenten, die planen & handeln

Ein Agent zerlegt eine Aufgabe in Schritte, entscheidet, welches Werkzeug er braucht, führt es aus und prüft das Ergebnis – autonom über mehrere Stufen, statt nur eine einzelne Frage zu beantworten.

Führende Frameworks

Wir arbeiten mit den etablierten Open-Source-Frameworks – LangGraph und LangChain, CrewAI, AutoGen. Auswählbar nach Aufgabe: robuste Zustandsmaschinen, kooperierende Rollen oder frei geführte Dialoge.

Lokales LLM-Backend

Als Denk-Modell dient ein lokales LLM (Llama, Qwen, Mistral) über Ollama oder vLLM. Kein API-Key zu einem Cloud-Anbieter, keine Abrechnung pro Aufruf – die Agenten laufen komplett in Ihrem Netz.

Tool-Anbindung via MCP

Über das Model Context Protocol (MCP) und Function-Calling greifen Agenten kontrolliert auf Ihre Systeme zu – Datenbanken, CRM, Dateiablagen, interne APIs. Zugriff ohne Datenabfluss nach außen.

Guardrails & Human-in-the-loop

Klare Leitplanken bestimmen, was ein Agent darf. Kritische Schritte legen wir zur Freigabe vor (Human-in-the-loop), riskante Aktionen werden blockiert oder protokolliert – Autonomie mit Sicherheitsnetz.

Die passende Hardware

Vom Einzel-Server bis zum Multi-GPU-System: Wir dimensionieren die Hardware auf Modellgröße, parallele Agentenläufe und Durchsatz – und rechnen den Break-even gegen Cloud-Kosten vor.

WARUM ON-PREMISE, LOKAL & OFF-GRID

Ihr Vorteil gegenüber jeder KI-Cloud

Agenten aus der Cloud sind bequem – bis zur ersten Rechnung, zur DSGVO-Frage oder zum geänderten Preismodell. Und ein Agent, der auf Ihre Systeme zugreift, sollte seine Daten nicht durch fremde Server schicken. Lokal betrieben gehören die Agenten Ihnen. Das sind die Gründe, warum wir on-premise aufbauen.

DSGVO by Design

Art. 6 & 9 DSGVO · keine Auftragsverarbeitung

Aufgaben, Prompts und die Daten, auf die Agenten zugreifen, bleiben ausschließlich im eigenen Netz. Kein Datentransfer in US-Clouds, kein Schrems-II-Risiko, kein AV-Vertrag mit einem Hyperscaler nötig.

Keine laufenden Kosten

einmal Hardware statt pro Token/Anfrage

Cloud-Agenten rechnen pro Token und Aufruf ab – und ein Agent macht viele Aufrufe pro Aufgabe. Lokal zahlen Sie Strom und einmal die Hardware. Ab dem Break-even laufen beliebig viele Agentenläufe faktisch zum Nulltarif.

Kein Vendor-Lock-in

offene Frameworks & Modelle

Quelloffene Frameworks, Modelle und Gewichte, die Sie behalten. Kein Anbieter kann Preise erhöhen, Modelle abschalten, Endpunkte abkündigen oder Ihren Zugang sperren.

Läuft offline & air-gapped

off-grid, ohne Internet

Der komplette Agenten-Stack funktioniert ohne Internetverbindung – im abgeschotteten Netz, an Standorten ohne stabile Leitung, im Sicherheitsbereich.

Keine Zensur, keine Limits

keine Content-Filter, kein Rate-Limit

Keine fremden Inhaltsfilter, die legitime Geschäftsaufgaben blockieren. Keine Warteschlangen, keine Tageskontingente, kein künstlich gedrosselter Durchsatz für Ihre Automatisierungen.

Volle Kontrolle & Auditierbarkeit

reproduzierbar & nachvollziehbar

Jeder Schritt, jeder Werkzeugaufruf und jede Entscheidung eines Agenten wird protokolliert. Läufe sind nachvollziehbar und reproduzierbar – wichtig für Freigaben, Compliance und Revision.

Ihre Hardware, Ihr Tempo

volle GPU-Leistung

Keine geteilten Cloud-Ressourcen. Die volle Leistung Ihrer GPU steht Ihren Agenten jederzeit zur Verfügung – planbar und ohne Nachbarn auf der Karte.

Wissenstransfer statt Abhängigkeit

Ihr Team betreibt es selbst

Nach dem Workshop können Ihre Leute die Agenten selbst bauen, bedienen, aktualisieren und erweitern – mit vollständiger Dokumentation. Wartung optional durch uns.

Das nehmen Sie aus dem Workshop mit

  • Lauffähige KI-Agenten
  • Datensouveränität
  • Tool-Anbindung via MCP
  • Guardrails & Freigaben
  • Nachvollziehbare Agentenläufe
  • Kostentransparenz
  • Offline-Fähigkeit
  • Update-Strategie
  • Betriebsdokumentation
  • Team-Enablement

Eingesetzte Open-Source-Bausteine je nach Anwendungsfall und Hardware, u. a.: LangGraph und LangChain, CrewAI und AutoGen als Agenten-Frameworks; das Model Context Protocol (MCP) für die Tool-Anbindung; lokale LLMs (Llama, Qwen, Mistral) über Ollama oder vLLM als Backend. Frameworks, Modelle und Lizenzen prüfen wir gemeinsam auf Eignung für Ihren kommerziellen Einsatz.

On-Premise-Serverraum – KI-Rechenleistung im eigenen Haus
DATENSOUVERÄNITÄT

Ihre Firmendaten und Prompts verlassen Ihr Haus nie.

On-premise und Open Source heißt: Aufgaben, Systemzugriffe und Kundendaten werden lokal verarbeitet – nicht auf fremde Server geladen, nicht zum Modelltraining verwendet, nicht in ein Drittland übertragen. Selbst wenn ein Agent auf interne Systeme zugreift, bleibt jeder Schritt in Ihrem Netz. Volle Kontrolle, technisch und rechtlich.

WORKSHOP-ABLAUF

Vom leeren Rechner zu eigenen KI-Agenten

01

Assessment & Hardware-Check

Wir klären, welche Aufgaben ein Agent übernehmen soll, welche Systeme er anbinden muss und welche Freigaben nötig sind – und prüfen Ihre Hardware oder empfehlen die passende GPU. Ergebnis: ein realistischer Fahrplan inkl. Break-even gegenüber Cloud-Kosten.

02

Setup auf Ihrer Hardware

Installation des kompletten Open-Source-Stacks (lokales LLM-Backend via Ollama/vLLM, Framework wie LangGraph, MCP-Anbindung) lokal in Ihrem Netz – als Einzel-Server oder zentrale Agenten-Plattform.

03

Hands-on am eigenen Use-Case

Praxis mit einer echten Aufgabe aus Ihrem Haus: Wir bauen den ersten Agenten, definieren seine Werkzeuge und lassen ihn eine mehrstufige Aufgabe end-to-end erledigen.

04

Vertiefung: Tools, Guardrails & Automatisierung

Wir binden weitere Systeme via MCP an, definieren Leitplanken und Human-in-the-loop-Freigaben, orchestrieren mehrere Agenten und hängen Läufe an Ihre Prozesse und Zeitpläne.

05

Enablement & Betrieb

Übergabe mit Betriebsdokumentation, Monitoring, Update-Strategie und Team-Schulung. Ihr Team baut und betreibt Agenten selbst – die Wartung übernehmen Sie oder wir.

TYPISCHE EINSATZFELDER

Wo lokale KI-Agenten am meisten bewegen

Überall dort, wo wiederkehrende, mehrstufige Aufgaben Zeit fressen, Systeme angebunden werden müssen oder sensible Daten das Netz nicht verlassen dürfen.

OPERATIONS

Prozess- & Backoffice-Automatisierung

Agenten übernehmen wiederkehrende Abläufe: Daten aus mehreren Systemen zusammenführen, Formulare ausfüllen, Freigaben anstoßen, Ergebnisse zurückschreiben – auditierbar und on-prem.

Outcome

Manuelle Routinearbeit verschwindet – jeder Schritt bleibt im Haus.

RESEARCH & ANALYSE

Recherche-Agenten

Ein Agent durchsucht interne Quellen und Wissensdatenbanken, vergleicht, fasst zusammen und liefert eine belegte Antwort mit Quellen – ohne dass Ihre Fragen oder Dokumente eine Cloud sehen.

Outcome

Fundierte Zusammenfassungen in Minuten statt Stunden.

SERVICE & SUPPORT

Support-Agenten mit CRM-Zugriff

Agenten lesen den Vorgang im CRM, ziehen passende Wissensartikel, entwerfen die Antwort und aktualisieren nach Freigabe den Fall – Kundendaten bleiben durchgängig in Ihrem Netz.

Outcome

Schnellere Fälle bei voller Datenkontrolle.

DATEN & REPORTING

Datenaufbereitung & Reporting

Agenten sammeln Kennzahlen aus Quellsystemen, bereinigen und verdichten sie und erzeugen wiederkehrende Berichte – geplant, reproduzierbar und komplett on-premise.

Outcome

Berichte auf Knopfdruck – ohne Daten aus der Hand zu geben.

FAQ zum KI-Agenten-Workshop

HÄUFIGE FRAGEN

Ein Chatbot beantwortet eine Frage. Ein KI-Agent erledigt eine Aufgabe: Er plant selbständig die nötigen Schritte, wählt und nutzt Werkzeuge – ruft z. B. eine Datenbank ab, schreibt in ein System, startet einen Prozess – prüft das Zwischenergebnis und arbeitet weiter, bis das Ziel erreicht ist. Das LLM ist dabei das Denk-Modell, die Frameworks geben ihm Struktur, Werkzeuge und Leitplanken.

Ja. Das LLM-Backend, die Agenten-Logik und die angebundenen Werkzeuge laufen auf Ihrer Hardware und in Ihrem Netz. Nach der Einrichtung braucht der Betrieb keine Internetverbindung – ideal für abgeschottete Netze und besonders schützenswerte Systeme. Nur wenn ein Agent bewusst eine externe Quelle nutzen soll, öffnen Sie genau diesen Zugang – kontrolliert und protokolliert.

Über Guardrails und Human-in-the-loop. Sie legen fest, welche Werkzeuge ein Agent nutzen darf und welche Aktionen nur nach menschlicher Freigabe ausgeführt werden. Kritische oder irreversible Schritte werden vorgelegt statt automatisch ausgeführt, riskante Aktionen blockiert. Jeder Schritt wird protokolliert und ist nachvollziehbar.

Ja – kontrolliert über das Model Context Protocol (MCP) und Function-Calling. Wir binden Datenbanken, CRM, Dateiablagen oder interne APIs als Werkzeuge an, mit klar definierten Rechten. Der Zugriff bleibt vollständig in Ihrem Netz; es fließen keine Daten an einen externen Dienst ab.

Da Agenten viele LLM-Aufrufe pro Aufgabe machen, empfiehlt sich eine leistungsfähige GPU – für den Einstieg oft eine Karte mit 24 GB VRAM, für parallele Läufe und größere Modelle Karten wie RTX 6000 Ada oder A100, auch als Multi-GPU-Server. Im Assessment dimensionieren wir die Hardware auf Ihre Anwendungsfälle und rechnen vor, ab wann sie sich gegenüber der Cloud rechnet.

Der lokale Betrieb ist der direkteste Weg zur DSGVO-Konformität: kein Transfer personenbezogener oder vertraulicher Daten an einen Cloud-Anbieter, keine Auftragsverarbeitung durch Dritte, keine Übermittlung in Drittländer. Aufgaben, Prompts und die Daten, auf die Agenten zugreifen, werden ausschließlich in Ihrem Netz verarbeitet und nicht zum Training fremder Modelle genutzt.

Beides ist möglich – genau das ist der Kern des Workshops. Wir richten den Stack ein und befähigen Ihr Team, Agenten eigenständig zu bauen, zu bedienen, zu aktualisieren und zu erweitern. Ob Sie die Wartung danach selbst übernehmen oder an uns geben, entscheiden Sie.

Beides: als Inhouse-Termin bei Ihnen, remote oder in Karlsruhe. Er richtet sich an technische Teams und Fachabteilungen, die Prozesse automatisieren wollen. Grundlegendes technisches Verständnis hilft; die Tool- und System-Anbindung erarbeiten wir gemeinsam mit Ihren IT- und Fach-Kolleg:innen.

Bereit für Ihre eigenen KI-Agenten?

In einem kostenlosen Erstgespräch klären wir Aufgaben, Systemanbindung und Hardware – und zeigen, wie schnell Sie KI-Agenten DSGVO-konform auf Ihrer eigenen Hardware produktiv einsetzen. Selbst betreiben oder von uns betreiben lassen: Sie entscheiden.