Agentische KI

Wir bauen zuverlässige Agenten

Wir konzipieren, bauen und betreiben Multi-Agent-Systeme mit klarer Orchestrierung, RAG und Observability.

So funktioniert Oronts AI

Oronts liefert maßgeschneiderte Enterprise-KI-Systeme. Unsere 'KI-Plattform' bezeichnet eine Liefer- und Orchestrierungsarchitektur, keine verpflichtende SaaS-Lizenz.

Sie besitzen den Code, die Modelle und die Infrastruktur. Wir entwerfen, bauen und betreiben gemeinsam mit Ihnen. Kein Lock-in.

Oronts ist eine KI-Entwicklungsagentur mit Sitz in München, Deutschland. Wir entwickeln maßgeschneiderte KI-Systeme, die sich direkt in bestehende Unternehmensabläufe integrieren. Organisationen müssen ihre Prozesse nicht an eine starre Plattform anpassen. Jedes Engagement beginnt mit einer Discovery-Phase. Unsere Ingenieure analysieren Datenquellen, Toolchains und Geschäftslogik. Dann entwerfen sie eine passende Architektur. Die Systeme kombinieren LLM-Integration, Retrieval-Augmented Generation (RAG-Systeme), Computer Vision und Predictive Analytics. Wir nutzen moderne KI-Agent-Frameworks wie Mastra AI, LangChain, LangGraph und CrewAI für produktionsreife agentische KI-Lösungen. Mastra AI treibt unsere TypeScript-basierten Agent-Workflows mit integriertem Memory, Tools und RAG-Fähigkeiten an. Diese kohärenten KI-Workflows laufen auf der Infrastruktur des Kunden. Organisationen behalten das volle Eigentum an Modellen, Trainingsdaten und Deployment-Umgebungen. Oronts ist spezialisiert auf KI-Automatisierung und agentische KI. Autonome KI-Agenten übernehmen mehrstufige Aufgaben wie Dokumentenverarbeitung, Kundenanfragen-Routing, Qualitätsprüfung und Supply-Chain-Optimierung mit menschlicher Aufsicht an kritischen Entscheidungspunkten. Unser KI-Beratungsteam in München betreut Kunden in ganz Deutschland und weltweit. Unsere 90-Tage-Pilotmethodik strukturiert jedes Projekt in wöchentliche Lieferergebnisse. Messbare Erfolgskriterien werden vor Arbeitsbeginn vereinbart.

Belegt durch ausgelieferte Arbeit und betriebene Workloads
99.9%
Uptime-SLA-Ziel
vertragliches Ziel auf verwalteten Workloads
5
KI-Agenten in Produktion
Mastra-Runtime auf dieser Website
GDPR
EU-first Engineering
Datenschutz ab Entwurf
2
Veröffentlichte Open-Source-Pakete
2 davon Open Source
Schnelle Eignungsprüfung

Ist Oronts AI das Richtige für Sie?

Ideal für

  • Unternehmen mit komplexen Workflows
  • Regulierte Branchen mit Compliance-Anforderungen
  • Teams, die KI in Produktion bringen
  • CTOs, die Kontrolle und Observability brauchen

Nicht geeignet für

  • Einfache Chatbot-Experimente
  • Reine Prompt-Automatisierung
  • Proof-of-Concepts ohne Budget
  • Teams ohne technische Ressourcen

Custom AI entwickeln, wenn die Antwort in Ihren eigenen Daten liegt

Kaufen Sie ein gehostetes AI-Werkzeug, wenn ein generischer Chatbot oder Zusammenfasser ausreicht und Ihre Daten Ihre Umgebung verlassen dürfen. Entwickeln Sie ein Custom-AI-System, wenn Antworten aus Ihren eigenen Dokumenten, Datensätzen und Regeln stammen müssen, wenn das Modell Ihre Systeme aufrufen und Aktionen ausführen soll und wenn falsche Antworten reale Kosten verursachen. Produktionsreife AI bedeutet für uns vier Dinge in jedem Build: Retrieval über Ihre Quellen, damit Antworten fundiert und belegbar sind, Tool-Use, damit das Modell Ihre Systeme unter kontrollierten Berechtigungen liest und beschreibt, menschliche Freigabe-Gates bei folgenreichen Aktionen und ein vollständiger Audit-Trail. Ihre Daten bleiben in Ihrer Cloud und die Provider-Grenzen werden vertraglich festgehalten.

  • Retrieval über Ihre Quellen, sodass jede Antwort fundiert und auf ein Dokument zurückführbar ist
  • Tool-Use unter eng gefassten Berechtigungen, sodass das Modell innerhalb Ihrer Systeme handelt, nicht daran vorbei
  • Menschliche Freigabe-Gates bei folgenreichen Schritten, wobei Fälle mit geringer Konfidenz an eine Person geleitet werden
  • Vollständiger Audit-Trail und Ihre Daten bleiben in Ihrer eigenen Cloud, nicht in einem Silo eines Drittanbieters

Wie ein produktionsreifes RAG- und Agentensystem zusammenpasst

Ihre Quellen werden für das Retrieval indexiert, ein Orchestrator verteilt die Arbeit an spezialisierte Agenten und Tools, und jede folgenreiche Aktion durchläuft ein menschliches Freigabe-Gate, bevor sie Ihre Systeme berührt. Der gesamte Pfad wird für das Audit protokolliert.

Approved sources
Permission-aware retrieval
Model / agent (bounded tools)
Human approval
Audit log
Schutzplanken und Feedback bei jedem Schritt

Ihre Daten bleiben in jedem Schritt in Ihrer Cloud. Modelle sind austauschbar; die Orchestrierungs-Spine, die Retrieval-Schicht, die Freigabe-Gates und das Audit-Log bleiben gleich, wenn Sie den Provider wechseln.

Von der Idee zu produktiven Agenten

Agenten, RAG, Workflows, Memory und Observability – als ein Gesamtsystem gedacht.

Rollendesign

Planer, Forscher, Ausführer mit klaren Verantwortlichkeiten

Fähigkeiten & ToolsLeitplankenEskalationspfade
Technische Auswirkung
  • Klare Rollengrenzen & Fähigkeiten
  • Bereichsbezogene Tool-Berechtigungen pro Rolle
Geschäftliche Ergebnisse
  • Weniger Fehlermodi
  • Schnellere Zykluszeit
Übergabe-GenauigkeitZeit bis Abschluss

Tooling

API-Aufrufe, Webhooks, Suche, DB und Drittanbieter-Integrationen

OAuth & SecretsRate LimitsRetry/Backoff
Technische Auswirkung
  • Wiederholungen mit Backoff
  • Circuit-Breaker für instabile Tools
Geschäftliche Ergebnisse
  • Höhere Erfolgsrate
  • Niedrigere Incident-Kosten
Tool-Erfolg %Fehlerrate

Sicherheit & Evals

Policy-Checks und automatisierte Evaluierungen pro Task

Prompt-LeitplankenUnit- & Regressions-EvalsRed-Team-Tests
Technische Auswirkung
  • Automatisiertes Eval-Harness
  • Dataset-Regressionschecks
Geschäftliche Ergebnisse
  • Zuverlässige Releases
  • Reduziertes Modell-Drift-Risiko
ErfolgsrateEval-Abdeckung

Mensch-in-der-Schleife

Inline-Genehmigungen und Übergaben für kritische Aktionen

Review-WarteschlangenEskalation an ExpertenAudit-Trails
Technische Auswirkung
  • Review-Warteschlangen & Genehmigungen
  • Audit-Trails für Aktionen
Geschäftliche Ergebnisse
  • Risikokontrolle
  • Compliance-Ausrichtung
Zeit bis GenehmigungEskalationsrate
Diese Muster live sehen?
KI-Orchestrierung

Orchestrator-Workflow

Nachvollziehbarer Weg von Nutzerintention zu verlässlichen Ergebnissen.

Am besten für
1

Absicht & Plan

Ziel analysieren und Plan mit Meilensteinen erstellen

PlanChecksAnnahmen
2

Abrufen & Grounding

Wissen via RAG und Policies einbinden

ZitateKontextRichtlinien
3

Handeln & Tools

Tools/APIs/Workflows mit Retries ausführen

AktionenErgebnisseLogs
4

Prüfen & Abstimmen

Self-Checks, Evals und menschliche Aufsicht

ScoresNotizenEskalationen
5

Liefern & Lernen

Ergebnisse liefern und Memory aktualisieren

ArtefakteMemoryFeedback
Beratung & Delivery-Meilensteine

Discovery

1–2 Wochen
  • Anwendungsfälle & KPIs
  • Daten- & Tool-Map
  • Risiko & Compliance

Architektur

1–2 Wochen
  • Agentenrollen & Tools
  • RAG- & Memory-Plan
  • Sicherheit & Observability

Pilot

3–6 Wochen
  • Funktionierende Agenten
  • Evals & Dashboards
  • ROI-Snapshot

Produktion

laufend
  • SLA & Runbooks
  • Alerts & Ops
  • Iterations-Roadmap
Bereit, Ihre Orchestrierung & Delivery zu planen?

Fähigkeiten

NLP, Vision, Vorhersage und Automatisierung – durchgängig beobachtbar.

Sprache verstehen

Konversation, Extraktion, Klassifikation

Mehrsprachig
Entity-Erkennung
Sicherheitsfilter
Summarization

Sehen & erkennen

Bild/Video-Analyse

OCR
Objekterkennung
Moderation
Image Generation

Vorhersagen

Prognosen & Empfehlungen

Zeitreihen
Anomalien
Reranking
Anomalie-Erkennung

Automatisierung

Workflows & Tools

API-Aufrufe
Rückfragen
Wiederholungen
Quality Control

Sprache verstehen

Konversation, Extraktion, Klassifikation

Multi-Agenten-Systeme

Agentische KI-Plattform

Multi-Agenten-Orchestrierung mit Transparenz, Steuerung und Skalierung. Zuverlässige Agenten über Ihren gesamten Stack.

Fähigkeiten auf einen Blick

Transparenz & Steuerung
Schnelle Iteration
Dauerhafte Performance
Modellneutral
Transparenz & Steuerung

Tracing auf Schritt-Ebene, Tool-Aufrufe, Retries, Guardrails und Human-in-the-loop

Schnelle Iteration

Build → Test → Deploy mit Evals und Feedback aus Produktion

Dauerhafte Performance

Langläufer-Workloads, Queues und Recovery für Enterprise-SLAs

Modellneutral

Ihre LLMs, Vektordatenbanken, Tools und Infrastruktur – ohne Lock-in

Multi-Agent-Orchestrierung

Spezialisierte Agenten koordinieren mit geteilter Memory und klaren Hand-offs.

Rollenbasierte Crews (Planer, Researcher, Executor)
Tool- & API-Integration pro Schritt
Geteilte Memory, RAG und Langzeit-Kontext
Sicherheitsgrenzen und Eskalationspfade
Anwendungsfälle
KundenserviceVertriebs-Co-PilotAnalysten-Assistent
KPIs
ErstlösungsquoteBearbeitungszeitQualitätsbewertung

Framework-Expertise

Wir wählen den passenden Stack – dort, wo Sie heute stehen.

CrewAI

Führende Orchestrierung für rollenspielende Multi-Agenten

Orchestrierung auf Produktionsniveau
LLM-agnostisch
Produktionsreife Patterns
Multi-agent
Orchestration

LangChain

Umfassende Plattform für Agent Engineering

Tracing & Steuerung
Schnelle Iteration
Robuste Infrastruktur
Modellneutral
Agent engineering
Platform

LangGraph

Graph-basierte Kontrolle für zuverlässige Multi-Agent-Systeme

Deterministische Flows
Recovery-Pfade
Menschliche Aufsicht
Graph-Steuerung
Zuverlässigkeit

VoltAgent

TypeScript Agent-Framework mit großartiger DX

Volle Kontrolle
Schnelle Orchestrierung
RAG & Tools
TypeScript
DX

Mastra

Moderner TS-Stack für Agenten & KI-Apps

Agenten
Workflows
RAG
Memory
Tools
TypeScript
Stack

Microsoft Agent Framework

Open-Source-Engine für agentische KI-Apps

Komponierbar
Observability
Evaluationen
Open-Source
Enterprise
Proprietäre KI-Technologie

Individuelle KI-Lösungen

Für Ihr Unternehmen entwickelt

Fortschrittliche KI-Technologie, maßgeschneidert für die Anforderungen Ihres Unternehmens

Individuelle LLM-Integration

Sprachmodell

Domänenspezifisch optimierte Sprachmodelle, verankert in Ihren eigenen Daten und Prozessen.

RAG
Verankerung
Menschliche Prüfung
Kontrolle
Mehrsprachig
Sprachen
EU-Option
Hosting
Retrieval-Augmented Generation über Ihre Dokumente und Wissensdatenbank
Quellenangaben und Schutzmechanismen bei jeder Antwort
Feinabgestimmt auf Ihre Fachterminologie
Betrieb in Ihrer Cloud oder auf EU-gehosteter Infrastruktur
Anwendungsfälle: Kundenservice, Content-Erstellung, Analytik

Computer-Vision-Systeme

Computer Vision

Visuelle Erkennung, trainiert auf Ihren Produkten, Standorten und Abläufen.

Individuell
Training
Menschliche Prüfung
Kontrolle
Multi-Format
Formate
Ihre Cloud
Betrieb
Fehler- und Anomalieerkennung, trainiert auf Ihren Bildern
Kompatibel mit vorhandenen Kameras und Bildformaten
Edge- oder Cloud-Inferenz passend zu Ihren Latenzanforderungen
Prüfwarteschlange für Fälle mit geringer Konfidenz
Anwendungsfälle: Fertigungsqualität, Sicherheit, Handelsanalytik

Predictive Analytics

Prognose-Engine

Zeitreihenprognosen und Anomalieerkennung auf Ihren operativen Daten.

Zeitreihen + ML
Methoden
Backtesting
Validierung
Drift-Warnungen
Überwachung
Geplant
Aktualisierung
Prognosen für Nachfrage, Auslastung und Umsatz aus Ihrer Historie
Anomalieerkennung mit nachvollziehbaren Signalen
Vor dem Go-live gegen Ihre historischen Daten getestet
Drift-Überwachung mit geplanten Nachtrainings
Anwendungsfälle: Bedarfsprognose, Risikomanagement, Optimierung

Workflow-Automatisierung

Workflow-Automatisierung

Intelligente Orchestrierung und Entscheidungslogik über Ihre bestehenden Systeme hinweg.

Audit-protokolliert
Kontrolle
Mensch
Übergabe
API-first
Integrationen
Retries + DLQ
Wiederherstellung
Orchestriert mehrstufige Prozesse über Ihre Systeme hinweg
Menschliche Übergabe bei Entscheidungen, die Freigabe erfordern
API-first-Integration in Ihren bestehenden Stack
Audit-Log, Wiederholungen und Dead-Letter-Recovery
Anwendungsfälle: Geschäftsprozessautomatisierung, Workflow-Optimierung
100% proprietär • Volles IP-Eigentum

Bauen Sie Ihre maßgeschneiderte KI

Lassen Sie uns besprechen, wie unsere individuellen Modelle Ihr Geschäft mit passgenauen Lösungen transformieren können.

Öffentlich prüfbares Engineering

Läuft auf dieser Website

Live

Der Assistent auf dieser Website ist ein agentisches, werkzeugnutzendes System, das wir gebaut haben und in Produktion betreiben, kein Demo hinter einem Login.

Vendure Data Hub

Open Source

Ein Vendure-Commerce-Plugin, das wir gebaut und veröffentlicht haben, öffentlich auf GitHub. Zwei unserer elf entwickelten Bundles sind öffentlich.

Auf GitHub ansehen

Pimcore Asset Pilot

Open Source

Ein Pimcore-Asset-Bundle, das wir gebaut und veröffentlicht haben, öffentlich auf GitHub und vollständig einsehbar.

Auf GitHub ansehen

Echte Einsatzbereiche, ehrlich beschrieben

Kundensupport

Support-Tickets stapeln sich. Das System liest jedes Ticket, klassifiziert die Absicht und leitet weiter oder löst Routinefälle, und lernt aus dem Feedback der Agents.

Routine-Tickets werden automatisch gelöst oder weitergeleitet; Agents konzentrieren sich auf die Fälle, die Urteilsvermögen erfordern.

Einkauf und Supply Chain

Fehl- und Überbestände binden Kapital. Das System ruft Verkaufsdaten ab, analysiert Muster, prognostiziert die Nachfrage und schlägt Nachbestellungen zur Prüfung vor.

Nachbestellsignale werden früher sichtbar, sodass Einkäufer auf Daten statt auf Bauchgefühl reagieren.

Risiko und Betrugsprävention

Verdächtige Transaktionen müssen erkannt werden, ohne ehrliche Kunden mit Fehlalarmen zu blockieren. Das System überwacht Transaktionen, bewertet sie in Echtzeit und markiert auffällige Muster.

Verdächtige Muster werden vor der Freigabe zur Prüfung markiert, wobei ein Mensch die finale Entscheidung trifft.

Vertrieb

Vertriebsmitarbeiter verlieren Zeit an Administration. Das System verfolgt Aktivitäten, schlägt nächste Aktionen vor, entwirft Follow-ups und aktualisiert das CRM.

Vertriebsmitarbeiter verbringen mehr Zeit mit Verkaufen und weniger mit Administration, mit der Next-Best-Action im Kontext eingeblendet.

Interaktiv

Live-Demos

Probieren Sie typische Agent-Workflows aus.

Wenn Sie mit uns arbeiten, besitzen Sie die Agenten, den Code, die Modelle und die Infrastruktur.

Chat-Assistent

Assistent

Hallo! Wie kann ich heute helfen?

Illustrative Demo mit simulierten Antworten. Der produktive Oronts-Assistent ist live in der Ecke dieser Seite.

Gehostetes Werkzeug, Glue-Code oder ein konstruiertes AI-System

Drei Wege, AI in Ihr Unternehmen zu bringen, und was jeder davon tatsächlich leistet. Wir bauen den dritten: ein System, das Ihnen gehört, in Ihren Daten verankert und durchgängig verwaltet.

Wischen Sie zur Seite, um alle drei Ansätze zu vergleichen.

Gehostetes AI-WerkzeugAPI plus Glue-CodeKonstruiertes AI-System
Daten bleiben in Ihrer Cloud
Retrieval über Ihre eigenen Quellen
Menschliche Freigabe-Gates bei Aktionen
Audit-Trail für jede Entscheidung
Model-agnostisch, Provider frei wechselbar
Ihnen gehören der Code und die Integration

Model-agnostisch konzipiert. Wir arbeiten mit Frontier-Modellen von OpenAI und Anthropic sowie Open-Source-Modellen und wechseln Provider, ohne Ihr System neu zu schreiben.

KI-Modelle

KI-Modelle

Passende Modelle für jeden Anwendungsfall.

OpenAI GPT (latest)

LLMModell
Proprietär
Parameter
Schnell
Geschwindigkeit

Anthropic Claude (latest)

LLMModell
Proprietär
Parameter
Schnell
Geschwindigkeit

Mixtral 8×7B

LLMModell
47B
Parameter
Schnell
Geschwindigkeit

Llama 4

LanguageModell
Open Source
Parameter
Sehr schnell
Geschwindigkeit

Stable Diffusion

ImageModell
Open Source
Parameter
Medium
Geschwindigkeit

Whisper large-v3

AudioModell
1.5B
Parameter
Fast
Geschwindigkeit

Eigene Modelle werden unterstützt.

Ökosystem

Ökosystem & Tools

Technologien, mit denen wir täglich arbeiten, von ML-Frameworks über Vektor-Datenbanken bis zu APIs.

ML Frameworks

TensorFlowPyTorchNumPyGoogle ML Kit

Vektor-Datenbanken

WeaviateMilvusQdrantChromaDeep LakeMindsDB

Audio-Generierung

Bark UITiny DiffusionAudio WebUIwhisper.cpp

LLM-Training

Colossal-AIMegatron-LMDeepSpeed

Autonome Agenten

Mastra AICrewAIAgentGPTSuperAGIAutoGPTBabyAGIAdalaAgentlabsLocalGPTPinokioAgent4Rec

Stable Diffusion Stack

FooocusKrita AIInvokeAIVoltaMLSHARKFace FusionStable StudioSD Next

LLM Backends

llama.cppOllamaLocalAIKoboldCppgpt4allText Gen WebUIvLLMExLlama

AI APIs

OpenAIAnthropicMistralGroqGeminiCohereHuggingFaceOpenRouterPerplexityLiteLLMOctoAIAnyscaleStability AI

Gebaut, um Ihre Beschaffung und Security-Prüfung zu bestehen

Die Fragen, die Ihre Rechts-, Security- und Datenschutzteams stellen, beantwortet, bevor sie sie stellen.

Code-Eigentum
Ihnen gehören der Quellcode, die Prompts und die Integration. Kein Lock-in in eine proprietäre Runtime, die Sie nicht verlassen können.
Ihre Cloud
Das System läuft in Ihrer Cloud oder On-Premises-Umgebung. Die Datenresidenz folgt Ihrem Tenancy, EU-Hosting ist verfügbar.
Training durch Drittanbieter-Modelle
So konfiguriert, dass Ihre Daten nicht zum Training von Drittanbieter-Modellen verwendet werden, vorbehaltlich der Bedingungen des jeweiligen Providers und Ihres gewählten Deployment-Modus.
AVV und GDPR
Auftragsverarbeitungsvertrag, wo erforderlich, vorhanden, mit GDPR-konformer Datenverarbeitung, Löschpfaden und dokumentierter Verarbeitung.
Modell- und Provider-Grenzen
Provider-, Regions- und Datenfluss-Grenzen sind schriftlich festgelegt. Modelle sind austauschbar, sodass ein Provider-Wechsel den Vertrag nicht verletzt.
Exit
Definierte Übergabe: Code, Infrastructure-as-Code, Dokumentation und Runbooks gehen an Ihr Team über, sodass Sie das System ohne uns betreiben oder verlagern können.

Mit wem Sie arbeiten

HRB 288224
Eingetragen in München
15+
Jahre, gründergeführt
DE · EN · AR
Liefersprachen
2
Open Source auf GitHub
EU
Datenresidenz, Frankfurt
AVV/DPA
Unterschriftsbereit, Art. 28

Engagement-Stufen

Oronts arbeitet mit ernsthaften Teams, die Senior-Delivery brauchen, kein Billig-Outsourcing.

Production Pilot
ab 25k EUR
Individualsoftware- und KI-Projekte
ab 50k EUR
Laufende technische Retainer
ab 15k EUR/Monat

Der genaue Preis hängt von Umfang, Verantwortung, Liefergeschwindigkeit, Teamgröße, Integrationen, Support-Erwartungen und Produktionsrisiko ab.

Bereit für den nächsten Schritt?

Wir bringen Agenten zuverlässig in Produktion – messbar und sicher.

Live-Demos verfügbar
Begleitete Pilotprojekte
Sie besitzen alles, was wir bauen

Zuletzt aktualisiert: 2026-06-24