Zum Inhalt springen

Die ESTAYA AI Platform

Das Fundament für Ihr System.

Auf ihr laufen ERP-Bausteine, Belegverarbeitung, Fuhrpark, Archiv, Sprachsysteme und Shops, darüber die KI-Schicht mit eigenen Modellen. Daraus bauen wir Ihr System und übernehmen danach den Betrieb.

Ihr Projekt beginnt nicht bei null. Die Plattform läuft bei über 50 Unternehmen im Tagesbetrieb, vom Geschäftskern bis zur Belegverarbeitung, zusammen 120.000 Vorgänge je Werktag. Deshalb schaffen wir rund 60 Projekte im Jahr, und Ihr System ist früher im Einsatz.

Das Fundament

Was schon läuft, wenn Ihr Projekt beginnt

Sechs Bausteine stehen im Echtbetrieb, bevor für Sie die erste Zeile Code entsteht.

Geschäftskern Buchhaltung, CRM, Lager, Projekte und Rechnungen auf Odoo-Basis. Die Abläufe, aus denen jede Firma besteht, sind eingerichtet und erprobt.
Anmeldung und Rechte Eine Anmeldung für alle Systeme, Rollen und Mandanten zentral über Keycloak. Ihre Mitarbeiter merken sich ein Passwort, und Sie steuern an einer Stelle, wer was sieht.
Schnittstellen und Geräte APIs zu Fremdsystemen, dazu Telematik-Einheiten, Sensoren und SIM-Karten. Die Geräte kommen von uns, Ihre Fahrzeuge und Maschinen melden sich direkt im System.
Web und Apps Weboberflächen, Apps für iOS und Android aus einer Codebasis, dazu Kundenportale und fertige UI-Bausteine. Ihre Anwender arbeiten früh mit echten Masken statt mit Entwürfen.
KI-Schicht Eigene Modelle auf eigenen GPU-Servern in Deutschland, zuschaltbar für jede Anwendung. Wie die Schicht aufgebaut ist, steht weiter unten auf dieser Seite.
Betrieb Eigene Server in Deutschland, Monitoring, Betrieb nach vereinbartem SLA. Störungen fallen bei uns auf, bevor sie bei Ihnen ankommen.

Eigentum und Daten

Wem was gehört

Sie zahlen einen Projektpreis und eine Lizenz. Dafür erhalten Sie ein dauerhaftes Nutzungsrecht an Ihrer Lösung, wir betreiben sie nach einem SLA, das wir gemeinsam festlegen. Die Rechte an Plattform und Anpassungen bleiben bei uns.

Den Einwand hören wir oft, mit einer Plattform bindet man sich an ihren Betreiber. Die Antwort steht im Vertrag. Ihre Daten gehören Ihnen, Sie können sie jederzeit vollständig exportieren, und wer geht, nimmt sie komplett mit. Was Sie bei uns hält, soll die Qualität des Betriebs sein.

  • Projektpreis plus Lizenz, dauerhaftes Nutzungsrecht an Ihrer Lösung
  • Ihre Daten gehören Ihnen, vollständiger Export jederzeit
  • Betrieb nach individuell vereinbartem SLA
  • Wer wechselt, nimmt seine Daten vollständig mit
AUDIT DSGVO · AI Act digitale Souveränität, messbar statt versprochen
EU AI Act

Die KI-Schicht

Eigene Modelle, nachprüfbare Antworten

Jede Antwort nennt ihre Quelle, und was das System nicht sicher weiß, beantwortet es nicht. Ihre Daten bleiben dabei auf unseren Servern in Deutschland.

Schichten
Ihre Anwendungen
ERP, Belege, Fuhrpark, Archiv, Sprache, Shops
Modell-Gateway · LiteLLM
Ein Zugang für alle Modelle und Anwendungen
OpenAI-kompatibel
RAG mit Quellenbeleg
Antworten satzgenau aus Ihren Dokumenten belegt
KI-Agenten
Erledigen Arbeitsschritte direkt in Ihren Systemen
Verifizierer
Lieber keine Antwort als eine erfundene
Guardrails
PII-Schutz, Abwehr von Prompt-Injection
Governance
Rollen, Budgets, Allowlists je Anwendung
Audit-Log
Jeder Aufruf dokumentiert und nachvollziehbar
Offene Modelle
Je Aufgabe das passende Modell, Inferenz mit vLLM
GPU-Server in Deutschland
Eigene Hardware, betrieben von unserem Team
DE · EU

Jeder Baustein dieser Schicht steht im Echtbetrieb, unter anderem in einer Belegverarbeitung mit über 30 Millionen Dokumenten im Jahr.

Feinabstimmung
Eigene Modelle auf Ihren Daten trainiert
Spracherkennung
Telefonate und Diktate werden Text
Vektorsuche
Findet Inhalte nach Bedeutung
Wissensgraph
Verknüpft Personen, Projekte und Belege
Qualitätsmessung
Jede Modelländerung wird gemessen
SDK
Eigene Anwendungen an die Schicht anbinden

Warum eine Plattform

Modell-Unabhängigkeit statt Vendor-Lock-in

Ihre Anwendungen sprechen ein einziges, OpenAI-kompatibles Format. Welches Modell dahinter antwortet, Llama, Mistral, Qwen, Teuken oder Ihr eigenes Fine-Tune, entscheidet die Plattform anhand Ihrer Regeln. So wechseln Sie Modelle wie Strom­anbieter: ohne Umbau.

  • Ein API (LiteLLM) für offene und eigene Modelle
  • Kosten- und Quota-Kontrolle pro Team
  • Deploy als SaaS, VPC oder air-gapped on-premise
  • Inferenz mit vLLM auf eigenen GPU-Servern in DE
Souveräne KI verstehen
KI-Plattform

Eigene Algorithmen

Mehr als ein RAG-Baukasten

Unter der Plattform stecken Verfahren, die generische Baukästen nicht mitbringen: hybride Suche mit Reciprocal Rank Fusion, Cross-Encoder-Reranking, NLI-Satz-Grounding mit Abstention (0-Halluzination), ein NLI-verifizierter Wissensgraph mit Pfadsuche und Communities sowie kontextadaptive Gewichtung je nach Frage-Intent.

Qualität ist messbar: ein eval_harness mit RAGAS-artigen Metriken (Faithfulness, Answer-Relevancy, Context-Precision), Gold-Set und Regressions-Gate. Confidence wird ehrlich ausgewiesen (hoch/mittel/niedrig) statt mit Pseudo-Prozenten.

  • Reciprocal Rank Fusion + Cross-Encoder-Reranking
  • NLI-Grounding & Abstention (0-Halluzination)
  • Wissensgraph: Pfade, Communities, Brokerage
  • Messbare Qualität via eval_harness (RAGAS)
Anfrage „Wer leitete das Projekt 2024?“ Stichwortsuche BM25: Begriffe, Namen, Aktenzeichen Vektorsuche selbst gehostete Embeddings: Bedeutung Reciprocal Rank Fusion beide Listen zusammengeführt → Top 50 Cross-Encoder-Reranking 50 → 5: nur die besten Passagen erreichen das Modell 50 → 5 NLI-Grounding-Gate jeder Satz gegen die Quellen geprüft Belegte Antwort jede Aussage mit Quellenangabe „nicht gefunden“ kein Beleg → kein Raten
Anfrage
„Wer leitete das Projekt 2024?“
Stichwortsuche
BM25: Begriffe & Namen
Vektorsuche
Embeddings: Bedeutung
Reciprocal Rank Fusion
beide Listen → Top 50
Cross-Encoder-Reranking
50 → 5 beste Passagen
NLI-Grounding-Gate
jeder Satz gegen Quellen geprüft
Belegte Antwort ✓
mit Quellenangabe
„nicht gefunden“
kein Beleg → kein Raten
EINFÜHRUNG

Vier Schritte

So entsteht Ihr System auf der Plattform

01 Assessment Use-Cases & Datenquellen. Sicherheits- und Compliance-Rahmen
02 Setup Gateway, RAG & Modelle aufsetzen. Rollen, Budgets, Guardrails
03 Pilot Erster Use-Case produktiv. Evaluierung & Feinschliff
04 Skalierung Weitere Teams & Use-Cases. Betrieb, Monitoring, SLA

Häufige Fragen

Fragen zur Plattform

Was ist ein Multi-Modell-Gateway?

Ein einheitliches API vor vielen Modellen. Ihre Anwendungen sprechen ein Format (OpenAI-kompatibel); das Gateway routet, verteilt Last, sichert per Failover ab und trackt Kosten. Ein Modellwechsel braucht keine Code-Änderung.

Läuft die Plattform vollständig on-premise?

Ja. Gateway, RAG und Inferenz (vLLM) laufen vollständig in Ihrem Rechenzentrum oder air-gapped, ohne Datenabfluss.

Welche Governance bietet die Plattform?

Audit-Logs, Budget- und Quota-Limits pro Team und Key, Modell-Allowlists, Rollen und Guardrails (PII, Themen-Filter), dokumentierbar für EU AI Act und interne Revision.

Läuft auf der Plattform auch Software ohne KI?

Ja. Der größte Teil der Plattform ist gewöhnliche Betriebssoftware. ERP, Fuhrpark oder Shop laufen ohne die KI-Schicht. Zugeschaltet wird sie, wenn ein konkreter Anwendungsfall sie braucht, bis dahin kostet sie weder Geld noch Aufmerksamkeit.

Wem gehören Lösung und Daten?

Sie erhalten ein dauerhaftes Nutzungsrecht an Ihrer Lösung, die Rechte an Plattform und Anpassungen bleiben bei uns. Ihre Daten gehören Ihnen und lassen sich jederzeit vollständig exportieren, auch wenn Sie sich eines Tages anders entscheiden.

Warum ist ein Projekt auf der Plattform schneller?

Weil die Bausteine bei über 50 Unternehmen im Echtbetrieb laufen. Gebaut wird nur, was Ihnen fehlt, alles andere wird eingerichtet und angepasst. Das verkürzt den Weg bis zum ersten produktiven Tag.

Warum eine Plattform statt verstreuter Werkzeuge

Einzelne KI-Bausteine erzeugen Wartungslast: ein Vektorspeicher hier, ein API-Adapter dort, ein Skript für Auswertungen. Die ESTAYA AI Platform fasst diese Schichten zu einem dokumentierbaren System zusammen. Im Zentrum steht ein Gateway auf Basis von LiteLLM. Es vereinheitlicht den Zugriff auf offene Modelle wie Llama, Mistral, Qwen und Teuken, die wir selbst mit vLLM betreiben. Sie sind dadurch nicht an einen Anbieter gebunden und tauschen Modelle aus, ohne Anwendungen umzuschreiben.

Die Antwortqualität entsteht über mehrere Verfahren statt über einen einzelnen Suchschritt. Citation-grounded RAG belegt jede Aussage mit ihrer Quelle. PageIndex ordnet lange Dokumente strukturiert ein, ein Wissensgraph verbindet Entitäten, und ein NLI-Prüfschritt verwirft Aussagen, die nicht durch den Kontext gedeckt sind. Eigene Algorithmen schärfen die Auswahl: Reciprocal Rank Fusion vereint mehrere Trefferlisten, Cross-Encoder-Reranking ordnet nach Relevanz, eine kontextadaptive Gewichtung passt sich der Anfrage an.

KI-Agenten arbeiten nach dem Muster Plan-Execute-Reflect und binden Fachsysteme über das Model Context Protocol an. Governance und Observability protokollieren jeden Aufruf, jedes Modell und jede Quelle nachvollziehbar. Mit dem eval_harness und RAGAS messen wir Treffergüte und Belegtreue in Zahlen.

  • Modell-Unabhängigkeit durch ein einheitliches Gateway
  • Belegbare Antworten über Grounding und NLI-Prüfung
  • Eigene Ranking-Algorithmen statt reiner Vektor-Suche
  • Deployment on-premises, in der VPC oder als SaaS auf eigenen Servern in Deutschland
  • Produktiv in der ESTAYA AI Platform und in einem großen KI-Archiv mit Millionen Dokumenten

DSGVO, EU AI Act, BSI IT-Grundschutz und ISO 27001/42001 bilden den Rahmen, den wir für Sie umsetzen. Beyonetix selbst ist nicht zertifiziert. Was wir liefern, sind nachvollziehbare Protokolle, mit denen Ihre Prüfung diese Anforderungen belegen kann.

Sehen Sie die ESTAYA AI Platform an Ihren Daten

Wir richten einen Piloten mit Ihrem Use-Case in Ihrer Umgebung ein.