Noveum.ai

Über Noveum

Zuverlässigkeitsinfrastruktur für das Agentenzeitalter.

Noveum ist die KI-native Plattform, mit der Teams ihre produktiv eingesetzten Agenten zuverlässig halten: Sie verfolgen jede Ausführung, bewerten sie mit kalibrierten Scorern, simulieren künftige Abläufe, sichern Live-Datenverkehr ab und stellen validierte Korrekturen als Pull Requests bereit. Ein kontinuierlicher Kreislauf statt einer Wand aus Diagrammen.

Open-Source-SDKs · SOC 2 Typ II (in Bearbeitung) · On-Premise und BYO ClickHouse

5

Produkte, ein Kreislauf

112

Kalibrierte Scorer

15

Scorer-Kategorien

4-zeilig

SDK-Integration

01 - Warum Noveum entstand

Einen Agenten bereitzustellen ist einfach. Ihn zuverlässig zu halten nicht.

Noveum entstand aus einer Frustration, die jedes Team beim Aufbau mit LLMs irgendwann erlebt: Einen Agenten in einer Demo zum Laufen zu bringen dauert einen Nachmittag. Ihn im Produktivbetrieb zuverlässig zu halten dauert eine Ewigkeit. Die dafür vorgesehenen Werkzeuge wurden für eine Welt entwickelt, die nicht mehr existiert.

Klassische Observability setzt deterministische Software voraus: gleiche Eingabe, gleiche Ausgabe und ein Stack Trace, wenn etwas ausfällt. KI-Agenten sind das Gegenteil. Sie durchlaufen zahlreiche Schritte, rufen Tools und andere Agenten auf, und „falsch“ bedeutet nur selten einen Absturz. Häufig ist es eine selbstsichere, plausibel wirkende Antwort, die unbemerkt am Bedarf des Nutzers vorbeigeht. APM-Dashboards erkennen das nicht. Protokolle erklären es nicht. Und niemand kann genügend Traces von Hand lesen, um Problemen stets zuvorzukommen.

Deshalb haben wir eine von Grund auf KI-native Zuverlässigkeitsschicht entwickelt. Sie behandelt Evaluierungen als Signal erster Klasse, rekonstruiert und simuliert reale Szenarien und verwandelt Fehler in Korrekturen statt in Warnmeldungen. Das ist Noveum: jede Ausführung verfolgen, mit kalibrierten Scorern bewerten, künftige Abläufe simulieren, Live-Datenverkehr absichern und validierte Korrekturen als Pull Requests bereitstellen.

02 - Woran wir glauben

Die Prinzipien, auf denen das Produkt basiert.

Ein paar Überzeugungen prägen jede unserer Entscheidungen – in der Architektur, der Roadmap und den Worten auf dieser Seite.

KI-nativ, nicht nachgerüstet

Wir haben KI nicht nachträglich an ein APM-Tool angebaut. Tracing, Scoring, Simulation und Guardrails wurden von Anfang an für nichtdeterministische, mehrstufige Agenten mit Tool-Nutzung entwickelt, so wie sie sich im Produktivbetrieb tatsächlich verhalten.

Belege statt Bauchgefühl

Eine Korrektur ist nicht fertig, nur weil sie sich besser anfühlt. Sie wird mit dem begründenden Score und einer belastbaren Validierung bereitgestellt. So ist jede Änderung überprüfbar statt bloß behauptet.

Zuverlässigkeit ist ein Kreislauf

Dashboards zeigen, dass etwas ausgefallen ist. Wir schließen den Kreislauf aus Erkennen, Diagnostizieren, Beheben und Überprüfen kontinuierlich. So wächst die Zuverlässigkeit, statt zwischen Vorfällen abzunehmen.

Ihre Daten bleiben Ihr Eigentum

Betreiben Sie Noveum in unserer Cloud, in Ihrer VPC oder vollständig On-Premise mit Ihrem eigenen ClickHouse. SOC 2 Typ II (in Bearbeitung) und DSGVO. Ihre Traces müssen Ihren Sicherheitsbereich nie verlassen.

Offenheit als Standard

Unsere Tracing-SDKs sind Open Source und lassen sich mit wenigen Zeilen integrieren. Wir gewinnen Vertrauen lieber durch lesbaren Code als durch einen Lock-in, dem Sie nicht entkommen können.

Ehrlich bei unseren Messungen

Ein Backtest validiert einen einzelnen Aufruf, eine Simulation das Gesamtergebnis. Wir schreiben dem einen nie die Aussagekraft des anderen zu, weder im Produkt noch im Verkaufsgespräch oder auf dieser Seite.

03 - Was wir entwickeln

Ein geschlossener Kreislauf für die Agentenzuverlässigkeit.

Fünf Systeme umschließen jeden Agenten, den Sie bereitstellen. Jedes speist das nächste, gemeinsam verwandeln sie Produktionssignale in Korrekturen, die Sie zusammenführen können.

  1. 1

    Tracing

    Erfassen Sie jede Ausführung mit LLM-Aufrufen, Tools, RAG und Übergaben zwischen Agenten als strukturierten Trace.

  2. 2

    Evaluieren

    Bewerten Sie jede Ausführung mit 112 kalibrierten Scorern. Jeder liefert ein Ergebnis und die zugehörige Begründung.

  3. 3

    Simulieren

    Simulieren Sie vollständige Szenarien mit virtualisierten Tool-Aufrufen und validieren Sie das Gesamtergebnis statt nur einer Antwort.

  4. 4

    Absichern

    Setzen Sie Richtlinien für den Live-Verkehr durch und blockieren Sie fehlerhafte Ausgaben, bevor ein Benutzer sie sieht.

  5. 5

    Korrigieren

    Verwandeln Sie Fehler in Korrekturen, die pro Aufruf rückwirkend getestet, End-to-End simuliert und als Pull Requests bereitgestellt werden.

04 - Wo wir sind

Offen entwickelt, im Produktivbetrieb bewährt.

Wir liefern schnell und transparent. Auf diesem Fundament läuft Noveum bereits heute.

Open-Source-SDKs

noveum-trace für Python und TypeScript: Tracing für LangChain, LangGraph, LiveKit, Pipecat und CrewAI mit wenigen Codezeilen.

112 kalibrierte Scorer

Eine Bewertungsbibliothek mit 15 Kategorien, darunter 36 spezialisierte Sprach-Scorer. Jeder liefert einen Score und die dazugehörige Begründung.

Unternehmenstauglich

SOC 2 Typ II (in Bearbeitung) und DSGVO, ergänzt durch On-Premise- und BYO-ClickHouse-Deployments für Teams, die keine Daten nach außen übertragen dürfen.

Im großen Maßstab produktiv im Einsatz

Plattformen wie MyOperator führen KI-Sprachagenten auf Noveum aus – integriert in vier Codezeilen, kontinuierlich validiert.

Entwickeln Sie Agenten, denen Sie vertrauen können.

Starten Sie in wenigen Minuten mit dem Tracing oder sprechen Sie mit uns über ein Noveum-Deployment in Ihrer eigenen Umgebung. Außerdem suchen wir Menschen, die den nächsten Teil dieses Kreislaufs mit uns entwickeln.