Über Noveum
Zuverlässigkeitsinfrastruktur für das Agentenzeitalter.
Noveum ist die KI-native Plattform, mit der Teams ihre produktiv eingesetzten Agenten zuverlässig halten: Sie verfolgen jede Ausführung, bewerten sie mit kalibrierten Scorern, simulieren künftige Abläufe, sichern Live-Datenverkehr ab und stellen validierte Korrekturen als Pull Requests bereit. Ein kontinuierlicher Kreislauf statt einer Wand aus Diagrammen.
Open-Source-SDKs · SOC 2 Typ II (in Bearbeitung) · On-Premise und BYO ClickHouse
5
Produkte, ein Kreislauf
112
Kalibrierte Scorer
15
Scorer-Kategorien
4-zeilig
SDK-Integration
01 - Warum Noveum entstand
Einen Agenten bereitzustellen ist einfach. Ihn zuverlässig zu halten nicht.
Noveum entstand aus einer Frustration, die jedes Team beim Aufbau mit LLMs irgendwann erlebt: Einen Agenten in einer Demo zum Laufen zu bringen dauert einen Nachmittag. Ihn im Produktivbetrieb zuverlässig zu halten dauert eine Ewigkeit. Die dafür vorgesehenen Werkzeuge wurden für eine Welt entwickelt, die nicht mehr existiert.
Klassische Observability setzt deterministische Software voraus: gleiche Eingabe, gleiche Ausgabe und ein Stack Trace, wenn etwas ausfällt. KI-Agenten sind das Gegenteil. Sie durchlaufen zahlreiche Schritte, rufen Tools und andere Agenten auf, und „falsch“ bedeutet nur selten einen Absturz. Häufig ist es eine selbstsichere, plausibel wirkende Antwort, die unbemerkt am Bedarf des Nutzers vorbeigeht. APM-Dashboards erkennen das nicht. Protokolle erklären es nicht. Und niemand kann genügend Traces von Hand lesen, um Problemen stets zuvorzukommen.
Deshalb haben wir eine von Grund auf KI-native Zuverlässigkeitsschicht entwickelt. Sie behandelt Evaluierungen als Signal erster Klasse, rekonstruiert und simuliert reale Szenarien und verwandelt Fehler in Korrekturen statt in Warnmeldungen. Das ist Noveum: jede Ausführung verfolgen, mit kalibrierten Scorern bewerten, künftige Abläufe simulieren, Live-Datenverkehr absichern und validierte Korrekturen als Pull Requests bereitstellen.
02 - Woran wir glauben
Die Prinzipien, auf denen das Produkt basiert.
Ein paar Überzeugungen prägen jede unserer Entscheidungen – in der Architektur, der Roadmap und den Worten auf dieser Seite.
KI-nativ, nicht nachgerüstet
Wir haben KI nicht nachträglich an ein APM-Tool angebaut. Tracing, Scoring, Simulation und Guardrails wurden von Anfang an für nichtdeterministische, mehrstufige Agenten mit Tool-Nutzung entwickelt, so wie sie sich im Produktivbetrieb tatsächlich verhalten.
Belege statt Bauchgefühl
Eine Korrektur ist nicht fertig, nur weil sie sich besser anfühlt. Sie wird mit dem begründenden Score und einer belastbaren Validierung bereitgestellt. So ist jede Änderung überprüfbar statt bloß behauptet.
Zuverlässigkeit ist ein Kreislauf
Dashboards zeigen, dass etwas ausgefallen ist. Wir schließen den Kreislauf aus Erkennen, Diagnostizieren, Beheben und Überprüfen kontinuierlich. So wächst die Zuverlässigkeit, statt zwischen Vorfällen abzunehmen.
Ihre Daten bleiben Ihr Eigentum
Betreiben Sie Noveum in unserer Cloud, in Ihrer VPC oder vollständig On-Premise mit Ihrem eigenen ClickHouse. SOC 2 Typ II (in Bearbeitung) und DSGVO. Ihre Traces müssen Ihren Sicherheitsbereich nie verlassen.
Offenheit als Standard
Unsere Tracing-SDKs sind Open Source und lassen sich mit wenigen Zeilen integrieren. Wir gewinnen Vertrauen lieber durch lesbaren Code als durch einen Lock-in, dem Sie nicht entkommen können.
Ehrlich bei unseren Messungen
Ein Backtest validiert einen einzelnen Aufruf, eine Simulation das Gesamtergebnis. Wir schreiben dem einen nie die Aussagekraft des anderen zu, weder im Produkt noch im Verkaufsgespräch oder auf dieser Seite.
03 - Was wir entwickeln
Ein geschlossener Kreislauf für die Agentenzuverlässigkeit.
Fünf Systeme umschließen jeden Agenten, den Sie bereitstellen. Jedes speist das nächste, gemeinsam verwandeln sie Produktionssignale in Korrekturen, die Sie zusammenführen können.
- 1
Tracing
Erfassen Sie jede Ausführung mit LLM-Aufrufen, Tools, RAG und Übergaben zwischen Agenten als strukturierten Trace.
- 2
Evaluieren
Bewerten Sie jede Ausführung mit 112 kalibrierten Scorern. Jeder liefert ein Ergebnis und die zugehörige Begründung.
- 3
Simulieren
Simulieren Sie vollständige Szenarien mit virtualisierten Tool-Aufrufen und validieren Sie das Gesamtergebnis statt nur einer Antwort.
- 4
Absichern
Setzen Sie Richtlinien für den Live-Verkehr durch und blockieren Sie fehlerhafte Ausgaben, bevor ein Benutzer sie sieht.
- 5
Korrigieren
Verwandeln Sie Fehler in Korrekturen, die pro Aufruf rückwirkend getestet, End-to-End simuliert und als Pull Requests bereitgestellt werden.
04 - Wo wir sind
Offen entwickelt, im Produktivbetrieb bewährt.
Wir liefern schnell und transparent. Auf diesem Fundament läuft Noveum bereits heute.
Open-Source-SDKs
noveum-trace für Python und TypeScript: Tracing für LangChain, LangGraph, LiveKit, Pipecat und CrewAI mit wenigen Codezeilen.
112 kalibrierte Scorer
Eine Bewertungsbibliothek mit 15 Kategorien, darunter 36 spezialisierte Sprach-Scorer. Jeder liefert einen Score und die dazugehörige Begründung.
Unternehmenstauglich
SOC 2 Typ II (in Bearbeitung) und DSGVO, ergänzt durch On-Premise- und BYO-ClickHouse-Deployments für Teams, die keine Daten nach außen übertragen dürfen.
Im großen Maßstab produktiv im Einsatz
Plattformen wie MyOperator führen KI-Sprachagenten auf Noveum aus – integriert in vier Codezeilen, kontinuierlich validiert.
Entwickeln Sie Agenten, denen Sie vertrauen können.
Starten Sie in wenigen Minuten mit dem Tracing oder sprechen Sie mit uns über ein Noveum-Deployment in Ihrer eigenen Umgebung. Außerdem suchen wir Menschen, die den nächsten Teil dieses Kreislaufs mit uns entwickeln.
