Process Mining Daten selbst generieren
Smart Data Forge ist das Tool, mit dem du dir deine Process-Mining-Daten selbst baust: Tabellen, Schlüssel, Zeitstempel, kausale Ketten, gezielte Abweichungen und deren Geschäftsfolgen — fertig als DDL- und INSERT-Skripte für PostgreSQL, SQL Server, MySQL oder Oracle. Du öffnest es und legst los.
Ein Demo-Datensatz aus Zufallsrauschen beweist nichts. „20 % aller Fälle haben Rework“ ist keine Erkenntnis, sondern ein Zufallsgenerator mit Prozentzeichen. Interessant wird es erst, wenn die Daten eine bekannte Ursache tragen: Lieferanten der Gruppe C liefern bei kritischem Material häufiger ab — daraus entsteht Prüfverzug, daraus ein Rechnungsblock, daraus eine Zahlung nach Skontofrist.
Genau das baust du hier: Du legst die Ground Truth vorher fest, erzeugst die Daten dazu und prüfst anschließend, ob Noreja die Ursache findet. Damit wird aus einer Demo ein Test — mit einer Antwort, die du vorher kennst.
Läuft vollständig lokal im Browser. Keine Installation, kein Server, keine Datenübertragung.
Ground Truth statt Zufall
Ursache, betroffene Dimension, Prozesswirkung, Fehlermuster und Business Outcome stehen fest, bevor die erste Zeile erzeugt wird.
Objekte statt flachem Log
Bestellung, Lieferung, Prüfung, Rechnung, Zahlung — mit echten 1:N- und N:1-Beziehungen, Verzweigungen und Joins statt einer einzigen Ereignisspalte.
Reproduzierbar per Seed
Ein fester Seed liefert denselben Datensatz erneut. Demos laufen jedes Mal identisch, Tests bleiben vergleichbar.
Prüfbares Ergebnis
Weil die Ursache bekannt ist, lässt sich messen, ob eine Analyse sie findet — statt nur zu zeigen, dass irgendetwas auffällt.
Was der Generator kann
Sieben Schritte, von der Tabelle bis zum Sammellauf. Jeder davon ist im Tool ein eigener Bereich.
01 · Define Tables
Geschäftsobjekte, Dimensionen und Historien: Primary Key, Foreign Keys, primärer Zeitstempel, weitere Zeitstempel, Properties und Status-Spalten.
02 · Generate DDL
Das passende Datenbankschema für PostgreSQL, SQL Server, MySQL oder Oracle — auf Wunsch als DROP + CREATE für Testumgebungen.
03 · Causal Chain
Die Prozesskette: Reihenfolge, Zeitabstände und -verteilungen, Kardinalitäten, AND-/XOR-Logik, Zeittrends, Fallzahl, Zeitraum und Seed.
04 · Special Behaviour
Gezielte Abweichungen: Overjump, Wrong Order, Rework und Abort — auch bedingt, sodass eine Property Timing, Wahrscheinlichkeit oder Attribute beeinflusst.
05 · Column Values
Werte und Verteilungen für Lieferantengruppe, Warengruppe, Werk, Betrag, Menge, Region oder Risikoklasse — jede Property mit analytischem Zweck.
06 · Generate Data
Erst klein zum Prüfen, dann voll: INSERT-Skripte zum Herunterladen und Einspielen in die Zieldatenbank.
07 · Bündelung / Batching
Im Expertenmodus: feste Prüftermine, Kapazität, Rückstau, Sammelläufe und der Durchschlag einer Verzögerung bis in den Skontoverlust.
In drei Schritten zum Datensatz
E-Mail eintragen
Der Generator öffnet sich direkt hier auf der Seite — in voller Größe, sofort nutzbar. Wer lieber offline arbeitet, lädt ihn zusätzlich herunter und startet ihn lokal.
Datei der KI geben
Lade das Tool zusätzlich in ChatGPT, Claude oder Gemini hoch. Die KI sieht damit die tatsächlich vorhandenen Felder deiner Version und führt dich vom Kundenproblem über Hypothese und Ground Truth Schritt für Schritt durch die Konfiguration.
Erzeugen, laden, prüfen
Daten generieren, in die Datenbank einspielen, in Noreja analysieren — und gegen die eingebaute Ursache prüfen. Die Konfiguration lässt sich als JSON speichern, wieder laden und von der KI gegen die Ground Truth reviewen.
Auf einen Blick
Generator öffnen
Einmal E-Mail eintragen, dann öffnest du das Tool mit einem Klick. Der Zugang bleibt in diesem Browser bestehen.
Smart Data Forge freischalten
Trag deine E-Mail-Adresse ein — danach öffnest du das Tool mit einem Klick direkt hier auf der Seite.
Wir nutzen deine Adresse für den Zugang und gelegentliche Produktneuigkeiten. Abmeldung jederzeit möglich. Mehr dazu in der Datenschutzerklärung.
Häufige Fragen
Was ist Noreja Smart Data Forge?
Smart Data Forge ist ein Tool, mit dem du synthetische Process-Mining-Daten selbst erzeugst; es läuft vollständig im Browser. Du definierst darin Tabellen und Beziehungen, eine kausale Prozesskette, gezielte Abweichungen wie Overjump, Wrong Order, Rework oder Abort sowie Werteverteilungen für die Properties. Als Ergebnis erzeugt das Tool DDL- und INSERT-Skripte für PostgreSQL, SQL Server, MySQL oder Oracle.
Wofür brauche ich synthetische Prozessdaten?
Für Demos, Schulungen, Proof of Concepts und Tests, bei denen echte Kundendaten nicht verwendet werden dürfen oder noch nicht verfügbar sind. Weil die Ursache bewusst eingebaut wird, lässt sich außerdem prüfen, ob eine Analyse sie wiederfindet — das geht mit echten Daten nur selten, weil dort niemand die Wahrheit sicher kennt.
Was bedeutet Ground Truth in diesem Zusammenhang?
Ground Truth ist die Ursache, die absichtlich in die Daten eingebaut wird, zusammen mit ihrer Wirkung: betroffene Dimension, veränderter Prozessschritt, entstehendes Fehlermuster und der daraus folgende Business Outcome. Eine gute Ground Truth lässt sich nicht an einer Spalte ROOT_CAUSE ablesen, sondern muss sich aus Beziehungen, Zeitverhalten, Properties und Vergleichsgruppen erschließen.
Verlassen meine Eingaben den Rechner?
Nein. Das Tool läuft vollständig im Browser und macht keine Netzwerkaufrufe: Konfiguration und erzeugte Skripte bleiben auf deinem Rechner, Downloads werden lokal erstellt. Für den Zugang wird lediglich eine E-Mail-Adresse abgefragt.
Welche Datenbanken werden unterstützt?
Der DDL-Export der bereitgestellten Version unterstützt PostgreSQL, SQL Server, MySQL und Oracle. Für Testumgebungen kann zusätzlich der Modus DROP + CREATE genutzt werden, der vorhandene Tabellen ersetzt.
Wie arbeitet der AI Coach mit dem Generator zusammen?
Du lädst das Tool in eine KI wie ChatGPT, Claude oder Gemini hoch. Die KI kann damit die tatsächlich vorhandenen Felder lesen und führt dich in der Rolle eines Coaches vom Geschäftsproblem über Hypothese und Ground Truth bis zur konkreten Einstellung jedes einzelnen Generator-Schritts. Die gespeicherte JSON-Konfiguration kannst du der KI anschließend zur Prüfung gegen die Ground Truth geben.
Was kostet der Zugang?
Nichts. Der Generator ist nach der Eingabe einer E-Mail-Adresse frei nutzbar und kann zusätzlich heruntergeladen und lokal weiterverwendet werden.
Von den Testdaten zur echten Analyse — sprich mit uns
Schließe dich Unternehmen an, die mit intelligenter Prozessanalyse Wachstum und Effizienz neu definieren.
