Hinweis öffnen
NEUIGKEIT · Die erneuerte Zenit-Programs-Website ist online – entdecken Sie die neue Oberfläche und die Dienste!

WeldExp-Datenbankentwicklung

Volle Kontrolle über die Daten

Schneller, kontrollierter Datenimport mit Codex, Excel-Vorlagen, GitHub-Validierungen und einer Testdatenbank.

Das manuelle Hochladen von Datenbanken ist zeitaufwendig und erfordert große Sorgfalt. Beim Befüllen der WeldExp-Datenbank erfolgen Datenextraktion, Strukturierung, Test und Prüfung daher in einem aufeinander aufbauenden, durch künstliche Intelligenz unterstützten Arbeitsablauf.

Aktueller Upload-Arbeitsablauf

  1. Auslesen der Daten und Quellenprüfung mit Unterstützung von Codex.
  2. Erstellen einer temporären Excel-Arbeitsmappe zur Datensammlung aus einer Vorlage, um die Daten übersichtlich zu strukturieren.
  3. Erstellen der SQL-Dateien und Markdown-Notizen und anschließendes Hochladen in das GitHub-Repository über MCP.
  4. Ausführen des Datenbank-Upload-Tests und der vorgeschriebenen Validierungen.

Das Testergebnis bestimmt den nächsten Schritt:

  • bei einem Validierungs- oder Datenstrukturfehler wird der Prozess mit einer Fehlermeldung gestoppt und die Korrektur in die durch Codex unterstützte Vorbereitungsphase zurückgeführt;
  • bei erfolgreichem Test kann nach der menschlichen Prüfung mit dem Produktiv-Upload begonnen werden.

Erstellen der Testdatenbank

Beim Upload auf GitHub kann die Testdatenbank auf zwei Arten entstehen:

  1. Bei einem Offline-Host aus einem auf GitHub manuell aktualisierten Seed-Paket, das eine Datenbanksicherung aus CSV- und SQL-Dateien enthält. Die Tests werden in diesem Fall von den Linux-Runnern des GitHub-Dienstes ausgeführt.
  2. Bei einem Online-Host aus einem automatisch aktualisierten Seed-Paket unter Verwendung der für die Produktivdatenbank konfigurierten API vor jeder neuen Upload-Aufgabe.

Automatisierung und menschliche Kontrolle

Die menschliche Prüfung darf nicht entfallen; dafür wird weiterhin ein übersichtliches Excel-Dokument benötigt. Ziel des Arbeitsablaufs ist ein schneller und kontrollierter Datenbank-Upload durch das gemeinsame Zusammenspiel der in der Datenbank definierten Triggerregeln, der Schemastruktur und der auf GitHub gespeicherten Validierungsverfahren.

Der Prozess wendet den aus ISO 9001 bekannten PDCA-Zyklus auf die maschinell unterstützte Datenverarbeitung und Kontrolle an: planen, ausführen, prüfen und bei Bedarf handeln.

Codex führt außerdem separate, erzwungene Gegenprüfungen durch, damit keine Daten ausgelassen werden und Tippfehler aufgrund ungenauer OCR-Auslesung oder Verarbeitungsgrenzen rechtzeitig erkannt werden.

Screenshots des Arbeitsablaufs

Die ersten beiden Bilder zeigen die auf GitHub festgehaltene Arbeitsanweisung zur Entwicklung des Upload-Prozesses.

Erster Teil der auf GitHub festgehaltenen WeldExp-Datenupload-Arbeitsanweisung
1. Arbeitsanweisung auf GitHub zur Entwicklung des Upload-Prozesses.
Zweiter Teil der auf GitHub festgehaltenen WeldExp-Datenupload-Arbeitsanweisung
2. Fortsetzung der Arbeitsanweisung auf GitHub zur Entwicklung des Upload-Prozesses.

Das dritte Bild zeigt die Validierung und den Datenbanktest, die beim GitHub-Upload vollständig automatisch ausgeführt werden.

Ergebnis der beim GitHub-Upload automatisch laufenden Validierung und des Datenbanktests
3. Beim GitHub-Upload automatisch laufende Validierung und Datenbanktest.

Das vierte Bild zeigt die Testfehler, die beim Upload in die Produktivdatenbank Probleme verursachen könnten.

Vom Datenbanktest gemeldete Fehler, die den Produktiv-Upload verhindern
4. Vom Datenbanktest gemeldete Fehler, die den Produktiv-Upload verhindern.