Große Datenbanken abgeleichen
Budget: €250 – €750 EUR
Wir haben zwei CSV Dateien.
In beiden Dateien gibt es jeweils ca. 5 Millionen Reihen.
Unser Ziel ist es, dass alle feature_id aus Datei 2 mit den feature_ids aus Datei 1 abgeglichen werden.
Gibt es Dopplungen, wird die Zeile in Datei 2 gelöscht. Am Ende sollen in Datei 2 nur noch die Zeilen mit feature_ids verbleiben, die NICHT in Datei 1 zu finden waren.
In beiden Dateien gibt es jeweils ca. 5 Millionen Reihen.
Unser Ziel ist es, dass alle feature_id aus Datei 2 mit den feature_ids aus Datei 1 abgeglichen werden.
Gibt es Dopplungen, wird die Zeile in Datei 2 gelöscht. Am Ende sollen in Datei 2 nur noch die Zeilen mit feature_ids verbleiben, die NICHT in Datei 1 zu finden waren.