Gast
#1428377
Das Problem: ich habe einen Haufen doppelte Dateien in zwei ähnlichen (aber nicht identischen) Verzeichnisbäumen. Teilweise sind identische Daten innerhalb desselben Pfades. Die Verzeichnisse enthalten jeweils ca. 15,000 Dateien (2 GB). findup (http://man.cx/fslint) erzeugt ein Listing von identischen Dateien aus zwei Verzeichnisbäumen: /usr/share/fslint/fslint/findup pfad1 pfad2 pfad1/datei1_1 pfad2/datei1_2 pfad1/datei2_1 pfad2/datei2_2 Ich möchte erstmal alle Dateien in pfad2 löschen, die auch in pfad1 vorkommen. Am Ende soll nur noch pfad1 existieren, mit allen 'einzigartigen' Dateien. Dazu könnte man alle Zeilen heraussuchen, die auf eine Zeile mit pfad1 folgen, die auf eine Leerzeile folgt. Dazu ist grep (http://man.cx/grep) wohl das Mittel der Wahl. Anschliessend diese Dateien löschen. Fragen: Ist das Vorgehen nachvollziehbar - gibt es einen besseren Weg? Wie lautet der reguläre Ausdruck? Irgendwas mit $.+pfad1.+\n.+pfad2