Newsletter abonnieren

Lies uns auf...

Folge LinuxCommunity auf Twitter

Top-Beiträge

Eingedost
(161 Punkte bei 4 Stimmen)
Aufteiler
(161 Punkte bei 4 Stimmen)

Heftarchiv

LinuxUser Heftarchiv

EasyLinux Heftarchiv

Ubuntu User Heftarchiv

Ubuntu User Heftarchiv

Partner-Links:

Das B2B Portal www.Linx.de informiert über Produkte und Dienstleistungen.

GNU parallel in Aktion
GNU parallel in Aktion

Dateien schneller packen und konvertieren mit GNU parallel

→ Zum Tipp-Archiv...

Wer viele Dateien in einem Verzeichnis komprimieren oder konvertieren möchte, kann das auf der Shell mit einer Schleife machen:

for i in *; do gzip $i; done 

Dieses Beispiel komprimiert nacheinander alle Dateien mit gzip. Um die Auflösung (also die Abmessungen) aller Bilder mit der Endung .png um 50 Prozent zu verkleinern, kann man zum Werkzeug mogrify aus dem ImageMagick-Paket greifen (unter Ubuntu 12.10 im Paket imagemagick):

for i in *.png; do mogrify -resize 50% $i; done 

Beide Lösungen haben jedoch die unangenehme Eigenschaft, dass sie jede Datei nacheinander behandeln. Oder mit anderen Worten: Je mehr Dateien im Verzeichnis liegen, desto länger dauert der gesamte Vorgang.

Die Kompression oder Umwandlung könnte man beschleunigen, indem man mehrere Dateien gleichzeitig einpacken beziehungsweise bearbeiten lässt. Damit würde dann auf modernen Prozessoren auch nicht nur ein Rechnenkern beschäftigt, während die anderen Däumchen drehen.

Je mehr Dateien zu verarbeiten sind, desto deutlicher sind die Unterschiede zwischen einer Schleife und der parallelen Verarbeitung..

Je mehr Dateien zu verarbeiten sind, desto deutlicher sind die Unterschiede zwischen einer Schleife und der parallelen Verarbeitung.

Genau hier springt das kleine Programm parallel ein, das alle großen Distributionen in ihren Repositories anbieten. Unter Ubuntu 12.10 steckt es beispielsweise im Paket parallel. Das Werkzeug startet einfach einen Befehl mehrfach. Alle Informationen, mit denen man parallel über die Standardeingabe füttert, reicht es an die von ihm gestarteten Befehle weiter. Klingt kompliziert, ist in der Praxis aber ganz einfach. Um alle Dateien im aktuellen Verzeichnis parallel verpacken zu lassen, ruft man einfach folgenden Befehl auf:

ls | parallel gzip

Die gepackten Dateien muss man nicht alle wieder einzeln auspacken. Stattdessen hilft auch hier wieder parallel:

ls | parallel gunzip

In beiden Fällen startet parallel gleich mehrfach gzip beziehungsweise gunzip und setzt die Bande dann auf die von ls herübergereichten Dateinamen an.

Nach dem gleichen Prinzip skaliert der folgende Befehl die Auflösung aller Bilder mit der Endung .png um die Hälfte herunter:

ls *.png | parallel mogrify -resize 50%

Die wesentlichen limitierenden Faktoren sind hier nur noch die Geschwindigkeit der Festplatte und die Anzahl der Prossorkerne.

Bookmark and Share

Kommentare
do not parse ls
norbert (unangemeldet), Donnerstag, 29. November 2012 15:50:49
Ein/Ausklappen

Siehe Überschrift. Den Output von ls zu parsen ist die schlechteste idee ever. Und wenn es nur ein Beispiel war, dann ein schlechtes. So lehrt man User, Bugs zu bauen.
näheres dazu: http://mywiki.wooledge.org/ParsingLs


Bewertung: 155 Punkte bei 26 Stimmen.
Den Beitrag bewerten: Gut / Schlecht
-
Re: do not parse ls
Kai (unangemeldet), Donnerstag, 29. November 2012 22:48:51
Ein/Ausklappen

Nein, nicht pauschal. Es kommt darauf an, was nach dem Pipe mit den Dateinamen passiert.

"ls" wird übrigens auch in der offiziellen parallel-Dokumentation als Beispiel genannt.

Auf Nummer sicher gehen kann man mit den doppelt geschweiften klammern:

ls | parallel befehl {}




Bewertung: 245 Punkte bei 18 Stimmen.
Den Beitrag bewerten: Gut / Schlecht
Achtung - systemlast
Ulf B., Dienstag, 20. November 2012 19:51:21
Ein/Ausklappen

Hallo,

nettes Progrämmchen, man sollte es allerdings mit bedacht einsetzten.

Zum einen bringt es nur etwas bei Hyberthreding und Mehrkern-CPUs und zum anderen kann man damit einen PC (je nach Kernel) quasi lahmlegen. und zwar wenn man mindestens so viele Tasks wie CPU Kerne (auch Hyberthredding) hat. Dieses tritt dann auf, wenn man den Prozess startet und zeitweise wenig z.B. auf dem Desktop tut. Denn nach einiger Zeit ordnet Linux den Prozessen mit hoher Last höhere Resourcen (RAM und CPU zeit zu). Dann sollte man die Priorität der Tasks herunter stufen - damit das nicht so gravierend auftritt.

Gruß
Ulf


Bewertung: 142 Punkte bei 26 Stimmen.
Den Beitrag bewerten: Gut / Schlecht
-
Re: Achtung - systemlast
mandri (unangemeldet), Donnerstag, 22. November 2012 21:07:07
Ein/Ausklappen

Haben die Macher auch bemerkt:
http://www.linux-community....hrichten/GNU-Parallel-20121122


Bewertung: 196 Punkte bei 18 Stimmen.
Den Beitrag bewerten: Gut / Schlecht

Kommentare
do not parse ls
norbert (unangemeldet), Donnerstag, 29. November 2012 15:50:49
Ein/Ausklappen
-
Re: do not parse ls
Kai (unangemeldet), Donnerstag, 29. November 2012 22:48:51
Ein/Ausklappen

Nein, nicht pauschal. Es kommt darauf an, was nach dem Pipe mit den Dateinamen passiert.

"ls" wird übrigens auch in der offiziellen parallel-Dokumentation als Beispiel genannt.

Auf Nummer sicher gehen kann man mit den doppelt geschweiften klammern:

ls | parallel befehl {}




Bewertung: 245 Punkte bei 18 Stimmen.
Den Beitrag bewerten: Gut / Schlecht

Tipp der Woche

Bilder vergleichen mit diffimg
Bilder vergleichen mit diffimg
Tim Schürmann, 01.04.2014 12:40, 1 Kommentare

Das kleine Werkzeug diffimg kann zwei (scheinbar) identische Bilder miteinander vergleichen und die Unterschiede optisch hervorheben. Damit lassen sich nicht nur Rätsel a la „Orignial und Fäls...

290 Hits
Wertung: 245 Punkte (18 Stimmen)

Aktuelle Fragen

programm suche
Hans-Joachim Köpke, 13.04.2014 10:43, 8 Antworten
suche noch programme die zu windows gibt, die auch unter linux laufen bzw sich ähneln sozusagen a...
Funknetz (Web-Stick)
Hans-Joachim Köpke, 04.04.2014 07:31, 2 Antworten
Bei Windows7 brauche ich den Stick nur ins USB-Fach schieben dann erkennt Windows7 Automatisch, a...
Ubuntu 13.10 überschreibt immer Windows 8 Bootmanager
Thomas Weiss, 15.03.2014 19:20, 8 Antworten
Hallo Leute, ich hoffe das ich richtig bin. Ich habe einen Dell Insipron 660 Ich möchte gerne Ub...
USB-PTP-Class Kamera wird nicht erkannt (Windows-only)
Wimpy *, 14.03.2014 13:04, 15 Antworten
ich habe meiner Frau eine Digitalkamera, AGFA Optima 103, gekauft und wir sind sehr zufrieden dam...
Treiber
Michael Kristahn, 12.03.2014 08:28, 5 Antworten
Habe mir ein Scanner gebraucht gekauft von Canon CanoScan LiDE 70 kein Treiber wie bekomme ich de...

Jetzt auf den Mailinglisten

Re: [EasyLinux-Ubuntu] Partitionen ändern [gelöst]
Heiko Ißleib, 18.04.2014 04:52
Am 17.04.2014, 21:58 Uhr, schrieb Joachim Puttkammer : > Am Donnerstag, 17. April 2014 schrieb Hartmut Haa...
Re: [EasyLinux-Ubuntu] Partitionen_ändern_[gelöst]
Joachim Puttkammer, 17.04.2014 21:58
Am Donnerstag, 17. April 2014 schrieb Hartmut Haase: noch eine Frage (z.Z. läuft hier Win7 in der VBox,...
Re: [EasyLinux-Ubuntu] Partitionen_ändern_[gelöst]
Hartmut Haase, 17.04.2014 19:36
Hallo Joachim, >> meine Festplatte ist so aufgeteilt: P1, P2, P3 + E. In P1 befindet sich >> XP...
[EasyLinux-Suse] tftp- get geht nicht
Edgar Dombrowski, 17.04.2014 16:29
Hallo, Linuxer. Ich benutze (noch) OS 12.3 und habe mir die Datei "tftp" installiert. Ich will nu...
Re: [EasyLinux-Ubuntu] Frohe Ostern
Uwe Herrmuth, 17.04.2014 16:21
Hallo Allerseits, H.-Ste. Neumeyer schrieb am 16.04.2014 um 09:58: > der Betreff sagt schon alles! >...