abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 18:11 | Nová verze

    Byla vydána nová verze 5.1 svobodného 3D softwaru Blender. Přehled novinek i s náhledy a videi v poznámkách k vydání. Videopředstavení na YouTube.

    Ladislav Hagara | Komentářů: 0
    dnes 04:55 | Nová verze

    Bylo oznámeno vydání nové verze 8.1 "Hoare" kolekce svobodného softwaru umožňujícího nahrávání, konverzi a streamovaní digitálního zvuku a obrazu FFmpeg (Wikipedie). Doprovodný příspěvek na blogu Khronosu rozebírá kódování a dekódování videa pomocí Vulkan Compute Shaders v FFmpeg.

    Ladislav Hagara | Komentářů: 5
    dnes 04:33 | Zajímavý projekt

    Byl představen open-source a open-hardware prototyp nízkonákladového raketometu kategorie MANPADS, který byl sestaven z běžně dostupné elektroniky a komponent vytištěných na 3D tiskárně. Raketa využívá skládací stabilizační křidélka a canardovou stabilizaci aktivně řízenou palubním letovým počítačem ESP32, vybaveným inerciální měřicí jednotkou MPU6050 (gyroskop a akcelerometr). Přenosné odpalovací zařízení obsahuje GPS,

    … více »
    NUKE GAZA! 🎆 | Komentářů: 32
    včera 14:22 | IT novinky

    Vědci z univerzity La Sapienza v Římě vyvinuli systém, který dokáže identifikovat jednotlivce pouze na základě toho, jak narušují signály Wi-Fi. Autoři tuto novou technologii nazvali WhoFi. Na rozdíl od tradičních biometrických systémů, jako jsou skenery otisků prstů a rozpoznávání obličeje, nevyžaduje tato metoda přímý fyzický kontakt ani vizuální vstupy. WhoFi může také sledovat jednotlivce na větší ploše než kamera s pevnou polohou; stačí, je-li k dispozici Wi-Fi síť.

    Ladislav Hagara | Komentářů: 11
    včera 04:22 | Nová verze

    SuperTux (Wikipedie), tj. klasická 2D plošinovka inspirovaná sérií Super Mario, byl vydán v nové verzi 0.7.0. Videoukázka na YouTube. Hrát lze i ve webovém prohlížeči.

    Ladislav Hagara | Komentářů: 7
    včera 03:11 | Zajímavý projekt

    Ageless Linux je linuxová distribuce vytvořená jako politický protest proti kalifornskému zákonu o věkovém ověřování uživatelů na úrovni OS (AB 1043). Kromě běžného instalačního obrazu je k dispozici i konverzní skript, který kompatibilní systém označí za Ageless Linux a levné jednodeskové počítače v ceně 12$ s předinstalovaným Ageless Linuxem, které se chystají autoři projektu dávat dětem. Ageless Linux je registrován jako operační

    … více »
    NUKE GAZA! 🎆 | Komentářů: 9
    15.3. 15:33 | Humor

    PimpMyGRC upravuje vzhled toolkitu GNU Radio a přidává alternativní barevná témata. Primárním cílem autora bylo pouze vytvořit tmavé prostředí vhodné pro noční práci, nicméně k dispozici je nakonec celá škála barevných schémat včetně možností různých animací a vizuálních efektů (plameny, matrix, bubliny...), které nepochybně posunou uživatelský zážitek na zcela jinou úroveň. Témata jsou skripty v jazyce Python, které nahrazují

    … více »
    NUKE GAZA! 🎆 | Komentářů: 3
    15.3. 14:33 | Nová verze Ladislav Hagara | Komentářů: 4
    15.3. 12:33 | Zajímavý projekt

    FRANK OS je open-source operační systém pro mikrokontrolér RP2350 (s FRANK M2 board) postavený na FreeRTOS, který přetváří tento levný čip na plně funkční počítač s desktopovým uživatelským rozhraním ve stylu Windows 95 se správcem oken, terminálem, prohlížečem souborů a knihovnou aplikací, ovládaný PS/2 myší a klávesnicí, s DVI video výstupem. Otázkou zůstává, zda by 520 KB SRAM stačilo každému 😅.

    NUKE GAZA! 🎆 | Komentářů: 5
    14.3. 22:55 | IT novinky

    Administrativa amerického prezidenta Donalda Trumpa by měla dostat zhruba deset miliard dolarů (asi 214 miliard Kč) za zprostředkování dohody o převzetí kontroly nad aktivitami sociální sítě TikTok ve Spojených státech.

    Ladislav Hagara | Komentářů: 2
    Které desktopové prostředí na Linuxu používáte?
     (16%)
     (7%)
     (0%)
     (11%)
     (29%)
     (2%)
     (5%)
     (1%)
     (13%)
     (24%)
    Celkem 1098 hlasů
     Komentářů: 27, poslední dnes 19:26
    Rozcestník

    Unixové nástroje – 9 (sed – nahrazování textu)

    17. 2. 2010 | David Watzke | Návody | 46698×

    V tomto díle se naučíme základy pokročilé editace textu (se zaměřením na nahrazování, tedy příkaz „s“) pomocí editoru sed.

    sed slouží k parsování a neinteraktivní úpravě textových souborů. Název je zkratkou stream editor, což znamená editor (textových) proudů.

    Existuje více implementací sedu. Nejdříve si popíšeme standardní sed, jak je popsán v SUS a potom si povíme o některých rozšířeních GNU implementace.

    Sed implementuje celý programovací jazyk sloužící k automatizaci úpravy textu. Pochopitelně zde nebudu rozebírat veškeré možnosti, protože to by vydalo na pěkně dlouhý specializovaný seriál. Zabývat se budu pouze možnostmi nahrazování textu.

    Nejčastější použití vypadá následovně:

    sed -e "s/původní výraz/nahrazující řetězec/" soubor.txt > upraveny_soubor.txt
    

    Tento příkaz projde soubor.txt řádek po řádku a první výskyt (na každém řádku) řetězce „původní výraz“ nahradí za „nahrazující řetězec“ a upravené řádky vypíše. Pokud „původní výraz“ nenajde, řádek je vypsán přesně tak, jak je v původním souboru. Jak vidíte, přepínač -e bere jako argument tzv. skript sedu (přímo jeho kód, ne soubor). Přepínačů -e můžete zadat více najednou. Nezadáte-li soubor, který má být upraven, program bude čekat na standardní vstup. To znamená, že mu lze předat výstup jiného programu:

    # vypíše „pes“
    echo koc | sed -e s/c/cka/ -e s/kocka/pes/
    

    Jdu na to rychle? Vysvětlím. Ve výrazu „koc“ se dle prvního předpisu nahradí „c“ za „cka“, vznikne tedy „kocka“. Podle druhého předpisu se pak nahradí "kocka" za „pes“. To už se ovšem opakuji, takže si ukážeme něco nového. Zkusme toto:

    sed -e "/and/ s/||/or/g" soubor.cpp
    

    Výraz /and/ je podmínka, která zapříčiní, že nahrazení „||“ za „or“ se provede pouze na řádcích, které obsahují výraz „and“. Písmeno „g“ za posledním lomítkem znamená, že se nenahradí pouze první výskyt „||“ na daném řádku, ale všechny výskyty. Těmto písmenům se říká „modifikátory“ (modifiers).

    Nyní si představíme přepínač -n, modifikátor „p“ a negaci podmínky (!).

    sed -n -e '/treti/!s/prvni/druhy/gp' soubor.txt
    

    Přepínač -n potlačí výpis řádků, které pro výpis nebyly explicitně označeny. Znegovaná podmínka se chová tak, jak by člověk očekával, takže se bude nahrazovat pouze na řádcích, které neobsahují výraz „treti“. Na takových řádcích se nahradí všechny výskyty řetězce „prvni“ za „druhy“ (modifikátor „g“) a také se pouze tyto odpovídající změněné řádky vypíšou, a to díky modifikátoru „p“, který k tomuto účelu (explicitní označení řádků pro výpis) slouží.

    Poslední standardní přepínač je -f, který se používá místo -e tehdy, máme-li sedový skript uložený v souboru. Mějme soubor html.sed, který mimochodem v praxi skutečně používám (např. při psaní článků pro AbcLinuxu), s následujícím obsahem:

    s/&/\&/g
    s/</\&lt;/g
    s/>/\&gt;/g
    

    Jednotlivé řádky zde obsahují to, co bych jinak musel předávat sedu přes přepínač -e. Konkrétně jde o nahrazení znaků nacházejících se v kódu C++ patřičnými HTML entitami. Nyní mi stačí, abych spustil:

    sed -f html.sed zdrojak.cpp >> clanek.html
    

    Upravený obsah souboru zdrojak.cpp se tímto připíše na konec souboru clanek.html.

    Sluší se ještě dodat, že přepínače -e-f lze libovolně kombinovat a opakovat a jimi dané skripty se interpretují postupně v pořadí, ve kterém byly zadány.

    GNU verze sedu se liší v mnoha ohledech. Dodržuje standard, ale implementuje další věci, z nichž mezi nejdůležitější patří přepínač -i (editace „na místě“) a podpora rozšířených regulárních výrazů pomocí -r.

    sed -i -r -e "/^[[:alpha:]]/ s/[0-9]+/cisla/g" soubor.txt
    

    Co provádí tento záhadný příkaz? Přepínač -i zajistí, že změny se provedou přímo v daném souboru soubor.txt, a nic se nebude vypisovat. Přepínač -r povolí rozšířené regulární výrazy, což umožní např. zápis ([0-9]+){3,} bez nutnosti escapovat výraz, tj. přidávat před všechny složené/kulaté závorky, otazníky a plusy zpětné lomítko; \([0-9]\+\)\{3,\}. Samotný skript nahradí všechny libovolně dlouhé sekvence číslic ([0-9]+) za řetězec „cisla“ na řádcích, které začínají (^) nějakým znakem abecedy ([[:alpha:]]). Další (jednodušší) příklad:

    # na konec každého řádku přidá tečku
    sed s/$/./
    

    Další zajímavou věcí jsou reference. Ty se používají v kombinaci s regulárními výrazy. Reference je vlastně něco jako proměnná. Váš regulární výraz označí nějaký text, ten se uloží do zvláštní proměnné a vy ji pak můžete použít v nahrazujícím výrazu. Hodí se to, například když chcete udělat nějakou změnu před a zároveň za nalezeným výrazem. Na příkladu to bude zřejmější. Zkusíme všechna čísla ve výrazu ohraničit hranatými závorkami. Místo 1 bude po provedení [1].

    sed -r -e "s/([0-9]+)/[\1]/g" << EOF
    text, číslo: 500, jiný text, 200, 50x
    abc100xyz
    EOF
    

    Jen pro úplnost nejdříve dodám, že zelená část je přesměrování shellu a s programem nijak nesouvisí. Je to jen způsob, jak programu předat nějaký text na vstup. K věci: Červená část je regulární výraz, který označí to, co potřebujeme – sekvenci číslic. Normálně by nemusel být v závorce, jenže chceme-li použít referenci, tak je to třeba. Samotná reference se vloží pomocí zpětného lomítka a pořadového čísla reference. Referencí může být více. Číslování začíná od 1. Ukážeme si ještě jeden příklad s více referencemi.

    sed -r -e "s/([0-9]+)[[:space:]]+([[:alpha:]]+)/\2 \1/g"
    

    Kdekoliv se v textu vyskytne číslo před slovem, tento příkaz je prohodí tak, že ve výsledku bude nejdříve slovo a potom číslo. Tzn. třeba 100 brambor se změní na brambor 100.

    Užitečný je také modifikátor „n“, přičemž n je celé číslo, které programu řekne, kolikátý výskyt daného původního řetězce se má na každém řádku změnit. Předvedeme si to na tom, co už známe:

    sed -r -e "s/([0-9]+)/[\1]/2" << EOF
    123 456 789
    1 2 3
    EOF
    

    Výstupem je toto:

    123 [456] 789
    1 [2] 3
    

    Nestandardním modifikátorem, který je dostupný v GNU sedu, je „i“. Zapne tzv. case insensitive režim. To znamená, že v původním výrazu nezáleží na velikosti písmen. Ještě se sluší dodat, že modifikátory, které si významově neprotiřečí, je možné kombinovat.

    echo abAba | sed s/a/C/gi
    

    Chcete-li ve výrazu použít lomítko (/), tak máte dvě možnosti. Buď jej escapujte pomocí zpětného lomítka (\/) nebo použijte jiný oddělovač. Zvolit si můžete libovolný znak.

    # odstraní všechna lomítka
    sed s/\///g
    # totéž, ale přehledněji (oddělovač je zde „:“, a ne „/“)
    sed s:/::g
    

    Ještě dva tipy na závěr: 1) Pokud používáte GNU sed a chcete si ověřit, zda váš příkaz bude fungovat i s nerozšířenou verzí sedu, pak se vám bude hodit přepínač --posix. 2) Když přepínači -i zadáte argument (např.) „bak“, před samotnou úpravou souboru se vytvoří jeho záloha s příponou „.bak“.

    Závěr

    Tolik k úvodu do upravování textu pomocí sedu. Máte-li zájem o více (česky komentovaných) ukázek použití, navštivte web sed.sourceforge.net.

           

    Hodnocení: 100 %

            špatnédobré        

    Nástroje: Tisk bez diskuse

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    Komentáře

    Diskuse byla administrátory uzamčena

    17.2.2010 00:31 Radek Hladik | skóre: 20
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Nevím, jestli jsem to jen nepřehledl, ale určitě stojí za zvýrazněné zdůraznění, že

    sed 's/neco/cosi' <soubor >soubor

    nebo

    cat soubor | sed 's/neco/cosi' >soubor

    je spatně a může mít za následek poměrně infarktovou situaci :-) V článku je zmíněn přepínač -i, ale mám pocit, že tohle stojí za vypíchnutí. Shell totiž nejdříve zmastí výstupní soubor, aby do něj mohl zapisovat, a pok už nemá, co by do něj zapisoval :-)
    17.2.2010 06:03 pht | skóre: 48 | blog: pht
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Stačí malý trik
    (rm soubor; sed 's/neco/cosi' >soubor) <soubor
    In Ada the typical infinite loop would normally be terminated by detonation.
    17.2.2010 10:18 pet
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Uf..., tohle jsem neznal, to se bude hodit, uz mockrat jsem to slozite obchazel, diky ;-)
    17.2.2010 12:36 Fill | skóre: 19 | blog: Fill | Třebíč
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    A ještě se v tom triku nesmí udělat chybička s chybějícím "/" na konci, jinak jsou data v tahu taktéž :).
    $ echo neco > soubor
    $ (rm soubor; sed 's/neco/cosi' >soubor) < soubor 
    sed: -e expression #1, char 11: unterminated `s' command
    $ l soubor 
    -rw-r--r-- 1 user users 0 2010-02-17 12:32 soubor
    $ echo neco > soubor 
    $ (rm soubor; sed 's/neco/cosi/' >soubor) < soubor 
    $ cat soubor 
    cosi
    
    17.2.2010 13:24 pht | skóre: 48 | blog: pht
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Proti selhání zapisovacího procesu není odolná žádná metoda "in place" editování.
    In Ada the typical infinite loop would normally be terminated by detonation.
    17.2.2010 14:23 Jakub Lucký | skóre: 40 | Praha
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
           -i[SUFFIX], --in-place[=SUFFIX]
    
                  edit files in place (makes backup if extension supplied)
    
    
    
    If you understand, things are just as they are; if you do not understand, things are just as they are.
    17.2.2010 17:30 pht | skóre: 48 | blog: pht
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    To už ale není "in place".
    In Ada the typical infinite loop would normally be terminated by detonation.
    17.2.2010 06:59 David Watzke | skóre: 74 | blog: Blog... | Praha
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Jak říkáš, tohle je vlastnost shellu, ne sedu a už jsem to zmiňoval v jednom z minulých dílů (u sortu).
    “Being honest may not get you a lot of friends but it’ll always get you the right ones” ―John Lennon
    17.2.2010 06:20 pht | skóre: 48 | blog: pht
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Pochopitelně zde nebudu rozebírat veškeré možnosti, protože to by vydalo na pěkně dlouhý specializovaný seriál. Zabývat se budu pouze možnostmi nahrazování textu.
    Přimlouval bych se za výčet i ostatních příkazů než jen "s". Řada lidí umí sedem jen substituovat a na složitější věci buď neví jak nebo volají těžkou techniku. Přitom sed umí prakticky cokoliv. A na dlouhý seriál to není, maximálně na jeden díl. V dnešním díle jste se zabýval spíše regulárními výrazy než sedem.
    In Ada the typical infinite loop would normally be terminated by detonation.
    17.2.2010 14:27 Miroslav Puda
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    btw. CPress: Awk & Sed.
    17.2.2010 14:39 Jakub Lucký | skóre: 40 | Praha
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Ta knížka mi nepřijde moc dobrá... Mám ji doma, ale blbě se čte, ještě hůř se v ní hledá, občas je to dost kryptické...
    If you understand, things are just as they are; if you do not understand, things are just as they are.
    17.2.2010 21:27 imploder | skóre: 11
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Mám ji půjčenou, souhlasím, že je místy nejasná, i když celkem to jde. Těžko říct jak je to s kvalitou překladu (originál neznám), překladateli na jednom místě nedošlo, že AWK neumí automaticky skloňovat :)
    23.2.2010 23:50 honza
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Mě velmi vyhovovala kniha sed & awk (O'Reilly), je tam vše velmi přehledně a navíc poměrně čtivě :) - navíc google je plný odkazů na html verze této knihy.
    17.2.2010 15:26 Robo
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    sed -r -e "s/([0-9]+)/[\1]/g"
    bacha na -r; to nie je standartny prepinac; zatvorky "(" je potrebne escape-ovat, t.j. "\)"
    17.2.2010 15:40 David Watzke | skóre: 74 | blog: Blog... | Praha
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Jo, -r zmiňuju jako rozšíření GNU. Bez něj to bere zákl. reg. výrazy (BRE = basic regular expressions) a jak správně říkáš, tam je třeba escapovat.
    “Being honest may not get you a lot of friends but it’ll always get you the right ones” ―John Lennon
    19.2.2010 09:12 Robo
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    no bolo by lepsie, keby si pouzival v prikladoch standartne veci a az potom sa zmienoval o rozsireniach GNU (nazov clanku je unixove nastroje); takto sa zaciatocnik nauci veci, ktore potom na unixoch nebudu fungovat, kdezto ked sa nauci najskor standartne veci, tak tie budu fungovat vsade a bude to mat jednoduchsie; tento clanok by som zaciatocnikom v ziadnom pripade nedoporucoval
    19.2.2010 12:53 David Watzke | skóre: 74 | blog: Blog... | Praha
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Tak to dělám ;-) Stačí číst pořádně.
    “Being honest may not get you a lot of friends but it’ll always get you the right ones” ―John Lennon
    19.2.2010 16:18 Robo
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    GNU verze sedu se liší v mnoha ohledech. Dodržuje standard, ale implementuje další věci, z nichž mezi nejdůležitější patří přepínač -i (editace „na místě“) a podpora regulárních výrazů (i rozšířených, pomocí -r).
    toto je klamliva veta, regularne vyrazu podporuje aj samotny sed bez GNU rozsireni, takisto aj referencie (s escapovanymi zatvorkami ;-)); cize vsetko co sa nachadza pod touto citovanou vetou je pre kazdeho kto sa chce ucit sed zavadzajuce
    22.2.2010 08:43 Ash | skóre: 53
    Rozbalit Rozbalit vše Re: Unixové nástroje – 9 (sed – nahrazování textu)
    Přepínač -r povolí rozšířené regulární výrazy, což umožní např. [0-9]+.

    Jen doplním: Bez -r, je potřeba plus escapovat (hvězdičku ne). [0-9]\+.
    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.