abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    včera 22:44 | IT novinky

    IBM kupuje společnost HashiCorp (Terraform, Packer, Vault, Boundary, Consul, Nomad, Waypoint, Vagrant, …) za 6,4 miliardy dolarů, tj. 35 dolarů za akcii.

    Ladislav Hagara | Komentářů: 3
    včera 15:55 | Nová verze

    Byl vydán TrueNAS SCALE 24.04 “Dragonfish”. Přehled novinek této open source storage platformy postavené na Debianu v poznámkách k vydání.

    Ladislav Hagara | Komentářů: 0
    včera 13:44 | IT novinky

    Oznámeny byly nové Raspberry Pi Compute Module 4S. Vedle původní 1 GB varianty jsou nově k dispozici také varianty s 2 GB, 4 GB a 8 GB paměti. Compute Modules 4S mají na rozdíl od Compute Module 4 tvar a velikost Compute Module 3+ a předchozích. Lze tak provést snadný upgrade.

    Ladislav Hagara | Komentářů: 0
    včera 04:44 | Nová verze

    Po roce vývoje od vydání verze 1.24.0 byla vydána nová stabilní verze 1.26.0 webového serveru a reverzní proxy nginx (Wikipedie). Nová verze přináší řadu novinek. Podrobný přehled v souboru CHANGES-1.26.

    Ladislav Hagara | Komentářů: 0
    včera 04:33 | Nová verze

    Byla vydána nová verze 6.2 živé linuxové distribuce Tails (The Amnesic Incognito Live System), jež klade důraz na ochranu soukromí uživatelů a anonymitu. Přehled změn v příslušném seznamu. Tor Browser byl povýšen na verzi 13.0.14.

    Ladislav Hagara | Komentářů: 0
    včera 04:22 | Nová verze

    Byla vydána nová verze 30.0.0 frameworku pro vývoj multiplatformních desktopových aplikací pomocí JavaScriptu, HTML a CSS Electron (Wikipedie, GitHub). Chromium bylo aktualizováno na verzi 124.0.6367.49, V8 na verzi 12.4 a Node.js na verzi 20.11.1. Electron byl původně vyvíjen pro editor Atom pod názvem Atom Shell. Dnes je na Electronu postavena celá řada dalších aplikací.

    Ladislav Hagara | Komentářů: 2
    včera 04:11 | Nová verze

    Byla vydána nová verze 9.0.0 otevřeného emulátoru procesorů a virtualizačního nástroje QEMU (Wikipedie). Přispělo 220 vývojářů. Provedeno bylo více než 2 700 commitů. Přehled úprav a nových vlastností v seznamu změn.

    Ladislav Hagara | Komentářů: 0
    23.4. 23:22 | IT novinky

    Evropský parlament dnes přijal směrnici týkající se tzv. práva spotřebitele na opravu. Poslanci ji podpořili 584 hlasy (3 bylo proti a 14 se zdrželo hlasování). Směrnice ujasňuje povinnosti výrobců opravovat zboží a motivovat spotřebitele k tomu, aby si výrobky nechávali opravit a prodloužili tak jejich životnost.

    Ladislav Hagara | Komentářů: 9
    23.4. 16:11 | Nová verze

    Bylo oznámeno (cs) vydání Fedora Linuxu 40. Přehled novinek ve Fedora Workstation 40 a Fedora KDE 40 na stránkách Fedora Magazinu. Současně byl oznámen notebook Slimbook Fedora 2.

    Ladislav Hagara | Komentářů: 24
    23.4. 13:44 | Upozornění

    ČTK (Česká tisková kancelář) upozorňuje (X), že na jejím zpravodajském webu České noviny byly dnes dopoledne neznámým útočníkem umístěny dva smyšlené texty, které nepocházejí z její produkce. Jde o text s titulkem „BIS zabránila pokusu o atentát na nově zvoleného slovenského prezidenta Petra Pelligriniho“ a o údajné mimořádné prohlášení ministra Lipavského k témuž. Tyto dezinformace byly útočníky zveřejněny i s příslušnými notifikacemi v mobilní aplikaci Českých novin. ČTK ve svém zpravodajském servisu žádnou informaci v tomto znění nevydala.

    Ladislav Hagara | Komentářů: 29
    KDE Plasma 6
     (72%)
     (9%)
     (2%)
     (17%)
    Celkem 722 hlasů
     Komentářů: 4, poslední 6.4. 15:51
    Rozcestník

    Dotaz: multiline sed? Najdi, porovnej a vymaž řádek

    2.1.2015 22:42 JanM | skóre: 28
    multiline sed? Najdi, porovnej a vymaž řádek
    Přečteno: 414×

    Mám plain text:

                    [Date.UTC(2014, 11, 23, 5, 12, 0, 0), 3],
                    [Date.UTC(2014, 11, 23, 5, 14, 0, 0), 3],
                    [Date.UTC(2014, 11, 23, 5, 16, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 18, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 20, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 22, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 24, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 26, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 28, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 30, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 32, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 34, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 36, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 38, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 40, 0, 0), 0],

    A potřeboval bych odstranit řádky výše zvýrazněné kurzívou, aby to vypadalo takto:

                    [Date.UTC(2014, 11, 23, 5, 12, 0, 0), 3],
                    [Date.UTC(2014, 11, 23, 5, 14, 0, 0), 3],
                    [Date.UTC(2014, 11, 23, 5, 16, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 26, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 28, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 38, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 40, 0, 0), 0],

    Konkrétně potřebuji porovnávat poslední číselný údaj a v případě souvislého opakování ponechat pouze první a poslední záznam.

    Dá se to relativně jednoduše zvládnout pomocí sed či awk? Pokud ne, asi bych to řešil mechanicky v bashi (načítání řádků, porovnávání hodnoty, vymazání nadbytečného řádku a pořád dokola, dokud bude co mazat).


    Řešení dotazu:


    Odpovědi

    3.1.2015 01:16 pavele
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    Tedy v bashi bych to řešil primitvně, například:
    cat soubor | sort -k8 -u -r >soubor1
    tac soubor | sort -k8 -u -r >soubor2
    #paste -d '\n' soubor1 soubor2 >vysledek
    paste -d '\n' soubor1 soubor2 | uniq >vysledek
    
    3.1.2015 13:55 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    To je trochu moc drastická metoda ;-)

    On ten plain text má stovky kB a číselný údaj v posl. sloupci se pohybuje mezi 0 - 5, střídavě nahoru a dolu. "unique" to pročistí tak důkladně, že z těch stovek kB zbude pár řádků.
    wamba avatar 3.1.2015 02:39 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    napsáno "nehezky" pomocí Perl-u
    perl -00 -pe 's/(\N* (\d+)\],\n).*\n(\N* \2\],\n)/$1$3/msg'
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    3.1.2015 18:14 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    Funguje na výše uvedený příklad, ale už ne obecně na velké množství dat. Pravda, to jsem v dotazu nezdůraznil.
    Řešení 1× (JanM (tazatel))
    wamba avatar 3.1.2015 19:41 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    tak třeba tohle by mohlo fungovat i na velké soubory
    perl  -ne ' /(\d+)\],/; print $pred_radek if $1!=$pred or $pred2!=$pred; $pred2=$pred; $pred=$1; $pred_radek=$_'
    
    vytiskni řádek jestli se předešlý nebo následující řádek liší v čísle před ],

    Ps. samozřejmě by bylo přehlednější napsat Perl script než tento "one-liner"
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    5.1.2015 21:47 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    Pěkné. Pro úplnost jsem přidal jeden print, aby to vytisklo i první řádku souboru:
    perl  -ne ' /(\d+)\],/; print if 1..1; print $pred_radek if $1!=$pred or $pred2!=$pred; $pred2=$pred; $pred=$1; $pred_radek=$_'
    wamba avatar 5.1.2015 22:34 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    no ono ho to netiskne jen pokud na prvním řádek (resp. dvou) je 0], jinak ho to tiskne, tak bych spíš doporučoval něco jako:
    perl  -ne 'BEGIN{$pred=-1}; /(\d+)\],/; print $pred_radek if $1!=$pred or $pred2!=$pred; $pred2=$pred; $pred=$1;$pred_radek=$_'
    #
    
    problém by ještě nastal kdyby "poslední" řádek nekončil \n, pak by se nevytiskl
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    Řešení 1× (JanM (tazatel))
    3.1.2015 11:30 petris_ | skóre: 12
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    jj, jde to snadno

    sed -re 'H;x;/([0-9]+)\].*\1\]/d'
    3.1.2015 15:39 MilanK
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    Funguje to skvěle, akorát to zduplikuje řádek, když se posl. údaj neopakuje (zvýrazněno kurzívou). To bych v nejhorším odstranil přes "uniq":
                    [Date.UTC(2014, 11, 25, 10, 36, 36, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 38, 38, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 40, 40, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 42, 42, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 44, 44, 0), 0],
                    [Date.UTC(2014, 11, 25, 10, 50, 50, 0), 0],
                    [Date.UTC(2014, 11, 25, 10, 52, 52, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 54, 54, 0), 0],
                    [Date.UTC(2014, 11, 25, 15, 42, 42, 0), 0],
                    [Date.UTC(2014, 11, 25, 15, 44, 44, 0), 1],
                    [Date.UTC(2014, 11, 25, 15, 46, 46, 0), 3],
    
                    [Date.UTC(2014, 11, 25, 10, 36, 36, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 42, 42, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 44, 44, 0), 0],
                    [Date.UTC(2014, 11, 25, 10, 50, 50, 0), 0],
                    [Date.UTC(2014, 11, 25, 10, 52, 52, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 52, 52, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 54, 54, 0), 0],
                    [Date.UTC(2014, 11, 25, 15, 42, 42, 0), 0],
                    [Date.UTC(2014, 11, 25, 15, 44, 44, 0), 1],
                    [Date.UTC(2014, 11, 25, 15, 44, 44, 0), 1],
                    [Date.UTC(2014, 11, 25, 15, 46, 46, 0), 3],
    

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.