abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    25.7. 19:55 | IT novinky

    Americký výrobce čipů Intel propustí 15 procent zaměstnanců (en), do konce roku by jich v podniku mělo pracovat zhruba 75.000. Firma se potýká s výrobními problémy a opouští také miliardový plán na výstavbu továrny v Německu a Polsku.

    Ladislav Hagara | Komentářů: 19
    25.7. 17:33 | Komunita

    MDN (Wikipedie), dnes MDN Web Docs, původně Mozilla Developer Network, slaví 20 let. V říjnu 2004 byl ukončen provoz serveru Netscape DevEdge, který byl hlavním zdrojem dokumentace k webovým prohlížečům Netscape a k webovým technologiím obecně. Mozille se po jednáních s AOL povedlo dokumenty z Netscape DevEdge zachránit a 23. července 2005 byl spuštěn MDC (Mozilla Developer Center). Ten byl v roce 2010 přejmenován na MDN.

    Ladislav Hagara | Komentářů: 0
    25.7. 14:55 | Nová verze

    Wayback byl vydán ve verzi 0.1. Wayback je "tak akorát Waylandu, aby fungoval Xwayland". Jedná se o kompatibilní vrstvu umožňující běh plnohodnotných X11 desktopových prostředí s využitím komponent z Waylandu. Cílem je nakonec nahradit klasický server X.Org, a tím snížit zátěž údržby aplikací X11.

    Ladislav Hagara | Komentářů: 0
    25.7. 13:33 | Nová verze

    Byla vydána nová verze 6.18 živé linuxové distribuce Tails (The Amnesic Incognito Live System), jež klade důraz na ochranu soukromí uživatelů a anonymitu. Nově se lze k síti Tor připojit pomocí mostu WebTunnel. Tor Browser byl povýšen na verzi 14.5.5. Thunderbird na verzi 128.12.0. Další změny v příslušném seznamu.

    Ladislav Hagara | Komentářů: 0
    24.7. 14:33 | IT novinky

    Meta představila prototyp náramku, který snímá elektrickou aktivity svalů (povrchová elektromyografie, EMG) a umožňuje jemnými gesty ruky a prstů ovládat počítač nebo různá zařízení. Získané datové sady emg2qwerty a emg2pose jsou open source.

    Ladislav Hagara | Komentářů: 1
    24.7. 14:22 | Nová verze

    Byla vydána (𝕏) nová verze 25.7 open source firewallové a routovací platformy OPNsense (Wikipedie). Jedná se o fork pfSense postavený na FreeBSD. Kódový název OPNsense 25.7 je Visionary Viper. Přehled novinek v příspěvku na fóru.

    Ladislav Hagara | Komentářů: 0
    24.7. 13:33 | IT novinky

    Před 40 lety, 23. července 1985, společnost Commodore představila první počítač Amiga. Jednalo se o počítač "Amiga od Commodore", jenž byl později pojmenován Amiga 1000. Mělo se jednat o přímou konkurenci počítače Apple Macintosh uvedeného na trh v lednu 1984.

    Ladislav Hagara | Komentářů: 2
    24.7. 06:00 | IT novinky

    T‑Mobile USA ve spolupráci se Starlinkem spustil službu T-Satellite. Uživatelé služby mohou v odlehlých oblastech bez mobilního signálu aktuálně využívat satelitní síť s více než 650 satelity pro posílání a příjem zpráv, sdílení polohy, posílání zpráv na 911 a příjem upozornění, posílání obrázků a krátkých hlasových zpráv pomocí aplikace Zprávy Google. V plánu jsou také satelitní data.

    Ladislav Hagara | Komentářů: 9
    23.7. 21:55 | Komunita

    Společnost Proxmox Server Solutions stojící za virtualizační platformou Proxmox Virtual Environment věnovala 10 000 eur nadaci The Perl and Raku Foundation (TPRF).

    Ladislav Hagara | Komentářů: 2
    23.7. 21:22 | Bezpečnostní upozornění

    Byla vydána nová verze 2.4.65 svobodného multiplatformního webového serveru Apache (httpd). Řešena je bezpečnostní chyba CVE-2025-54090.

    Ladislav Hagara | Komentářů: 0
    Kolik tabů máte standardně otevřeno ve web prohlížeči?
     (29%)
     (25%)
     (5%)
     (4%)
     (4%)
     (1%)
     (3%)
     (27%)
    Celkem 135 hlasů
     Komentářů: 17, poslední včera 20:08
    Rozcestník

    Dotaz: multiline sed? Najdi, porovnej a vymaž řádek

    2.1.2015 22:42 JanM | skóre: 28
    multiline sed? Najdi, porovnej a vymaž řádek
    Přečteno: 458×

    Mám plain text:

                    [Date.UTC(2014, 11, 23, 5, 12, 0, 0), 3],
                    [Date.UTC(2014, 11, 23, 5, 14, 0, 0), 3],
                    [Date.UTC(2014, 11, 23, 5, 16, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 18, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 20, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 22, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 24, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 26, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 28, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 30, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 32, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 34, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 36, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 38, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 40, 0, 0), 0],

    A potřeboval bych odstranit řádky výše zvýrazněné kurzívou, aby to vypadalo takto:

                    [Date.UTC(2014, 11, 23, 5, 12, 0, 0), 3],
                    [Date.UTC(2014, 11, 23, 5, 14, 0, 0), 3],
                    [Date.UTC(2014, 11, 23, 5, 16, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 26, 0, 0), 2],
                    [Date.UTC(2014, 11, 23, 5, 28, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 38, 0, 0), 1],
                    [Date.UTC(2014, 11, 23, 5, 40, 0, 0), 0],

    Konkrétně potřebuji porovnávat poslední číselný údaj a v případě souvislého opakování ponechat pouze první a poslední záznam.

    Dá se to relativně jednoduše zvládnout pomocí sed či awk? Pokud ne, asi bych to řešil mechanicky v bashi (načítání řádků, porovnávání hodnoty, vymazání nadbytečného řádku a pořád dokola, dokud bude co mazat).


    Řešení dotazu:


    Odpovědi

    3.1.2015 01:16 pavele
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    Tedy v bashi bych to řešil primitvně, například:
    cat soubor | sort -k8 -u -r >soubor1
    tac soubor | sort -k8 -u -r >soubor2
    #paste -d '\n' soubor1 soubor2 >vysledek
    paste -d '\n' soubor1 soubor2 | uniq >vysledek
    
    3.1.2015 13:55 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    To je trochu moc drastická metoda ;-)

    On ten plain text má stovky kB a číselný údaj v posl. sloupci se pohybuje mezi 0 - 5, střídavě nahoru a dolu. "unique" to pročistí tak důkladně, že z těch stovek kB zbude pár řádků.
    wamba avatar 3.1.2015 02:39 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    napsáno "nehezky" pomocí Perl-u
    perl -00 -pe 's/(\N* (\d+)\],\n).*\n(\N* \2\],\n)/$1$3/msg'
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    3.1.2015 18:14 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    Funguje na výše uvedený příklad, ale už ne obecně na velké množství dat. Pravda, to jsem v dotazu nezdůraznil.
    Řešení 1× (JanM (tazatel))
    wamba avatar 3.1.2015 19:41 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    tak třeba tohle by mohlo fungovat i na velké soubory
    perl  -ne ' /(\d+)\],/; print $pred_radek if $1!=$pred or $pred2!=$pred; $pred2=$pred; $pred=$1; $pred_radek=$_'
    
    vytiskni řádek jestli se předešlý nebo následující řádek liší v čísle před ],

    Ps. samozřejmě by bylo přehlednější napsat Perl script než tento "one-liner"
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    5.1.2015 21:47 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    Pěkné. Pro úplnost jsem přidal jeden print, aby to vytisklo i první řádku souboru:
    perl  -ne ' /(\d+)\],/; print if 1..1; print $pred_radek if $1!=$pred or $pred2!=$pred; $pred2=$pred; $pred=$1; $pred_radek=$_'
    wamba avatar 5.1.2015 22:34 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    no ono ho to netiskne jen pokud na prvním řádek (resp. dvou) je 0], jinak ho to tiskne, tak bych spíš doporučoval něco jako:
    perl  -ne 'BEGIN{$pred=-1}; /(\d+)\],/; print $pred_radek if $1!=$pred or $pred2!=$pred; $pred2=$pred; $pred=$1;$pred_radek=$_'
    #
    
    problém by ještě nastal kdyby "poslední" řádek nekončil \n, pak by se nevytiskl
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    Řešení 1× (JanM (tazatel))
    3.1.2015 11:30 petris_ | skóre: 12
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    jj, jde to snadno

    sed -re 'H;x;/([0-9]+)\].*\1\]/d'
    3.1.2015 15:39 MilanK
    Rozbalit Rozbalit vše Re: multiline sed? Najdi, porovnej a vymaž řádek
    Funguje to skvěle, akorát to zduplikuje řádek, když se posl. údaj neopakuje (zvýrazněno kurzívou). To bych v nejhorším odstranil přes "uniq":
                    [Date.UTC(2014, 11, 25, 10, 36, 36, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 38, 38, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 40, 40, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 42, 42, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 44, 44, 0), 0],
                    [Date.UTC(2014, 11, 25, 10, 50, 50, 0), 0],
                    [Date.UTC(2014, 11, 25, 10, 52, 52, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 54, 54, 0), 0],
                    [Date.UTC(2014, 11, 25, 15, 42, 42, 0), 0],
                    [Date.UTC(2014, 11, 25, 15, 44, 44, 0), 1],
                    [Date.UTC(2014, 11, 25, 15, 46, 46, 0), 3],
    
                    [Date.UTC(2014, 11, 25, 10, 36, 36, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 42, 42, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 44, 44, 0), 0],
                    [Date.UTC(2014, 11, 25, 10, 50, 50, 0), 0],
                    [Date.UTC(2014, 11, 25, 10, 52, 52, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 52, 52, 0), 1],
                    [Date.UTC(2014, 11, 25, 10, 54, 54, 0), 0],
                    [Date.UTC(2014, 11, 25, 15, 42, 42, 0), 0],
                    [Date.UTC(2014, 11, 25, 15, 44, 44, 0), 1],
                    [Date.UTC(2014, 11, 25, 15, 44, 44, 0), 1],
                    [Date.UTC(2014, 11, 25, 15, 46, 46, 0), 3],
    

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.