abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 02:11 | IT novinky Ladislav Hagara | Komentářů: 0
    včera 19:11 | Zajímavý projekt

    Fugleramme, v překladu 'ptačí rámeček', je open-source projekt postavený na Raspberry Pi, který pomocí lokální umělé inteligence BirdNET-Go rozpoznává ptačí druhy podle jejich zpěvu a na displeji následně zobrazuje koláž tvořenou odpovídajícími ilustracemi. Databáze obsahuje přes 800 ručně vybraných historických přírodovědných ilustrací více než 400 druhů ptáků.

    … více »
    AfD 💙 | Komentářů: 1
    včera 16:55 | Nová verze

    Unicode Consortium, nezisková organizace koordinující rozvoj standardu Unicode, oznámila vydání Unicode 18.0. Přidáno bylo 13 007 nových znaků. Celkově jich je 172 808. Přibylo 9 nových Emoji.

    Ladislav Hagara | Komentářů: 3
    včera 13:22 | Zajímavý článek

    Nové číslo časopisu Raspberry Pi zdarma ke čtení: Raspberry Pi Official Magazine 169 (pdf).

    Ladislav Hagara | Komentářů: 0
    včera 03:33 | Nová verze

    Byla vydána nová verze 6.4 programovacího jazyka Swift (Wikipedie). Zdrojové kódy jsou k dispozici na GitHubu.

    Ladislav Hagara | Komentářů: 0
    17.9. 23:11 | Komunita

    Německý kancléř Friedrich Merz (CDU) se během debaty s finalisty studentské vědecké soutěže Jugend forscht vyjádřil pro konec anonymity na internetu a vyslovil názor, že pro uživatele Internetu by měla platit podobná právní odpovědnost jako pro novináře tradičních médií. Na dotaz studenta, jak by se tedy povinnost uvádět pravé jméno slučovala s prací investigativních novinářů nebo ochranou jejich zdrojů, Merz neodpověděl, ve své

    … více »
    AfD 💙 | Komentářů: 48
    17.9. 17:55 | IT novinky

    Společnost Fujitsu představila FUJITSU-MONAKA CPU a Fujitsu MONAKA Server. Navrženo, vyvinuto a vyrobeno v Japonsku. Pro suverénní AI infrastrukturu.

    Ladislav Hagara | Komentářů: 0
    17.9. 16:44 | IT novinky

    Předprodej v květnu představených notebooků Googlebook, nástupců notebooků Chromebook, bude spuštěn v pondělí 21. září.

    Ladislav Hagara | Komentářů: 4
    16.9. 23:22 | Nová verze

    Byla vydána betaverze Fedora Linuxu 45 (ChangeSet), tj. poslední zastávka před vydáním finální verze, která je naplánována na úterý 20. října. S konzolí kmscon místo fbcon. Současně byla vydána betaverze Fedora Linux Asahi Remixu 45. S podporou čipů M3.

    Ladislav Hagara | Komentářů: 4
    16.9. 21:44 | Nová verze

    Po půl roce vývoje od vydání verze 50 bylo vydáno GNOME 51 s kódovým názvem "A Coruña" (Mastodon). Podrobný přehled novinek i s náhledy v poznámkách k vydání a v novinkách pro vývojáře. Videopředstavení na PeerTube a YouTube.

    Ladislav Hagara | Komentářů: 37
    Které desktopové prostředí na Linuxu používáte?
     (9%)
     (7%)
     (4%)
     (21%)
     (29%)
     (8%)
     (5%)
     (2%)
     (14%)
     (21%)
    Celkem 2695 hlasů
     Komentářů: 31, poslední 13.8. 00:27
    Rozcestník

    Dotaz: SED - extrakce retezce z html

    14.8.2007 15:03 Honza
    SED - extrakce retezce z html
    Přečteno: 556×
    Dobry den, uz 2 dny se trapim se sedem. Potrebuji z textu vytahnout urcite retezce, ktere jsou ohraniceny jinymi retezci. Dam priklad:
    -w ref='c1' click="video('XXX');" --img src='img.jpg'--/a>
    -w ref='c2' click="video('XXX');" --img src='img.jpg'--/a>
    -w ref='c3' click="video('XXX');" --img src='img.jpg'--/a>
    -w ref='c4' click="video('XXX');" --img src='img.jpg'--/a>
    kde XXX je zcela obecnej text, na kazdem radku jinej. Potrebuji do vysledneho souboru ulozit pouze retezce XXX Uz sem zkousel s/ /d ale ani jedno mi nechtelo fungovat Diky Jan Muller

    Odpovědi

    Zdeněk Molík avatar 14.8.2007 15:35 Zdeněk Molík | skóre: 14 | Znojmo - Oblekovice
    Rozbalit Rozbalit vše Re: SED - extrakce retezce z html
    No nevím zda jsem to přesně pochopil, ale pro uvedený příklad ( vstupní soubor in.html) by to mohlo býti následovně:

    sed -n -e "/video/p" < in.html | sed -e "s/.*video('\(.*\)').*/\1/ > out.txt

    Nejdříve si vyfiltruji pouze řádky s s textem video a pak vlastní obsah, který uložím do souboru out.txt
    14.8.2007 15:59 Honza
    Rozbalit Rozbalit vše Re: SED - extrakce retezce z html
    skvely...funguje to...moc moc diky Honza
    14.8.2007 17:33 qiRzT | skóre: 14 | blog: U_Marvina
    Rozbalit Rozbalit vše Re: SED - extrakce retezce z html
    Má to jeden drobnej nedostatek. Nebude to fungovat pokud na řádku za video(XXX) bude někde ). Ale na to už je, tuším, sed krátkej... Jinak jako dva zlepšováky doporučuju:

    1) sed -n -e "/video/p" < in.html | sed -e "s/.*video('\([^)]*\)').*/\1/ > out.txt , pokud v XXX nejsou závorky

    2) sed -n -e "/video/p" < in.html | sed -e "s/.*video('\(.*\)')\;.*/\1/ > out.txt pokud tam závorky jsou, řeší to aspoň trochu problém s další ) na řádku. Teď tam nesmí být );.
    Důležité je vědět jak problém vyřešit, zbytek zvládne i cvičená opice...
    14.8.2007 18:23 kirpike | skóre: 8 | Plzeň
    Rozbalit Rozbalit vše Re: SED - extrakce retezce z html
    Když už, tak proč ne takto:
    sed -n -e "/.*video('\([^']*\)');.*/{s//\1/;p}" <in.html >out.txt
    
    pak to zvládne i tento vstup:
    -w ref='c1' click="video('alpha');" --img src='img.jpg'--/a> neco('xxx');
    bla bla
    -w ref='c2' click="video('beta');" --img src='img.jpg'--/a> nic(xxx)
    Bla Bla Bla
    -w ref='c3' click="video('gama');" --img src='img.jpg'--/a;gt;
    To je prima video.
    
    14.8.2007 17:48 YYY | skóre: 29 | blog: martinek
    Rozbalit Rozbalit vše Re: SED - extrakce retezce z html
    Nejlepsi by bylo pouziti AWK :-)

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.