abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 04:44 | Humor

    Agent umělé inteligence vytvořil 'útočný' článek o Scottu Shambaughovi, dobrovolném správci knihovny matplotlib, poté, co vývojář odmítl agentem navrženou změnu kódu (pull request). 'Uražený' agent autonomně sepsal a publikoval na svém blogu článek, který přisuzuje Shambaughovi smyšlené motivace, egoismus a strach z AI coby konkurence.

    NUKE GAZA! 🎆 | Komentářů: 3
    včera 20:11 | Nová verze

    Bylo vydáno Ubuntu 24.04.4 LTS, tj. čtvrté opravné vydání Ubuntu 24.04 LTS s kódovým názvem Noble Numbat. Přehled novinek a oprav na Discourse.

    Ladislav Hagara | Komentářů: 0
    včera 17:44 | Pozvánky

    V pátek 20. února 2026 se v pražské kanceláři SUSE v Karlíně uskuteční 6. Mobile Linux Hackday, komunitní setkání zaměřené na Linux na mobilních zařízeních, kernelový vývoj a uživatelský prostor. Akce proběhne od 10:00 do večera. Hackday je určen všem, kteří si chtějí prakticky vyzkoušet práci s linuxovým jádrem i uživatelským prostorem, od posílání patchů například pomocí nástroje b4, přes balíčkování a Flatpak až po drobné úpravy

    … více »
    lkocman | Komentářů: 5
    včera 13:33 | IT novinky

    Evropská rada vydavatelů (EPC) předložila Evropské komisi stížnost na americkou internetovou společnost Google kvůli její službě AI Overviews (AI souhrny), která při vyhledávání na internetu zobrazuje shrnutí informací ze zpravodajských serverů vytvořená pomocí umělé inteligence (AI). Evropská komise již v prosinci oznámila, že v souvislosti s touto službou začala firmu Google vyšetřovat. Google obvinění ze strany vydavatelů

    … více »
    Ladislav Hagara | Komentářů: 12
    včera 04:44 | Komunita

    Ubuntu 26.04 (Resolute Raccoon) už nebude v desktopové instalaci obsahovat GUI nástroj 'Software & Updates'. Důvodem jsou obavy z jeho složitosti pro běžné uživatele a z toho plynoucích bezpečnostních rizik. Nástroj lze doinstalovat ručně (sudo apt install software-properties-gtk).

    NUKE GAZA! 🎆 | Komentářů: 24
    včera 04:33 | IT novinky

    Thomas Dohmke, bývalý CEO GitHubu, představil startup Entire - platformu pro spolupráci vývojářů a agentů umělé inteligence. Entire získalo rekordních 60 milionů dolarů na vývoj databáze a nástrojů, které mají zefektivnit spolupráci mezi lidmi a agenty umělé inteligence. Dohmke zdůrazňuje potřebu přepracovat tradiční vývojové postupy tak, aby odpovídaly realitě, kdy většinu kódu produkuje umělá inteligence.

    NUKE GAZA! 🎆 | Komentářů: 0
    včera 04:22 | Zajímavý projekt

    Toyota Connected North America oznámila vývoj open-source herního enginu Fluorite, postaveného na frameworku Flutter. Pro renderování grafiky využívá 3D engine Filament od společnosti Google a dle svého tvrzení cílí na konzolovou kvalitu her. Fluorite je zřejmě navržen tak, aby fungoval i na méně výkonném hardware, což naznačuje možnost použití přímo v ICE systémech vozidel. Zdrojový kód zatím zveřejněný není.

    NUKE GAZA! 🎆 | Komentářů: 4
    včera 04:11 | Bezpečnostní upozornění

    Byl vytvořen nástroj a postup pro překonání věkového ověření platforem Discord, Kick, Twitch, Snapchat (a možná dalších), kód je open-source a dostupný na GitHubu. Všechny tyto sítě používají stejnou službu k-ID, která určuje věk uživatele scanem obličeje a na původní server posílá pouze šifrovaná metadata, ty ale sociální síť už nedokáže sama nijak validovat, 'útok' spočívá ve vygenerování a podstrčení legitimně vypadajících ověřovacích metadat.

    NUKE GAZA! 🎆 | Komentářů: 12
    11.2. 14:11 | IT novinky

    Jihokorejská kryptoměnová burza Bithumb přiznala vážné selhání interních systémů, které ji vystavilo riziku sabotáže a nezabránilo chybné transakci v hodnotě přes 40 miliard dolarů (814 miliard Kč). Druhá největší kryptoměnová burza v Koreji minulý týden při propagační akci omylem rozeslala zákazníkům zhruba 620 000 bitcoinů místo 620 000 wonů (8700 Kč). Incident vyvolal pokles ceny bitcoinu o 17 procent. Většinu

    … více »
    Ladislav Hagara | Komentářů: 9
    11.2. 13:55 | Nová verze

    Google Chrome 145 byl prohlášen za stabilní. Nejnovější stabilní verze 145.0.7632.45 přináší řadu novinek z hlediska uživatelů i vývojářů. Podrobný přehled v poznámkách k vydání. Zpátky je podpora grafického formátu JPEG XL, viz Platform Status. Odstraněna byla před třemi lety. Nový dekodér JPEG XL jxl-rs je napsán v Rustu. Zobrazování JPEG XL lze vyzkoušet na testovací stránce. Povolit lze v nastavení chrome://flags (Enable JXL image format).

    Ladislav Hagara | Komentářů: 0
    Které desktopové prostředí na Linuxu používáte?
     (19%)
     (6%)
     (0%)
     (11%)
     (26%)
     (3%)
     (4%)
     (2%)
     (12%)
     (27%)
    Celkem 855 hlasů
     Komentářů: 25, poslední 3.2. 19:50
    Rozcestník

    Dotaz: multi regexp

    19.7.2013 14:43 Zaboj Campula
    multi regexp
    Přečteno: 415×

    Zdravim vsechny,

    Vstup

    • Mam mnozinu regularnich vyrazu (radove tisice).
    • a mam jeden textovy retezec.
    Problem
    • Najit alespon jeden regularni vyraz ktery s shoduje s retezcem nebo vratit chybu.
    Jazyk
    • idealne c/c++
    Sekvencni prochazeni vsech regularnich vyrazu a test na shodu je pomale.

    Ma nekdo nejaky napad na chytry algoritmus?

    Odpovědi

    19.7.2013 15:55 Kit
    Rozbalit Rozbalit vše Re: multi regexp
    Spojit těch 1000 regulárních výrazů do jednoho?
    19.7.2013 16:15 ::: | skóre: 14 | blog: e_lama
    Rozbalit Rozbalit vše Re: multi regexp
    pokud potrebuje vedet i ktery z nich matchuje tak to nebude tak jednoduchy.

    Napada me treba:

    - nejdriv udelas jeden velky RE, ktery vrati match pokud libovolny z tech 1000 RE by vratil match

    - vyzkousis a pokud najde match, tak:

    - vytvoris si 2 novy RE. Jeden bude spojovat puvodni RE 1 .. 500, ten druhy bude spojovat puvodni RE 501 .. 1000

    - vyzkousis match s kazdym z tech dvou

    - ten ktery vrati shodu znovu rozdelis, atd...

    Ty spojovaci RE by sis mohl predpocitat a umistnit do binarniho stromu, ktery bys potom prochazel od korene k listum...

    Takze bys vzdycky zkousel log2(N) RE.
    19.7.2013 16:20 ::: | skóre: 14 | blog: e_lama
    Rozbalit Rozbalit vše Re: multi regexp
    jeste bych doplnil ze tohle by melo fungovat dobre pokud pouzivas regex engine ktery si to vnitrne prevadi na FA.

    Pokud vnitrne pouziva backtracking tak to asi nepomuze...
    19.7.2013 16:18 Zaboj Campula
    Rozbalit Rozbalit vše Re: multi regexp
    To jako kdybych mel dejme tomu regularni vyrazy
    • A.*B
    • A[AB]C
    • D$
    Tak udlat jeden \(A.*B\|A[AB]C\|D$\) To by mozna slo, ale nejsem si jisty jestly by to bylo o moc rychlejsi nez sekvencni prohledavani. Zmerim a dam vedet.
    19.7.2013 16:58 Kit
    Rozbalit Rozbalit vše Re: multi regexp
    Přesně tak. Záleží na kvalitě kompilátoru regulárního výrazu, ale předpokládám řádové zrychlení oproti sekvenčnímu prohledávání.

    Některé jazyky (např. PHP) umožňují zadat regulární výrazy do pole. Netuším, jak je to s rychlostí.
    wamba avatar 19.7.2013 18:00 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multi regexp
    No v Perl-u jsem to zkoušel a dokážu najít případy, kdy to bude rychlejší i o dost pomalejší
    #!/usr/bin/perl
    use 5.010;
    use warnings;
    use strict;
    use List::Util qw{first};
    use Benchmark;
    our $VERSION = 0.001;
    
    my $string =
    '234781802319q8019810328103982104398021483049823094830498023982094823028340932840923830483201223';
    
    my @multiregexp = ( qr{ \A \d+ . \z }msx, qr{ \$ }msx, );
    
    timethese(
        1000000,
        {
            more => sub {
                my $trueregexp = first { $string ~~ $_ } @multiregexp;
            },
            one => sub { my $tt = $string ~~ m{\A \d+ . \z|\$}msx ? 1 : 0; },
            one_better =>
              sub { my $tt = $string ~~ m{\A \d+ . \z|\A .* \$ .* \z}msx ? 1 : 0; },
        }
    );
    
    mi vypíše
    Benchmark: timing 1000000 iterations of more, one, one_better...
          more:  3 wallclock secs ( 2.72 usr +  0.00 sys =  2.72 CPU) @ 367647.06/s (n=1000000)
           one: 14 wallclock secs (13.69 usr +  0.01 sys = 13.70 CPU) @ 72992.70/s (n=1000000)
    one_better: 12 wallclock secs (12.06 usr +  0.00 sys = 12.06 CPU) @ 82918.74/s (n=1000000)
    
    když $string upravím a přidám na konec $, tak
          more:  3 wallclock secs ( 3.21 usr +  0.00 sys =  3.21 CPU) @ 311526.48/s (n=1000000)
           one: 12 wallclock secs (13.74 usr +  0.00 sys = 13.74 CPU) @ 72780.20/s (n=1000000)
    one_better:  1 wallclock secs ( 2.04 usr +  0.00 sys =  2.04 CPU) @ 490196.08/s (n=1000000)
    
    a když smažu q z takto upraveného $string
          more:  3 wallclock secs ( 2.18 usr +  0.00 sys =  2.18 CPU) @ 458715.60/s (n=1000000)
           one:  1 wallclock secs ( 1.39 usr +  0.00 sys =  1.39 CPU) @ 719424.46/s (n=1000000)
    one_better:  0 wallclock secs ( 1.36 usr +  0.00 sys =  1.36 CPU) @ 735294.12/s (n=1000000)
    
    atp.
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    wamba avatar 19.7.2013 18:51 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multi regexp
    a to first ještě dá na výstup, který ten regexp bude true ještě se to dá otestovat jako
     more_better => sub {
                my $tt = $string ~~ @multiregexp ? 1 : 0;
              }
    
    které je nejrychlejší ve všech předešlých případech
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    19.7.2013 15:59 Mr.S1lent.cz
    Rozbalit Rozbalit vše Re: multi regexp
    Nebo taky muzes zaindexovat hledany retezec a napsat custom regexp nastroj pro vyhledavani v indexu :)
    19.7.2013 16:25 Zaboj Campula
    Rozbalit Rozbalit vše Re: multi regexp
    Omlovam se, ale nechapu. Slo by ten napad nejak rozvest, abych ho pochopil i ja?
    19.7.2013 18:55 Mr.S1lent.cz
    Rozbalit Rozbalit vše Re: multi regexp
    Zalezi na povaze vstupu, z toho musis vychazet.

    1) je to nahodny retezec vsech pismen nebo jen velkych a malych, cisel, specialnich znaku? 2) regexpy jsou generovany obecne na nejake mnoziny znaku nebo primo na nejaky konkretni retezce?

    To zaindexovani ti odhalim, az ty mi zodpovis tyto dva body, jinak to nema smysl :)
    wamba avatar 20.7.2013 09:59 wamba | skóre: 38 | blog: wamba
    Rozbalit Rozbalit vše Re: multi regexp
    tak abych odpověděl navrhuji použít Perl
    use 5.010;
    use warnings;
    use strict;
    use List::Util qw{first};
    our $VERSION = 0.001;
    
    my $string =
    '23478180231x98019810328103982104398021483049823094830498023982094823028340932840923830483201223$';
    
    my @multiregexp = ( qr{ \A \d+ . \z }msx, qr{ \$ }msx, );
    my $trueregexp = first { $string ~~ $_ } @multiregexp;
    
    say 'tento regexp vyhovuje ', $trueregexp;
    
    a když to nebude dostatečně rychlé, tak to chce vědět více o těch regexp-ech popř. o tom řetězci, aby se dalo navrhnout něco efektivnějšího
    This would have been so hard to fix when you don't know that there is in fact an easy fix.
    23.7.2013 15:51 Zaboj Campula
    Rozbalit Rozbalit vše Re: multi regexp

    Takze dekuji vsem za kometare.

    Spojeni do jednoho velkeho regexpu jak je navrzeno vyse by snad splnilo podminku na rychle vyhledavani, nicmene jsem skoncil na tom ze je potreba i pomerne rychla reakce na to kdyz uzivatel nejaky regulani vyraz prida/ubere/zmeni a konstrukce toho dloooouheho regularniho vyrazu a jeho kompilace je prilis pomala.

    Vysledne reseni je nakonec zalozene na tom, ze ty regularni vyrazy - tedy alespon vetsinaz nich ma v sobe nejaky pevny retezec, napriklad "[0-9]ABC[0-9]" a pomoci techto retezcu lze udelat index a v tom indexu najit podmnozinu regexu ktere se pak matchuji sekvencne. Vetsinou jsou to regexy slozitejsi nez v tom prikladu, ale obvykle to jde a tech par stovek regexu, ze kterych se neda nejaky rozumny retezec vyextraovat se bude prochazet sekvencne az kdyz se nenajde jinde.

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.