abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×

dnes 11:33 | Pozvánky

Konference LinuxDays 2017 proběhne o víkendu 7. a 8. října v Praze v Dejvicích v prostorách FIT ČVUT. Konference OpenAlt 2017 proběhne o víkendu 4. a 5. listopadu na FIT VUT v Brně. Organizátoři konferencí vyhlásili CFP (LinuxDays, OpenAlt). Přihlaste svou přednášku nebo doporučte konference známým.

Ladislav Hagara | Komentářů: 0
dnes 06:00 | Nová verze

Byla vydána verze 1.3.0 odlehčeného desktopového prostředí Lumina (Wikipedie, GitHub) postaveného nad toolkitem Qt. Z novinek lze zmínit nový motiv ikon nahrazující Oxygen (material-design-[light/dark]) nebo vlastní multimediální přehrávač (lumina-mediaplayer).

Ladislav Hagara | Komentářů: 2
včera 17:33 | Bezpečnostní upozornění

Před šesti týdny byly publikovány výsledky bezpečnostního auditu zdrojových kódů OpenVPN a nalezené bezpečnostní chyby byly opraveny ve verzi OpenVPN 2.4.2. Guido Vranken minulý týden oznámil, že v OpenVPN nalezl další čtyři bezpečnostní chyby (CVE-2017-7520, CVE-2017-7521, CVE-2017-7522 a CVE-2017-7508). Nejzávažnější z nich se týká způsobu, jakým aplikace zachází s SSL certifikáty. Vzdálený útočník může pomocí speciálně

… více »
Ladislav Hagara | Komentářů: 1
včera 06:55 | Zajímavý projekt

V Edici CZ.NIC vyšla kniha Průvodce labyrintem algoritmů. Kniha je ke stažení zcela zdarma (pdf) nebo lze objednat tištěnou verzi za 339 Kč (připojení přes IPv4) nebo 289 Kč (připojení přes IPv6).

Ladislav Hagara | Komentářů: 6
včera 06:33 | Zajímavý software

Byla vydána verze 2.2.0 svobodného správce hesel KeePassXC (Wikipedie). Jedná se o komunitní fork správce hesel KeePassX s řadou vylepšení.

Ladislav Hagara | Komentářů: 0
včera 06:11 | IT novinky

Vývojář Debianu Henrique de Moraes Holschuh upozorňuje v diskusním listu debian-devel na chybu v Hyper-Threadingu v procesorech Skylake a Kaby Lake od Intelu. Za určitých okolností může chyba způsobit nepředvídatelné chování systému. Doporučuje se aktualizace mikrokódu CPU nebo vypnutí Hyper-Threadingu v BIOSu nebo UEFI [reddit].

Ladislav Hagara | Komentářů: 0
24.6. 01:23 | Komunita

Phoronix spustil 2017 Linux Laptop Survey. Tento dotazník s otázkami zaměřenými na parametry ideálního notebooku s Linuxem lze vyplnit do 6. července.

Ladislav Hagara | Komentářů: 3
23.6. 22:44 | Nová verze

Po třech měsících vývoje od vydání verze 5.5.0 byla vydána verze 5.6.0 správce digitálních fotografií digiKam (digiKam Software Collection). Do digiKamu se mimo jiné vrátila HTML galerie a nástroj pro vytváření videa z fotografií. V Bugzille bylo uzavřeno více než 81 záznamů.

Ladislav Hagara | Komentářů: 1
23.6. 17:44 | Nová verze

Byla vydána verze 9.3 open source alternativy GitHubu, tj. softwarového nástroje s webovým rozhraním umožňujícího spolupráci na zdrojových kódech, GitLab. Představení nových vlastností v příspěvku na blogu a na YouTube.

Ladislav Hagara | Komentářů: 3
23.6. 13:53 | Nová verze

Simon Long představil na blogu Raspberry Pi novou verzi 2017-06-21 linuxové distribuce Raspbian určené především pro jednodeskové miniaturní počítače Raspberry Pi. Společně s Raspbianem byl aktualizován také instalační nástroj NOOBS (New Out Of the Box Software). Z novinek lze zdůraznit IDE Thonny pro vývoj v programovacím jazyce Python a především offline verzi Scratche 2.0. Ten bylo dosud možné používat pouze online. Offline bylo možné používat pouze Scratch ve verzi 1.4. Z nového Scratchu lze ovládat také GPIO piny. Scratch 2.0 vyžaduje Flash.

Ladislav Hagara | Komentářů: 1
Chystáte se pořídit CPU AMD Ryzen?
 (6%)
 (31%)
 (1%)
 (9%)
 (44%)
 (9%)
Celkem 851 hlasů
 Komentářů: 65, poslední 1.6. 19:16
    Rozcestník

    Dotaz: MySQL ORDER BY RAND() a výkon

    9.10.2012 20:09 filbar | skóre: 36 | blog: Denicek_programatora | Ostrava
    MySQL ORDER BY RAND() a výkon
    Přečteno: 1086×
    V jednom modulu webové aplikace jsem se setkal s
    ORDER BY RAND()
    LIMIT 1
    
    jak je na tom takový dotaz s výkonností? Tuším správně, že je to pro výkonnost špatné?

    Odpovědi

    MMMMMMMMM avatar 9.10.2012 20:19 MMMMMMMMM | skóre: 41 | blog: unstable | Valašsko :-)
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    9.10.2012 21:21 kuka
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    To predevsim zalezi, ceho se to tyka. Jestli to pracuje treba nad 100 zaznamy, tak na tom urcite nic spatneho neni. Podobne pokud to jednou mesicne vylosuje jednoho uzivatele, nebude vadit, ze to pobezi nekolik minut, naopak pokud se to vola stokrat za minutu, musi to bezet radove desetiny sekundy atd.
    10.10.2012 12:46 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    To je ale kravina, znám lepší způsoby jak zatížit server.
    Velmi výkonné je to na M$SQL, ale zas to nedělá to, co by se očekávalo :-).
    To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†
    AraxoN avatar 10.10.2012 13:35 AraxoN | skóre: 45 | blog: slon_v_porcelane | Košice
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    jj, MS SQL vygeneruje rovnaké náhodné číslo pre všetky riadky. To je prosímpekne vlastnosť, nie chyba! :-D
    A fine is a tax for doing wrong. A tax is a fine for doing well.
    Josef Kufner avatar 11.10.2012 12:01 Josef Kufner | skóre: 67
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    Potíž je v tom, že MySQL si napřed vygeneruje ke každému řádku náhodné číslo, pak řádky podle tohoto čísla seřadí a nakonec veme ten první. Takže si potřebuje udělat dočasnou tabulku, která pojme všechny řádky ve zdrojové tabulce (tedy alespoň ta náhodná čísla), tu pak seřadit a nakonec zahodit, protože je potřeba jen jeden řádek.

    Pokud chceš jen jeden náhodný řádek, dej RAND() * (SELECT COUNT(*)) do offsetu v LIMIT.

    Pokud chceš řádků více, je to trochu těžší. Pro několik málo řádků prostě volej jednořádkovou variantu kolikrát potřebuješ. Pro hodně řádků, pokud máš jako primární klíč celá čísla, můžeš vygenerovat seznam náhodných ID a pak si o ně říct. Pokud jsou ID děravá, tak to spustíš vícekrát, dokud nedostaneš požadovaný počet (můžeš ID vygenerovat pár navíc aby jsi omezil počet dotazů).
    Hello world ! Segmentation fault (core dumped)
    AraxoN avatar 11.10.2012 15:19 AraxoN | skóre: 45 | blog: slon_v_porcelane | Košice
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    Možno to platí len pre postgresql, ale výhodnejšie je ORDER BY RANDOM(), než OFFSET RANDOM() * SELECT COUNT():
    EXPLAIN SELECT * FROM test ORDER BY RANDOM() LIMIT 1;
                                         QUERY PLAN
    -------------------------------------------------------------------------------------
     Limit  (cost=19755.35..19755.36 rows=1 width=1162)
       ->  Sort  (cost=19755.35..20165.12 rows=163906 width=1162)
             Sort Key: (random())
             ->  Seq Scan on test  (cost=0.00..18935.83 rows=163906 width=1162)
    (4 rows)
    EXPLAIN SELECT * FROM test LIMIT 1 OFFSET RANDOM()*(SELECT COUNT(*) FROM test);
                                         QUERY PLAN
    ------------------------------------------------------------------------------------
     Limit  (cost=20788.49..20788.60 rows=1 width=1162)
       InitPlan 1 (returns $0)
         ->  Aggregate  (cost=18935.83..18935.84 rows=1 width=0)
               ->  Seq Scan on test  (cost=0.00..18526.06 rows=163906 width=0)
       ->  Seq Scan on test  (cost=0.00..18526.06 rows=163906 width=1162)
    (5 rows)
    Cost prvej možnosti je nižší než druhej.
    A fine is a tax for doing wrong. A tax is a fine for doing well.
    11.10.2012 16:33 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    Záleží na tom jak moc je efektivní 'COUNT(*)' a nad jak velkými daty se to dělá.
    U mě na MySQL (InnoDB i MyISAM) nad tabulkou s několika záznamy je ekvivalent druhého zápisu také rychlejší, ale s např. 180000 záznamy už ne (použil jsem co jsem měl po ruce - proto to číslo), ale celé je to o tom, že nejdéle trvá 'SELECT COUNT(*)…', pokud tedy budu losovat několik záznamů tak už je to diametrálně jiné, samozřejmě se ale nesmí použít ten uvedený druhý zápis, ale uložení si COUNT(*).
    Čísla na 180 000 záznamech:
    InnoDB: 0.21sec (získání COUNT(*) z toho 0.16 sec)   vs.   0.29sec 
    MyISAM: 0.08sec (získání COUNT(*) z toho 0.05 sec)   vs.   0.18sec
    
    To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†
    Heron avatar 15.10.2012 16:04 Heron | skóre: 51 | blog: root_at_heron | Olomouc
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    U MVCC databáze (tedy asi všechno krom MyISAM) je COUNT(*) velmi drahá operace. Musí se spočítat řádky platné v dané transakci.
    okbob avatar 11.10.2012 18:13 okbob | skóre: 30 | blog: systemakuv_blog | Benešov
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    cost je hausnumero, to ještě nic nemusí znamenat - v každém případku použití ORDER BY RANDOM vede na sekvenční scan, což u velkých tabulek může být brzda - a tuplem, když je takový dotaz častý - pro tabulky do několikaseti řádků je to jedno, ale pak už to může zabolet. Viděl jsem server, kde významnou část zátěže produkoval podobný a pro většinu aplikací naprosto zbytný dotaz.
    Heron avatar 15.10.2012 16:01 Heron | skóre: 51 | blog: root_at_heron | Olomouc
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    Ale v každém případě se provádí sekvenční scan celé tabulky a v tom druhém případě dokonce dvakrát. Pro normálně velké tabulky ten server tímto efektivně odstavíte.
    17.10.2012 16:35 l0gik | skóre: 22
    Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
    U nepříliš děravé databáze, která neumí count bez prolejzání DB (většina MVCC) můž být zajímavé toto řešení:
    
    SELECT MAX(id) FROM Tabulka INTO max
    WHILE true:
       SELECT * FROM TABULKA WHERE id >= RANDOM() * max INTO rec
       SELECT COALESCE(MAX(id),0) FROM TABULKA WHERE id < rec.id INTO prev_id
       if RANDOM()<1.0/(rec.id - prev_id):
           return rec
    
       
    Myšlenka je doufám jasná: využiju ID, random udělam na díru, a díry ošětřím tak, že záznam "za dírou" vrátím jen v patřičném podílu případů, v opačném selektuju znovu.

    Nevýhoda je nedeterministický čas.

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.