abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
eParkomat, startup z ČR, postoupil mezi finalisty evropského akcelerátoru ChallengeUp!
Robot na pivo mu otevřel dveře k opravdovému byznysu
Internet věcí: Propojený svět? Už se to blíží...
včera 16:38 | Komunita

Byly zveřejněny videozáznamy přednášek a workshopů z letošní konference OpenAlt konané 5. a 6. listopadu v Brně. K videozáznamům lze přistupovat ze stránky na SuperLectures nebo přes program konference, detaily o vybrané přednášce nebo workshopu a dále kliknutím na ikonku filmového pásu. Celkově bylo zpracováno 65 hodin z 89 přednášek a workshopů.

Ladislav Hagara | Komentářů: 0
včera 11:30 | Komunita

Bylo oznámeno, že bude proveden bezpečnostní audit zdrojových kódů open source softwaru pro implementaci virtuálních privátních sítí OpenVPN. Audit provede Matthew D. Green (blog), uznávaný kryptolog a profesor na Univerzitě Johnse Hopkinse. Auditována bude verze 2.4 (aktuálně RC 1, stabilní verze je 2.3.14). Audit bude financován společností Private Internet Access [reddit].

Ladislav Hagara | Komentářů: 2
včera 06:00 | Komunita

Na YouTube byl publikován Blender Institute Reel 2016, ani ne dvouminutový sestřih z filmů, které vznikly za posledních 10 let díky Blender Institutu. V institutu aktuálně pracují na novém filmu Agent 327. Dění kolem filmu lze sledovat na Blender Cloudu. Videoukázka Agenta 327 z června letošního roku na YouTube.

Ladislav Hagara | Komentářů: 0
včera 01:02 | Zajímavý článek

Minulý týden byly vydány verze 1.2.3 a 1.1.7 webového poštovního klienta Roundcube. V oznámení o vydání bylo zmíněno řešení bezpečnostního problému nalezeného společností RIPS a souvisejícího s voláním funkce mail() v PHP. Tento týden byly zveřejněny podrobnosti. Útočník mohl pomocí speciálně připraveného emailu spustit na serveru libovolný příkaz. Stejně, jak je popsáno v článku Exploit PHP’s mail() to get remote code execution z roku 2014.

Ladislav Hagara | Komentářů: 1
8.12. 16:00 | Nová verze

Byla vydána verze 0.98 svobodného nelineárního video editoru Pitivi. Z novinek lze zmínit například přizpůsobitelné klávesové zkratky. Videoukázka práce s nejnovější verzí Pitivi na YouTube.

Ladislav Hagara | Komentářů: 1
8.12. 15:00 | Zajímavý software

Stop motion je technika animace, při níž je reálný objekt mezi jednotlivými snímky ručně upravován a posouván o malé úseky, tak aby po spojení vyvolala animace dojem spojitosti. Jaký software lze pro stop motion použít na Linuxu? Článek na OMG! Ubuntu! představuje Heron Animation. Ten bohužel podporuje pouze webové kamery. Podpora digitálních zrcadlovek je začleněna například v programu qStopMotion.

Ladislav Hagara | Komentářů: 5
7.12. 21:21 | Nová verze Ladislav Hagara | Komentářů: 0
7.12. 11:44 | Zajímavý projekt

Na Indiegogo byla spuštěna kampaň na podporu herní mini konzole a multimediálního centra RetroEngine Sigma od Doyodo. Předobjednat ji lze již od 49 dolarů. Požadovaná částka 20 000 dolarů byla překonána již 6 krát. Majitelé mini konzole si budou moci zahrát hry pro Atari VCS 2600, Sega Genesis nebo NES. Předinstalováno bude multimediální centrum Kodi.

Ladislav Hagara | Komentářů: 2
7.12. 00:10 | Nová verze

Byla vydána verze 4.7 redakčního systému WordPress. Kódové označením Vaughan bylo vybráno na počest americké jazzové zpěvačky Sarah "Sassy" Vaughan. Z novinek lze zmínit například novou výchozí šablonu Twenty Seventeen, náhledy pdf souborů nebo WordPress REST API.

Ladislav Hagara | Komentářů: 10
6.12. 12:00 | Zajímavý projekt

Projekt Termbox umožňuje vyzkoušet si linuxové distribuce Ubuntu, Debian, Fedora, CentOS a Arch Linux ve webovém prohlížeči. Řešení je postaveno na projektu HyperContainer. Podrobnosti v často kladených dotazech (FAQ). Zdrojové kódy jsou k dispozici na GitHubu [reddit].

Ladislav Hagara | Komentářů: 28
Kolik máte dat ve svém domovském adresáři na svém primárním osobním počítači?
 (32%)
 (24%)
 (29%)
 (7%)
 (5%)
 (3%)
Celkem 807 hlasů
 Komentářů: 50, poslední 29.11. 15:50
Rozcestník
Reklama

Dotaz: MySQL ORDER BY RAND() a výkon

9.10.2012 20:09 filbar | skóre: 36 | blog: Denicek_programatora | Ostrava
MySQL ORDER BY RAND() a výkon
Přečteno: 1079×
V jednom modulu webové aplikace jsem se setkal s
ORDER BY RAND()
LIMIT 1
jak je na tom takový dotaz s výkonností? Tuším správně, že je to pro výkonnost špatné?

Odpovědi

MMMMMMMMM avatar 9.10.2012 20:19 MMMMMMMMM | skóre: 41 | blog: unstable | Valašsko :-)
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
9.10.2012 21:21 kuka
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
To predevsim zalezi, ceho se to tyka. Jestli to pracuje treba nad 100 zaznamy, tak na tom urcite nic spatneho neni. Podobne pokud to jednou mesicne vylosuje jednoho uzivatele, nebude vadit, ze to pobezi nekolik minut, naopak pokud se to vola stokrat za minutu, musi to bezet radove desetiny sekundy atd.
10.10.2012 12:46 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
To je ale kravina, znám lepší způsoby jak zatížit server.
Velmi výkonné je to na M$SQL, ale zas to nedělá to, co by se očekávalo :-).
To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†
AraxoN avatar 10.10.2012 13:35 AraxoN | skóre: 45 | blog: slon_v_porcelane | Košice
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
jj, MS SQL vygeneruje rovnaké náhodné číslo pre všetky riadky. To je prosímpekne vlastnosť, nie chyba! :-D
A fine is a tax for doing wrong. A tax is a fine for doing well.
Josef Kufner avatar 11.10.2012 12:01 Josef Kufner | skóre: 66
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
Potíž je v tom, že MySQL si napřed vygeneruje ke každému řádku náhodné číslo, pak řádky podle tohoto čísla seřadí a nakonec veme ten první. Takže si potřebuje udělat dočasnou tabulku, která pojme všechny řádky ve zdrojové tabulce (tedy alespoň ta náhodná čísla), tu pak seřadit a nakonec zahodit, protože je potřeba jen jeden řádek.

Pokud chceš jen jeden náhodný řádek, dej RAND() * (SELECT COUNT(*)) do offsetu v LIMIT.

Pokud chceš řádků více, je to trochu těžší. Pro několik málo řádků prostě volej jednořádkovou variantu kolikrát potřebuješ. Pro hodně řádků, pokud máš jako primární klíč celá čísla, můžeš vygenerovat seznam náhodných ID a pak si o ně říct. Pokud jsou ID děravá, tak to spustíš vícekrát, dokud nedostaneš požadovaný počet (můžeš ID vygenerovat pár navíc aby jsi omezil počet dotazů).
Hello world ! Segmentation fault (core dumped)
AraxoN avatar 11.10.2012 15:19 AraxoN | skóre: 45 | blog: slon_v_porcelane | Košice
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
Možno to platí len pre postgresql, ale výhodnejšie je ORDER BY RANDOM(), než OFFSET RANDOM() * SELECT COUNT():
EXPLAIN SELECT * FROM test ORDER BY RANDOM() LIMIT 1;
                                     QUERY PLAN
-------------------------------------------------------------------------------------
 Limit  (cost=19755.35..19755.36 rows=1 width=1162)
   ->  Sort  (cost=19755.35..20165.12 rows=163906 width=1162)
         Sort Key: (random())
         ->  Seq Scan on test  (cost=0.00..18935.83 rows=163906 width=1162)
(4 rows)
EXPLAIN SELECT * FROM test LIMIT 1 OFFSET RANDOM()*(SELECT COUNT(*) FROM test);
                                     QUERY PLAN
------------------------------------------------------------------------------------
 Limit  (cost=20788.49..20788.60 rows=1 width=1162)
   InitPlan 1 (returns $0)
     ->  Aggregate  (cost=18935.83..18935.84 rows=1 width=0)
           ->  Seq Scan on test  (cost=0.00..18526.06 rows=163906 width=0)
   ->  Seq Scan on test  (cost=0.00..18526.06 rows=163906 width=1162)
(5 rows)
Cost prvej možnosti je nižší než druhej.
A fine is a tax for doing wrong. A tax is a fine for doing well.
11.10.2012 16:33 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
Záleží na tom jak moc je efektivní 'COUNT(*)' a nad jak velkými daty se to dělá.
U mě na MySQL (InnoDB i MyISAM) nad tabulkou s několika záznamy je ekvivalent druhého zápisu také rychlejší, ale s např. 180000 záznamy už ne (použil jsem co jsem měl po ruce - proto to číslo), ale celé je to o tom, že nejdéle trvá 'SELECT COUNT(*)…', pokud tedy budu losovat několik záznamů tak už je to diametrálně jiné, samozřejmě se ale nesmí použít ten uvedený druhý zápis, ale uložení si COUNT(*).
Čísla na 180 000 záznamech:
InnoDB: 0.21sec (získání COUNT(*) z toho 0.16 sec)   vs.   0.29sec 
MyISAM: 0.08sec (získání COUNT(*) z toho 0.05 sec)   vs.   0.18sec
To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†
Heron avatar 15.10.2012 16:04 Heron | skóre: 50 | blog: root_at_heron | Olomouc
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
U MVCC databáze (tedy asi všechno krom MyISAM) je COUNT(*) velmi drahá operace. Musí se spočítat řádky platné v dané transakci.
okbob avatar 11.10.2012 18:13 okbob | skóre: 30 | blog: systemakuv_blog | Benešov
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
cost je hausnumero, to ještě nic nemusí znamenat - v každém případku použití ORDER BY RANDOM vede na sekvenční scan, což u velkých tabulek může být brzda - a tuplem, když je takový dotaz častý - pro tabulky do několikaseti řádků je to jedno, ale pak už to může zabolet. Viděl jsem server, kde významnou část zátěže produkoval podobný a pro většinu aplikací naprosto zbytný dotaz.
Heron avatar 15.10.2012 16:01 Heron | skóre: 50 | blog: root_at_heron | Olomouc
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
Ale v každém případě se provádí sekvenční scan celé tabulky a v tom druhém případě dokonce dvakrát. Pro normálně velké tabulky ten server tímto efektivně odstavíte.
17.10.2012 16:35 l0gik | skóre: 22
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon
U nepříliš děravé databáze, která neumí count bez prolejzání DB (většina MVCC) můž být zajímavé toto řešení:

SELECT MAX(id) FROM Tabulka INTO max
WHILE true:
   SELECT * FROM TABULKA WHERE id >= RANDOM() * max INTO rec
   SELECT COALESCE(MAX(id),0) FROM TABULKA WHERE id < rec.id INTO prev_id
   if RANDOM()<1.0/(rec.id - prev_id):
       return rec

   
Myšlenka je doufám jasná: využiju ID, random udělam na díru, a díry ošětřím tak, že záznam "za dírou" vrátím jen v patřičném podílu případů, v opačném selektuju znovu.

Nevýhoda je nedeterministický čas.

Založit nové vláknoNahoru

Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

ISSN 1214-1267   www.czech-server.cz
© 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.