Přihlášení | Registrace

napište » Zprávičky

Reportáž z ceremonie podpisu kořenové zóny DNS

dnes 15:44 | Zajímavý článek

Ondřej Filip publikoval reportáž z ceremonie podpisu kořenové zóny DNS. Zhlédnout lze také jeho nedávnou přednášku Jak se podepisuje kořenová zóna Internetu v rámci cyklu Fyzikální čtvrtky FEL ČVUT.

Ladislav Hagara | Komentářů: 0

Monitory určené pro programátory?

dnes 14:22 | IT novinky

Společnost BenQ uvádí na trh novou řadu monitorů RD určenou pro programátory. První z nich je RD240Q.

Ladislav Hagara | Komentářů: 7

Superpočítač Frontier nadále zůstává nejvýkonnějším superpočítačem na světě (TOP500 06/2024)

dnes 13:00 | IT novinky

Byl aktualizován seznam 500 nejvýkonnějších superpočítačů na světě TOP500. Nejvýkonnějším superpočítačem nadále zůstává Frontier od HPE (Cray) s výkonem 1,206 exaFLOPS. Druhá Aurora má oproti loňsku přibližně dvojnásobný počet jader a dvojnásobný výkon: 1,012 exaFLOPS. Novým počítačem v první desítce je na 6. místě Alps. Novým českým počítačem v TOP500 je na 112. místě C24 ve Škoda Auto v Mladé Boleslavi. Ostravská Karolina, GPU

… více »

Ladislav Hagara | Komentářů: 0

GHC (Glasgow Haskell Compiler) 9.10.1

dnes 10:11 | Nová verze

GHC (Glasgow Haskell Compiler, Wikipedie), tj. překladač funkcionálního programovacího jazyka Haskell (Wikipedie), byl vydán ve verzi 9.10.1. Přehled novinek v poznámkách k vydání.

Ladislav Hagara | Komentářů: 0

Linux 6.9

dnes 09:22 | Nová verze

Po 9 týdnech vývoje od vydání Linuxu 6.8 oznámil Linus Torvalds vydání Linuxu 6.9. Přehled novinek a vylepšení na LWN.net: první a druhá polovina začleňovacího okna. Později také na Linux Kernel Newbies.

Ladislav Hagara | Komentářů: 1

Pingora 0.2.0

11.5. 18:22 | Nová verze

Byla vydána verze 0.2.0 v Rustu napsaného frameworku Pingora pro vytváření rychlých, spolehlivých a programovatelných síťových systémů. Společnost Cloudflare jej letos v únoru uvolnila pod licencí Apache 2.0.

Ladislav Hagara | Komentářů: 0

xrdp 0.10.0

10.5. 19:11 | Nová verze

Open source RDP (Remote Desktop Protocol) server xrdp (Wikipedie) byl vydán ve verzi 0.10.0. Z novinek je vypíchnuta podpora GFX (Graphic Pipeline Extension). Nová větev řeší také několik bezpečnostních chyb.

Ladislav Hagara | Komentářů: 16

Rocky Linux 9.4

10.5. 04:11 | Nová verze

Rocky Linux byl vydán v nové stabilní verzi 9.4. Přehled novinek v poznámkách k vydání.

Ladislav Hagara | Komentářů: 0

Dellu byla odcizena databáze zákazníků

9.5. 22:22 | Bezpečnostní upozornění

Dellu byla odcizena databáze zákazníků (jméno, adresa, seznam zakoupených produktů) [Customer Care, Bleeping Computer].

Ladislav Hagara | Komentářů: 22

Kdy Zed na Linuxu?

9.5. 21:11 | Zajímavý článek

V lednu byl otevřen editor kódů Zed od autorů editoru Atom a Tree-sitter. Tenkrát běžel pouze na macOS. Byl napevno svázán s Metalem. Situace se ale postupně mění. V aktuálním příspěvku Kdy Zed na Linuxu? na blogu Zedu vývojáři popisují aktuální stav. Blíží se alfa verze.

Ladislav Hagara | Komentářů: 61

Centrum | Napsat | Starší

navrhněte » Anketa

Podle hypotézy Mrtvý Internet mj. tvoří většinu online interakcí boti.

Jsem bot. (71%)

Jsem člověk. (7%)

Opravdu jsem člověk! (11%)

Jsem něco jiného. (12%)

Celkem 213 hlasů

Komentářů: 14, poslední dnes 15:03

Rozcestník

AbcLinuxu

HDmag.cz

AbcLinuxu:/ Poradna / Databázová poradna / MySQL ORDER BY RAND() a výkon

Štítky: databáze, limit, MySQL, výkon

Dotaz: MySQL ORDER BY RAND() a výkon

9.10.2012 20:09 filbar | skóre: 36 | blog: Denicek_programatora | Ostrava
MySQL ORDER BY RAND() a výkon

Přečteno: 1172×

Odpovědět | Admin

V jednom modulu webové aplikace jsem se setkal s

ORDER BY RAND()
LIMIT 1

jak je na tom takový dotaz s výkonností? Tuším správně, že je to pro výkonnost špatné?

Nástroje: Začni sledovat (1) ?

Odpovědi

9.10.2012 20:19 MMMMMMMMM | skóre: 44 | blog: unstable | Valašsko :-)
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

Je to čiré zlo. :) https://www.google.cz/search?q=order+by+rand+mysql+alternative

Linux Dokumentační Projekt - PDF ke stažení

9.10.2012 21:21 kuka
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

To predevsim zalezi, ceho se to tyka. Jestli to pracuje treba nad 100 zaznamy, tak na tom urcite nic spatneho neni. Podobne pokud to jednou mesicne vylosuje jednoho uzivatele, nebude vadit, ze to pobezi nekolik minut, naopak pokud se to vola stokrat za minutu, musi to bezet radove desetiny sekundy atd.

10.10.2012 12:46 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

To je ale kravina, znám lepší způsoby jak zatížit server.
Velmi výkonné je to na M$SQL, ale zas to nedělá to, co by se očekávalo :-)

To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†

10.10.2012 13:35 AraxoN | skóre: 47 | blog: slon_v_porcelane | Košice
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

jj, MS SQL vygeneruje rovnaké náhodné číslo pre všetky riadky. To je prosímpekne vlastnosť, nie chyba! :-D

11.10.2012 12:01 Josef Kufner | skóre: 70
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

Potíž je v tom, že MySQL si napřed vygeneruje ke každému řádku náhodné číslo, pak řádky podle tohoto čísla seřadí a nakonec veme ten první. Takže si potřebuje udělat dočasnou tabulku, která pojme všechny řádky ve zdrojové tabulce (tedy alespoň ta náhodná čísla), tu pak seřadit a nakonec zahodit, protože je potřeba jen jeden řádek.

Pokud chceš jen jeden náhodný řádek, dej RAND() * (SELECT COUNT(*)) do offsetu v LIMIT.

Pokud chceš řádků více, je to trochu těžší. Pro několik málo řádků prostě volej jednořádkovou variantu kolikrát potřebuješ. Pro hodně řádků, pokud máš jako primární klíč celá čísla, můžeš vygenerovat seznam náhodných ID a pak si o ně říct. Pokud jsou ID děravá, tak to spustíš vícekrát, dokud nedostaneš požadovaný počet (můžeš ID vygenerovat pár navíc aby jsi omezil počet dotazů).

Hello world ! Segmentation fault (core dumped)

11.10.2012 15:19 AraxoN | skóre: 47 | blog: slon_v_porcelane | Košice
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

Možno to platí len pre postgresql, ale výhodnejšie je ORDER BY RANDOM(), než OFFSET RANDOM() * SELECT COUNT():

EXPLAIN SELECT * FROM test ORDER BY RANDOM() LIMIT 1;
                                     QUERY PLAN
-------------------------------------------------------------------------------------
 Limit  (cost=19755.35..19755.36 rows=1 width=1162)
   ->  Sort  (cost=19755.35..20165.12 rows=163906 width=1162)
         Sort Key: (random())
         ->  Seq Scan on test  (cost=0.00..18935.83 rows=163906 width=1162)
(4 rows)

EXPLAIN SELECT * FROM test LIMIT 1 OFFSET RANDOM()*(SELECT COUNT(*) FROM test);
                                     QUERY PLAN
------------------------------------------------------------------------------------
 Limit  (cost=20788.49..20788.60 rows=1 width=1162)
   InitPlan 1 (returns $0)
     ->  Aggregate  (cost=18935.83..18935.84 rows=1 width=0)
           ->  Seq Scan on test  (cost=0.00..18526.06 rows=163906 width=0)
   ->  Seq Scan on test  (cost=0.00..18526.06 rows=163906 width=1162)
(5 rows)

Cost prvej možnosti je nižší než druhej.

11.10.2012 16:33 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

Záleží na tom jak moc je efektivní 'COUNT(*)' a nad jak velkými daty se to dělá.
U mě na MySQL (InnoDB i MyISAM) nad tabulkou s několika záznamy je ekvivalent druhého zápisu také rychlejší, ale s např. 180000 záznamy už ne (použil jsem co jsem měl po ruce - proto to číslo), ale celé je to o tom, že nejdéle trvá 'SELECT COUNT(*)…', pokud tedy budu losovat několik záznamů tak už je to diametrálně jiné, samozřejmě se ale nesmí použít ten uvedený druhý zápis, ale uložení si COUNT(*).
Čísla na 180 000 záznamech:

InnoDB: 0.21sec (získání COUNT(*) z toho 0.16 sec)   vs.   0.29sec 
MyISAM: 0.08sec (získání COUNT(*) z toho 0.05 sec)   vs.   0.18sec

To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†

15.10.2012 16:04 Heron | skóre: 53 | blog: root_at_heron | Olomouc
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

U MVCC databáze (tedy asi všechno krom MyISAM) je COUNT(*) velmi drahá operace. Musí se spočítat řádky platné v dané transakci.

Heron

11.10.2012 18:13 okbob | skóre: 30 | blog: systemakuv_blog | Benešov
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

cost je hausnumero, to ještě nic nemusí znamenat - v každém případku použití ORDER BY RANDOM vede na sekvenční scan, což u velkých tabulek může být brzda - a tuplem, když je takový dotaz častý - pro tabulky do několikaseti řádků je to jedno, ale pak už to může zabolet. Viděl jsem server, kde významnou část zátěže produkoval podobný a pro většinu aplikací naprosto zbytný dotaz.

15.10.2012 16:01 Heron | skóre: 53 | blog: root_at_heron | Olomouc
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

Ale v každém případě se provádí sekvenční scan celé tabulky a v tom druhém případě dokonce dvakrát. Pro normálně velké tabulky ten server tímto efektivně odstavíte.

Heron

17.10.2012 16:35 l0gik | skóre: 22
Rozbalit Rozbalit vše Re: MySQL ORDER BY RAND() a výkon

U nepříliš děravé databáze, která neumí count bez prolejzání DB (většina MVCC) můž být zajímavé toto řešení:


SELECT MAX(id) FROM Tabulka INTO max
WHILE true:
   SELECT * FROM TABULKA WHERE id >= RANDOM() * max INTO rec
   SELECT COALESCE(MAX(id),0) FROM TABULKA WHERE id < rec.id INTO prev_id
   if RANDOM()<1.0/(rec.id - prev_id):
       return rec

Myšlenka je doufám jasná: využiju ID, random udělam na díru, a díry ošětřím tak, že záznam "za dírou" vrátím jen v patřičném podílu případů, v opačném selektuju znovu.

Nevýhoda je nedeterministický čas.

Založit nové vlákno • Nahoru

Tiskni Sdílej:

Píšeme jinde

ISSN 1214-1267 www.czech-server.cz

Redakce | Inzerce | Podmínky použití | Osobní údaje