abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 15:00 | Zajímavý článek

    Byl publikován přehled vývoje renderovacího jádra webového prohlížeče Servo (Wikipedie) za uplynulé dva měsíce. Servo zvládne už i Gmail. Zakázány jsou příspěvky generované pomocí AI.

    Ladislav Hagara | Komentářů: 0
    včera 17:22 | Nová verze

    Raspberry Pi Connect, tj. oficiální služba Raspberry Pi pro vzdálený přístup k jednodeskovým počítačům Raspberry Pi z webového prohlížeče, byla vydána v nové verzi 2.5. Nejedná se už o beta verzi.

    Ladislav Hagara | Komentářů: 0
    včera 15:22 | Komunita

    Google zveřejnil seznam 1272 projektů (vývojářů) od 185 organizací přijatých do letošního, již jednadvacátého, Google Summer of Code. Plánovaným vylepšením v grafických a multimediálních aplikacích se věnuje článek na Libre Arts.

    Ladislav Hagara | Komentářů: 0
    8.5. 19:22 | Nová verze

    Byla vydána (𝕏) dubnová aktualizace aneb nová verze 1.100 editoru zdrojových kódů Visual Studio Code (Wikipedie). Přehled novinek i s náhledy a videi v poznámkách k vydání. Ve verzi 1.100 vyjde také VSCodium, tj. komunitní sestavení Visual Studia Code bez telemetrie a licenčních podmínek Microsoftu.

    Ladislav Hagara | Komentářů: 0
    8.5. 18:00 | Nová verze

    Open source platforma Home Assistant (Demo, GitHub, Wikipedie) pro monitorování a řízení inteligentní domácnosti byla vydána v nové verzi 2025.5.

    Ladislav Hagara | Komentářů: 0
    8.5. 01:22 | Nová verze Ladislav Hagara | Komentářů: 0
    8.5. 00:55 | Zajímavý projekt

    PyXL je koncept procesora, ktorý dokáže priamo spúštat Python kód bez nutnosti prekladu ci Micropythonu. Podľa testov autora je pri 100 MHz približne 30x rýchlejší pri riadeni GPIO nez Micropython na Pyboard taktovanej na 168 MHz.

    vlk | Komentářů: 0
    7.5. 19:44 | Nová verze

    Grafana (Wikipedie), tj. open source nástroj pro vizualizaci různých metrik a s ní související dotazování, upozorňování a lepší porozumění, byla vydána ve verzi 12.0. Přehled novinek v aktualizované dokumentaci.

    Ladislav Hagara | Komentářů: 0
    7.5. 17:33 | Nová verze

    Raspberry Pi OS, oficiální operační systém pro Raspberry Pi, byl vydán v nové verzi 2025-05-06. Přehled novinek v příspěvku na blogu Raspberry Pi a poznámkách k vydání. Pravděpodobně se jedná o poslední verzi postavenou na Debianu 12 Bookworm. Následující verze by již měla být postavena na Debianu 13 Trixie.

    Ladislav Hagara | Komentářů: 0
    7.5. 05:33 | Komunita

    Richard Stallman dnes v Liberci přednáší o svobodném softwaru a svobodě v digitální společnosti. Od 16:30 v aule budovy G na Technické univerzitě v Liberci. V anglickém jazyce s automaticky generovanými českými titulky. Vstup je zdarma i pro širokou veřejnost.

    Ladislav Hagara | Komentářů: 17
    Jaký filesystém primárně používáte?
     (57%)
     (1%)
     (8%)
     (22%)
     (4%)
     (2%)
     (2%)
     (1%)
     (1%)
     (3%)
    Celkem 571 hlasů
     Komentářů: 26, poslední 8.5. 09:58
    Rozcestník

    Administrace komentářů

    Jste na stránce určené pro řešení chyb a problémů týkajících se diskusí a komentářů. Můžete zde našim administrátorům reportovat špatně zařazenou či duplicitní diskusi, vulgární či osočující příspěvek a podobně. Děkujeme vám za vaši pomoc, více očí více vidí, společně můžeme udržet vysokou kvalitu AbcLinuxu.cz.

    Příspěvek
    12.3.2019 13:26 EtDirloth | skóre: 11
    Rozbalit Rozbalit vše Re: postgres optimalizace dotazu
    Velmi pekna uloha!

    Postgresql zial nevie efektivne pouzit index pre group by - pouzije index only scan iba ked sa mu zakaze seq. scan.

    Najprv definica tabulky, a simulacia tvojich dat: (testovane na pg11)
    --DROP TABLE IF EXISTS van;
    CREATE TABLE van (
       rodatum timestamp
     , server  integer NOT NULL
     , vanview integer NOT NULL
    );
    -- populate with 10M of records with 25 distinct combinations of server & vanview
    INSERT INTO van (server, vanview, rodatum)
       SELECT (random() * 4)::int
            , (random() * 4+5)::int
            , ts + ((random() * 5000)::int || 'seconds')::interval
          FROM generate_series('2000-01-01'::timestamp, now(), '1minute') AS x(ts)
    ;
    
    SELECT count(*) FROM van;
    -- 10095150
    SELECT count(*) FROM van GROUP BY (server, vanview);
    -- (25 rows)
    Jednotlive stlpce vo viacstlpcovych indexoch je potrebne radit v poradi selektivity a znovupouzitelnosti. Ak query filtruje len podla niektorych stlpcov indexu zlava, vie ho pouzit. A preto sa pouzije index ix_van_server_vanview_rodatum na SELECT min(server), ale uz nie na SELECT min(vanview).
     -- used by min(server), max(rodatum) per server&vanview
    CREATE INDEX ix_van_server_vanview_rodatum ON van (server, vanview, rodatum DESC NULLS LAST);
     -- used by min(vanview)
    CREATE INDEX ix_van_vanview ON van (vanview);
    Test tvojej query pre porovnanie casov:
    EXPLAIN (BUFFERS, ANALYZE) select max(rodatum), server, vanview  FROM van GROUP BY server, vanview;
    -- actual time=1791.880..1791.936
    -- Parallel Seq Scan on van
    Pouzil sa Seq scan, napriek tomu, ze existuje ix_van_server_vanview_rodatum, skusim ho zakazat:
    SET enable_seqscan = OFF;
    EXPLAIN (BUFFERS, ANALYZE) select max(rodatum), server, vanview  FROM van GROUP BY server, vanview;
    -- actual time=218.738..3580.570
    -- Parallel Index Only Scan using ix_van_server_vanview_rodatum
    
    ...este pomalsie - zda sa, ze planner funguje spravne

    Kedze mame pomerne male mnozstvo kombinacii ((count(server)*count(vanview))==25), napadlo ma pouzit index ix_van_server_vanview_rodatum tak, ze mu podsuniem 25 roznych hodnot, co by bezalo so zlozitostou O(25 log 10^7). Takze potrebujem ziskat 25 unikatnych hodnot. Lenze SELECT DISTINCT je este pomalsi, nez SELECT server, vanview GROUP BY server, vanview:
    SELECT DISTINCT server, vanview FROM van
    -- Time: 1878,862 ms (00:01,879)
    SELECT server, vanview FROM van GROUP BY server,vanview
    -- Time: 980,318 ms
    Korelovana subquery je potom obmedzena pomalostou DISTINCT/GROUP-BY:
    SELECT max(rodatum), server, vanview
       FROM van
       WHERE (server,vanview) IN (SELECT DISTINCT server, vanview FROM van)
       GROUP BY server,vanview
    ;
    -- Time: 5028,114 ms (00:05,028)
    
    SELECT (
       SELECT max(v.rodatum)
          FROM van AS v
          WHERE (v.server, v.vanview) = (vv.server, vv.vanview)
       ), server, vanview
       FROM (SELECT server, vanview FROM van GROUP BY server,vanview) AS vv
       GROUP BY server, vanview
    ;
    --Time: 984,181 ms
    ...je vidiet mierne zrychlenie, ale stale sme v radoch sekund.

    A tu prichadza trik s rekurzivnou CTE pre indexovany DISTINCT v kombinacii s horeuvedenou korelovanou subquery:
    --EXPLAIN (BUFFERS, ANALYZE) 
    WITH RECURSIVE t AS (
       SELECT min(server) AS s FROM van
       UNION ALL
       SELECT (SELECT min(server) FROM van WHERE server > t.s)
       FROM t WHERE t.s IS NOT NULL
    )
    , tt AS (
       SELECT min(vanview) AS v FROM van
       UNION ALL
       SELECT (SELECT min(vanview) FROM van WHERE vanview > tt.v)
       FROM tt WHERE tt.v IS NOT NULL
    )
    SELECT (
       SELECT max(rodatum)
          FROM van
          WHERE server = s
            AND vanview = v
       ), s, v
       FROM t, tt
       WHERE s IS NOT NULL
         AND v IS NOT NULL
    ;
    -- Time: 1,679 ms
    
    Pre vysvetlenie vid https://wiki.postgresql.org/wiki/Loose_indexscan

    V tomto formuláři můžete formulovat svou stížnost ohledně příspěvku. Nejprve vyberte typ akce, kterou navrhujete provést s diskusí či příspěvkem. Potom do textového pole napište důvody, proč by měli admini provést vaši žádost, problém nemusí být patrný na první pohled. Odkaz na příspěvek bude přidán automaticky.

    Vaše jméno
    Váš email
    Typ požadavku
    Slovní popis
    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.