abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 04:22 | Pozvánky

    Letos se uskuteční již 11. ročník soutěže v programování Kasiopea. Tato soutěž, (primárně) pro středoškoláky, nabízí skvělou příležitost procvičit logické myšlení a dozvědět se něco nového ze světa algoritmů – a to nejen pro zkušené programátory, ale i pro úplné začátečníky. Domácí kolo proběhne online od 22. 11. do 7. 12. 2025 a skládá se z 9 zajímavých úloh různé obtížnosti. Na výběru programovacího jazyka přitom nezáleží – úlohy jsou

    … více »
    SoutezKasiopea | Komentářů: 0
    dnes 04:11 | Nová verze

    Byla vydána nová verze 2.52.0 distribuovaného systému správy verzí Git. Přispělo 94 vývojářů, z toho 33 nových. Přehled novinek v příspěvku na blogu GitHubu a v poznámkách k vydání.

    Ladislav Hagara | Komentářů: 0
    včera 18:00 | Nová verze

    VKD3D-Proton byl vydán ve verzi 3.0. Jedná se fork knihovny vkd3d z projektu Wine pro Proton. Knihovna slouží pro překlad volání Direct3D 12 na Vulkan. V přehledu novinek je vypíchnuta podpora AMD FSR 4 (AMD FidelityFX Super Resolution 4).

    Ladislav Hagara | Komentářů: 0
    včera 03:11 | Nová verze

    Poštovní klient Thunderbird byl vydán v nové verzi 145.0. Podporuje DNS přes HTTPS nebo Microsoft Exchange skrze Exchange Web Services. Ukončena byla podpora 32bitového Thunderbirdu pro Linux.

    Ladislav Hagara | Komentářů: 0
    včera 02:33 | IT novinky

    U příležitosti státního svátku 17. listopadu probíhá na Steamu i GOG.com již šestý ročník Czech & Slovak Games Week aneb týdenní oslava a také slevová akce českých a slovenských počítačových her.

    Ladislav Hagara | Komentářů: 0
    16.11. 19:33 | Nová verze

    Byla vydána nová verze 9.19 z Debianu vycházející linuxové distribuce DietPi pro (nejenom) jednodeskové počítače. Přehled novinek v poznámkách k vydání. Vypíchnout lze například nový balíček BirdNET-Go, tj. AI řešení pro nepřetržité monitorování a identifikaci ptáků.

    Ladislav Hagara | Komentářů: 0
    16.11. 02:22 | Nová verze

    Byla vydána nová verze 3.38 frameworku Flutter (Wikipedie) pro vývoj mobilních, webových i desktopových aplikací a nová verze 3.10 souvisejícího programovacího jazyka Dart (Wikipedie).

    Ladislav Hagara | Komentářů: 0
    16.11. 01:33 | Nová verze

    Organizace Apache Software Foundation (ASF) vydala verzi 28 integrovaného vývojového prostředí a vývojové platformy napsané v Javě NetBeans (Wikipedie). Přehled novinek na GitHubu. Instalovat lze také ze Snapcraftu a Flathubu.

    Ladislav Hagara | Komentářů: 0
    15.11. 16:11 | Nová verze

    Byl vydán Debian 13.2, tj. druhá opravná verze Debianu 13 s kódovým názvem Trixie. Řešeny jsou především bezpečnostní problémy, ale také několik vážných chyb. Instalační média Debianu 13 lze samozřejmě nadále k instalaci používat. Po instalaci stačí systém aktualizovat.

    Ladislav Hagara | Komentářů: 0
    15.11. 12:11 | IT novinky

    Google představil platformu Code Wiki pro rychlejší porozumění existujícímu kódu. Code Wiki pomocí AI Gemini udržuje průběžně aktualizovanou strukturovanou wiki pro softwarové repozitáře. Zatím jenom pro veřejné. V plánu je rozšíření Gemini CLI také pro soukromé a interní repozitáře.

    Ladislav Hagara | Komentářů: 5
    Jaké řešení používáte k vývoji / práci?
     (35%)
     (46%)
     (18%)
     (18%)
     (23%)
     (15%)
     (23%)
     (16%)
     (16%)
    Celkem 360 hlasů
     Komentářů: 16, poslední 12.11. 18:21
    Rozcestník

    Dotaz: Analýza obrazu pro vytvoření úsporného PDFka

    6.5.2015 09:07 JanM | skóre: 28
    Analýza obrazu pro vytvoření úsporného PDFka
    Přečteno: 727×
    Dobré dopoledne,

    zaujala mne metoda scanneru Canon MF8450 (multifunkce), jak dosahuje malých souborů u naskenovaných kancelářských dokumentů - obraz prostě rozloží na části bitonální (CCITT) a plnobarevné (JPEG). V PDFku to naskládá přes sebe.

    Výsledkem je čistý, dobře čitelný dokument.

    Oproti tomu proklatě drahá skenovací stanice Kodak či ještě hůře kopírka Kodaku vždy vytvoří pouze jednu RGB bitmapu, takže chci-li alespoň trochu zmenšit soubor, tak nastupuje brutální JPEG komprese - čitelnost mizerná.
    $ pdfimages -list Canon\ MF8450\ 300dpi.pdf   
    page   num  type   width height color comp bpc  enc interp  object ID x-ppi y-ppi size ratio 
    -------------------------------------------------------------------------------------------- 
      1     0 image    1232  1728  rgb     3   8  jpeg   no         4  0   151   150 39.5K 0.6% 
      1     1 stencil  2352  2924  -       1   1  ccitt  no         5  0   300   300 37.6K 4.5% 
      1     2 stencil   648   236  -       1   1  ccitt  no         6  0   300   300 3300B  17% 
      1     3 stencil   320   136  -       1   1  ccitt  no         7  0   300   300  424B 7.8% 
    $ pdfimages -list Kodak\ scanner\ 300dpi\ text-graphics\ good-quality\ no-ocr.pdf  
    page   num  type   width height color comp bpc  enc interp  object ID x-ppi y-ppi size ratio 
    -------------------------------------------------------------------------------------------- 
      1     0 image    1232  1749  rgb     3   8  jpeg   yes       13  0   151   150  132K 2.1%
    Neznáte někdo linuxový nástroj, který by dokázal analyzovat a rozložit dokument podobně jako ten Canon?

    Odpovědi

    6.5.2015 09:18 #Tom | skóre: 32 | blog: Inspirace, aneb co jsem kde vyhrabal
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Před několika lety jsem totéž řešil pro účely scanování do DJVU. Napsal jsem si scheme skript pro Gimp, který postupoval přibližně tak, že vybral vše černé oddělil to do samostatné vrstvy, a tyto dvě vrstvy odděleně uložil do souborů. Potom následoval převod do DJVU vrstev a jejich složení do výsledné stránky. Ve výsledku vypadal dobře, text, obrázky byly oddělením černé složky mírně poškozeny, protože i jich se týkalo skládání vrstev.

    CCITT Group 4 umí určitě ImageMagick pro TIFF formát, jestli to dokáže i pro PDF, to nevím, ale obyčejné PNG by taky stačilo. Na barvy by šel možná i JPEG-2000. Dvě složky v oddělených PDF souborech lze spojit třeba pomocí PDFTK, kde jedna poslouží jako pozadí a druhá jako popředí.

    Skript pro Gimp (snad 2.2) ještě někde mám, ale vím, že v novějších verzích nefunguje.
    6.5.2015 09:57 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Kdybyste jej našel, to byste mne potěšil.
    15.5.2015 23:34 #Tom | skóre: 32 | blog: Inspirace, aneb co jsem kde vyhrabal
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Příloha:
    Nakonec jsem to našel, a funguje to zcela bez úprav za předpokladu, že se doplní chybějící funkce strcspn. Aby byl výsledek rozumný, je třeba správně předvolit práh pro převod na černobílou složku. Pro zajímavost přikládám i skripty pro převod PNG na dvouvrstvé DJVU.

    Skripty SCM je třeba nahrát do $HOME/.gimp-2.X/scripts. Oddělovač barevných vrstev lze použít nejenom dávkově, ale lze jej vyvolat i z nabídky Filters. Pracuje však jen se soubory na disku, ne s otevřenými obrázky.
    4.6.2015 23:44 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Funguje. Najdu-li čas, zkusím si s tím pohrát.
    6.5.2015 09:53 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Příloha:
    Ještě přikládám ukázku.
    16.5.2015 09:47 Radovan Garabik
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Neznáte někdo linuxový nástroj, který by dokázal analyzovat a rozložit dokument podobně jako ten Canon?
    didjvu

    len, pravda, je to na prevod do djvu...
    4.6.2015 23:25 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Zajímavé. Pro vlastní použití je djvu v pohodě, ale pro sdílení přece jen PDF kraluje.

    Zkoušel jsem separovat následný djvu produkt, pomocí djvuextract se mi podařilo získat monochromatickou masku (text + desaturovaná barevná grafika), pozadí (které zahodím) a popředí (které nese informaci o barvě).

    Potíž s popředím je, že je ve formátu IW44, a nepřišel jsem na to, jak to rozumně zkombinovat s maskou a vytvořit samostatné bitmapy pro čistě černobílý text a barevnou grafiku, abych to poté mohl ve vrstvách složit do PDF.

    Poslední krok by šel provést jako složení černobílého textu z masky a navrch barevné vrstvy pomocí pdftk (pdf + stamp). Asi by to nebylo tak dobré, jako to zvládá skener Canon, ale mohlo by stačit.
    2.10.2015 22:32 JanM | skóre: 28
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Zatím jsem moc nepokročil (protože: není čas), raději skenuji na té správné mašině ;-)

    Nicméně dnes mne zaujalo, že v LibreOffice (který jinak moc nepoužívám) lze pracovat s průhledností obrázků (tj. skládat je přes sebe) a jeho přímý export do PDF funguje obdobně jako výše popsaný skener Canon, tj. kombinuje JPEG, PNG a CCITT vč. masek pro průhlednost. To by byla vícevrstvá alternativa k pdftk.

    export přes libreoffice.

    Jen ještě dořešit potíž s kvalitním rozkladem obrazu.
    16.5.2015 21:54 safs
    Rozbalit Rozbalit vše Re: Analýza obrazu pro vytvoření úsporného PDFka
    Zajimavy trik.

    Pri tomhle se pouziva vlastnost lidskeho oka, ktere vnima podstatne vetsi rozliseni v cernobile a mnohem hure v barvach. Proto maji cernobile tiskarny rozliseni 600dpi a vic (u 400 dpi je to opravdu videt), kdezto barevne snimky maji klidne 120dpi a nikdo si toho ani nevsimne.

    Rada je asi jasna, rozlozit snimek na intensitu a barevne kanaly, barve zmensit rozliseni a zkopresovat. Nezvladnul by to ImageMagick?

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.