abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    včera 17:11 | IT novinky

    Proběhla hackerská soutěž Pwn2Own Ireland 2025. Celkově bylo vyplaceno 1 024 750 dolarů za 73 unikátních zranitelností nultého dne (0-day). Vítězný Summoning Team si odnesl 187 500 dolarů. Shrnutí po jednotlivých dnech na blogu Zero Day Initiative (1. den, 2. den a 3. den) a na YouTube.

    Ladislav Hagara | Komentářů: 1
    včera 13:33 | Komunita

    Byl publikován říjnový přehled dění a novinek z vývoje Asahi Linuxu, tj. Linuxu pro Apple Silicon. Pracuje se na podpoře M3. Zanedlouho vyjde Fedora Asahi Remix 43. Vývojáře lze podpořit na Open Collective a GitHub Sponsors.

    Ladislav Hagara | Komentářů: 0
    25.10. 15:44 | Zajímavý software

    Iniciativa Open Device Partnership (ODP) nedávno představila projekt Patina. Jedná se o implementaci UEFI firmwaru v Rustu. Vývoj probíhá na GitHubu. Zdrojové kódy jsou k dispozici pod licencí Apache 2.0. Nejnovější verze Patiny je 13.0.0.

    Ladislav Hagara | Komentářů: 0
    25.10. 05:11 | Zajímavý článek

    Obrovská poptávka po plynových turbínách zapříčinila, že datová centra začala používat v generátorech dodávajících energii pro provoz AI staré dobré proudové letecké motory, konvertované na plyn. Jejich výhodou je, že jsou menší, lehčí a lépe udržovatelné než jejich průmyslové protějšky. Proto jsou ideální pro dočasné nebo mobilní použití.

    karkar | Komentářů: 8
    24.10. 19:55 | Nová verze

    Typst byl vydán ve verzi 0.14. Jedná se o rozšiřitelný značkovací jazyk a překladač pro vytváření dokumentů včetně odborných textů s matematickými vzorci, diagramy či bibliografií.

    Ladislav Hagara | Komentářů: 0
    24.10. 13:33 | Bezpečnostní upozornění

    Specialisté společnosti ESET zaznamenali útočnou kampaň, která cílí na uživatele a uživatelky v Česku a na Slovensku. Útočníci po telefonu zmanipulují oběť ke stažení falešné aplikace údajně od České národní banky (ČNB) nebo Národní banky Slovenska (NBS), přiložení platební karty k telefonu a zadání PINu. Malware poté v reálném čase přenese data z karty útočníkovi, který je bezkontaktně zneužije u bankomatu nebo na platebním terminálu.

    Ladislav Hagara | Komentářů: 20
    24.10. 13:22 | Upozornění

    V Ubuntu 25.10 byl balíček základních nástrojů gnu-coreutils nahrazen balíčkem rust-coreutils se základními nástroji přepsanými do Rustu. Ukázalo se, že nový "date" znefunkčnil automatickou aktualizaci. Pro obnovu je nutno balíček rust-coreutils manuálně aktualizovat.

    Ladislav Hagara | Komentářů: 13
    24.10. 04:55 | Komunita

    VST 3 je nově pod licencí MIT. S verzí 3.8.0 proběhlo přelicencování zdrojových kódů z licencí "Proprietary Steinberg VST3 License" a "General Public License (GPL) Version 3". VST (Virtual Studio Technology, Wikipedie) je softwarové rozhraní pro komunikaci mezi hostitelským programem a zásuvnými moduly (pluginy), kde tyto moduly slouží ke generování a úpravě digitálního audio signálu.

    Ladislav Hagara | Komentářů: 1
    24.10. 03:22 | Nová verze

    Open source 3D herní a simulační engine Open 3D Engine (O3DE) byl vydán v nové verzi 25.10. Podrobný přehled novinek v poznámkách k vydání.

    Ladislav Hagara | Komentářů: 0
    23.10. 20:11 | Komunita

    V Londýně probíhá dvoudenní Ubuntu Summit 25.10. Na programu je řada zajímavých přednášek. Zhlédnout je lze také na YouTube (23. 10. a 24. 10.).

    Ladislav Hagara | Komentářů: 0
    Jaké řešení používáte k vývoji / práci?
     (36%)
     (48%)
     (20%)
     (20%)
     (23%)
     (17%)
     (21%)
     (17%)
     (18%)
    Celkem 276 hlasů
     Komentářů: 14, poslední 14.10. 09:04
    Rozcestník

    Dotaz: OCR

    27.8.2013 08:18 juvi
    OCR
    Přečteno: 551×
    Zdravím, hledám nějaký OCR a našel jsem info, že slušně fungovalo Cuneiform. Ovšem (prohlídkou webu) mám dojem, že dnes to asi na Linuxu moc nejede a openocr.org se mi jeví poněkud mrtvé. Provozujete to někdo? Gocr moc slavné není, potřeboval bych něco lepšího.

    Odpovědi

    27.8.2013 08:39 onno
    Rozbalit Rozbalit vše Re: OCR
    yagf jako frontent pro cuneiform a tesseract.
    Luboš Doležel (Doli) avatar 27.8.2013 10:12 Luboš Doležel (Doli) | skóre: 98 | blog: Doliho blog | Kladensko
    Rozbalit Rozbalit vše Re: OCR
    Z mých zkušeností byl Tesseract vždy nejlepší. Cuneiform měl horší výsledky a ještě mi zahazoval diakritiku (ale to možná byla moje chyba).
    27.8.2013 10:25 onno
    Rozbalit Rozbalit vše Re: OCR
    ano, také mám lepší zkušenosti s Tesseractem.
    27.8.2013 15:48 Radun
    Rozbalit Rozbalit vše Re: OCR
    Problémy s češtinou u cuneiform v mém případě zmizely po vlastním překladu s patchem (na stránkách projektu), který řeší Bug #978183 .
    27.8.2013 09:30 Radovan Garabík
    Rozbalit Rozbalit vše Re: OCR
    ABBYY finereader. Je to síce platené, ale pomerne dobrý SW.
    27.8.2013 09:49 mica
    Rozbalit Rozbalit vše Re: OCR
    Dovolte, abych vás opravil. Nikoli poměrně dobrý, nýbrž velmi dobrý. K některým skenerům dodávána ořezaná verze (podpora omezeného počtu jazyků, nicméně mně angličtina a čeština bohatě stačí), i ta nicméně funguje velmi dobře.
    27.8.2013 09:57 Radovan Garabík
    Rozbalit Rozbalit vše Re: OCR
    Pomerne, lebo v linuxovej verzii sa nedajú natrénovať vlastné znaky, CLI má pomerne obskurnú voľbu parametrov (záleží na poradí!), nedokumentovane vyrába veľké dočasné súbory v /tmp (takže s tmpfs dopadne niekedy na hubu), nedá sa použiť vlastný spellchecker, nepodporuje SMP atď....

    Windows verzia je na tom lepšie.
    29.8.2013 07:21 mica
    Rozbalit Rozbalit vše Re: OCR
    Linuxovou verzi neznám, používám verzi pro Windows pod Wine a u ní jsem jmenované problémy nezaznamenal, takže moje hodnocení platí pro ni.
    27.8.2013 09:52 Sandik | skóre: 13 | blog: obcasny_obcasny_blog | Praha (když zrovna nejsem někde jinde ;o)
    Rozbalit Rozbalit vše Re: OCR
    Používám asi deset let starý ABBYY FineReader pro Win přes Wine. Funguje to spolehlivě, jenom mu musím předhodit jako "vstup" nikoli přímo scanner (na tom padá) ale předtím pomocí Gimpu a XSane vytvořené jpg soubory.
    ...
    Luboš Doležel (Doli) avatar 27.8.2013 09:58 Luboš Doležel (Doli) | skóre: 98 | blog: Doliho blog | Kladensko
    Rozbalit Rozbalit vše Re: OCR
    Já jsem zkoušel verzi pro Linux a ten program se mi pořádně ani nespustil a padal.
    27.8.2013 10:36 Sandik | skóre: 13 | blog: obcasny_obcasny_blog | Praha (když zrovna nejsem někde jinde ;o)
    Rozbalit Rozbalit vše Re: OCR
    Vůbec netuším, to to má i verzi pro Linux. Každopádně Windowsí verze, kterou jsem mimochodem kdysi kdesi získal zdarma, funguje spolehlivě. Poradí si s diakritikou, zvládá i formátované texty (sloupce, obrázky, nadpisy, tučné písmo a kurzivu), je sto schroustat i ne moc dobré fotky z digitálního foťáku. Prostě spokojenost.
    ...
    27.8.2013 10:49 Sandik | skóre: 13 | blog: obcasny_obcasny_blog | Praha (když zrovna nejsem někde jinde ;o)
    Rozbalit Rozbalit vše Re: OCR
    mělo být "že to má", sorry za ten překlep
    ...
    27.8.2013 14:03 Radun
    Rozbalit Rozbalit vše Re: OCR
    Celkem dlouho jsem zkoušel cuneiform i tesseract. Tesseract se mi zdál o něco lepší. U cuneiform jsem narazil na dvě chyby, které způsobily ukončení programu s chybou. Došlo k tomu vždy, pokud na stránce nebyl rozpoznán žádný text (např. prázdná stránka - prováděl jsem převod celé knihy automaticky) a pak tehdy, pokud bylo rozlišení větší než 3500px v libovolném směru.

    Tesseract má zřejmě o něco lépe vyřešen jakýsi pre-processing, který pomocí nastavení prahových hodnot černé bílé převede obrázek na 1-bit ČB. Pokud jsem totiž podstrčil programu cuneiform obrázek takto upravený pomocí imagemagick, pak byl výsledek slušný (asi stejný jako u tesseract); jinak u obrázeku 8-bit šedé (neupravený, rovnou ze scanneru) dopadlo rozpoznání lépe vždy za použití tesseract.

    (Oba programy podporují české znaky.)

    Pro jednorázovou akci < 100 stránek je také možné stáhnout demo verzi placeného abbyyocr9. Tento program jsem vyzkoušel a musím potvrdit, že i velmi nekvalitní text ze 100 let starých knih dokázal rozpoznat velmi slušně a přitom si také poradil se stíny, kazy a různými jinými nectnostmi; v tomto případě byl výsledek obou open source programů špatný ( byl jen o něco lepší při pracné úpravě pomocí imagemagick). Jakékoliv upravování obrázku pomocí imagemagick jsem u abbyyocr shledal jako zbytečné nebo horší. Nejlepší výsledek byl vždy rovnou s obrázkem ze scanneru (barevný i čb); program si s tím sám poradil nejlépe. Škoda jen že cena programu je v linux verzi vysoká a lincence je časově nebo od počtu stránek (už nevím přesně) omezená.

    Stejně dobré výsledky jako s abbyyocr se mi podařilo dosáhnout také s on-line OCR na www.onlineocr.net ; mám podezření, že jim tam běží stejný program. Pro převod pár stránek běžného textu je to asi nejlepší a nejrychlejší řešení.
    28.8.2013 22:34 jik
    Rozbalit Rozbalit vše Re: OCR
    Díky, tesseract se mi na OpenSUSE 12.3 podařilo nainstalovat. Budu zkoušet.

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.