abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
eParkomat, startup z ČR, postoupil mezi finalisty evropského akcelerátoru ChallengeUp!
Robot na pivo mu otevřel dveře k opravdovému byznysu
Internet věcí: Propojený svět? Už se to blíží...
včera 17:02 | Pozvánky

Přijďte si popovídat o open source obecně a openSUSE konkrétně s dalšími uživateli a vývojáři. Oslava nového vydání openSUSE Leap se uskuteční 16. prosince od 17:00 v nových prostorách firmy SUSE v Praze. K dispozici bude nějaké občerstvení a DVD pro ty, kdo je sbírají nebo ještě mají mechaniku. Po párty v kanceláři se bude pokračovat v některé z hospod v okolí.

Miška | Komentářů: 7
včera 14:55 | Zajímavý software

Byla vydána verze Alpha 1.0 otevřeného operačního systému pro chytré hodinky AsteroidOS. Podporovány jsou hodinky LG G Watch, LG G Watch Urbane, Asus ZenWatch 2 a Sony Smartwatch 3. Ukázka ovládání hodinek na YouTube. Jaroslav Řezník přednášel o AsteroidOS na chytrých hodinkách (videozáznam) na letošní konferenci OpenAlt.

Ladislav Hagara | Komentářů: 0
včera 13:30 | Zajímavý software

Byly uvolněny zdrojové kódy známé rogue-like hry DoomRL. Počátky hry jsou v roce 2002. Je napsána ve FreePascalu a zdrojový kód je nyní k dispozici na GitHubu pod licencí GNU GPL 2.0. Autor pracuje na nové hře Jupiter Hell, která je moderním nástupcem DoomRL a na jejíž vývoj shání peníze prostřednictvím Kickstarteru.

Blaazen | Komentářů: 0
včera 13:15 | Pozvánky

Přijďte s námi oslavit vydání Fedory 25. Na programu budou přednášky o novinkách, diskuse, neřízený networking atd. Release Party se bude konat 16. prosince v prostorách společnosti Etnetera. Na party budou volně k dispozici také propagační materiály, nová DVD s Fedorou 25 a samozřejmě občerstvení. Přednášky budou probíhat v češtině. Pro více informací se můžete podívat na web MojeFedora.cz. Jen připomínám, že tentokrát jsme zavedli

… více »
frantisekz | Komentářů: 0
9.12. 16:38 | Komunita

Byly zveřejněny videozáznamy přednášek a workshopů z letošní konference OpenAlt konané 5. a 6. listopadu v Brně. K videozáznamům lze přistupovat ze stránky na SuperLectures nebo přes program konference, detaily o vybrané přednášce nebo workshopu a dále kliknutím na ikonku filmového pásu. Celkově bylo zpracováno 65 hodin z 89 přednášek a workshopů.

Ladislav Hagara | Komentářů: 0
9.12. 11:30 | Komunita

Bylo oznámeno, že bude proveden bezpečnostní audit zdrojových kódů open source softwaru pro implementaci virtuálních privátních sítí OpenVPN. Audit provede Matthew D. Green (blog), uznávaný kryptolog a profesor na Univerzitě Johnse Hopkinse. Auditována bude verze 2.4 (aktuálně RC 1, stabilní verze je 2.3.14). Audit bude financován společností Private Internet Access [reddit].

Ladislav Hagara | Komentářů: 4
9.12. 06:00 | Komunita

Na YouTube byl publikován Blender Institute Reel 2016, ani ne dvouminutový sestřih z filmů, které vznikly za posledních 10 let díky Blender Institutu. V institutu aktuálně pracují na novém filmu Agent 327. Dění kolem filmu lze sledovat na Blender Cloudu. Videoukázka Agenta 327 z června letošního roku na YouTube.

Ladislav Hagara | Komentářů: 0
9.12. 01:02 | Zajímavý článek

Minulý týden byly vydány verze 1.2.3 a 1.1.7 webového poštovního klienta Roundcube. V oznámení o vydání bylo zmíněno řešení bezpečnostního problému nalezeného společností RIPS a souvisejícího s voláním funkce mail() v PHP. Tento týden byly zveřejněny podrobnosti. Útočník mohl pomocí speciálně připraveného emailu spustit na serveru libovolný příkaz. Stejně, jak je popsáno v článku Exploit PHP’s mail() to get remote code execution z roku 2014.

Ladislav Hagara | Komentářů: 1
8.12. 16:00 | Nová verze

Byla vydána verze 0.98 svobodného nelineárního video editoru Pitivi. Z novinek lze zmínit například přizpůsobitelné klávesové zkratky. Videoukázka práce s nejnovější verzí Pitivi na YouTube.

Ladislav Hagara | Komentářů: 1
8.12. 15:00 | Zajímavý software

Stop motion je technika animace, při níž je reálný objekt mezi jednotlivými snímky ručně upravován a posouván o malé úseky, tak aby po spojení vyvolala animace dojem spojitosti. Jaký software lze pro stop motion použít na Linuxu? Článek na OMG! Ubuntu! představuje Heron Animation. Ten bohužel podporuje pouze webové kamery. Podpora digitálních zrcadlovek je začleněna například v programu qStopMotion.

Ladislav Hagara | Komentářů: 5
Kolik máte dat ve svém domovském adresáři na svém primárním osobním počítači?
 (32%)
 (23%)
 (29%)
 (7%)
 (5%)
 (3%)
Celkem 810 hlasů
 Komentářů: 50, poslední 29.11. 15:50
Rozcestník
Reklama

Dotaz: OCR

27.8.2013 08:18 juvi
OCR
Přečteno: 477×
Zdravím, hledám nějaký OCR a našel jsem info, že slušně fungovalo Cuneiform. Ovšem (prohlídkou webu) mám dojem, že dnes to asi na Linuxu moc nejede a openocr.org se mi jeví poněkud mrtvé. Provozujete to někdo? Gocr moc slavné není, potřeboval bych něco lepšího.

Odpovědi

27.8.2013 08:39 onno
Rozbalit Rozbalit vše Re: OCR
yagf jako frontent pro cuneiform a tesseract.
Luboš Doležel (Doli) avatar 27.8.2013 10:12 Luboš Doležel (Doli) | skóre: 98 | blog: Doliho blog | Kladensko
Rozbalit Rozbalit vše Re: OCR
Z mých zkušeností byl Tesseract vždy nejlepší. Cuneiform měl horší výsledky a ještě mi zahazoval diakritiku (ale to možná byla moje chyba).
27.8.2013 10:25 onno
Rozbalit Rozbalit vše Re: OCR
ano, také mám lepší zkušenosti s Tesseractem.
27.8.2013 15:48 Radun
Rozbalit Rozbalit vše Re: OCR
Problémy s češtinou u cuneiform v mém případě zmizely po vlastním překladu s patchem (na stránkách projektu), který řeší Bug #978183 .
27.8.2013 09:30 Radovan Garabík
Rozbalit Rozbalit vše Re: OCR
ABBYY finereader. Je to síce platené, ale pomerne dobrý SW.
27.8.2013 09:49 mica
Rozbalit Rozbalit vše Re: OCR
Dovolte, abych vás opravil. Nikoli poměrně dobrý, nýbrž velmi dobrý. K některým skenerům dodávána ořezaná verze (podpora omezeného počtu jazyků, nicméně mně angličtina a čeština bohatě stačí), i ta nicméně funguje velmi dobře.
27.8.2013 09:57 Radovan Garabík
Rozbalit Rozbalit vše Re: OCR
Pomerne, lebo v linuxovej verzii sa nedajú natrénovať vlastné znaky, CLI má pomerne obskurnú voľbu parametrov (záleží na poradí!), nedokumentovane vyrába veľké dočasné súbory v /tmp (takže s tmpfs dopadne niekedy na hubu), nedá sa použiť vlastný spellchecker, nepodporuje SMP atď....

Windows verzia je na tom lepšie.
29.8.2013 07:21 mica
Rozbalit Rozbalit vše Re: OCR
Linuxovou verzi neznám, používám verzi pro Windows pod Wine a u ní jsem jmenované problémy nezaznamenal, takže moje hodnocení platí pro ni.
27.8.2013 09:52 Sandik | skóre: 13 | blog: obcasny_obcasny_blog | Praha (když zrovna nejsem někde jinde ;o)
Rozbalit Rozbalit vše Re: OCR
Používám asi deset let starý ABBYY FineReader pro Win přes Wine. Funguje to spolehlivě, jenom mu musím předhodit jako "vstup" nikoli přímo scanner (na tom padá) ale předtím pomocí Gimpu a XSane vytvořené jpg soubory.
...
Luboš Doležel (Doli) avatar 27.8.2013 09:58 Luboš Doležel (Doli) | skóre: 98 | blog: Doliho blog | Kladensko
Rozbalit Rozbalit vše Re: OCR
Já jsem zkoušel verzi pro Linux a ten program se mi pořádně ani nespustil a padal.
27.8.2013 10:36 Sandik | skóre: 13 | blog: obcasny_obcasny_blog | Praha (když zrovna nejsem někde jinde ;o)
Rozbalit Rozbalit vše Re: OCR
Vůbec netuším, to to má i verzi pro Linux. Každopádně Windowsí verze, kterou jsem mimochodem kdysi kdesi získal zdarma, funguje spolehlivě. Poradí si s diakritikou, zvládá i formátované texty (sloupce, obrázky, nadpisy, tučné písmo a kurzivu), je sto schroustat i ne moc dobré fotky z digitálního foťáku. Prostě spokojenost.
...
27.8.2013 10:49 Sandik | skóre: 13 | blog: obcasny_obcasny_blog | Praha (když zrovna nejsem někde jinde ;o)
Rozbalit Rozbalit vše Re: OCR
mělo být "že to má", sorry za ten překlep
...
27.8.2013 14:03 Radun
Rozbalit Rozbalit vše Re: OCR
Celkem dlouho jsem zkoušel cuneiform i tesseract. Tesseract se mi zdál o něco lepší. U cuneiform jsem narazil na dvě chyby, které způsobily ukončení programu s chybou. Došlo k tomu vždy, pokud na stránce nebyl rozpoznán žádný text (např. prázdná stránka - prováděl jsem převod celé knihy automaticky) a pak tehdy, pokud bylo rozlišení větší než 3500px v libovolném směru.

Tesseract má zřejmě o něco lépe vyřešen jakýsi pre-processing, který pomocí nastavení prahových hodnot černé bílé převede obrázek na 1-bit ČB. Pokud jsem totiž podstrčil programu cuneiform obrázek takto upravený pomocí imagemagick, pak byl výsledek slušný (asi stejný jako u tesseract); jinak u obrázeku 8-bit šedé (neupravený, rovnou ze scanneru) dopadlo rozpoznání lépe vždy za použití tesseract.

(Oba programy podporují české znaky.)

Pro jednorázovou akci < 100 stránek je také možné stáhnout demo verzi placeného abbyyocr9. Tento program jsem vyzkoušel a musím potvrdit, že i velmi nekvalitní text ze 100 let starých knih dokázal rozpoznat velmi slušně a přitom si také poradil se stíny, kazy a různými jinými nectnostmi; v tomto případě byl výsledek obou open source programů špatný ( byl jen o něco lepší při pracné úpravě pomocí imagemagick). Jakékoliv upravování obrázku pomocí imagemagick jsem u abbyyocr shledal jako zbytečné nebo horší. Nejlepší výsledek byl vždy rovnou s obrázkem ze scanneru (barevný i čb); program si s tím sám poradil nejlépe. Škoda jen že cena programu je v linux verzi vysoká a lincence je časově nebo od počtu stránek (už nevím přesně) omezená.

Stejně dobré výsledky jako s abbyyocr se mi podařilo dosáhnout také s on-line OCR na www.onlineocr.net ; mám podezření, že jim tam běží stejný program. Pro převod pár stránek běžného textu je to asi nejlepší a nejrychlejší řešení.
28.8.2013 22:34 jik
Rozbalit Rozbalit vše Re: OCR
Díky, tesseract se mi na OpenSUSE 12.3 podařilo nainstalovat. Budu zkoušet.

Založit nové vláknoNahoru

Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

ISSN 1214-1267   www.czech-server.cz
© 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.