abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 16:44 | Nová verze

    Svobodný multiplatformní herní engine Bevy napsaný v Rustu byl vydán ve verzi 0.18. Díky 174 přispěvatelům.

    Ladislav Hagara | Komentářů: 2
    dnes 15:11 | IT novinky

    Miliardy korun na digitalizaci služeb státu nestačily. Stát do ní v letech 2020 až 2024 vložil víc než 50 miliard korun, ale původní cíl se nepodařilo splnit. Od loňského února měly být služby státu plně digitalizované a občané měli mít právo komunikovat se státem digitálně. Do tohoto data se povedlo plně digitalizovat 18 procent agendových služeb státu. Dnes to uvedl Nejvyšší kontrolní úřad (NKÚ) v souhrnné zprávě o stavu digitalizace v Česku. Zpráva vychází z výsledků víc než 50 kontrol, které NKÚ v posledních pěti letech v tomto oboru uskutečnil.

    Ladislav Hagara | Komentářů: 6
    dnes 13:55 | IT novinky

    Nadace Wikimedia, která je provozovatelem internetové encyklopedie Wikipedia, oznámila u příležitosti 25. výročí vzniku encyklopedie nové licenční dohody s firmami vyvíjejícími umělou inteligenci (AI). Mezi partnery encyklopedie tak nově patří Microsoft, Amazon a Meta Platforms, ale také start-up Perplexity a francouzská společnost Mistral AI. Wikimedia má podobnou dohodu od roku 2022 také se společností Google ze skupiny

    … více »
    Ladislav Hagara | Komentářů: 0
    dnes 02:22 | Nová verze

    D7VK byl vydán ve verzi 1.2. Jedná se o fork DXVK implementující překlad volání Direct3D 5, 6 a 7 na Vulkan. DXVK zvládá Direct3D 8, 9, 10 a 11.

    Ladislav Hagara | Komentářů: 0
    dnes 02:00 | Nová verze

    Byla vydána verze 12.0.0 knihovny libvirt (Wikipedie) zastřešující různé virtualizační technologie a vytvářející jednotné rozhraní pro správu virtuálních strojů. Současně byl ve verzi 12.0.0 vydán související modul pro Python libvirt-python. Přehled novinek v poznámkách k vydání.

    Ladislav Hagara | Komentářů: 0
    včera 19:22 | Humor

    CreepyLink.com je nový zkracovač URL adres, 'díky kterému budou vaše odkazy vypadat tak podezřele, jak je to jen možné'. Například odkaz na abclinuxu.cz tento zkracovač převádí do podoby 'https://netflix.web-safe.link/logger_8oIlgs_free_money.php'. Dle prohlášení autora je CreepyLink alternativou ke zkracovači ShadyURL (repozitář na githubu), který dnes již bohužel není v provozu.

    NUKE GAZA! 🎆 | Komentářů: 3
    včera 12:33 | IT novinky

    Na blogu Raspberry Pi byla představena rozšiřující deska Raspberry Pi AI HAT+ 2 s akcelerátorem Hailo-10 a 8 GB RAM. Na rozdíl od předchozí Raspberry Pi AI HAT+ podporuje generativní AI. Cena desky je 130 dolarů.

    Ladislav Hagara | Komentářů: 3
    včera 12:11 | Komunita

    Wikipedie slaví 25. výročí svého založení. Vznikla 15. ledna 2001 jako doplňkový projekt k dnes již neexistující encyklopedii Nupedia. Doména wikipedia.org byla zaregistrována 12. ledna 2001. Zítra proběhne v Praze Večer svobodné kultury, který pořádá spolek Wikimedia ČR.

    Ladislav Hagara | Komentářů: 1
    včera 04:44 | Nová verze

    Po více než dvou letech od vydání předchozí verze 2.12 byla vydána nová stabilní verze 2.14 systémového zavaděče GNU GRUB (GRand Unified Bootloader, Wikipedie). Přehled novinek v souboru NEWS a v aktualizované dokumentaci.

    Ladislav Hagara | Komentářů: 2
    včera 02:22 | Nová verze

    Google Chrome 144 byl prohlášen za stabilní. Nejnovější stabilní verze 144.0.7559.59 přináší řadu novinek z hlediska uživatelů i vývojářů. Podrobný přehled v poznámkách k vydání. Opraveno bylo 10 bezpečnostních chyb. Vylepšeny byly také nástroje pro vývojáře (YouTube).

    Ladislav Hagara | Komentářů: 4
    Které desktopové prostředí na Linuxu používáte?
     (14%)
     (5%)
     (0%)
     (9%)
     (19%)
     (3%)
     (6%)
     (3%)
     (11%)
     (42%)
    Celkem 462 hlasů
     Komentářů: 12, poslední 14.1. 21:12
    Rozcestník

    Dotaz: pdf po uložení do .txt souboru nečitelný

    26.5.2012 11:50 tonda | skóre: 8
    pdf po uložení do .txt souboru nečitelný
    Přečteno: 1091×
    Ahoj všem. Chtěl jsem vyhledávat v pdf souboru text (ctrl+f v adobe reader) . Bohužel i když jsem text viděl vyhledávač jen nenalezl. Tak jsem tedy zkusil uložit text jako .txt v adobe reader. Je to nečitelný text plný různých znaků. Další co jsem zkusil bylo ctrl+c a vložit do textˇáku - výpis opět nečitelný. Ještě jsem zkusil uložit text pomocí pdftotext a opět bez úspěchu. Další moje pokusy byly změnit kódování v Kwrite na cp1250 ISO8859-2 ISO8859-3 také bez úspěchu. V LilbreOffice Writer změna fontu také nezabrala.

    Otázka zní: je možné uložit tento text do souboru .txt, aby text byl čitelný.

    Děkuji Tonda

    Původní text.

    Předpis ČD Z11 obsahuje základní ustanovení pro obsluhu rádiových zařízení v železničním provozu na síti Českých drah.

    Takto vypadá tento odstavec při použití příkazu pdftotext (po vložení do tohoto okna jsou tam místo různých znaků obdélníky)

    3?HGSLV?ý'?=???REVDKXMH?]iNODGQt?XVWDQRYHQt?SUR?REVOXKX?UiGLoYêFK?]D?t]HQt?Y?åHOH]QLþQtP?SURYR]X?QD?VtWL?ýHVNêFK?GUDK? 3UR? REVOXKX? ]iNODGQRYêFK?? YR]LGORYêFK? D? S?HQRVQêFK? UiGLRYêFK? VWDQLF platí dále zásady uvedené v?QiYRGHFK?SUR?REVOXKX?MHGQRWOLYêFK?W\S$?]a?t]HQt?

    výpis při použití crl+c ctrl+v a uložit jako text .?? (?# ?$ %!! 6#'???? ??+?' ?? ?#?'? ???? (? 6#???? ?? ?o- ?*?? ?'?????? ? )?????????? (? ? ?? ?' #??? ??#+*??

    ?'??


    Řešení dotazu:


    Odpovědi

    Migi avatar 26.5.2012 11:54 Migi | skóre: 59 | blog: Mig_Alley
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    a neni to pdfko jen exportovanej obrazek? Pak by samozrejme nebylo co kopirovat.
    26.5.2012 12:08 tonda | skóre: 8
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Obrázek to rohzodně není - 1600 řádků nečitelného textu.
    26.5.2012 11:59 tonda | skóre: 8
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Příloha:
    Jelikož se znaky v předchozím textu silně změnily přikládám obrázek.
    26.5.2012 12:29 Filip Jirsák | skóre: 67 | blog: Fa & Bi
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Bylo by potřeba přiložit to originální PDF. Ale podle vašeho popisu to možné není, protože ten text není v PDF vložen.

    Ve formátu PDF je text vložen tak, že jsou tam víceméně náhodné znaky, a u každého typu znaku je určeno, jak se má vykreslit. Aby se dalo v textu vyhledávat a kopírovat, musí tam být ještě tabulka, která ty náhodné znaky mapuje na nějakou známou znakovou sadu (třeba UTF-8). Ta v tomhle PDF evidentně není.

    Zda je PDF udělané tak, aby se text dal vyhledávat a kopírovat, to závisí na způsobu jeho vytvoření, tedy na programu autora PDF.
    26.5.2012 12:51 tonda | skóre: 8
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Na tomto odkaze naleznete tento pdf soubor. http://www.ulozto.cz/xW9QK42/predpis-pdf

    Omlouvám se za předchozí překlepy "nenalezl jsem kde to mohu opravit" a děkuji za Vaši ochotu to řešit.
    26.5.2012 16:04 Filip Jirsák | skóre: 67 | blog: Fa & Bi
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Zvláštní je, že části textu jsou tam správně i s českým kódováním. Každopádně tam text není vložený správně tak, aby bylo možné jej z toho snadno získat. Připadá mi to, jakoby se zdrojová aplikace pokoušela přepínat jazyky a Adobe Distiller, který z toho generoval PDF, to nezpracoval správně. Ty texty tam možná jsou zakódované špatně nějak systematicky, takže by to teoreticky šlo strojově zase rozkódovat zpět, ale podle mne by to bylo příliš pracné. Pokud z toho potřebujete získat text, zkusil bych ještě nějaké OCR. Texty se vykreslují vektorově, takže to PDF lze libovolně zvětšit a máte tak dokument jakoby s libovolným DPI a vytištěný na dokonalé tiskárně. Úspěšnost OCR by mohla být skoro stoprocentní.
    26.5.2012 13:57 Jirka
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    A toto by nepomohlo?
    26.5.2012 14:08 Semo | skóre: 45 | blog: Semo
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    If you hold a Unix shell up to your ear, you can you hear the C.
    26.5.2012 14:46 tonda | skóre: 8
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Mockrát děkuji. Tonda

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.