abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×

    dnes 01:44 | Zajímavý projekt

    Na redditu byly publikovány zajímavé QR kódy vygenerované pomocí Stable Diffusion. Přehled použitého softwaru v článku na Ars Technica.

    Ladislav Hagara | Komentářů: 0
    včera 15:11 | Nová verze

    Byl vydán Mozilla Firefox 114.0. Přehled novinek v poznámkách k vydání, poznámkách k vydání pro firmy a na stránce věnované vývojářům. Nově jsou také na Linuxu podporovány USB FIDO2/WebAuthn bezpečnostní klíče. WebTransport je ve výchozím stavu povolen. Řešeny jsou rovněž bezpečnostní chyby. Nový Firefox 114 je již k dispozici také na Flathubu a Snapcraftu.

    Ladislav Hagara | Komentářů: 0
    včera 11:44 | Nová verze

    Byla vydána červnová aktualizace aneb verze 2023.06-1 linuxové distribuce OSMC (Open Source Media Center). Z novinek lze zdůraznit povýšení verze multimediálního centra Kodi na 20. Na léto je plánováno představení nového vlajkového zařízení Vero, jež nahradí Vero 4K +.

    Ladislav Hagara | Komentářů: 0
    včera 11:11 | Pozvánky

    Už zítra 7. června od 17 hodin proběhne SUSE Czech Open House 2023 aneb den otevřených dveří pražské pobočky SUSE. Těšit se lze na komentovanou prohlídku nebo přednášku o spotřebě procesorů.

    Ladislav Hagara | Komentářů: 0
    5.6. 22:33 | IT novinky

    Na vývojářské konferenci Applu WWDC23 byla představena řada novinek (cz): brýle Apple Vision Pro, MacBook Air 15” s čipem M2, Mac Studio s čipem M2 Max nebo M2 Ultra, Mac Pro s čipem M2 Ultra, iOS 17, iPadOS 17, macOS Sonoma, watchOS 10, …

    Ladislav Hagara | Komentářů: 2
    5.6. 21:55 | Pozvánky

    Chystá se poslední jarní Virtuální Bastlírna. Nachystejte si ledové kávy, mojita a vodní chladiče a pojďte se se strahovskými bastlíři pobavit o technice a bastlení! Ptáte se, co mají bastlíři za novinky? Například se ukázalo, že OLED s SSD1306 ve skutečnosti nejsou nutně jen černobílé. Vyšla také nová verze KiCADu včetně betaverze pluginu pro tvorbu databázových knihoven pro KiCAD v InvenTree a na internetu se objevil USB

    … více »
    bkralik | Komentářů: 1
    5.6. 21:22 | IT novinky

    6. červen je dnem za skutečný internet (neboli Světový den IPv6). Již tradiční příležitost urgovat svého ISP, kdy zavede do sítě IPv6, ale také příležitost šířit osvětu i mezi netechnické uživatele. V současnosti má IPv6 v ČR jen cca 20 % uživatelů (podle statistik společností Akamai a Google).

    xHire | Komentářů: 0
    5.6. 15:44 | Pozvánky

    Festival plný workshopů, interaktivních činností a především nadšených a zvídavých lidí Maker Faire Prague 2023 proběhne o víkendu 10. a 11. června na Výstavišti Praha.

    Ladislav Hagara | Komentářů: 0
    5.6. 11:44 | Nová verze

    Byla vydána verze 8.18 z Debianu vycházející linuxové distribuce DietPi pro (nejenom) jednodeskové počítače. Přehled novinek v poznámkách k vydání.

    Ladislav Hagara | Komentářů: 0
    5.6. 11:33 | Zajímavý projekt

    Projekty Blink a Blinkenlights dospěly do verze 1.0. Jedná se o x86-64-linux emulátor a jeho TUI nadstavbu sloužící jako debugger. Blink je v porovnání s qemu-x86_64 menší a rychlejší.

    Ladislav Hagara | Komentářů: 0
    Twitter (nejen pro příležitostné čtení)
     (89%)
     (2%)
     (9%)
    Celkem 159 hlasů
     Komentářů: 6, poslední včera 09:40
    Rozcestník

    Dotaz: pdf po uložení do .txt souboru nečitelný

    26.5.2012 11:50 tonda | skóre: 8
    pdf po uložení do .txt souboru nečitelný
    Přečteno: 984×
    Ahoj všem. Chtěl jsem vyhledávat v pdf souboru text (ctrl+f v adobe reader) . Bohužel i když jsem text viděl vyhledávač jen nenalezl. Tak jsem tedy zkusil uložit text jako .txt v adobe reader. Je to nečitelný text plný různých znaků. Další co jsem zkusil bylo ctrl+c a vložit do textˇáku - výpis opět nečitelný. Ještě jsem zkusil uložit text pomocí pdftotext a opět bez úspěchu. Další moje pokusy byly změnit kódování v Kwrite na cp1250 ISO8859-2 ISO8859-3 také bez úspěchu. V LilbreOffice Writer změna fontu také nezabrala.

    Otázka zní: je možné uložit tento text do souboru .txt, aby text byl čitelný.

    Děkuji Tonda

    Původní text.

    Předpis ČD Z11 obsahuje základní ustanovení pro obsluhu rádiových zařízení v železničním provozu na síti Českých drah.

    Takto vypadá tento odstavec při použití příkazu pdftotext (po vložení do tohoto okna jsou tam místo různých znaků obdélníky)

    3?HGSLV?ý'?=???REVDKXMH?]iNODGQt?XVWDQRYHQt?SUR?REVOXKX?UiGLoYêFK?]D?t]HQt?Y?åHOH]QLþQtP?SURYR]X?QD?VtWL?ýHVNêFK?GUDK? 3UR? REVOXKX? ]iNODGQRYêFK?? YR]LGORYêFK? D? S?HQRVQêFK? UiGLRYêFK? VWDQLF platí dále zásady uvedené v?QiYRGHFK?SUR?REVOXKX?MHGQRWOLYêFK?W\S$?]a?t]HQt?

    výpis při použití crl+c ctrl+v a uložit jako text .?? (?# ?$ %!! 6#'???? ??+?' ?? ?#?'? ???? (? 6#???? ?? ?o- ?*?? ?'?????? ? )?????????? (? ? ?? ?' #??? ??#+*??

    ?'??


    Řešení dotazu:


    Odpovědi

    Migi avatar 26.5.2012 11:54 Migi | skóre: 59 | blog: Mig_Alley
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    a neni to pdfko jen exportovanej obrazek? Pak by samozrejme nebylo co kopirovat.
    26.5.2012 12:08 tonda | skóre: 8
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Obrázek to rohzodně není - 1600 řádků nečitelného textu.
    26.5.2012 11:59 tonda | skóre: 8
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Příloha:
    Jelikož se znaky v předchozím textu silně změnily přikládám obrázek.
    26.5.2012 12:29 Filip Jirsák | skóre: 68 | blog: Fa & Bi
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Bylo by potřeba přiložit to originální PDF. Ale podle vašeho popisu to možné není, protože ten text není v PDF vložen.

    Ve formátu PDF je text vložen tak, že jsou tam víceméně náhodné znaky, a u každého typu znaku je určeno, jak se má vykreslit. Aby se dalo v textu vyhledávat a kopírovat, musí tam být ještě tabulka, která ty náhodné znaky mapuje na nějakou známou znakovou sadu (třeba UTF-8). Ta v tomhle PDF evidentně není.

    Zda je PDF udělané tak, aby se text dal vyhledávat a kopírovat, to závisí na způsobu jeho vytvoření, tedy na programu autora PDF.
    26.5.2012 12:51 tonda | skóre: 8
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Na tomto odkaze naleznete tento pdf soubor. http://www.ulozto.cz/xW9QK42/predpis-pdf

    Omlouvám se za předchozí překlepy "nenalezl jsem kde to mohu opravit" a děkuji za Vaši ochotu to řešit.
    26.5.2012 16:04 Filip Jirsák | skóre: 68 | blog: Fa & Bi
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Zvláštní je, že části textu jsou tam správně i s českým kódováním. Každopádně tam text není vložený správně tak, aby bylo možné jej z toho snadno získat. Připadá mi to, jakoby se zdrojová aplikace pokoušela přepínat jazyky a Adobe Distiller, který z toho generoval PDF, to nezpracoval správně. Ty texty tam možná jsou zakódované špatně nějak systematicky, takže by to teoreticky šlo strojově zase rozkódovat zpět, ale podle mne by to bylo příliš pracné. Pokud z toho potřebujete získat text, zkusil bych ještě nějaké OCR. Texty se vykreslují vektorově, takže to PDF lze libovolně zvětšit a máte tak dokument jakoby s libovolným DPI a vytištěný na dokonalé tiskárně. Úspěšnost OCR by mohla být skoro stoprocentní.
    26.5.2012 13:57 Jirka
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    A toto by nepomohlo?
    26.5.2012 14:08 Semo | skóre: 45 | blog: Semo
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    If you hold a Unix shell up to your ear, you can you hear the C.
    26.5.2012 14:46 tonda | skóre: 8
    Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
    Mockrát děkuji. Tonda

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.