abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
včera 17:35 | Bezpečnostní upozornění

Německá Bundesnetzagentur (obdoba českého ČTU) zakázala na německém území prodej panenky Cayla kvůli „špionáži“ dětí. Tato elektronická hračka obsahuje mikrofon, reproduktor a kameru a bezdrátové komunikační rozhraní, pomocí kterého se hračka připojuje na servery výrobce. Takovýmto způsobem může hračka pomocí umělé inteligence „odpovídat“ na dotazy dítěte. Hlavní problém bude ale asi někde jinde, podle prvotních zpráv může

… více »
Petr Tomášek | Komentářů: 21
17.2. 15:30 | Bezpečnostní upozornění

CSIRT.CZ upozorňuje, že bezpečnostní experti objevili nový typ malwaru, jenž cílí na open source e-commerce platformu Magento. Malware je zajímavý tím, že se jedná o první svého druhu, jehož kód zůstává skrytý v SQL databázi zasaženého e-shopu. Škodlivý kód je volán pomocí tzv. SQL trigerru, který je spouštěn při každém vytvoření objednávky v systému.

Ladislav Hagara | Komentářů: 0
17.2. 09:00 | Nová verze

Bylo vydáno Ubuntu 16.04.2 LTS, tj. druhé opravné vydání Ubuntu 16.04 LTS s kódovým názvem Xenial Xerus. Přehled novinek v poznámkách k vydání a v přehledu změn.

Ladislav Hagara | Komentářů: 37
17.2. 06:00 | Zajímavý článek

Pavel Tišnovský se v dvoudílném článku na MojeFedora.cz věnuje tvorbě pluginů (modulů) pro bitmapový grafický editor GIMP. Pomocí pluginů lze GIMP rozšiřovat o další funkce. Implementovat lze například nové filtry nebo pomocné utility pro tvorbu animací či poloautomatickou retuš snímků.

Ladislav Hagara | Komentářů: 6
16.2. 23:32 | Komunita

Do 30. března se lze přihlásit do dalšího kola programu Outreachy, jehož cílem je přitáhnout do světa svobodného a otevřeného softwaru lidi ze skupin, jež jsou ve světě svobodného a otevřeného softwaru málo zastoupeny. Za 3 měsíce práce, od 30. května do 30. srpna 2017, v participujících organizacích lze vydělat 5 500 USD. Jedná se již o 14. kolo tohoto programu.

Ladislav Hagara | Komentářů: 11
16.2. 23:13 | Nová verze

Byla vydána verze 0.92.1 svobodného multiplatformního vektorového grafického editoru Inkscape. Přehled novinek v poznámkách k vydání. Řešen je mimo jiné problém s verzí 0.92, jež rozbíjí dokumenty vytvořené v předchozích verzích Inkscape. Více v příspěvku na blogu Davida Revoye, autora open source webového komiksu Pepper&Carrot nebo portrétu GNU/Linuxu.

Ladislav Hagara | Komentářů: 0
16.2. 16:26 | Bezpečnostní upozornění

Byla vydána verze 1.1.0e kryptografické knihovny OpenSSL. Dle bezpečnostního upozornění 20170216 byla opravena závažná bezpečnostní chyba CVE-2017-3733.

Ladislav Hagara | Komentářů: 1
16.2. 13:03 | Pozvánky

GNOME hackaton proběhne v Brně na FIT VUT v Red Hat Labu (budova Q) v pondělí 20. února od 15:00. Registrace není nutná, ale pokud dáte na FaceBooku vědět, že plánujete dorazit, pomůže to s plánováním.

Ladislav Hagara | Komentářů: 0
16.2. 13:02 | Pozvánky

Únorový Prague Containers Meetup se koná 21. února v budově MSD. Můžete se těšit na přednášky o tom, proč a jak používat kontejnery a zároveň získat zajímavý pohled na historii a budoucnost kontejnerů.

little-drunk-jesus | Komentářů: 0
16.2. 08:55 | Zajímavý software

Google na svém blogu věnovaném vývojářům oznámil vydání verze 1.0 open source knihovny pro strojové učení TensorFlow (Wikipedie). Přehled novinek v poznámkách k vydání na GitHubu. Zdrojové kódy TensorFlow jsou k dispozici pod licencí Apache 2.0.

Ladislav Hagara | Komentářů: 0
Jak se stavíte k trendu ztenčování přenosných zařízení (smartphony, notebooky)?
 (13%)
 (2%)
 (72%)
 (3%)
 (10%)
Celkem 656 hlasů
 Komentářů: 52, poslední 13.2. 12:45
Rozcestník
Reklama

Dotaz: pdf po uložení do .txt souboru nečitelný

26.5.2012 11:50 tonda | skóre: 8
pdf po uložení do .txt souboru nečitelný
Přečteno: 665×
Ahoj všem. Chtěl jsem vyhledávat v pdf souboru text (ctrl+f v adobe reader) . Bohužel i když jsem text viděl vyhledávač jen nenalezl. Tak jsem tedy zkusil uložit text jako .txt v adobe reader. Je to nečitelný text plný různých znaků. Další co jsem zkusil bylo ctrl+c a vložit do textˇáku - výpis opět nečitelný. Ještě jsem zkusil uložit text pomocí pdftotext a opět bez úspěchu. Další moje pokusy byly změnit kódování v Kwrite na cp1250 ISO8859-2 ISO8859-3 také bez úspěchu. V LilbreOffice Writer změna fontu také nezabrala.

Otázka zní: je možné uložit tento text do souboru .txt, aby text byl čitelný.

Děkuji Tonda

Původní text.

Předpis ČD Z11 obsahuje základní ustanovení pro obsluhu rádiových zařízení v železničním provozu na síti Českých drah.

Takto vypadá tento odstavec při použití příkazu pdftotext (po vložení do tohoto okna jsou tam místo různých znaků obdélníky)

3?HGSLV?ý'?=???REVDKXMH?]iNODGQt?XVWDQRYHQt?SUR?REVOXKX?UiGLoYêFK?]D?t]HQt?Y?åHOH]QLþQtP?SURYR]X?QD?VtWL?ýHVNêFK?GUDK? 3UR? REVOXKX? ]iNODGQRYêFK?? YR]LGORYêFK? D? S?HQRVQêFK? UiGLRYêFK? VWDQLF platí dále zásady uvedené v?QiYRGHFK?SUR?REVOXKX?MHGQRWOLYêFK?W\S$?]a?t]HQt?

výpis při použití crl+c ctrl+v a uložit jako text .?? (?# ?$ %!! 6#'???? ??+?' ?? ?#?'? ???? (? 6#???? ?? ?o- ?*?? ?'?????? ? )?????????? (? ? ?? ?' #??? ??#+*??

?'??


Řešení dotazu:


Odpovědi

Migilenik avatar 26.5.2012 11:54 Migilenik | skóre: 58 | blog: Mig_Alley
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
a neni to pdfko jen exportovanej obrazek? Pak by samozrejme nebylo co kopirovat.
GIMP 2.8 Cage Transformation - what is it good for? http://www.youtube.com/watch?v=S4whULCb8t0
26.5.2012 12:08 tonda | skóre: 8
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
Obrázek to rohzodně není - 1600 řádků nečitelného textu.
26.5.2012 11:59 tonda | skóre: 8
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
Příloha:
Jelikož se znaky v předchozím textu silně změnily přikládám obrázek.
26.5.2012 12:29 Filip Jirsák | skóre: 66 | blog: Fa & Bi
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
Bylo by potřeba přiložit to originální PDF. Ale podle vašeho popisu to možné není, protože ten text není v PDF vložen.

Ve formátu PDF je text vložen tak, že jsou tam víceméně náhodné znaky, a u každého typu znaku je určeno, jak se má vykreslit. Aby se dalo v textu vyhledávat a kopírovat, musí tam být ještě tabulka, která ty náhodné znaky mapuje na nějakou známou znakovou sadu (třeba UTF-8). Ta v tomhle PDF evidentně není.

Zda je PDF udělané tak, aby se text dal vyhledávat a kopírovat, to závisí na způsobu jeho vytvoření, tedy na programu autora PDF.
26.5.2012 12:51 tonda | skóre: 8
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
Na tomto odkaze naleznete tento pdf soubor. http://www.ulozto.cz/xW9QK42/predpis-pdf

Omlouvám se za předchozí překlepy "nenalezl jsem kde to mohu opravit" a děkuji za Vaši ochotu to řešit.
26.5.2012 16:04 Filip Jirsák | skóre: 66 | blog: Fa & Bi
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
Zvláštní je, že části textu jsou tam správně i s českým kódováním. Každopádně tam text není vložený správně tak, aby bylo možné jej z toho snadno získat. Připadá mi to, jakoby se zdrojová aplikace pokoušela přepínat jazyky a Adobe Distiller, který z toho generoval PDF, to nezpracoval správně. Ty texty tam možná jsou zakódované špatně nějak systematicky, takže by to teoreticky šlo strojově zase rozkódovat zpět, ale podle mne by to bylo příliš pracné. Pokud z toho potřebujete získat text, zkusil bych ještě nějaké OCR. Texty se vykreslují vektorově, takže to PDF lze libovolně zvětšit a máte tak dokument jakoby s libovolným DPI a vytištěný na dokonalé tiskárně. Úspěšnost OCR by mohla být skoro stoprocentní.
26.5.2012 13:57 Jirka
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
A toto by nepomohlo?
26.5.2012 14:08 Semo | skóre: 44 | blog: Semo
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
If you hold a Unix shell up to your ear, you can you hear the C.
26.5.2012 14:46 tonda | skóre: 8
Rozbalit Rozbalit vše Re: pdf po uložení do .txt souboru nečitelný
Mockrát děkuji. Tonda

Založit nové vláknoNahoru

Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

ISSN 1214-1267   www.czech-server.cz
© 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.