abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 16:11 | Nová verze

    Bylo oznámeno (cs) vydání Fedora Linuxu 40. Přehled novinek ve Fedora Workstation 40 a Fedora KDE 40 na stránkách Fedora Magazinu. Současně byl oznámen notebook Slimbook Fedora 2.

    Ladislav Hagara | Komentářů: 4
    dnes 13:44 | Upozornění

    ČTK (Česká tisková kancelář) upozorňuje (X), že na jejím zpravodajském webu České noviny byly dnes dopoledne neznámým útočníkem umístěny dva smyšlené texty, které nepocházejí z její produkce. Jde o text s titulkem „BIS zabránila pokusu o atentát na nově zvoleného slovenského prezidenta Petra Pelligriniho“ a o údajné mimořádné prohlášení ministra Lipavského k témuž. Tyto dezinformace byly útočníky zveřejněny i s příslušnými notifikacemi v mobilní aplikaci Českých novin. ČTK ve svém zpravodajském servisu žádnou informaci v tomto znění nevydala.

    Ladislav Hagara | Komentářů: 15
    dnes 13:33 | Komunita

    Byla založena nadace Open Home Foundation zastřešující více než 240 projektů, standardů, ovladačů a knihoven (Home Assistant, ESPHome, Zigpy, Piper, Improv Wi-Fi, Wyoming, …) pro otevřenou chytrou domácnost s důrazem na soukromí, možnost výběru a udržitelnost.

    Ladislav Hagara | Komentářů: 0
    dnes 13:00 | Nová verze

    Společnost Meta otevírá svůj operační systém Meta Horizon OS pro headsety pro virtuální a rozšířenou realitu. Vedle Meta Quest se bude používat i v připravovaných headsetech od Asusu a Lenova.

    Ladislav Hagara | Komentářů: 0
    dnes 04:33 | IT novinky

    Společnost Espressif (ESP8266, ESP32, …) získala většinový podíl ve společnosti M5Stack, čímž posiluje ekosystém AIoT.

    Ladislav Hagara | Komentářů: 0
    včera 23:44 | Nová verze

    Byla vydána nová stabilní verze 3.5 svobodného multiplatformního softwaru pro editování a nahrávání zvukových souborů Audacity (Wikipedie). Přehled novinek také na YouTube. Nově lze využívat cloud (audio.com). Ke stažení je oficiální AppImage. Zatím starší verze Audacity lze instalovat také z Flathubu a Snapcraftu.

    Ladislav Hagara | Komentářů: 0
    včera 16:44 | Zajímavý článek

    50 let operačního systému CP/M, článek na webu Computer History Museum věnovaný operačnímu systému CP/M. Gary Kildall z Digital Research jej vytvořil v roce 1974.

    Ladislav Hagara | Komentářů: 2
    včera 16:22 | Pozvánky

    Byl zveřejněn program a spuštěna registrace na letošní konferenci Prague PostgreSQL Developer Day, která se koná 4. a 5. června. Na programu jsou 4 workshopy a 8 přednášek na různá témata o PostgreSQL, od konfigurace a zálohování po využití pro AI a vector search. Stejně jako v předchozích letech se konference koná v prostorách FIT ČVUT v Praze.

    TomasVondra | Komentářů: 0
    včera 03:00 | IT novinky

    Po 48 letech Zilog končí s výrobou 8bitového mikroprocesoru Zilog Z80 (Z84C00 Z80). Mikroprocesor byl uveden na trh v červenci 1976. Poslední objednávky jsou přijímány do 14. června [pdf].

    Ladislav Hagara | Komentářů: 6
    včera 02:00 | IT novinky

    Ještě letos vyjde Kingdom Come: Deliverance II (YouTube), pokračování počítačové hry Kingdom Come: Deliverance (Wikipedie, ProtonDB Gold).

    Ladislav Hagara | Komentářů: 13
    KDE Plasma 6
     (72%)
     (10%)
     (2%)
     (17%)
    Celkem 697 hlasů
     Komentářů: 4, poslední 6.4. 15:51
    Rozcestník

    Dotaz: RTF→TXT konvertor s podporou češtiny

    30.1.2012 13:14 redinsect
    RTF→TXT konvertor s podporou češtiny
    Přečteno: 631×
    Potřeboval bych nějaký konzolový program pro Linux, který by uměl převést RTF soubor na prostý TXT soubor, přičemž musí umět zpracovat i české znaky. Narazil jsem na unrtf, ale některé české znaky během konverze vynechává, podobně další programy, které jsem zkoušel.

    Máte prosím někdo tip na něco spolehlivého? Ta RTF, která budu zpracovávat, jsou z externích zdrojů a nemůžu je před samotným zpracováním nijak upravit.

    Odpovědi

    30.1.2012 17:01 Radovan Garabík
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    catdoc -scp1250 subor.rtf
    30.1.2012 23:54 Ondřej
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Díky, ale nedaří se mi to zprovoznit. Mám stejný problém, který je popsaný na této stránce: http://forums.knowledgetree.org/viewtopic.php?f=6&t=1014 Uspokojivé řešení tam není (root nemám). Háže mi to chybu „Cannot load charset cp1251 - file not found”, předpokládám, že to vůbec nezná cestu ke složce charsets, s jiným kódováním to vyhodí stejnou chybu, jen se změní dané kódování.
    31.1.2012 13:50 Radovan Garabík
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Používam catdoc z distribúcie, tam sú také veci vyriešené...
    30.1.2012 17:06 chrono
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    S unrtf som zatiaľ problémy nemal, a bez problémov som ním teraz do čistého textu previedol niekoľko rtf dokumentov v slovenčine a češtine.
    31.1.2012 00:02 Ondřej
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Příloha:
    A můžeš prosím zkusit převést tenhle RTF soubor? http://leteckaposta.cz/445808888 (mě by být i v příloze) Já z toho dostanu „Přliš žluťčý ků pě ďbelské ódy”
    Josef Kufner avatar 31.1.2012 00:07 Josef Kufner | skóre: 70
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    $ lowriter --nologo --convert-to html *.rtf 
    convert .../rich.rtf -> .../rich.html using XHTML Writer File
    $ lynx -dump *.html 
       Příliš žluťoučký kůň pěl ďábelské ódy
    $
    Hello world ! Segmentation fault (core dumped)
    31.1.2012 11:16 Ondřej
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Díky, to jsem rád, že to aspoň někde funguje. Nicméně bych byl rád, pokud bych nemusel na server instalovat celý LibreOffice jen kvůli RTF konverzi. Ale asi to tak dopadne, jak to vidím…
    31.1.2012 18:41 chrono
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Problém je, že unrtf vkladá znaky, ktoré sú v rtf súbore vložené ako unicode sekvencie (a teda \uxx), len do niektorých formátov (konkrétne len do html a rtf formátu). Netuším, prečo tam také obmedzenie je, pretože skonvertovať to do utf-8 nie je zložité a so znakmi vloženými pomocou sekvencie '\XX sa to tam tak robí.

    Ak by tam nebol ďalší problém, tak by fungovalo vygenerovanie html súboru s následným dump-om cez lynx. Problém ale je, že to nie celkom funguje.

    Zaujímavá časť kódu, pre tento problém je v súbore convert.c vo funkcii cmd_u. Tam je na konci poznámka, že ak vieme, ako interpretovať unicode znak, vo výstupnom formáte, preskočíme nasledujúce slovo. A presne to spôsobuje, že, minimálne pri tom priloženom rtf súbore, sa potom preskočia znaky, ktoré nasledujú za tými unicode znakmi (dokumentáciu k rtf formátu som nečítal, tekže netuším, či je problém unrtf, alebo program, ktorý ten rtf súbor vygeneroval).
    1.2.2012 13:03 Ondřej
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Díky za objasnění :-). Já jsem to RTF vytvářel a ukládal na Macu, když jsem zkusil stáhnout nějaké RTF, které bylo nejspíš vytvořené na Windows, tak to fungovalo. Alespoň přes tu konverzi do HTML, když jsem tam rovnou dal —text, tak mi to zase místo některých znaků naházelo otazníky.
    31.1.2012 15:03 ikarr
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    asi v nich nebylo "ř" :-)

    možná by stačilo doplnit /usr/lib/unrtf/SYMBOL.charmap
    31.1.2012 15:14 ikarr
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    odpovím si sám, nestačilo.
    Josef Kufner avatar 30.1.2012 23:58 Josef Kufner | skóre: 70
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Pokud nenajdeš nic lepšího, tak použij LibreOffice:
    loffice --convert-to ...
    Nezkoušel jsem to, ale pokud to bude produkovat divně formátovaný text, tak to vem ještě skrz html a lynx.
    Hello world ! Segmentation fault (core dumped)
    31.1.2012 13:50 poko | skóre: 9
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.