abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 00:11 | Nová verze

    Open source modální textový editor Helix, inspirovaný editory Vim, Neovim či Kakoune, byl vydán ve verzi 25.07. Přehled novinek se záznamy terminálových sezení v asciinema v oznámení na webu. Detailně v CHANGELOGu na GitHubu.

    Ladislav Hagara | Komentářů: 0
    včera 20:44 | IT novinky

    Americký výrobce čipů Nvidia získal od vlády prezidenta Donalda Trumpa souhlas s prodejem svých pokročilých počítačových čipů používaných k vývoji umělé inteligence (AI) H20 do Číny. Prodej těchto čipů speciálně upravených pro čínský trh by tak mohl být brzy obnoven, uvedla firma na svém blogu. Americká vláda zakázala prodej v dubnu, v době eskalace obchodního sporu mezi oběma zeměmi. Tehdy to zdůvodnila obavami, že by čipy mohla využívat čínská armáda.

    Ladislav Hagara | Komentářů: 0
    včera 17:22 | Nová verze

    3D software Blender byl vydán ve verzi 4.5 s prodlouženou podporou. Podrobnosti v poznámkách k vydání. Videopředstavení na YouTube.

    Ladislav Hagara | Komentářů: 0
    14.7. 22:22 | Komunita

    Open source webový aplikační framework Django slaví 20. narozeniny.

    Ladislav Hagara | Komentářů: 0
    14.7. 16:11 | Komunita

    V Brestu dnes začala konference vývojářů a uživatelů linuxové distribuce Debian DebConf25. Na programu je řada zajímavých přednášek. Sledovat je lze online.

    Ladislav Hagara | Komentářů: 0
    14.7. 11:33 | IT novinky

    Před 30 lety, tj. 14. července 1995, se začala používat přípona .mp3 pro soubory s hudbou komprimovanou pomocí MPEG-2 Audio Layer 3.

    Ladislav Hagara | Komentářů: 26
    14.7. 10:55 | IT novinky

    Výroba 8bitových domácích počítačů Commodore 64 byla ukončena v dubnu 1994. Po více než 30 letech byl představen nový oficiální Commodore 64 Ultimate (YouTube). S deskou postavenou na FPGA. Ve 3 edicích v ceně od 299 dolarů a plánovaným dodáním v říjnu a listopadu letošního roku.

    Ladislav Hagara | Komentářů: 20
    13.7. 17:55 | Zajímavý projekt

    Společnost Hugging Face ve spolupráci se společností Pollen Robotics představila open source robota Reachy Mini (YouTube). Předobjednat lze lite verzi za 299 dolarů a wireless verzi s Raspberry Pi 5 za 449 dolarů.

    Ladislav Hagara | Komentářů: 17
    11.7. 16:44 | Komunita

    Dnes v 17:30 bude oficiálně vydána open source počítačová hra DOGWALK vytvořena v 3D softwaru Blender a herním enginu Godot. Release party proběhne na YouTube od 17:00.

    Ladislav Hagara | Komentářů: 3
    11.7. 14:55 | Humor

    McDonald's se spojil se společností Paradox a pracovníky nabírá také pomocí AI řešení s virtuální asistentkou Olivii běžící na webu McHire. Ian Carroll a Sam Curry se na toto AI řešení blíže podívali a opravdu je překvapilo, že se mohli přihlásit pomocí jména 123456 a hesla 123456 a získat přístup k údajům o 64 milionech uchazečů o práci.

    Ladislav Hagara | Komentářů: 16
    Jaký je váš oblíbený skriptovací jazyk?
     (59%)
     (26%)
     (7%)
     (3%)
     (1%)
     (1%)
     (4%)
    Celkem 399 hlasů
     Komentářů: 16, poslední 8.6. 21:05
    Rozcestník

    Dotaz: RTF→TXT konvertor s podporou češtiny

    30.1.2012 13:14 redinsect
    RTF→TXT konvertor s podporou češtiny
    Přečteno: 656×
    Potřeboval bych nějaký konzolový program pro Linux, který by uměl převést RTF soubor na prostý TXT soubor, přičemž musí umět zpracovat i české znaky. Narazil jsem na unrtf, ale některé české znaky během konverze vynechává, podobně další programy, které jsem zkoušel.

    Máte prosím někdo tip na něco spolehlivého? Ta RTF, která budu zpracovávat, jsou z externích zdrojů a nemůžu je před samotným zpracováním nijak upravit.

    Odpovědi

    30.1.2012 17:01 Radovan Garabík
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    catdoc -scp1250 subor.rtf
    30.1.2012 23:54 Ondřej
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Díky, ale nedaří se mi to zprovoznit. Mám stejný problém, který je popsaný na této stránce: http://forums.knowledgetree.org/viewtopic.php?f=6&t=1014 Uspokojivé řešení tam není (root nemám). Háže mi to chybu „Cannot load charset cp1251 - file not found”, předpokládám, že to vůbec nezná cestu ke složce charsets, s jiným kódováním to vyhodí stejnou chybu, jen se změní dané kódování.
    31.1.2012 13:50 Radovan Garabík
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Používam catdoc z distribúcie, tam sú také veci vyriešené...
    30.1.2012 17:06 chrono
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    S unrtf som zatiaľ problémy nemal, a bez problémov som ním teraz do čistého textu previedol niekoľko rtf dokumentov v slovenčine a češtine.
    31.1.2012 00:02 Ondřej
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Příloha:
    A můžeš prosím zkusit převést tenhle RTF soubor? http://leteckaposta.cz/445808888 (mě by být i v příloze) Já z toho dostanu „Přliš žluťčý ků pě ďbelské ódy”
    Josef Kufner avatar 31.1.2012 00:07 Josef Kufner | skóre: 70
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    $ lowriter --nologo --convert-to html *.rtf 
    convert .../rich.rtf -> .../rich.html using XHTML Writer File
    $ lynx -dump *.html 
       Příliš žluťoučký kůň pěl ďábelské ódy
    $
    Hello world ! Segmentation fault (core dumped)
    31.1.2012 11:16 Ondřej
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Díky, to jsem rád, že to aspoň někde funguje. Nicméně bych byl rád, pokud bych nemusel na server instalovat celý LibreOffice jen kvůli RTF konverzi. Ale asi to tak dopadne, jak to vidím…
    31.1.2012 18:41 chrono
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Problém je, že unrtf vkladá znaky, ktoré sú v rtf súbore vložené ako unicode sekvencie (a teda \uxx), len do niektorých formátov (konkrétne len do html a rtf formátu). Netuším, prečo tam také obmedzenie je, pretože skonvertovať to do utf-8 nie je zložité a so znakmi vloženými pomocou sekvencie '\XX sa to tam tak robí.

    Ak by tam nebol ďalší problém, tak by fungovalo vygenerovanie html súboru s následným dump-om cez lynx. Problém ale je, že to nie celkom funguje.

    Zaujímavá časť kódu, pre tento problém je v súbore convert.c vo funkcii cmd_u. Tam je na konci poznámka, že ak vieme, ako interpretovať unicode znak, vo výstupnom formáte, preskočíme nasledujúce slovo. A presne to spôsobuje, že, minimálne pri tom priloženom rtf súbore, sa potom preskočia znaky, ktoré nasledujú za tými unicode znakmi (dokumentáciu k rtf formátu som nečítal, tekže netuším, či je problém unrtf, alebo program, ktorý ten rtf súbor vygeneroval).
    1.2.2012 13:03 Ondřej
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Díky za objasnění :-). Já jsem to RTF vytvářel a ukládal na Macu, když jsem zkusil stáhnout nějaké RTF, které bylo nejspíš vytvořené na Windows, tak to fungovalo. Alespoň přes tu konverzi do HTML, když jsem tam rovnou dal —text, tak mi to zase místo některých znaků naházelo otazníky.
    31.1.2012 15:03 ikarr
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    asi v nich nebylo "ř" :-)

    možná by stačilo doplnit /usr/lib/unrtf/SYMBOL.charmap
    31.1.2012 15:14 ikarr
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    odpovím si sám, nestačilo.
    Josef Kufner avatar 30.1.2012 23:58 Josef Kufner | skóre: 70
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny
    Pokud nenajdeš nic lepšího, tak použij LibreOffice:
    loffice --convert-to ...
    Nezkoušel jsem to, ale pokud to bude produkovat divně formátovaný text, tak to vem ještě skrz html a lynx.
    Hello world ! Segmentation fault (core dumped)
    31.1.2012 13:50 poko | skóre: 9
    Rozbalit Rozbalit vše Re: RTF→TXT konvertor s podporou češtiny

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.