abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 12:33 | IT novinky

    Na blogu Raspberry Pi byla představena rozšiřující deska Raspberry Pi AI HAT+ 2 s akcelerátorem Hailo-10 a 8 GB RAM. Na rozdíl od předchozí Raspberry Pi AI HAT+ podporuje generativní AI. Cena desky je 130 dolarů.

    Ladislav Hagara | Komentářů: 0
    dnes 12:11 | Komunita

    Wikipedie slaví 25. výročí svého založení. Vznikla 15. ledna 2001 jako doplňkový projekt k dnes již neexistující encyklopedii Nupedia. Doména wikipedia.org byla zaregistrována 12. ledna 2001. Zítra proběhne v Praze Večer svobodné kultury, který pořádá spolek Wikimedia ČR.

    Ladislav Hagara | Komentářů: 0
    dnes 04:44 | Nová verze

    Po více než dvou letech od vydání předchozí verze 2.12 byla vydána nová stabilní verze 2.14 systémového zavaděče GNU GRUB (GRand Unified Bootloader, Wikipedie). Přehled novinek v souboru NEWS a v aktualizované dokumentaci.

    Ladislav Hagara | Komentářů: 0
    dnes 02:22 | Nová verze

    Google Chrome 144 byl prohlášen za stabilní. Nejnovější stabilní verze 144.0.7559.59 přináší řadu novinek z hlediska uživatelů i vývojářů. Podrobný přehled v poznámkách k vydání. Opraveno bylo 10 bezpečnostních chyb. Vylepšeny byly také nástroje pro vývojáře (YouTube).

    Ladislav Hagara | Komentářů: 2
    dnes 01:55 | Humor

    Microsoft zveřejnil zdrojový kód XAML Studia a uvolnil ho pod MIT licencí. XAML Studio je nástroj ze světa Windows, určený pro tvorbu uživatelského rozhraní aplikací pomocí XAML (Extensible Application Markup Language). Stalo se tak zhruba po osmi letech od prvního prohlášení Microsoftu, že se tento kód chystá zveřejnit.

    NUKE GAZA! 🎆 | Komentářů: 0
    dnes 01:44 | Zajímavý projekt

    TimeCapsule, 'časová kapsle', je jazykový model trénovaný výhradně na datech z určitých míst a časových období, aby se tak napodobila autentická slovní zásoba, způsob vyjadřování a názory dané doby. Na Hugging face jsou k dispozici modely natrénované na historických textech dostupných v oblasti Londýna mezi lety 1800 až 1875.

    NUKE GAZA! 🎆 | Komentářů: 2
    včera 17:55 | Nová verze

    Radicle byl vydán ve verzi 1.6.0 s kódovým jménem Amaryllis. Jedná se o distribuovanou alternativu k softwarům pro spolupráci jako např. GitLab.

    Ladislav Hagara | Komentářů: 0
    včera 13:22 | Upozornění

    Zemřel Scott Adams, tvůrce komiksových stripů Dilbert parodujících pracovní prostředí velké firmy.

    Ladislav Hagara | Komentářů: 3
    včera 13:00 | Nová verze

    Sdružení CZ.NIC vydalo novou verzi Knot Resolveru (6.1.0). Jedná se o první vydanou stabilní verzi 6, která je nyní oficiálně preferovanou a doporučovanou verzí, namísto předešlé verze 5. Více o Knot Resolveru 6 je možné se dočíst přímo v dokumentaci.

    VSladek | Komentářů: 3
    včera 01:22 | Nová verze

    Byl vydán Linux Mint 22.3 s kódovým jménem Zena. Podrobnosti v přehledu novinek a poznámkách k vydání. Vypíchnout lze, že nástroj Systémová hlášení (System Reports) získal mnoho nových funkcí a byl přejmenován na Informace o systému (System Information). Linux Mint 22.3 bude podporován do roku 2029.

    Ladislav Hagara | Komentářů: 1
    Které desktopové prostředí na Linuxu používáte?
     (14%)
     (5%)
     (0%)
     (8%)
     (19%)
     (3%)
     (6%)
     (3%)
     (11%)
     (44%)
    Celkem 442 hlasů
     Komentářů: 12, poslední včera 21:12
    Rozcestník

    Dotaz: Konverze ruznych textovych formatu do jednoho

    polo23 avatar 29.2.2012 19:26 polo23 | skóre: 28 | blog: polo23
    Konverze ruznych textovych formatu do jednoho
    Přečteno: 609×
    Ahoj,
    potreboval bych poradit jak zkonvertovat hromadu textovych souboru do jenoho druhu formatu napr. ASCII nebo UTF8.

    Tady je sezna typu formatu souboru co potrebuju zkonvertovat. Chtel jsem pouzit iconv ale ten chce zadat vzdy alepson vstupni typ formatu.
    ASCII C++ program text
    ASCII C++ program text
    ASCII text
    ASCII text
    ASCII text, with escape sequences
    ASCII text, with CRLF line terminators
    ASCII text, with CRLF line terminators
    ASCII text, with CRLF, LF line terminators
    ASCII text
    ISO-8859 text
    ISO-8859 text
    ASCII text
    ASCII text, with CRLF line terminators, with escape sequences
    ASCII text, with CRLF line terminators
    ASCII text
    ASCII text, with CRLF line terminators
    ASCII C program text
    Non-ISO extended-ASCII English text, with CRLF line terminators
    ASCII text
    ASCII text
    ISO-8859 English text
    ISO-8859 English text
    ASCII English text
    ASCII English text
    ISO-8859 text, with CRLF line terminators
    ASCII text, with escape sequences
    ASCII text
    ASCII text
    ASCII text
    ASCII text
    ASCII English text
    ASCII text, with CRLF line terminators
    ASCII text, with CRLF line terminators
    ASCII text, with CRLF line terminators
    ASCII text, with CRLF line terminators
    ASCII English text, with CRLF line terminators
    Non-ISO extended-ASCII text
    ASCII English text, with CRLF line terminators
    UTF-8 Unicode English text
    ASCII English text
    ASCII text
    ASCII English text
    data
    ASCII Pascal program text
    ASCII Pascal program text
    ASCII text
    ASCII English text
    ASCII English text
    UTF-8 Unicode C program text
    UTF-8 Unicode text
    ASCII text, with CRLF line terminators
    ASCII text, with CRLF line terminators
    ASCII text
    ASCII C++ program text
    ASCII C++ program text
    ASCII text
    ASCII text
    ASCII text
    ASCII text
    Non-ISO extended-ASCII text, with LF, NEL line terminators
    MMDF mailbox
    ASCII text, with CRLF line terminators
    Non-ISO extended-ASCII text, with CRLF, NEL line terminators
    ASCII assembler program text, with CRLF, CR line terminators
    ASCII Pascal program text, with CRLF line terminators
    Non-ISO extended-ASCII English text
    Non-ISO extended-ASCII English text
    Non-ISO extended-ASCII text
    HTML document text
    Non-ISO extended-ASCII text
    ISO-8859 English text
    Non-ISO extended-ASCII English text
    ASCII text
    directory

    Odpovědi

    29.2.2012 19:42 l4m4
    Rozbalit Rozbalit vše Re: Konverze ruznych textovych formatu do jednoho
    Potíž jsou ty Non-ISO extended-ASCII, protože mohou být naprosto cokoli. Zkusil bych enca, zda ti je detekuje správně.

    Některé formáty budeš muset převést speciálně jiným programem, např. ten mailbox nebo HTML, pokud chceš na konci jen text (ale zase vesměs obsahují kódování, ve kterém jsou).

    Převod do ASCII není definován. Nevím, jak převedeš do ASCII třeba tohle:

    http://www.cl.cam.ac.uk/~mgk25/ucs/examples/UTF-8-demo.txt
    polo23 avatar 29.2.2012 21:37 polo23 | skóre: 28 | blog: polo23
    Rozbalit Rozbalit vše Re: Konverze ruznych textovych formatu do jednoho
    Ta enca je nerozpoznala... Ma problem s rozpoznavanim i dalsich formatu... Nemusi to byt ASCII ale treba to UTF8. Proste neco co bezny txt prohlizec otevre.
    pavlix avatar 1.3.2012 09:54 pavlix | skóre: 54 | blog: pavlix
    Rozbalit Rozbalit vše Re: Konverze ruznych textovych formatu do jednoho
    Ma problem s rozpoznavanim i dalsich formatu...
    To se jí vůbec nedivím.
    Já už tu vlastně ani nejsem. Abclinuxu umřelo.
    polo23 avatar 29.2.2012 21:38 polo23 | skóre: 28 | blog: polo23
    Rozbalit Rozbalit vše Re: Konverze ruznych textovych formatu do jednoho
    Jeste me napada otrocina otevirat to rucne treba v gedit a ukladat to v ASCII:) Ale do toho se mi nechce.
    29.2.2012 23:45 l4m4
    Rozbalit Rozbalit vše Re: Konverze ruznych textovych formatu do jednoho
    Pokud ti stačí jakkoli zmršit ne-ASCII znaky, tak je prostě odstraň:

    tr -d -c '[\001-\177]'

    Požadavek konverze do UTF-8 a požadavek modifikace souboru, aby neobsahoval ne-ASCII znaky jsou velmi odlišné a musejí se odlišně řešit. Není jedno, co z toho se má provést.
    1.3.2012 05:50 ahuska
    Rozbalit Rozbalit vše Re: Konverze ruznych textovych formatu do jednoho
    man konwert viz any/cs a crlf
    pavlix avatar 1.3.2012 10:03 pavlix | skóre: 54 | blog: pavlix
    Rozbalit Rozbalit vše Re: Konverze ruznych textovych formatu do jednoho
    Rozhodnutí jestli konvertovat do ASCII nebo UTF-8 je docela zásadní. ASCII je zároveň i znakovou sadou, která je podmnožinou znakové sady Unicode (kóduje se mimojiné jako UTF-8).

    Unicode je univerzální v tom, že dneska můžeš redefinovat všechna běžná ḱódování předefinovat jako (často neúplná) kódování znakové sady Unicode. Takže třeba kódování českého textu do ASCII je nutně ztrátové, zatímco překódování prakticky čehokoli do UTF-8 je bezztrátové.
    Já už tu vlastně ani nejsem. Abclinuxu umřelo.

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.