abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    včera 14:00 | Zajímavý článek

    Byl publikován aktuální přehled vývoje renderovacího jádra webového prohlížeče Servo (Wikipedie).

    Ladislav Hagara | Komentářů: 0
    včera 12:00 | Nová verze

    V programovacím jazyce Go naprogramovaná webová aplikace pro spolupráci na zdrojových kódech pomocí gitu Forgejo byla vydána ve verzi 12.0 (Mastodon). Forgejo je fork Gitei.

    Ladislav Hagara | Komentářů: 0
    17.7. 18:44 | Zajímavý článek

    Nová čísla časopisů od nakladatelství Raspberry Pi zdarma ke čtení: Raspberry Pi Official Magazine 155 (pdf) a Hello World 27 (pdf).

    Ladislav Hagara | Komentářů: 1
    17.7. 16:11 | Nová verze

    Hyprland, tj. kompozitor pro Wayland zaměřený na dláždění okny a zároveň grafické efekty, byl vydán ve verzi 0.50.0. Podrobný přehled novinek na GitHubu.

    Ladislav Hagara | Komentářů: 2
    17.7. 15:55 | Komunita

    Patrick Volkerding oznámil před dvaatřiceti lety vydání Slackware Linuxu 1.00. Slackware Linux byl tenkrát k dispozici na 3,5 palcových disketách. Základní systém byl na 13 disketách. Kdo chtěl grafiku, potřeboval dalších 11 disket. Slackware Linux 1.00 byl postaven na Linuxu .99pl11 Alpha, libc 4.4.1, g++ 2.4.5 a XFree86 1.3.

    Ladislav Hagara | Komentářů: 5
    16.7. 21:22 | IT novinky

    Ministerstvo pro místní rozvoj (MMR) jako první orgán státní správy v Česku spustilo takzvaný „bug bounty“ program pro odhalování bezpečnostních rizik a zranitelných míst ve svých informačních systémech. Za nalezení kritické zranitelnosti nabízí veřejnosti odměnu 1000 eur, v případě vysoké závažnosti je to 500 eur. Program se inspiruje přístupy běžnými v komerčním sektoru nebo ve veřejné sféře v zahraničí.

    Ladislav Hagara | Komentářů: 19
    16.7. 16:22 | IT novinky

    Vláda dne 16. července 2025 schválila návrh nového jednotného vizuálního stylu státní správy. Vytvořilo jej na základě veřejné soutěže studio Najbrt. Náklady na přípravu návrhu a metodiky činily tři miliony korun. Modernizovaný dvouocasý lev vychází z malého státního znaku. Vizuální styl doprovází originální písmo Czechia Sans.

    Ladislav Hagara | Komentářů: 26
    16.7. 15:33 | Upozornění

    Vyhledávač DuckDuckGo je podle webu DownDetector od 2:15 SELČ nedostupný. Opět fungovat začal na několik minut zhruba v 15:15. Další služby nesouvisející přímo s vyhledáváním, jako mapyAI asistent jsou dostupné. Pro některé dotazy během výpadku stále funguje zobrazování například textu z Wikipedie.

    bindiff | Komentářů: 8
    16.7. 13:33 | Bezpečnostní upozornění

    Více než 600 aplikací postavených na PHP frameworku Laravel je zranitelných vůči vzdálenému spuštění libovolného kódu. Útočníci mohou zneužít veřejně uniklé konfigurační klíče APP_KEY (např. z GitHubu). Z více než 260 000 APP_KEY získaných z GitHubu bylo ověřeno, že přes 600 aplikací je zranitelných. Zhruba 63 % úniků pochází z .env souborů, které často obsahují i další citlivé údaje (např. přístupové údaje k databázím nebo cloudovým službám).

    Ladislav Hagara | Komentářů: 5
    16.7. 00:11 | Nová verze

    Open source modální textový editor Helix, inspirovaný editory Vim, Neovim či Kakoune, byl vydán ve verzi 25.07. Přehled novinek se záznamy terminálových sezení v asciinema v oznámení na webu. Detailně v CHANGELOGu na GitHubu.

    Ladislav Hagara | Komentářů: 0
    Jaký je váš oblíbený skriptovací jazyk?
     (59%)
     (27%)
     (7%)
     (3%)
     (0%)
     (1%)
     (4%)
    Celkem 410 hlasů
     Komentářů: 16, poslední 8.6. 21:05
    Rozcestník

    Dotaz: neznámé kódování v XML

    10.11.2010 20:34 Ladislav Nešněra | skóre: 30 | blog: ..+2
    neznámé kódování v XML
    Přečteno: 770×
    Potřeboval bych analyzovat záznamy v HelpDesku. Neboť umožňuje výstup v XML, zvolil jsem cestu transformace do csv a pak zpracování v tabulkovém procesoru. Žel narazil jsem na dvojí kódování ve vstupním souboru a ten druhý navíc nepoznávám. Tušíte někdo, co je to zač? Díky


    Řešení dotazu:


    Odpovědi

    10.11.2010 20:45 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Druhý řádek je asi 2× překódovaný & = &, tudíž &#FD = &#FD = ý
    To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†
    10.11.2010 20:51 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Opravička: …tudíž: &#xFD = &#xFD = ý
    Hexadecimální zápis a navíc překódovaný.
    To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†
    10.11.2010 20:50 Filip Jirsák | skóre: 68 | blog: Fa & Bi
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Kdyby tady ten soubor byl přiložen, můžeme se na to třeba zkusit podívat. Ale křišťálovou kouli, abychom to poznali bez ukázky, asi nikdo nemá. Nebo zkuste použít nástroj Enca.
    10.11.2010 21:00 Ladislav Nešněra | skóre: 30 | blog: ..+2
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Jasně že by to s originálním XML šlo líp, ale jsem vázán mlčenlivostí. Měl jsem to uvést už v dotazu. Omlouvám se ;?)
    10.11.2010 21:16 Filip Jirsák | skóre: 68 | blog: Fa & Bi
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Stačilo by kousek. Až po odeslání komentáře jsem zjistil, že součástí dotazu je obrázek – já mám obrázky v komentářích zakázané, takže tam nic nevidím. kdybyste místo toho obrázku přiložil textový soubor s jeho obsahem, bylo by to lepší. Ostatně ten obsah šlo vložit i přímo do textu dotazu.
    10.11.2010 22:16 Ladislav Nešněra | skóre: 30 | blog: ..+2
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Příloha:
    nakonec jsem nějaký nezávadný kousek jsem našel. Snad bude stačit ;?)

    To přímé vložení jsem zkoušel, ale co je UTF8 v HTML, je přímo nahrazeno, proto ty přílohy/obrázky..
    10.11.2010 22:57 Filip Jirsák | skóre: 68 | blog: Fa & Bi
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Některé znaky musely už v tom vstupu být zakódovány jako XML entity, a v tom dokumentu jsou pak zakódovány podruhé. Jiné znaky s diakritiky jsou ale zakódovány jen jednou. Každopádně když ten obsah načtete jako XML text, dostanete z toho tohle:
    Při uzavírání spisu XXX se objevila chyba v synchronizaci, která není specifikována, pro nevím, jak ji odstranit. Prosím o nápravu. Povšimla jsem si (jedná se o toitž již o třetí případ), že chyba se objeví vždy, když chci uložit změny do karty případu.
    To je pak znova potřeba interpretovat jako zdrojový kód XML v kódování Windows-1250, tj. třeba okolo toho znova přidat nějaké XML značky.

    Můžete si to vyzkoušet třeba ve webovém prohlížeči, který umí zobrazovat i XML – zobrazit původní dokument jako XML v kódování Windows-1250, okopírujte si zobrazený obsah do schránky, vložte v textovém editoru do souboru, přidejte na začátek <a> a na konec </a>, uložte, a výsledek znova zobrazte v prohlížeči v kódování Windows-1250.
    11.11.2010 19:46 Ladislav Nešněra | skóre: 30 | blog: ..+2
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Potvrzení pravděpodobné teorie, jak k této podivnosti dochází jsem našel zde

    Jak věští ve své reakci Šangala, kódování je utf-8 s hex zápisem entity.

    Ruční postup pomocí browseru funguje, ale v zamýšlená transformaci se mi těch entit zbavit nepodařilo (prakticky nulové zkušenosti s XSL)
    11.11.2010 19:44 Šangala | skóre: 56 | blog: Dutá Vrba - Wally
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Jak jsem Vám hned napsal, je to 2× překódované - klasika...
    Anebo to není 2× překódované, ale je to tak správně - je to věcí pohledu:
    Máte HTML validní data (řetězce) a ty používají pro diakritiku hexadecimální zápis znaků tj. &xXX.
    A ty data uložíte do XML dokumentu a v XML dokumentu se znak & nahradí za &amp;, protože tak je to správně. - HA! :)

    Když ta data vytahujete libovolným parsrem XML, měl by vám vrátit, validní HTML kód (tj. &xXX)
    Prostě jsou to HTML data uložena v XML.
    Je to obdoba, jako když se do DB ukládají HTML data, jenže tam to netrkne, bo se to tam zapisuje tak jak to je, ale XML dokument má některá pravidla.

    Pokud to parsujete „nějak“ partyzánsky, lze udělat prasárny typu:
    Vem hodnotu (řetězec) a zaměň:
    &amp; za &
    &amp;lt; za &lt;
    &amp;gt; za &gt;
    &amp;quot; za &quot;
    &amp;apos; za &apos;
    
    Pak z toho dostanete normální HTML řetězce no a musíte si zaměnit sekvence:
    &lt; za <
    &gt; za >
    &quot; za "
    &apos; za '
    &xXX za chr(hextodec(XX))
    
    A asi tímto divným postupem z toho vyleze normální string.
    To, že trpíš stihomamem, ještě neznamená, že po tobě nejdou. ⰞⰏⰉⰓⰀⰜⰉ ⰗⰞⰅⰜⰘ ⰈⰅⰏⰉ ⰒⰑⰎⰉⰁⰕⰅ ⰏⰉ ⰒⰓⰄⰅⰎ ·:⁖⁘⁙†
    16.11.2010 00:40 Ladislav Nešněra | skóre: 30 | blog: ..+2
    Rozbalit Rozbalit vše Re: neznámé kódování v XML
    Oběma ještě jednou díky za pomoc

    Neb si potřebuji připomenout Python, řešil jsem to v něm. Po prvním kole mi XSL transformace nechala nečitelné jen ty hexadecimálně zapsané entity. Těch jsem se následně zbavil kódem inspirovaným tímto.

    Ještě jsem narazil na docela zajímavý projekt, žel hexadecimální entity také neumí.

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.