abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 03:33 | IT novinky

    Do prodeje jde tichá bezdrátová herní myš Logitech PRO X2 SUPERSTRIKE s analogovými spínači s haptickou odezvou (HITS, Haptic Inductive Trigger System). Cena je 4 459 Kč.

    Ladislav Hagara | Komentářů: 3
    včera 21:00 | Zajímavý projekt

    Microsoft na GitHubu zveřejnil zdrojový kód projektu LiteBox, jedná se o 'knihovní operační systém' (library OS) zaměřený na bezpečnost, využívající systémovou architekturu LVBS k ochraně jádra před útoky z uživatelského prostoru. LiteBox je napsán v Rustu a uvolněný pod licencí MIT. Projekt je teprve v rané fázi vývoje.

    NUKE GAZA! 🎆 | Komentářů: 1
    včera 16:11 | Zajímavý software

    BreezyBox je open-source shell a virtuální terminál pro populární jednočip ESP32. Nabízí základní unixové příkazy, sledování aktuálního pracovního adresáře (CWD), jednoduchý instalátor a spouštěč aplikací v podobě ELF binárních souborů, zabudovaný HTTP server nebo třeba ovládání WiFi - ukázka použití coby 'malého osobního počítače'. Ačkoliv je BreezyBox inspirovaný BusyBoxem, oproti němu má tento projekt několik externích závislostí, zejména na ESP-IDF SDK. BreezyBox je dostupný pod licencí MIT.

    NUKE GAZA! 🎆 | Komentářů: 0
    včera 16:00 | Humor

    Byl představen cross-assembler xa.sh, napsaný čistě v Bourne shell skriptu. Tento nástroj umožňuje zpracovávat assemblerový kód pro Intel 8080, přičemž je možné snadno přidat podporu i pro další architektury, například 6502 a 6809. Skript využívá pouze různé běžné unixové příkazy jako jsou awk, sed nebo printf. Skript si lze stáhnout z GitHubového repozitáře projektu.

    NUKE GAZA! 🎆 | Komentářů: 6
    6.2. 17:22 | IT novinky

    Byla představena nová verze modelu Claude Opus 4.6 od společnosti Anthropic. Jako demonstraci možností Anthropic využil 16 agentů Claude Opus 4.6 k vytvoření kompilátoru jazyka C, napsaného v programovacím jazyce Rust. Claude pracoval téměř autonomně, projekt trval zhruba dva týdny a náklady činily přibližně 20 000 dolarů. Výsledkem je fungující kompilátor o 100 000 řádcích kódu, jehož zdrojový kód je volně dostupný na GitHubu pod licencí Creative Commons.

    NUKE GAZA! 🎆 | Komentářů: 18
    6.2. 16:44 | Komunita

    Kultovní britský seriál The IT Crowd (Ajťáci) oslavil dvacáté výročí svého prvního vysílání. Sitcom o dvou sociálně nemotorných pracovnících a jejich nadřízené zaujal diváky svým humorem a ikonickými hláškami. Seriál, který debutoval v roce 2006, si i po dvou dekádách udržuje silnou fanouškovskou základnu a pravidelně se objevuje v seznamech nejlepších komedií své doby. Nedávné zatčení autora seriálu Grahama Linehana za hatecrime však vyvolává otázku, jestli by tento sitcom v současné Velké Británii vůbec vznikl.

    NUKE GAZA! 🎆 | Komentářů: 10
    6.2. 13:33 | IT novinky

    Společnost JetBrains oznámila, že počínaje verzí 2026.1 budou IDE založená na IntelliJ ve výchozím nastavení používat Wayland.

    Ladislav Hagara | Komentářů: 4
    6.2. 11:22 | IT novinky

    Společnost SpaceX amerického miliardáře Elona Muska podala žádost o vypuštění jednoho milionu satelitů na oběžnou dráhu kolem Země, odkud by pomohly zajistit provoz umělé inteligence (AI) a zároveň šetřily pozemské zdroje. Zatím se ale neví, kdy by se tak mělo stát. V žádosti Federální komisi pro spoje (FCC) se píše, že orbitální datová centra jsou nejúspornějším a energeticky nejúčinnějším způsobem, jak uspokojit rostoucí poptávku po

    … více »
    Ladislav Hagara | Komentářů: 28
    6.2. 11:11 | Nová verze

    Byla vydána nová verze 2.53.0 distribuovaného systému správy verzí Git. Přispělo 70 vývojářů, z toho 21 nových. Přehled novinek v poznámkách k vydání.

    Ladislav Hagara | Komentářů: 0
    6.2. 04:22 | Komunita

    Spolek OpenAlt zve příznivce otevřených řešení a přístupu na 216. sraz, který proběhne v pátek 20. února od 18:00 v Red Hat Labu (místnost Q304) na Fakultě informačních technologií VUT v Brně na ulici Božetěchova 1/2. Tématem srazu bude komunitní komunikační síť MeshCore. Jindřich Skácel představí, co je to MeshCore, předvede nejrůznější klientské zařízení a ukáže, jak v praxi vypadá nasazení vlastního repeateru.

    Ladislav Hagara | Komentářů: 0
    Které desktopové prostředí na Linuxu používáte?
     (19%)
     (6%)
     (0%)
     (10%)
     (26%)
     (3%)
     (4%)
     (2%)
     (12%)
     (29%)
    Celkem 807 hlasů
     Komentářů: 25, poslední 3.2. 19:50
    Rozcestník

    Dotaz: Python a XML

    17.8.2012 09:47 George O.
    Python a XML
    Přečteno: 671×
    Zdravim, potrebuju parsovat html obsah a tak jsem se koukal, ktere knihovny python nabizi, nasel jsem xml.parsers.expat a xml.dom.minidom. Bohuzel, ani jedna nefunguje a momentalne nechapu proc. Data, ktera parsuji jsou v kodovani utf-8 a presne takove kodovani nastavuji i parseru, avsak vzdy to selze na nejakem beznem znaku, napriklad:
    <img src="imageResize.php?src=_public/upload/images/2011-03/34502249_villa.jpg&w=522&h=619&crop=1" alt="The Villas" />
                            <img src="imageResize.php?src=_public/upload/images/2011-03/p1-2.jpg&w=522&h=619&crop=1" alt="The Villas 2" />
                            <img src="imageResize.php?src=_public/upload/images/2011-03/p1.jpg&w=522&h=619&crop=1" alt="The Villas" />
    zde to pada na 2. radku a pise to chybu u 92., 94. anebo 105. znaku... Chyba presne zni: "noZdravim, potrebuju parsovat html obsah a tak jsem se koukal, ktere knihovny python nabizi, nasel jsem xml.parsers.expat a xml.dom.minidom. Bohuzel, ani jedna nefunguje a momentalne nechapu proc. Data, ktera parsuji jsou v kodovani utf-8 a presne takove kodovani nastavuji i parseru, avsak vzdy to selze na nejakem beznem znaku, napriklad:
    <img src="imageResize.php?src=_public/upload/images/2011-03/34502249_villa.jpg&w=522&h=619&crop=1" alt="The Villas" />
                            <img src="imageResize.php?src=_public/upload/images/2011-03/p1-2.jpg&w=522&h=619&crop=1" alt="The Villas 2" />
                            <img src="imageResize.php?src=_public/upload/images/2011-03/p1.jpg&w=522&h=619&crop=1" alt="The Villas" />
    zde to pada na 2. radku a pise to chybu u 92., 94. anebo 105. znaku... Chyba presne zni: "not well-formed (invalid token): line 106, column 94", coz mi nedava smysl, protoze tam zadny non-ascii znak neni...

    Mate s tim nekdo zkusenosti? Diky :-)t well-formed (invalid token): line 106, column 94", coz mi nedava smysl, protoze tam zadny non-ascii znak neni...

    Mate s tim nekdo zkusenosti? Diky :-)

    Odpovědi

    17.8.2012 09:51 George O.
    Rozbalit Rozbalit vše Re: Python a XML
    Koukam, ze zde to vkladani dotazu je nejake rozbite, inu tady je PRESNA KOPIE meho dotazu, kterou si vzdycky ukladam pred odeslanim requestu do pameti:

    http://pastebin.com/2DMp7Eht
    17.8.2012 10:01 l4m4
    Rozbalit Rozbalit vše Re: Python a XML
    Ampersandy v atributech musí být zapsány pomocí entit, pokud to má být parsovatelné coby XML.
    17.8.2012 10:09 George O.
    Rozbalit Rozbalit vše Re: Python a XML
    Aha, takze i presto, ze treba ten parser neukazuje primo chyby u tech "&", tak je to jimi? To uz, hadam, je vykonnejsi napsat si svuj vlastni parser, kdyz bych musel zvalidovat to cele xml pred vlastnim parsovanim...
    17.8.2012 10:25 l4m4
    Rozbalit Rozbalit vše Re: Python a XML
    Nevím, zda jsou ampersandy jediný problém, ale praštily do očí.

    Můžeš použít třeba tidy...

    Ale obecně, ano: nedává smysl parsovat něco, co není X[HT]ML, coby XML. Stejně dobře můžeš zkoušet parsovat JPEG jako CSV...
    17.8.2012 10:29 kuka
    Rozbalit Rozbalit vše Re: Python a XML
    Tak s chuti do toho, napsat parser bude jiste snazsi nez osetrit par specialnich znaku. Ale jak uz nekdo psal - jestlize to neni XML, tak mozna XML parser nebude nejlepsi napad...
    17.8.2012 10:50 George O.
    Rozbalit Rozbalit vše Re: Python a XML
    Problem vyresen - ja blbec jsem se spatne koukal a az ted jsem nasel primo HTMLParser, mlatim se hlavou do stolu, dekuji za vas cas :-)
    17.8.2012 20:07 intense
    Rozbalit Rozbalit vše Re: Python a XML
    Ak je možné tak odporúčam používať validné XML + lxml. V prípade že sa nedá validnosť xml kódu zaručiť (asi tento prípad) tak odporúčam použiť knižnicu Beautiful Soup, ktorá v celku dobre handluje chyby počas parsovania.
    17.8.2012 20:31 chrono
    Rozbalit Rozbalit vše Re: Python a XML
    lxml obsahuje aj html5parser, takže aj lxml by si s tým malo poradiť.
    17.8.2012 20:56 intense
    Rozbalit Rozbalit vše Re: Python a XML
    ono ani tak nejde o parsovanie html5 ale o štruktúru kódu, lxml ale nehandluje moc dobre nevalidný kód, teda pri parsovaní zlyhá, preto skôr soup, ktorý si väčšinou dokáže poradiť s nevalidným kódom
    17.8.2012 20:57 intense
    Rozbalit Rozbalit vše Re: Python a XML
    ne html5... (preklep) html/xml celkovo som myslel
    17.8.2012 21:45 chrono
    Rozbalit Rozbalit vše Re: Python a XML
    Práve html5 štandard by sa mal postarať, okrem iného, o to, aby nevalidný kód všetky aplikácie spracovávali rovnako. Takže ak ten kód dokážu spracovať prehliadače, mali by fungovať aj knižnice na parsovanie html5 (zvyčajne používam práve html5 parser z lxml, ale pre python sú aj iné).
    18.8.2012 15:46 l4m4
    Rozbalit Rozbalit vše Re: Python a XML
    Práve html5 štandard by sa mal postarať, okrem iného, o to, aby nevalidný kód všetky aplikácie spracovávali rovnako.
    Další ukázka toho, že lidi okolo HTML5 nechápou smysl slov jako standard, validní, specifikace, vyhovující, ...

    V tomto případě fakticky rozšiřují definici platných (validních) HTML dokumentů tak, že zahrnuje i dnes nevalidní -- ať už tomu říkají jakkoli.
    18.8.2012 19:12 Radek Miček | skóre: 23 | blog: radekm_blog
    Rozbalit Rozbalit vše Re: Python a XML
    To, že se specifikuje chování v chybových stavech ještě neznamená, že se tyto stavy považují správné.
    18.8.2012 19:58 l4m4
    Rozbalit Rozbalit vše Re: Python a XML
    Je specifikováno, že takový chybový stav bude indikován jako chybový (o odmítnutí ani nemluvím)? Liší se nějak zacházení s takovým dokumentem od zacházení se ,správným`? Neliší-li, tak se tyto stavy považují za správné, jen se to ve ,standardu` nesmyslně pojmenovává.

    Lze vůbec z pohledu toho jejich ,living standard` v principu odlišit chybový stav? Třeba je ten dokument podle standardu, jak vypadal před týdnem, nebo jak bude vypadat až za týden...
    18.8.2012 20:29 intense
    Rozbalit Rozbalit vše Re: Python a XML
    Asi som so svojím príspevkom rozpútal vášnivú diskusiu ale nemôžeme ísť späť k pôvodnému problému? Myslím že ideme off topic. Ako som už písal, tak z vlastnej skúsenosti odporúčam skúsiť ten Beautiful Soup na rozparsovanie, ktorý (v mojom prípade) zvláda rozparsovať väčšinou aj html kde lxml a xml zlyhávajú.
    18.8.2012 21:10 Radek Miček | skóre: 23 | blog: radekm_blog
    Rozbalit Rozbalit vše Re: Python a XML
    Je specifikováno, že takový chybový stav bude indikován jako chybový (o odmítnutí ani nemluvím)?
    Při výskytu chyby se musí parser řídit pravidly pro zotavení nebo musí ukončit zpracování vstupu.
    Neliší-li, tak se tyto stavy považují za správné, jen se to ve ,standardu` nesmyslně pojmenovává.
    Nevím, co si představujete pod pojmem "lišit se".

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.