abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×

dnes 10:22 | Zajímavý článek

Lukáš Růžička v článku Kuchařka naší Růži aneb vaříme rychlou polévku z Beameru na MojeFedora.cz ukazuje "jak si rychle vytvořit prezentaci v LaTeXu, aniž bychom se přitom pouštěli do jeho bezedných hlubin".

Ladislav Hagara | Komentářů: 1
dnes 07:22 | Komunita

Od 26. do 29. října proběhla v Bochumi European Coreboot Conference 2017 (ECC'17). Na programu této konference vývojářů a uživatelů corebootu, tj. svobodné náhrady proprietárních BIOSů, byla řada zajímavých přednášek. Jejich videozáznamy jsou postupně uvolňovány na YouTube.

Ladislav Hagara | Komentářů: 0
včera 19:22 | Nová verze

Ondřej Filip, výkonný ředitel sdružení CZ.NIC, oznámil vydání verze 2.0.0 open source routovacího démona BIRD (Wikipedie). Přehled novinek v diskusním listu a v aktualizované dokumentaci.

Ladislav Hagara | Komentářů: 0
včera 09:22 | Pozvánky

V Praze dnes probíhá Konference e-infrastruktury CESNET. Na programu je řada zajímavých přednášek. Sledovat je lze i online na stránce konference.

Ladislav Hagara | Komentářů: 1
9.12. 20:11 | Nová verze

Byl vydán Debian 9.3, tj. třetí opravná verze Debianu 9 s kódovým názvem Stretch a Debian 8.10, tj. desátá opravná verze Debianu 8 s kódovým názvem Jessie. Řešeny jsou především bezpečnostní problémy, ale také několik vážných chyb. Instalační média Debianu 9 a Debianu 8 lze samozřejmě nadále k instalaci používat. Po instalaci stačí systém aktualizovat.

Ladislav Hagara | Komentářů: 0
9.12. 00:44 | Nová verze

Po 6 měsících vývoje od vydání verze 0.13.0 byla vydána verze 0.14.0 správce balíčků GNU Guix a na něm postavené systémové distribuce GuixSD (Guix System Distribution). Na vývoji se podílelo 88 vývojářů. Přibylo 1 211 nových balíčků. Jejich aktuální počet je 6 668. Aktualizována byla také dokumentace.

Ladislav Hagara | Komentářů: 4
8.12. 21:33 | Nová verze

Po půl roce vývoje od vydání verze 5.9 byla vydána nová stabilní verze 5.10 toolkitu Qt. Přehled novinek na wiki stránce. Současně byla vydána nová verze 4.5.0 integrovaného vývojového prostředí (IDE) Qt Creator nebo verze 1.10 nástroje pro překlad a sestavení programů ze zdrojových kódů Qbs.

Ladislav Hagara | Komentářů: 0
7.12. 11:11 | Komunita

Naprostá většina příjmů Mozilly pochází od výchozích webových vyhledávačů ve Firefoxu. Do konce listopadu 2014 měla Mozilla globální smlouvu se společností Google. Následně bylo místo jedné globální smlouvy uzavřeno několik smluv s konkrétními vyhledávači pro jednotlivé země. V USA byla podepsána pětiletá smlouva s vyhledávačem Yahoo. Dle příspěvku na blogu Mozilly podala společnost Yahoo na Mozillu žalobu ohledně porušení této

… více »
Ladislav Hagara | Komentářů: 0
7.12. 05:55 | Zajímavý článek

V Londýně probíhá konference věnovaná počítačové bezpečnosti Black Hat Europe 2017. Průběžně jsou zveřejňovány prezentace. Videozáznamy budou na YouTube zveřejněny o několik měsíců. Zveřejněna byla například prezentace (pdf) k přednášce "Jak se nabourat do vypnutého počítače, a nebo jak v Intel Management Engine spustit vlastní nepodepsaný kód". Dle oznámení na Twitteru, aktualizace vydaná společností Intel nevylučuje možnost útoku.

Ladislav Hagara | Komentářů: 5
7.12. 04:44 | Komunita

Virtualizační nástroj GNOME Boxy ve Fedoře 27 umožňuje jednoduše stáhnout a nainstalovat Red Hat Enterprise Linux, který je pro vývojáře zdarma. Vývojová verze GNOME Boxy již umožňuje jednoduše stáhnout a nainstalovat další linuxové distribuce. Ukázka na YouTube. Seznam distribucí a jejich verze, nastavení a cesty k ISO obrazům je udržován v knihovně a databázi libosinfo (GitLab).

Ladislav Hagara | Komentářů: 0
Jak se vás potenciálně dotkne trend odstraňování analogového audio konektoru typu 3,5mm jack z „chytrých telefonů“?
 (8%)
 (1%)
 (1%)
 (1%)
 (75%)
 (14%)
Celkem 957 hlasů
 Komentářů: 45, poslední 1.12. 19:00
    Rozcestník

    Dotaz: HTML->RSS jako třída PHP nebo free online app ...

    9.4.2013 10:02 hanoj
    HTML->RSS jako třída PHP nebo free online app ...
    Přečteno: 213×
    Zajimam se o problem urednich desek na webu, ktere nemaji RSS. V nasem meste je jich cca 40 a kazda je na jinem webu a ma jinou formu HTML, vyvesene rozhodnuti je ale nakonec vzdy PDF.

    Chtel bych agregovat vsechna rozhodnuti na jednu stranku, umoznit filtrovani, hledat zmeny, archivovat. Neco jako HTML->RSS. Nema nekdo zkusenost free online aplikaci nebo s nejakou PHP tridou?

    Odpovědi

    9.4.2013 10:17 NN
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    RSS je jen dobre naformatovane XML, tak proc tak slozite. Cele to napises bez problemu v PHP. Jednou casti kodu budes tahat data, druhou je parsovat do RSS XML formatu.
    9.4.2013 12:07 hanoj
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    Abys mohl neco dobre naformatovat potrebujes dobre XML a pak staci XPATH. Ale 40 ruznych adhoc HTML formatu... to bych si rad ulehcil nejakym udelatkem... Takovej nastroj na HTML DOM jako adblock+ by byl dobrej ale GUI nepozaduji ;)
    9.4.2013 11:01 pesspi | skóre: 7 | blog: hateblog
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    Robil som podobny web v PHP len som agregoval ponuky realitnych kancelarii ktore nemali RSS. Robil som to tak ze som parsoval tie ich stranky. Ak som chcel mat kvalitny vystup, musel som dost pracne pisat parser pre kazdu stranku zvlast. Na jeden web to vychadzalo cca 10 riadkov husteho ad-hoc kodu (regexy, ify, fory). Nejake genericke riesenie mi moc nefungovalo lebo sa menili reklamy na ich webe co sposobovalo ze si system myslel ze sa nieco zmenilo, alebo oni menili poradie inzeratov, pripadne znova publikovali starsie inzeraty.

    Ak je to ako pises ze skutocne je to len odkaz na PDF na webstranke, malo by stacit primitivny regex typu: /http[s]*:\/\/[a-zA-Z0-9-\.\/]+.pdf/ a tieto PDF stahovat a na zaklade nejakeho MD5 hashu rozhodnut ci je to PDF nove alebo nie. Ak je nove zverejnit na RSS (atom je primitivny xml, da sa bez problemov napisat aj rucne).
    9.4.2013 12:04 hanoj
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    Ano tvuj pripad je hodne podobny. Chapu to tak, ze jsi zadnou knihovnu nepouzil. S temi PDFkami je trochu problem. Jsou zpravidla vnorene nekolik stranek pod uvodnim seznamem. Nektere dokonce zadny prehledny seznam nemaji a lze v nich jen listovat (na jedne strance N je 1 PDF a odtud vede odkaz na stranku N-1 s PDF).
    9.4.2013 12:39 pesspi | skóre: 7 | blog: hateblog
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    Myslim ze budes kazdu stranku musiet riesit osobitne, niektore na viac krokov (nacitat index, najst formular, daco vyhladat, najst vyseledkove stranky, stiahnut tie a v nich hladat pdf)
    9.4.2013 13:18 hanoj
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    Jeste by mne zajimalo, jak jsi resil update. Mam predstavu ze 1x za den by se to melo aktualizovat. Jak jsi rozpoznaval na strankach zmeny oproti predchozimu stavu, pripadne novinky od zmen, duplicity z ruznych serveru?
    9.4.2013 13:26 pesspi | skóre: 7 | blog: hateblog
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    Updaty som riesil raz za hodinu cronom. U mna bol unikatny identifikator md5(nadpis+obsah inzeratu+zoznam nazvov obrazkov), ukladal som to do db a co tam nebolo som oznacil ako nove a islo to do feedu. Duplicity to riesilo len ak skopirovali plne znenie inzeratu. Rucne som potom vyhodil niekolko notoricky sa opakujucich inzeratov (napr. tento). Byty som riesil inak, tam som mal regexy na vsetko mozne a veci ktore ma nezaujimali som rovno zahadzoval (prve poschodie, posledne pozschodie, vybrane ulice a mestske casti). Po tej filtracii uz tam nebol az tak velky trafik, radovo 10 inzeratov denne ktore som vyfiltroval rucne. Pouzival som to len dokym som nekupil byt, potom som to nechal tak.
    9.4.2013 12:30 Kit
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    V PHP je na to třída DomDocument. Umí číst i nevalidní HTML, ale musí se před to hodit @.
    9.4.2013 13:25 hanoj
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    diky zda se ze tohle by mi mohlo usnadnit adresovani DOM... getElementsByTagName
    9.4.2013 13:35 Kit
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    Na to už můžeš použít XPath.
    9.4.2013 13:37 Kit
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    Také se to dá zpracovat XSLT. Dokonce se tá udělat jednotná šablona pro všech 40 webů.
    9.4.2013 14:04 hanoj
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    XSLT a XPATH u mne budi hruzu. Jednou jsem to musel pouzit, ale nikdy jsem to nebyl schopen pochopit. Zaklady ano, ale pokrocile, ty co clovek opravdu potrebuje byly mimo me chapani.
    9.4.2013 14:36 Kit
    Rozbalit Rozbalit vše Re: HTML->RSS jako třída PHP nebo free online app ...
    To bude asi proto, že jsi zvyklý na procedurální programování. Také mi dlouho trvalo, než jsem u toho začal přemýšlet v duchu jazyka.

    Načtením do DOMu získáš strom. Virtuální procesor XSLT je druhým stromem. Jejich sloučením (transformací) vznikne třetí strom, výsledek.

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.