abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 10:11 | IT novinky

    V pořadí šestou knihou autora Martina Malého, která vychází v Edici CZ.NIC, správce české národní domény, je titul Kity, bity, neurony. Kniha s podtitulem Moderní technologie pro hobby elektroniku přináší ucelený pohled na svět současných technologií a jejich praktické využití v domácích elektronických projektech. Tento knižní průvodce je ideální pro každého, kdo se chce podívat na současné trendy v oblasti hobby elektroniky, od

    … více »
    Ladislav Hagara | Komentářů: 0
    dnes 03:11 | Komunita

    Linux Foundation zveřejnila Výroční zprávu za rok 2025 (pdf). Příjmy Linux Foundation byly 311 miliónů dolarů. Výdaje 285 miliónů dolarů. Na podporu linuxového jádra (Linux Kernel Project) šlo 8,4 miliónu dolarů. Linux Foundation podporuje téměř 1 500 open source projektů.

    Ladislav Hagara | Komentářů: 0
    dnes 02:11 | Zajímavý článek

    Jean-Baptiste Mardelle se v příspěvku na blogu rozepsal o novinkám v nejnovější verzi 25.12.0 editoru videa Kdenlive (Wikipedie). Ke stažení také na Flathubu.

    Ladislav Hagara | Komentářů: 0
    dnes 02:00 | Nová verze

    OpenZFS (Wikipedie), tj. implementace souborového systému ZFS pro Linux a FreeBSD, byl vydán ve verzi 2.4.0.

    Ladislav Hagara | Komentářů: 0
    dnes 01:00 | IT novinky

    Kriminalisté z NCTEKK společně s českými i zahraničními kolegy objasnili mimořádně rozsáhlou trestnou činnost z oblasti kybernetické kriminality. V rámci operací OCTOPUS a CONNECT ukončili činnost čtyř call center na Ukrajině. V prvním případě se jednalo o podvodné investice, v případě druhém o podvodné telefonáty, při kterých se zločinci vydávali za policisty a pod legendou napadeného bankovního účtu okrádali své oběti o vysoké finanční částky.

    Ladislav Hagara | Komentářů: 3
    včera 14:44 | IT novinky

    Na lepší pokrytí mobilním signálem a dostupnější mobilní internet se mohou těšit cestující v Pendolinech, railjetech a InterPanterech Českých drah. Konsorcium firem ČD - Telematika a.s. a Kontron Transportation s.r.o. dokončilo instalaci 5G opakovačů mobilního signálu do jednotek Pendolino a InterPanter. Tento krok navazuje na zavedení této technologie v jednotkách Railjet z letošního jara.

    Ladislav Hagara | Komentářů: 3
    včera 12:22 | Bezpečnostní upozornění

    Rozšíření webového prohlížeče Urban VPN Proxy a další rozšíření od stejného vydavatele (např. 1ClickVPN Proxy, Urban Browser Guard či Urban Ad Blocker) od července 2025 skrytě zachytávají a odesílají celé konverzace uživatelů s AI nástroji (včetně ChatGPT, Claude, Gemini, Copilot aj.), a to nezávisle na tom, zda je VPN aktivní. Sběr probíhá bez možnosti jej uživatelsky vypnout a zahrnuje plný obsah dotazů a odpovědí, metadata relací i

    … více »
    Ladislav Hagara | Komentářů: 5
    včera 05:22 | Zajímavý software

    QStudio, tj. nástroj pro práci s SQL podporující více než 30 databází (MySQL, PostgreSQL, DuckDB, QuestDB, kdb+, …), se stal s vydáním verze 5.0 open source. Zdrojové kódy jsou k dispozici na GitHubu pod licencí Apache 2.0.

    Ladislav Hagara | Komentářů: 6
    včera 04:55 | Nová verze

    Byla vydána nová verze 259 správce systému a služeb systemd (Wikipedie, GitHub).

    Ladislav Hagara | Komentářů: 0
    včera 02:55 | Zajímavý článek

    Cloudflare Radar poskytuje aktuální informace o globálním internetovém provozu, útocích nebo trendech. Publikován byl celkový přehled za rok 2025. Globální internetový provoz vzrostl v roce 2025 o 19 %.

    Ladislav Hagara | Komentářů: 0
    Kdo vám letos nadělí dárek?
     (0%)
     (0%)
     (0%)
     (0%)
     (0%)
     (0%)
     (40%)
     (20%)
     (40%)
    Celkem 5 hlasů
     Komentářů: 7, poslední dnes 11:06
    Rozcestník

    Dotaz: Python: jak spravne extrahovat nazvy souboru z adresare?

    29.3.2016 17:27 zdenek2008 | skóre: 26
    Python: jak spravne extrahovat nazvy souboru z adresare?
    Přečteno: 525×
    Prepisuji si z bashe do pythonu skript, pomoci ktereho generuji (krome jineho) lyx dokument. Do toho lyx dokumentu nacitam externi pdf dokumenty a uvadim je v obsahu (TOC). Zatim mam castecne vyreseny proces zapisovani do souboru (promenne v textu jsou jeste podle bashove syntaxe), ale iterovani v adresari s pdf soubory je jeste (bash) v zakomentovanych radkach. Nemeli byste nekdo tip na nejake elegantni reseni, abych treba nevynalezal nejake kostrbatiny? Predem diky za pripadne navrhy.
    file=open('../soubor.lyx','a')
    
    #for nazev_souboru in ../nejake_pdf_documenty/*.[pP][dD][fF]; do
    #nazev_souboru_bez_pripony=${nazev_souboru:25:-4}
    
    text=r"""\begin_layout Standard
    \begin_inset CommandInset label
    LatexCommand label
    name "${nazev_souboru_bez_pripony}"
    
    \end_inset
    
    
    \end_layout
    
    \begin_layout Standard
    \begin_inset External
    	template PDFPages
    	filename ${nazev_souboru:1}
    	extra LaTeX "pages=-, pagecommand={\thispagestyle{fancy}}, addtotoc={1,section,1,${nazev_souboru_bez_pripony},${nazev_souboru_bez_pripony}}"
    	scale 80
    
    \end_inset
    
    
    \end_layout
    
    """
    
    file.write(text)
    logging.debug('text: '+text)
    
    #done
    
    file.close()
    del file
    del text
    

    Řešení dotazu:


    Odpovědi

    Řešení 1× (zdenek2008 (tazatel))
    xxxxxx avatar 29.3.2016 18:31 xxxxxx | skóre: 23
    Rozbalit Rozbalit vše Re: Python: jak spravne extrahovat nazvy souboru z adresare?
    Ten kus LyX kódu bych hodil do jiného souboru, v kódu tohle obvykle není pěkné. Jestli tomu dobře rozumím, máš šablonu pro LyX, do které chceš nasázet hodnoty. To bych použil rovnou modul Jinja2.
    import glob
    import os
    from jinja2 import Environment
    
    # Načtení šablony do prom. tmp
    env = Environment()
    
    with open('cesta/k/templatu.lyx', 'r', encoding='utf8') as fread:
        tmp = env.from_string(fread.read())
    
    # dict s hodnotami
    content = {}
    
    # Pak tady budeš všechno možné, třeba to prolezení PDF souborů
    # Dejme tomu, že magicka_funkce vrací list s názvy PDF
    def magicka_funkce(path):
        files = glob.glob(path + '*.pdf')
    
        out = []
    
        # Ošklivé, ale takhle nějak
        for fl in files:
            out.append({'cesta': fl,
                        'nazev_souboru': os.path.basename(fl),
                        'nazev_souboru_bez_pripony': os.path.splitext(os.path.basename(fl))[0]})
    
        return out
    
    seznam_souboru = magicka_funkce('cesta/')
    content['seznam_souboru'] = seznam_souboru
    
    # Nakonec ten seznam pošleš šabloně
    vygenerovany_dokument_jako_string = tmp.render(content)
    
    with open('vysledny_soubor.lyx', 'r', encoding='utf8') as fwrite:
        fwrite.write(vygenerovany_dokument_jako_string)
    
    No a v té šabloně budeš mít už syntaxi Jinja:
    {% for pdf in seznam_souboru %}
    \begin_layout Standard
    \begin_inset CommandInset label
    LatexCommand label
    name "{{ pdf.nazev_souboru_bez_pripony }}"
    
    \end_inset
    
    
    \end_layout
    
    \begin_layout Standard
    \begin_inset External
    	template PDFPages
    	filename {pdf.nazev_souboru:1}
    	extra LaTeX "pages=-, pagecommand={\thispagestyle{fancy}}, addtotoc={1,section,1,{{ pdf.nazev_souboru_bez_pripony }}},{{ pdf.nazev_souboru_bez_pripony }}}"
    	scale 80
    
    \end_inset
    
    
    \end_layout
    {% endfor %}
    
    Jakmile generuju soubory, tak takhle. Než jsem se dostal k Jinja2, tak jsem to dělal stejně, jako to máš v otázce, tj. postupně zapisovat do souboru po kouskách. Ale tohle je o poznání jednodušší a čistší. Hlavně to podporuje cykly i podmínky (viz první řádek templatu).

    Kromě Jinja2 má python ve standardní knihovně string.Template. Což je něco podobného, ale spíš jen formou search & replace.
    29.3.2016 19:06 zdenek2008 | skóre: 26
    Rozbalit Rozbalit vše Re: Python: jak spravne extrahovat nazvy souboru z adresare?
    Diky. Co se tyce te iterace tak zatim jsem se dostal k tomuhle:
    nejake_pdf_dokumenty=glob.glob('../nejake_pdf_dokumenty/*.[pP][dD][fF]')
    nejake_pdf_dokumenty.sort()
    logging.debug('nejake_pdf_dokumenty: '+str(nejake_pdf_dokumenty))
    
    for nazev_souboru in nejake_pdf_dokumenty:
      logging.debug('nazev_souboru: '+nazev_souboru)
      nazev_souboru_bez_pripony=nazev_souboru[25:-4]
      logging.debug('nazev_souboru_bez_pripony: '+nazev_souboru_bez_pripony)
    Tim bash skriptem jsem doposud vyplnoval pdf formulare a sadu lyx dokumentu ktere jsem jeste pak dodatecne rucne editoval (jejich obsah, ne kod) a nakonec vse zahrnul do jedineho lyx svazku a ten nakonec opet exportoval do pdf fasciklu pro konecne pouziti. Jak ten skript rostl tak vyslo najevo ze bash uz nevyhovuje a je treba prepsat do jineho jazyka, oddelit sablony od kodu (uz ted mi dochazi ke konfliktum syntaxi lyxu a pythonu, jako treba uvozovky) a pokud jde o kod samotny tak ten je potreba take restrukturalizovat, napsat funkce a rozdelit do vhodnych modulu. Navic bude asi potreba skript distribuovat takze je treba doresit i instalatory na jine OS. Diky za tip na reseni, toto vyuziju.
    xxxxxx avatar 29.3.2016 20:42 xxxxxx | skóre: 23
    Rozbalit Rozbalit vše Re: Python: jak spravne extrahovat nazvy souboru z adresare?
    Jinak jak koukám, vyhnul bych se tomuhle: nazev_souboru[25:-4]. Teď to třeba na 3 písmenné přípony funguje, ale projet složku s jpg/jpeg a už to fungovat nebude. Proto existuje funkce splitext. A jestli bude potřeba skript i na Win, tak v modulu os jsou fce na práci s cestami, které chápou / a \, není pak nutné ve skriptu detekovat os a ručně uplácávat cesty.
    29.3.2016 21:10 zdenek2008 | skóre: 26
    Rozbalit Rozbalit vše Re: Python: jak spravne extrahovat nazvy souboru z adresare?
    Diky, to budu muset take predelat. S cestou k souboru potrebuji zachazet spis "systemove" nez jako s textovym retezcem. Nastesti cely skript uz konecne funguje v pythonu takze ted muzu zacit ladit.

    Založit nové vláknoNahoru

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.