abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
eParkomat, startup z ČR, postoupil mezi finalisty evropského akcelerátoru ChallengeUp!
Robot na pivo mu otevřel dveře k opravdovému byznysu
Internet věcí: Propojený svět? Už se to blíží...
dnes 17:02 | Pozvánky

Přijďte si popovídat o open source obecně a openSUSE konkrétně s dalšími uživateli a vývojáři. Oslava nového vydání openSUSE Leap se uskuteční 16. prosince od 17:00 v nových prostorách firmy SUSE v Praze. K dispozici bude nějaké občerstvení a DVD pro ty, kdo je sbírají nebo ještě mají mechaniku. Po párty v kanceláři se bude pokračovat v některé z hospod v okolí.

Miška | Komentářů: 1
dnes 14:55 | Zajímavý software

Byla vydána verze Alpha 1.0 otevřeného operačního systému pro chytré hodinky AsteroidOS. Podporovány jsou hodinky LG G Watch, LG G Watch Urbane, Asus ZenWatch 2 a Sony Smartwatch 3. Ukázka ovládání hodinek na YouTube. Jaroslav Řezník přednášel o AsteroidOS na chytrých hodinkách (videozáznam) na letošní konferenci OpenAlt.

Ladislav Hagara | Komentářů: 0
dnes 13:30 | Zajímavý software

Byly uvolněny zdrojové kódy známé rogue-like hry DoomRL. Počátky hry jsou v roce 2002. Je napsána ve FreePascalu a zdrojový kód je nyní k dispozici na GitHubu pod licencí GNU GPL 2.0. Autor pracuje na nové hře Jupiter Hell, která je moderním nástupcem DoomRL a na jejíž vývoj shání peníze prostřednictvím Kickstarteru.

Blaazen | Komentářů: 0
dnes 13:15 | Pozvánky

Přijďte s námi oslavit vydání Fedory 25. Na programu budou přednášky o novinkách, diskuse, neřízený networking atd. Release Party se bude konat 16. prosince v prostorách společnosti Etnetera. Na party budou volně k dispozici také propagační materiály, nová DVD s Fedorou 25 a samozřejmě občerstvení. Přednášky budou probíhat v češtině. Pro více informací se můžete podívat na web MojeFedora.cz. Jen připomínám, že tentokrát jsme zavedli

… více »
frantisekz | Komentářů: 0
včera 16:38 | Komunita

Byly zveřejněny videozáznamy přednášek a workshopů z letošní konference OpenAlt konané 5. a 6. listopadu v Brně. K videozáznamům lze přistupovat ze stránky na SuperLectures nebo přes program konference, detaily o vybrané přednášce nebo workshopu a dále kliknutím na ikonku filmového pásu. Celkově bylo zpracováno 65 hodin z 89 přednášek a workshopů.

Ladislav Hagara | Komentářů: 0
včera 11:30 | Komunita

Bylo oznámeno, že bude proveden bezpečnostní audit zdrojových kódů open source softwaru pro implementaci virtuálních privátních sítí OpenVPN. Audit provede Matthew D. Green (blog), uznávaný kryptolog a profesor na Univerzitě Johnse Hopkinse. Auditována bude verze 2.4 (aktuálně RC 1, stabilní verze je 2.3.14). Audit bude financován společností Private Internet Access [reddit].

Ladislav Hagara | Komentářů: 4
včera 06:00 | Komunita

Na YouTube byl publikován Blender Institute Reel 2016, ani ne dvouminutový sestřih z filmů, které vznikly za posledních 10 let díky Blender Institutu. V institutu aktuálně pracují na novém filmu Agent 327. Dění kolem filmu lze sledovat na Blender Cloudu. Videoukázka Agenta 327 z června letošního roku na YouTube.

Ladislav Hagara | Komentářů: 0
včera 01:02 | Zajímavý článek

Minulý týden byly vydány verze 1.2.3 a 1.1.7 webového poštovního klienta Roundcube. V oznámení o vydání bylo zmíněno řešení bezpečnostního problému nalezeného společností RIPS a souvisejícího s voláním funkce mail() v PHP. Tento týden byly zveřejněny podrobnosti. Útočník mohl pomocí speciálně připraveného emailu spustit na serveru libovolný příkaz. Stejně, jak je popsáno v článku Exploit PHP’s mail() to get remote code execution z roku 2014.

Ladislav Hagara | Komentářů: 1
8.12. 16:00 | Nová verze

Byla vydána verze 0.98 svobodného nelineárního video editoru Pitivi. Z novinek lze zmínit například přizpůsobitelné klávesové zkratky. Videoukázka práce s nejnovější verzí Pitivi na YouTube.

Ladislav Hagara | Komentářů: 1
8.12. 15:00 | Zajímavý software

Stop motion je technika animace, při níž je reálný objekt mezi jednotlivými snímky ručně upravován a posouván o malé úseky, tak aby po spojení vyvolala animace dojem spojitosti. Jaký software lze pro stop motion použít na Linuxu? Článek na OMG! Ubuntu! představuje Heron Animation. Ten bohužel podporuje pouze webové kamery. Podpora digitálních zrcadlovek je začleněna například v programu qStopMotion.

Ladislav Hagara | Komentářů: 5
Kolik máte dat ve svém domovském adresáři na svém primárním osobním počítači?
 (32%)
 (24%)
 (29%)
 (7%)
 (5%)
 (3%)
Celkem 808 hlasů
 Komentářů: 50, poslední 29.11. 15:50
Rozcestník
Reklama
Štítky: není přiřazen žádný štítek

Dotaz: Statistika znaku

13.12.2008 23:53 Tomas Kuranyi
Statistika znaku
Přečteno: 311×

 

Dobry den.

Existuje nejaky program, ktery udela statistiku jednotlivych znaku v souboru?

Chtel bych vedet, ze jake znaky jsou v danem souboru... muze se zdat, ze je to blbost, ale vygenerovany soubor z nejake aplikace muze obsahovat nulovy byte, form feed, vert. tabulator... atd. Tedy mi jde hlavne o prvnich 32 ridicich znaku v ASCII...

Program by mohl vypsat, ze kolikrat obsahuje soubor ridici znaky, pripadne na ktere pozici se nachazi jako prvni. Mate zkusenost s timto problemem?


Dekuji.

 

Odpovědi

14.12.2008 00:23 Bilbo
Rozbalit Rozbalit vše Re: Statistika znaku
Jeden takovy jsem si pro sve vlastni ucely napsal. Vystavil jsem ho na http://git.wz.cz/histogram.zip - ke kompilaci postaci make a g++, je to pod MIT licenci :)

Program vypisuje teda jenom kolikrat, ale vypis vyskytu prvniho bych tam mohl asi jeste dopsat, to by se taky mohlo casem hodit :)
14.12.2008 13:49 Tomas Kuranyi
Rozbalit Rozbalit vše Re: Statistika znaku

 

Fajn, presne jsem si myslel na takovou vec... :)

Kdy bude zintegrovany do coreutils Linuxu? Protoze je uzitecny...

Kdyz muzu neco doporucit: mohl bys napsat do vystupu jmeno tech ridicich znaku 0..31

Kdyz program to umi, tak se omlouvam, ale nenasel jsem.

Dik.

14.12.2008 12:43 Semo | skóre: 44 | blog: Semo
Rozbalit Rozbalit vše Re: Statistika znaku
Nechat vypisat pomocou od do citatelnej podoby, nasekat na jednotlive znaky, zotriedit a spocitat
od -An -a subor |sed -r 's/^ *//; s/[ ]+/\n/g' | sort | uniq -c
If you hold a Unix shell up to your ear, you can you hear the C.
14.12.2008 14:25 Tomas Kuranyi
Rozbalit Rozbalit vše Re: Statistika znaku

 

Tiez funguje...

Od "od" by som to neocakaval...

Este by som mal nejake otazky k tomu...

1. Ako by som vymenil 12345-ty bajt v subore na iny bajt (zadany najlepsie hexadecimalne, napr. 0x0a)?

2. Ako by som vymazal 12345-ty bajt v subore? Ostatne bajty zostanu, teda subor bude o 1bajt mensi.

Dakujem.

 

14.12.2008 16:48 Semo | skóre: 44 | blog: Semo
Rozbalit Rozbalit vše Re: Statistika znaku
Urcite existuje lepsie a rychlejsie riesenie. Ale som vysadeny na sed a bavi ma, takze:
sed 's/./&\n/g' subor |
sed -n '
    /^$/b print
    H
    $b print
    d
    :print
    x
    s/\n//g
    p
    d
'
Toto rozoberie subor na znaky a zase ho posklada (zbiera znaky az dokym nepride \n; vtedy ich vycisti, vypise a zase znova; posledny riadok ma troska specialne zachadzanie, pretoze nemusi koncit \n). Medzi tie 2 sedy uz mozes zaradit cokolvek, napr. 3. sed, ktory spravi co chces. Napr:

sed 12345d #vymaze 12345. riadok = 12345. byte sed '12345s/.*/x/' #zmeni 12345. znak na "x", akceptuje aj \n, \t, \xa,...
If you hold a Unix shell up to your ear, you can you hear the C.
14.12.2008 21:38 Tomas Kuranyi
Rozbalit Rozbalit vše Re: Statistika znaku

 

No to je uz celkom brutalne riesenie...

Teraz menit byte uz viem cez midnight commander -> F3 (View) -> F4 (Hex) -> F2 (Edit)...

Zbyvaju: pridanie za (pred?) dany byte a odstranenie daneho bytu.

Mozno ten "xxd" to vie -- skusim to. Ale ak vie niekto nech napise. Dakujem.

 

14.12.2008 22:13 Radek Černoch | skóre: 14 | Praha
Rozbalit Rozbalit vše Re: Statistika znaku

Milý Tomáši,

myslím, že nebudu sám, koho by zajímalo, na co takový program potřebuješ. Jeho napsání v C, Javě, nebo jakémkoli jiném použitelném jazyce by nemělo být tak složité. Strýček Google totiž prozradí, že podobně záhadné dotazy už tu máš minimálně dva (první, druhý). Jak tu již jednou padlo, smrdí to semestrálku...

Nerad bych Ti křivdil. Prozradíš tedy, k čemu je takový program dobrý?

S pozdravem,

Radek

15.12.2008 09:18 Tomas Kuranyi
Rozbalit Rozbalit vše Re: Statistika znaku

No, ja jsem si myslel, ze toto forum neni o sikane.

Jake zahadne dotazy?!

ad "ls" -- ja si myslim, ze jsem opravnene ocekaval od programu na vypis obsahu adresare to, ze mi umi pripravit vsechny soubory rekurzivne vcetne cesty.

ad "column" -- o tomto programu jsem nevedel, dostal jsem odpoved

A v zadnem pripade nemam tyhle veci do skoly. A i kdybych mel, tak co? Kdyz nechces, tak nepomuzes, a hotovo. Ale jak je videt: na kritiku mas energiu.

A k tomuto: mas dokument, jednak ve formate Word, a jednak PDF. Jak jich porovnas (zda jsou vubec rozdily, ktery je starsi dle informace, atd...)

Vyexportoval jsem do txt oboje a pomoci "diff" jsem porovnaval modifikovane verze. Je tam dost rozdilu, ale hlavne kvuli ridicich znaku...

Proto je treba odstranit ^L znaky a podobne. Nebo menit na novy radek -- podle potreby.

Vec naco se ptam, je vlastne nejobecnejsi textovy editor (menit, smazat, pridat byte na danou pozici)... To muze hodit kdykoliv.

A jeste jedna vec: nejsem nejaky obrovsky expert na shell, ale podobne utoky, ze "k cemu je dobry" jsou celkem zbytecne... Kdyz jsem byl uplne zacatecnik a spustil jsem program "yes", tak taky jsem se ptal "k cemu k..rva tento program je dobry"... ted uz vim.

15.12.2008 11:18 vencas | skóre: 32
Rozbalit Rozbalit vše Re: Statistika znaku

Zdravím, na účely porovnávání textů používám osobně:

  1. Konverze abiword --to=txt *.doc *.odt *.docx
  2. sim_text -e -s *.txt

Funguje to velmi rychle, i na textech v utf8, sim_test je v balíku similarity-tester v debianu. Ještě jsem pokusně zbastlil porovnávání všech dvojic text pomocí python-levenshtein modulu, ale to znak po znaku, výrazně pomalejší (všechny páry) a výsledky stejné.

15.12.2008 14:05 Radek Černoch | skóre: 14 | Praha
Rozbalit Rozbalit vše Re: Statistika znaku

Dobrá, věřím Ti. Přitom není pravda, že bych nechtěl pomoct.

Jen je někdy rychlejší, pokud se zeptáš na konkrétní problém přímo -- viz elegantní rada od vencase. Ne snad, že by Tě do uvádění podrobností o problému někdo nutil; jen se pak nezlob za podobné dotazy.

A pokud by tohle byl úkol do školy, tak je IMHO mnohem lepší odkázat na dobrý a rychlý tutorial než úlohu za jiného vyřešit. Mé oblíbené jsou bash, sed one-liners, nebo C a C++.

15.12.2008 00:50 Jan Martinek | skóre: 43 | blog: johny | Brno
Rozbalit Rozbalit vše Re: Statistika znaku

Tohle:

#!/usr/bin/python

import sys, curses.ascii
counts = {}
for pos, c in enumerate(sys.stdin.read()):
    if c > ' ': continue
    try:
        counts[c][1] += 1
    except KeyError:
        counts[c] = [pos, 1]
counts_list = counts.items()
def deco(x):
    return x[1][1]
counts_list.sort(key = deco)
for c, pos_count in counts_list:
    pos, count = pos_count
    print count, '%06x' %pos, curses.ascii.controlnames[ord(c)]

Vypíše statistiku řídících znaků (tj. 0 až 32), ostatní přeskakuje. Výstup je setříděný podle počtu, obsahuje první pozici výskytu (hexadecimálně) a název řídícího znaku. Binárku to zpracuje asi desetkrát rychleji než to řešení v shellu, ale určitě mnohem pomaleji než to v c++.

Ani jsem se nesnažil šetřit paměť…

Založit nové vláknoNahoru

Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

ISSN 1214-1267   www.czech-server.cz
© 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.