Inzerujte na AbcPráce.cz od 950 Kč

napište » Zprávičky

Česká národní kvantová komunikační infrastruktura

dnes 14:22 | IT novinky

Dne 30. června 2026 byla završena fyzická realizace projektu Czech National Quantum Communication Infrastructure (CZQCI), tedy České národní kvantové komunikační infrastruktury. Projekt byl realizován od 1. března 2023 a financován z Národního plánu obnovy částkou 121,6 milionu Kč. Cílem podpořeného projektu bylo vybudovat základy národní kvantové komunikační infrastruktury a ověřit možnosti jejího praktického využití. Mezi

… více »

Ladislav Hagara | Komentářů: 0

Šumperk čelil kybernetickému útoku, úřad omezil provoz, únik dat se prověřuje

dnes 14:11 | IT novinky

Město Šumperk se stalo terčem kybernetického útoku, chod úřadu je omezen. Zjišťuje se, jestli unikla nějaká data. Cílem hackerů byla městská datová síť. První útoky zaznamenali odborníci na informační technologie již v pondělí večer, závady se ale plně projevily až dnes ráno. Město událost nahlásilo Národnímu úřadu pro kybernetickou a informační bezpečnost (NUKIB).

Ladislav Hagara | Komentářů: 0

Samba 4.24.5, 4.23.10 a 4.22.11

dnes 13:55 | Bezpečnostní upozornění

Samba, svobodná implementace síťového protokolu SMB/CIFS, byla vydána ve verzích 4.24.5, 4.23.10 a 4.22.11. Řešeno je 6 zranitelností.

Ladislav Hagara | Komentářů: 0

Open Secure AI Alliance

včera 23:44 | IT novinky

Přední technologické společnosti (Adobe, Cadence, Capital One, Cisco, Cloudera, Cloudflare, Cognition, CrowdStrike, Databricks, Dell Technologies, DoorDash, Elastic, HPE, Hugging Face, IBM, LangChain, Linux Foundation, Microsoft, NAVER, NetApp, Nous Research, NVIDIA, OpenClaw, Palantir, Palo Alto Networks, Red Hat, Reflection AI, Salesforce, SAP, ServiceNow, Siemens, SK Telecom, Snowflake, SpacexAI, Synopsys, Thinking

… více »

Ladislav Hagara | Komentářů: 5

Krabix.cz, online 3D konfigurátor krabiček pro 3D tisk

včera 18:11 | Zajímavý projekt

Krabix.cz je online 3D konfigurátor krabiček pro 3D tisk s exportem do STL. Běží přímo v prohlížeči. Nic se neposílá na server.

Ladislav Hagara | Komentářů: 4

Databáze zařízení pro Home Assistant

včera 17:00 | Komunita

Nadace Open Home Foundation spustila veřejnou preview verzi komunitní databáze zařízení pro Home Assistant. Má fungovat jako „Wikipedie pro chytrá zařízení".

Ladislav Hagara | Komentářů: 0

Nové widgety na stránce nového panelu Firefoxu

včera 15:22 | Komunita

Na stránce nového panelu Firefoxu přibudou nové widgety. Například denně aktualizována interaktivní křížovka.

Ladislav Hagara | Komentářů: 0

PGSimCity

včera 14:11 | Zajímavý projekt

PGSimCity (GitHub) je webová 3D vizualizace vnitřního fungování databázového systému PostgreSQL v podobě města. Vytvořena pomocí umělé inteligence.

Ladislav Hagara | Komentářů: 3

Ubuntu Touch 24.04-2.0 a 24.04-1.4

včera 03:33 | Nová verze

UBports, nadace a komunita kolem Ubuntu pro telefony a tablety Ubuntu Touch, vydala Ubuntu Touch 24.04-2.0 a 24.04-1.4. Nová verze 24.04-2.0 již počítá s výřezy pro fotoaparát (notch) a zaoblenými rohy displeje. Webový prohlížeče Morph přešel z Chromia 87 na Chromium 134. Do shellu Lomiri byl přidán editor snímků obrazovky.

Ladislav Hagara | Komentářů: 0

CVE-2026-64600 aneb RefluXFS, lokální eskalace práv v XFS

25.7. 14:22 | Bezpečnostní upozornění

Byly zveřejněny informace o kritické zranitelnosti CVE-2026-64600 pojmenované RefluXFS (technické detaily) v XFS. Je tam již od verze Linuxu 4.11, tj. rok 2017. Jedná se o lokální eskalaci práv. Neprivilegovaný uživatel může editovat libovolný soubor, například klidně zrušit rootovské heslo v /etc/passwd. Videoukázka na Vimeo. V upstreamu je zranitelnost opravena.

Ladislav Hagara | Komentářů: 5

Centrum | Napsat | Starší

navrhněte » Anketa

Komentářů: 30, poslední 3.4. 20:20

Rozcestník

AbcLinuxu

HDmag.cz

AbcLinuxu:/ Poradna / Linuxová poradna / existuje nastroj pro zjisteni duplicitniho obsahu v souborech?

Štítky: není přiřazen žádný štítek

Dotaz: existuje nastroj pro zjisteni duplicitniho obsahu v souborech?

10.9.2010 16:20 j3nda | skóre: 14 | ostrava/brno
existuje nastroj pro zjisteni duplicitniho obsahu v souborech?

Přečteno: 327×

Odpovědět | Admin

zdravim,

chci se zeptat znalejsich, zda:
- existuje nastroj na odhaleni souboru, ktere maji 100% anebo castecny napr 95% duplicitni obsah?

jde mi o to, ze mam spoustu dat (asi 200GB) a chtel bych odhalit duplicitni soubory. nejedna se o 100% shodu. spis nejake vymezeni, napr +/- 20% treba s moznosti znazorneni, kde je tato shoda v souboru 100% a kde napr 80% (zacatek, stred, konec, ...)

je mi jasne, ze si na to muzu napsat nastroj, ktery by fungoval podle mych predstav - ale mozna neco existuje a vy o podobnem nastroji vite. poradite?

j3.

___---==~[ uxunilcba | baclniuxu ]~==---__sevrer_pnly_liunx-lkie_hcaricku__/libGDX-rulez-the-W0R7D!___

Nástroje: Začni sledovat (1) ?

Odpovědi

10.9.2010 16:34 Jakub Lucký | skóre: 40 | Praha
Rozbalit Rozbalit vše Re: existuje nastroj pro zjisteni duplicitniho obsahu v souborech?

no, takové utilitky existují... Na 100% shodu by stačil nějaký skriptík, ale:

fdupes - identifies duplicate files within given directories
findimagedupes - Finds visually similar or duplicate images
perforate - Utilities to save disk space
simhash - generate similarity hashes to find nearly duplicate files

If you understand, things are just as they are; if you do not understand, things are just as they are.

10.9.2010 16:58 j3nda | skóre: 14 | ostrava/brno
Rozbalit Rozbalit vše Re: existuje nastroj pro zjisteni duplicitniho obsahu v souborech?

dik. fdupes: funguje nejak podivne.

kdyz jsem si zkusil do testdiru (ze ktereho by melo byt jasne, co je duplicita a co ne) dat .mp3

tak vypsal, ze je tam ulozena duplicitne (*x=stejny soubor jako .mp3) - coz je spravne.

3403976 bytes each:
./testdir.x/v.Mr. Oizo - Monday Massacre.mp3
./testdir.x/*x

ale kdyz jsem nakonec "*x" pridal znaky "xxxxxxxxxxxxxxxx", cimz jsem vynutil castecnou shodu, tak ve vypise soubory nefigurovaly - i kdyz by mely.

takze se v tom chvili budu vrtat...

___---==~[ uxunilcba | baclniuxu ]~==---__sevrer_pnly_liunx-lkie_hcaricku__/libGDX-rulez-the-W0R7D!___

10.9.2010 17:03 j3nda | skóre: 14 | ostrava/brno
Rozbalit Rozbalit vše Re: existuje nastroj pro zjisteni duplicitniho obsahu v souborech?

jeste jsem nasel toto:
http://freshmeat.net/projects/fdupe/

ale taky to resi bud 100% anebo 0% (mezitim nic). viz
soubory: .mp3 a *x

___---==~[ uxunilcba | baclniuxu ]~==---__sevrer_pnly_liunx-lkie_hcaricku__/libGDX-rulez-the-W0R7D!___

10.9.2010 19:03 Matlák
Rozbalit Rozbalit vše Re: existuje nastroj pro zjisteni duplicitniho obsahu v souborech?

Ono sledovat "podobnost" dvou souborů libovolného typu je obecně nepříliš triviální problém. Je to velmi závislé na tom, co chce člověk sledovat - u obrázků například konkrétní tvary či barvy, u hudby/zvuků melodie a rytmy, to vše naprosto nezávisle na použitém bitrate/rozlišení apod.. takže standardní porovnávání pomocí kontrolních součtů je přitom k ničemu. Je podstatné co chcete porovnávat, v jakém rozsahu apod.. K porovnávání obrázků a zvuků je asi nejvhodnější nějaký druh spektrální analýzy...

10.9.2010 19:14 j3nda | skóre: 14 | ostrava/brno
Rozbalit Rozbalit vše Re: existuje nastroj pro zjisteni duplicitniho obsahu v souborech?

jedna se jen o hudebni soubory. takze myslenka spektralni analyzy je dobry smer.

zkusim si procist to, co mi p. Kasprzak zaslal (mj. prikladam), cituji:

Tak tohle je dost slozita problematika uz v pripade, kdy drzite dva soubory a jen chcete zjistit kde presne se prekryvaji. Neco k tomuto tematu je popsano treba tady:

http://theses.cz/id/kjlbf0

A to jak vybrat vhodne kandidaty abyste nemusel zkoumat vsechny dvojice souboru je taky kapitola sama pro sebe. V textovych souborech se to dela napriklad pomoci rozkouskovani a hledani techto kousku (clanek Sergeje Brina a dalsich "Copy detection mechanisms for digital documents" z roku 1995, napriklad).

a nejak se rozhodnout, jak to budu resit.

___---==~[ uxunilcba | baclniuxu ]~==---__sevrer_pnly_liunx-lkie_hcaricku__/libGDX-rulez-the-W0R7D!___

Založit nové vlákno • Nahoru

Tiskni Sdílej: