Firma X zaslala předžalobní výzvu vývojáři projektu Nitter (Wikipedia), open-source alternativního frontendu k sociální síti X (ex-Twitter), a provozovatelům instancí jako XCancel, které umožňovaly číst příspěvky bez přihlášení, reklam a javascriptu. Údajně se dopouštějí „sběru dat“. Zdrojový kód Nitteru vývojář archivoval. Vývoj již dříve přerušil v roce 2024 po tehdejším omezení API X. X je dceřiná společnost SpaceXAI Elona Muska, provozující mj. kontroverzního chatbota Grok.
Bylo vydáno Ubuntu 26.04.1 LTS, tj. první opravné vydání Ubuntu 26.04 LTS s kódovým názvem Resolute Raccoon. Přehled novinek a oprav na Discourse.
Národní úřad pro kybernetickou a informační bezpečnost (NÚKIB) vydal Zprávu o stavu kybernetické bezpečnosti ČR za rok 2025 (pdf). Incidentů ubylo, sofistikovanost útočníků roste.
Open source softwarový stack AMD ROCm (Wikipedie) pro vývoj AI a HPC na GPU od AMD byl vydán v nové major verzi 10.0. S ROCm.AI. Přehled novinek v aktualizované dokumentaci.
Finanční skupina Partners se stala minulou neděli obětí kybernetického útoku, při kterém se útočníci dostali k některým osobním údajům klientů. Společnost o tom informovala ve čtvrtek. Ujišťuje, že peníze klientů nejsou v ohrožení. „Kybernetický útok zasáhl část IT infrastruktury naší společnosti. Ihned po zjištění útoku jsme s pomocí externích bezpečnostních odborníků začali intenzivně pracovat na minimalizaci škod. Útočníci se
… více »Americká technologická společnost Meta Platforms se dohodla, že zaplatí až zhruba 18 miliard dolarů (asi 373 miliard Kč) za mimosoudní urovnání sporu o závislosti dětí na sociálních sítích a provede významné změny pro jejich používání mladistvými. Téměř tři desítky států USA firmu v roce 2023 obvinily z toho, že sítě Facebook a Instagram vědomě navrhla tak, aby u dětí vyvolávaly závislost, a zatajovala tyto dopady před veřejností. Firma se
… více »Byl publikován aktuální přehled dění a novinek z vývoje Asahi Linuxu, tj. Linuxu pro Apple Silicon. Blíží se vydání podporující čipy M3. Vývojáře lze podpořit na GitHub Sponsors a Open Collective.
Kancelářský balík LibreOffice byl vydán ve verzi 26.8. Mimo jiné vylepšuje typografii a kompatibilitu s formáty MS Office, více v poznámkách k vydání.
Armbian, tj. linuxová distribuce založená na Debianu a Ubuntu optimalizovaná pro jednodeskové počítače na platformě ARM a RISC-V, ke stažení ale také pro Intel a AMD, byl vydán ve verzi 26.8. Přehled novinek v poznámkách k vydání.
Byla vydána nová verze 23.1.0, tj. první stabilní verze z nové řady 23.1.x, překladačové infrastruktury LLVM (Wikipedie). Přehled novinek v poznámkách k vydání: LLVM, Clang, LLD, Extra Clang Tools, Libc++, Polly a Flang.
maj tam nějakou trial verzi hele tak to mužeš zkusit ale asi ti to nepojede :O :O
Odporučil by som znížiť rozlíšenie skenovania, ak nie sú zdrojové súbory k dispozícii.Předpokládanám, že jsi to radil především kvůli tomu, aby se tečky slily, jinak je to pouze cesta, jak ztratit další procento obrazové informace. Správná cesta je získat co nejlepší sken, a pak laborovat s postprocessingem.
Len rozlíšenie bude musieť byť ešte menšie nech na tom nepohorí OCRJe to cesta, ale nikoliv nezbytně nutná. Během postprocessingu se to dá vyřešit filtrem co rozmázne skvrny podle barvy tím pádem lze cíleně „slít” pouze ty tečky. Pak už si s tím OCR poradí. Největší blbost je, tyhle materiály skenovat černobíle, nebo ve stupních šedi. Nejrychlejší je to mastit foťákem.
Vetsina originalu byla tisknuta 24 jehlickovymi tiskarnami, novejsi laserovkou, nektere jsou fotokopie. S kvalitou scanu fakt problem neni, zabyvam se tim uz snad 2 roky. Jde o software. Abbyy je kralem, predtim se jeste pouzivala Recognita. Zadny opensource se kvalitou OCR k temto nepriblizil.
To mozna puvodni tazatel. Jak poznamenava Alesuv prispevek DjVu ma nejake vychytavky navic, hlavne velikost je zajimava. Vysledek ukladame:
djvutool, a přes volbu algoritmu a dalších parametrů mohu výsledek dost výrazně ovlivnit.
V minulosti jsem používal i zmíněné balíky pro win prostředí. Podle mne už dávno zastaraly. V linuxovém prostředí je výborný nástroj pro zpracování PDF, který podporuje i OCR Master PDF Editor, který využívá právě tesseract. Dokonce má i nějakou podporu učení.
Já toho moc nevyužívám. Stránky na které pouštím OCR to většinou neopotřebují. Přeci jenom těch textů není zas tolik. Jen sem tam nějaká knížka. Ale jak jsem napsal, 20 let zkušeností.
Ovšem ten hlavním důvod, proč je na tohle DjVu lepší než PDF je ten, že lze do souboru vložit kontrolní součty všech vrstev, podepsané důvěryhodným certifikátem, takže je prakticky vyloučeno dodatečné zfixlování obrazové informace.Zatímco v PDF můžete podepsat verzi dokumentu důvěryhodným certifikátem, pak přidat novou verzi s textovou vrstvou (novou verzi můžete případně také podepsat). A pak můžete přidávat další verze s úpravami textové vrstvy. Takže je prakticky vyloučeno dodatečné zfixlování obrazové informace. V čem je tedy rozdíl oproti DjVu?
Zatímco v PDF můžete podepsat verzi dokumentu důvěryhodným certifikátem, pak přidat novou verzi s textovou vrstvou (novou verzi můžete případně také podepsat). A pak můžete přidávat další verze s úpravami textové vrstvy.Přiznám se, že zrovna tomuto moc nerozumím. Vím jak vypadá PDF a není mi jasné proč by měla být verzována zrovna textová vrstva, která má za cíl usnadnit vyhledání informace v obrazové vrstvě. Z DjVu dokumentu nikdy nelze vyrobit dokument, který by bylo možné zaměnit s originálem. To v prvé řadě. Je technicky nemožné, z něj vytáhnout obrazovou vrstvu a dodatečně do ní vlepit něco jiného. Což u PDF neplatí. A pokud to PDF bude falšovat osoba s přístupem k důvěryhodnému certifikátu, neodhalíte nic. DjVu formát navíc umožňuje vlepit i originální sken v jpeg2000. Prakticky se to ale nedělá. Prohlížeče s tím nepočítají a výsledný soubor by byl moc velký, takže např. archive.org udržuje originální skeny v tomhle formátu v samostatných archivech.
Tiskni
Sdílej: