Tim Cook po 15 letech opustí post generálního ředitele americké technologické společnosti Apple. Od 1. září ho vystřídá John Ternus, který byl dosud odpovědný za hardware. Cook se stane předsedou představenstva. Cook vedl Apple od roku 2011, kdy funkci převzal od zesnulého spoluzakladatele společnosti Stevea Jobse.
Evropská aplikace na ověřování věku uživatelů lze hacknout během dvou minut, navzdory tvrzením předsedkyně Evropské komise Uršuly von der Leyenové, že je tato aplikace 'technicky připravená pro ostré nasazení' a 'splňuje nejvyšší standardy ochrany osobních údajů na světě'. Zdrojové kódy aplikace byly Bruselem zveřejněny v repozitářích na GitHubu.
Po 26 letech od protiprávního policejního zásahu, který byl spuštěn na základě podnětu společnosti Microsoft, Obvodní soud pro Prahu 2 rozsudkem potvrdil, že Mironet prokázal významnou část svého nároku na náhradu škody vůči Ministerstvu spravedlnosti ČR. Soudem nyní přiznaná část nároku znamená rekordní odškodné, jaké kdy české soudy přiznaly za nesprávný postup státu. Spor byl rozdělen na několik škod, u pravomocně uzavřených částí
… více »Lehké desktopové prostředí LXQt bylo vydáno ve verzi 2.4.0. Jde o převážně opravné vydání s drobnými vylepšeními podpory Waylandu.
Počítačová hra Kingdom Come: Deliverance 2 českého studia Warhorse získala cenu BAFTA v kategorii nejlepší příběh. V konkurenci pěti dalších nominovaných děl porazila i úspěšnou francouzskou hru Clair Obscur: Expedition 33, která v letošním ročníku získala cenu za nejlepší hru roku.
Projekt KDE oslaví v říjnu 30 let. Matthias Ettrich poslal 14. října 1996 do diskusní skupiny comp.os.linux.misc zprávu, která započala historii projektu. Důležité milníky jsou zobrazeny na časové ose KDE.
Byly vyhlášeny výsledky letošní volby vedoucí/ho projektu Debian (DPL, Wikipedie). Poprvé povede Debian žena. Novou vedoucí je Sruthi Chandran. Letos byla jedinou kandidátkou. Kandidovala již v letech 2020, 2021, 2024 a 2025. Na konferenci DebConf19 měla přednášku Is Debian (and Free Software) gender diverse enough?
Byla vydána nová verze 10.3 z Debianu vycházející linuxové distribuce DietPi pro (nejenom) jednodeskové počítače. Přehled novinek v poznámkách k vydání. Přidána byla podpora Orange Pi 4 LTS. Přibyl balíček Prometheus.
Implementace VPN softwaru WireGuard (Wikipedie) pro Windows, tj. WireGuard pro Windows a WireGuardNT, dospěly do verze 1.0.
V Pekingu dnes proběhl 2. ročník půlmaratonu humanoidních robotů. První 3 místa obsadili roboti Honor Lightning v různých týmech. Nový rekord autonomního robota je 50 minut a 26 sekund. Operátorem řízený robot to zvládl i s pádem za 48 minut a 19 sekund. Řízení roboti měli časovou penalizaci 20 %. Před rokem nejrychlejší robot zvládl půlmaraton za 2 hodiny 40 minut a 42 sekund. Aktuální lidský rekord drží Jacob Kiplimo z Ugandy s časem 57 minut a 20 sekund [𝕏].
Na počiatku bolo slovo a určite netrvalo dlho kým sa našla aj nejaká tá chyba. A práve chyby sú to, o čo tu kráča. A do akých skupín ich rozdeliť? Mne sa najviac pozdáva delenie na tieto tri skupiny: preklep tj. vieme ako sa slovo píše, ale jednoducho postláčame niečo iné (napr. dva znaky miesto jedného, vynechanie znaku), fonetické a pravopisné chyby tj. chyby, kde máme predstavu o tom, ako sa slovo vyslovuje, ale s písanou podobou to je o čosi horšie (napr. s/z, d/t) a poslednou skupinou sú chyby spôsobené externými vlivmi, grafickou podobnosťou, alebo problémom s QWERTY/QWERTZ(napr. y/z, 1/l, 0/O).
Z nášho hľadiska je najpodstatnejšou práve druhá kategória fonetických a pravopisných chýb (stále sme len na úrovni jednotlivých slov), ktorú má zmysel rozdeľovať ešte na ďaľšie sekcie: delete (vynechanie znaku), insert (vloženie znaku navyše), transpose (zámena dvoch po sebe idúcich znakov) a replace (zámena znaku za znak napr. i/y alebo chyby v diakritike).
Po tejto dávke teórie sa už takmer môžeme pustiť do porovnávania. Potrebujeme si však povedať ešte čosi o maximálnej editačnej vzdialenosťi. Vyzerá to síce hrozivo, ale nie je to nič hrôzostrašné. Jedná sa len o to, koľko chýb smieme spraviť v jednom slove, aby sme dokázali nájsť to pôvodné slovo (napr. d(pes,tma) = 3, d(linux,ilnux) = 1). A hor sa do porovnávania.
Ako už bolo uvedené v predchádzajúcich dieloch, tak ispell je najrýchlejší, ale nenájde až toľko správnych náhrad. Je to dané najmä tým, že on hľadá slová len do vzdialenosti 1. Naproti tomu ASpell (štandardne) hľadá slová (resp. ich zvukové prepisy) do vzdialenosti 2, čomu odpovedá aj jeho rýchlosť. Nesprávnych slov, ktoré obsahujú dve chyby, kde aspell nájde to správne slovo je okolo šiestich percent [Kuki92]. Pri vzdialenosti 3 je čakanie na nájdenie správneho slova otázka desiatok sekúnd, čo skutočne nie je použiteľné v praxi. O väčších vzdialenostiach sa v našom prípade nemá ani zmysel rozprávať, pretože už pri vzdialenosti 3 sa nám slovo zzz smie premeniť napr. na slovo pes, alebo dom.
Ale skúsme sa posunúť ďalej. Je zrejmé, že kvalita programov tohoto typu je závislá od slovníku. Už prvý pohľad zavádza k tomu, že čím väčší slovník, tým lepšie. Ale nie je to tak; ak máte slovník príliš veľký, tak sa zvyšuje pravdepodobnosť, že po chybe vznikne opať korektné slovo. Napr. v angličtine pre 50.000 slovník je to 10% a pre 350.000 slovník dokonca 16%, tieto hodnoty však berte len orientačne, pretože neplatia pre češtinu ani slovenčinu, keďže u nás vznikajú slová trochu odlišným spôsobom. Na druhej strane sa neoplatí mať ani príliš malý slovník, pretože potom sme obťažovaný zbytočnými hláseniami o nájdenej chybe. Posledným trendom je dopĺňanie frekvencie slov do slovníkov, čo nám umožní ponúkať frekventovanejšie slová na prvých miestach medzi náhradami.
O programoch ako ispell či ASpell ste sa už dozvedeli, takže teraz niečo o tom, čo takmer určite nepoznáte :). Program fispell vznikol v laboratóriu spracovania prirodzeného jazyka na fakulte informatiky MU v Brne (www.fi.muni.cz/nlp) a je dostupný pod licenciou GNU/GPL. V súčasnosti má dve rozhranie, jedno je realizované v textovom móde a druhé nad grafickou knižnicou Gtk (a je zatiaľ o čosi nestabilnejšie). Jeho finálna verzia s českým a slovenským slovníkom síce ešte nie je hotová a ani dostupná verejnosti, ale táto doba sa približuje. A počas babieho leta už si asi budete môcť kontrolovať slová práve týmto nástrojom.
Pre tých, ktorí očakávajú aj konkrétne porovnania medzi ispellom, ASpellom a fispellom, som ich niekoľko vybral. Testy prebehli na malom testovacom súbore (244 slov), ktorý obsahoval len slová, o ktorých si všetky programy mysleli, že sú nesprávne. Všetky programy boli spustené v neinteraktívnom móde.
| program | čas celkom (s) | na jedno slovo (s) |
|---|---|---|
| ispell | 10 | 0.056 |
| aspell | 292 | 1.631 |
| fispell | 83 | 0.464 |
| program | správna náhrada | len nájdená chyba | nenájdená chyba |
|---|---|---|---|
| ispell | 177 | 41 | 26 |
| aspell | 208 | 24 | 12 |
| fispell | 228 | 3 | 13 |
Čísla nie sú skreslené veľkosťou slovníka. Rozdiel je v použitom prístupe k spojeným a rozdeleným slovám. Ani ispell, ani ASpell nezvládli napr. slovo vedou-cí. Pri nenájdených chybách sa jednalo zvačša o iné slovo, ktoré už bolo obsiahnuté v slovníku, a tak programy ani nehľadali náhradu.
Poradie správnej náhrady v ponúknutom zozname:
| program | 1 | 2-3 | 4-6 | 7-10 | 11- | priemer |
|---|---|---|---|---|---|---|
| fispell | 184 | 22 | 10 | 4 | 8 | 2.09 |
| aspell | 175 | 19 | 6 | 7 | 1 | 2.06 |
| ispell | 116 | 32 | 19 | 2 | 8 | 2.66 |
Nástroje: Tisk bez diskuse
Tiskni
Sdílej:
(navíc je zde podobnost jako kritérium pro hledání potenciálních správných tvarů poměrně k ničemu -- podívejte se, co vám korektory nabízejí za opravy na ,dvoumi`).