abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    dnes 12:33 | IT novinky

    Na blogu Raspberry Pi byla představena rozšiřující deska Raspberry Pi AI HAT+ 2 s akcelerátorem Hailo-10 a 8 GB RAM. Na rozdíl od předchozí Raspberry Pi AI HAT+ podporuje generativní AI. Cena desky je 130 dolarů.

    Ladislav Hagara | Komentářů: 2
    dnes 12:11 | Komunita

    Wikipedie slaví 25. výročí svého založení. Vznikla 15. ledna 2001 jako doplňkový projekt k dnes již neexistující encyklopedii Nupedia. Doména wikipedia.org byla zaregistrována 12. ledna 2001. Zítra proběhne v Praze Večer svobodné kultury, který pořádá spolek Wikimedia ČR.

    Ladislav Hagara | Komentářů: 0
    dnes 04:44 | Nová verze

    Po více než dvou letech od vydání předchozí verze 2.12 byla vydána nová stabilní verze 2.14 systémového zavaděče GNU GRUB (GRand Unified Bootloader, Wikipedie). Přehled novinek v souboru NEWS a v aktualizované dokumentaci.

    Ladislav Hagara | Komentářů: 0
    dnes 02:22 | Nová verze

    Google Chrome 144 byl prohlášen za stabilní. Nejnovější stabilní verze 144.0.7559.59 přináší řadu novinek z hlediska uživatelů i vývojářů. Podrobný přehled v poznámkách k vydání. Opraveno bylo 10 bezpečnostních chyb. Vylepšeny byly také nástroje pro vývojáře (YouTube).

    Ladislav Hagara | Komentářů: 2
    dnes 01:55 | Humor

    Microsoft zveřejnil zdrojový kód XAML Studia a uvolnil ho pod MIT licencí. XAML Studio je nástroj ze světa Windows, určený pro tvorbu uživatelského rozhraní aplikací pomocí XAML (Extensible Application Markup Language). Stalo se tak zhruba po osmi letech od prvního prohlášení Microsoftu, že se tento kód chystá zveřejnit.

    NUKE GAZA! 🎆 | Komentářů: 0
    dnes 01:44 | Zajímavý projekt

    TimeCapsule, 'časová kapsle', je jazykový model trénovaný výhradně na datech z určitých míst a časových období, aby se tak napodobila autentická slovní zásoba, způsob vyjadřování a názory dané doby. Na Hugging face jsou k dispozici modely natrénované na historických textech dostupných v oblasti Londýna mezi lety 1800 až 1875.

    NUKE GAZA! 🎆 | Komentářů: 2
    včera 17:55 | Nová verze

    Radicle byl vydán ve verzi 1.6.0 s kódovým jménem Amaryllis. Jedná se o distribuovanou alternativu k softwarům pro spolupráci jako např. GitLab.

    Ladislav Hagara | Komentářů: 0
    včera 13:22 | Upozornění

    Zemřel Scott Adams, tvůrce komiksových stripů Dilbert parodujících pracovní prostředí velké firmy.

    Ladislav Hagara | Komentářů: 3
    včera 13:00 | Nová verze

    Sdružení CZ.NIC vydalo novou verzi Knot Resolveru (6.1.0). Jedná se o první vydanou stabilní verzi 6, která je nyní oficiálně preferovanou a doporučovanou verzí, namísto předešlé verze 5. Více o Knot Resolveru 6 je možné se dočíst přímo v dokumentaci.

    VSladek | Komentářů: 3
    včera 01:22 | Nová verze

    Byl vydán Linux Mint 22.3 s kódovým jménem Zena. Podrobnosti v přehledu novinek a poznámkách k vydání. Vypíchnout lze, že nástroj Systémová hlášení (System Reports) získal mnoho nových funkcí a byl přejmenován na Informace o systému (System Information). Linux Mint 22.3 bude podporován do roku 2029.

    Ladislav Hagara | Komentářů: 1
    Které desktopové prostředí na Linuxu používáte?
     (14%)
     (5%)
     (0%)
     (8%)
     (19%)
     (3%)
     (6%)
     (3%)
     (11%)
     (44%)
    Celkem 443 hlasů
     Komentářů: 12, poslední včera 21:12
    Rozcestník

    Mistral OCR

    Společnost Mistral AI představila Mistral OCR, tj. svůj AI model a API pro OCR (optické rozpoznávání znaků) a převod PDF do Markdown.

    7.3.2025 18:33 | Ladislav Hagara | IT novinky


    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    Komentáře

    Vložit další komentář

    8.3.2025 16:42 ~
    Rozbalit Rozbalit vše Re: Mistral OCR
    Jo protoze sen kazdyho OCRkare je jebat vsechno do cloudu :-) Mysleli to dobre a dopadlo to jako obvykle.
    8.3.2025 22:46 Milan Vančura | skóre: 2
    Rozbalit Rozbalit vše Re: Mistral OCR
    Také jsem si říkal, že to vypadá jako online služba, ale je to jen trochu zmatený popis, kde sloučili dvě věci dohromady. Ve skutečnosti nabízejí mnoho různých modelů optimalizovaných různým způsobem a také se lišící licencí. A všechny open-source modely jdou stáhnout a používat lokálně, navíc vyladit např. na vlastní konkrétní typy dokumentů. Jako příklad uvádím dvě citace z uvedení modelu Mistral Small 3:
    Local inference: Particularly beneficial for hobbyists and organizations handling sensitive or proprietary information. When quantized, Mistral Small 3 can be run privately on a single RTX 4090 or a Macbook with 32GB RAM.

    Open-source models at Mistral

    We’re renewing our commitment to using Apache 2.0 license for our general purpose models, as we progressively move away from MRL-licensed models. As with Mistral Small 3, model weights will be available to download and deploy locally, and free to modify and use in any capacity.
    10.3.2025 10:23 ..... Izak ..... | skóre: 14
    Rozbalit Rozbalit vše Re: Mistral OCR
    Super, mam Mac mini pro s 64GB RAM - ale LM_Studio mi rika, ze max pro GPU neumi 60GB, ale 48GB - coz je porad OK
    9.3.2025 08:39 Peter Golis | skóre: 65 | blog: Bežné záležitosti | Bratislava
    Rozbalit Rozbalit vše Re: Mistral OCR
    Keď si spomeniem že ku niektorým skenerom sa dodával OCR software schopný naskenovať dokument do štrukturovaného textu (aj s detekciou obrázkov a tabuliek) už pred cca 2O rokmi, tak vidím v používaní buzzwordu AI pokrok. Podobne ako keď sa mi voľajaký SW učil znaky keď som pred vyše 5 rokmi riešil automatický prepis bitmapových titulkov z DVD Video (no ten mal trošku problémy s lignatúrami ako sú napr. et, fi). Tiež si zabudol dať do názvu AI, a tak sa o ňom široká laická verejnosť nedozvedela.
    9.3.2025 14:09 Mendoza
    Rozbalit Rozbalit vše Re: Mistral OCR
    Nevim, jak kvalitni je ocr s pouzitim ai, ale leta jsem pouzival Abby Finereader nebo Omnipage a vzdycky byla potreba, zvlast u slozitejsich dokumentu, spousta naslednych uprav. Vim, ze ebookari maji i docela vychytana makra na ty nejhorsi veci. Takze ano, slo to, ale zazrak to nikdy nebyl.
    regine2 avatar 9.3.2025 17:09 regine2 | skóre: 14
    Rozbalit Rozbalit vše Re: Mistral OCR

    Abby Finereader byl a je stále asi nejlepší (na češtinu). Též jsem ho dostal a stále užívám se skenerem. Problém s následnými úpravami bych neviděl v programech na OCR, ale v nejednoznačnosti (nedefinování) souboru pro dokumenty. I takový MS Word je slepenec.

    Dokud nepřiletí mimozemšťané, všechno už jaksi bylo.
    10.3.2025 10:42 ..... Izak ..... | skóre: 14
    Rozbalit Rozbalit vše Re: Mistral OCR
    Vsak OCR je ve skutecnosti AI, rozpoznava znaky - ale pocitalo se to jen na CPU a muselo to byt rychle, urcite to projel i nejakym slovnikem - ale na textovou analyzu je moderni AI pro GPU mnohem lepsi- umi tak opravovat chyby. Pravdou je, ze je to dost neoptimalizobvane, kdy na to potrebuje tak silene zdroje ;-) - asi by to slo udelat lepe - ale oni jsou lini, udelali koncept, ze na osucasnou AI implementovali OCR - podle me to jeste vyladi - kdyz totiz OCR neco prevde, nadela tam chyby, coz nevadi, nebot pak to projde analyzou a opravi - mozna to nekdy i zmrvi, zvlaste u basnicek, nebo nejakych literarnich del, kde si hraji se slovy, co neexistuji
    xkucf03 avatar 10.3.2025 11:18 xkucf03 | skóre: 50 | blog: xkucf03
    Rozbalit Rozbalit vše Re: Mistral OCR - AI a generování chyb
    umi tak opravovat chyby
    Nebo do textu zanášet nové a vymýšlet si, co tam není…

    (tím neříkám, že je to úplně k ničemu, ale obezřetnost je na místě)
    Mám rád, když se lidé přou, znamená to, že vědí, co dělají, a že mají směr. Frantovo.cz, SQL-DK, Relational pipes
    10.3.2025 11:59 ..... Izak ..... | skóre: 14
    Rozbalit Rozbalit vše Re: Mistral OCR - AI a generování chyb
    Treba upravovat historicke udalosti a tak ;-)
    xkucf03 avatar 9.3.2025 14:17 xkucf03 | skóre: 50 | blog: xkucf03
    Rozbalit Rozbalit vše Re: Mistral OCR, Tesseract, AI
    AI je i klasický Tesseract, akorát pochází z doby, kdy to ještě nebyla taková móda a necpala se ta zkratka všude.
    Mám rád, když se lidé přou, znamená to, že vědí, co dělají, a že mají směr. Frantovo.cz, SQL-DK, Relational pipes
    9.3.2025 21:56 @
    Rozbalit Rozbalit vše Re: Mistral OCR, Tesseract, AI
    jasne mistre, mas prehled, az na to, ze Tesseract zrovna pouziva neco, cemu se da rikat "AI", od verze 4, ktera vysla kdy, no schvalne, zjisti si sam... ze ti to nevoni je jasny, jak by mohlo, kdyz je na tom tolik veci, co se da hejtit - ze ti ten hejt ale pomaha se dopracovat k necemu, co fakt dava smysl... vzdyt se roky nikam nehejbes :-D
    9.3.2025 22:11 Peter Golis | skóre: 65 | blog: Bežné záležitosti | Bratislava
    Rozbalit Rozbalit vše Re: Mistral OCR, Tesseract, AI
    Až na to že AI znamená SW schopný sa niečo sám učiť, a to existovalo už v minulom tisícročí. Bez ohľadu na to, či ti to niekto povedal na hodine počítačových dejín.
    xkucf03 avatar 10.3.2025 07:37 xkucf03 | skóre: 50 | blog: xkucf03
    Rozbalit Rozbalit vše Re: Mistral OCR, Tesseract, AI
    Vždyť taky ta v4 (LSTM) je starší než současná módní vlna, kdy se zkratka "AI" cpe pro jistotu do všeho. I samotná AI je tu o desítky let déle, než současný zájem veřejnosti a investorů.

    Mistral OCR vyzkouším a jestli bude funkčně lepší a licenčně aspoň stejný jako ten Tesseract, tak ho rád budu používat.
    Mám rád, když se lidé přou, znamená to, že vědí, co dělají, a že mají směr. Frantovo.cz, SQL-DK, Relational pipes

    Založit nové vláknoNahoru


    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.