abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
dnes 17:21 | Pozvánky
Dnes (čtvrtek 24. dubna) v 20:00 v rámci CodeNight v Brmlabu proběhne přednáška "OpenGL a shadery", zaměřený na naprosté začátečníky (potřeba je jen základní znalost C/C++ a matematiky na úrovni střední školy). Talk bude v češtině nebo v angličtině (pokud bude alespoň jeden zájemce nemluvící česky). Shrnutí: základy programovatelné pipeline, souřadnicové systémy, model-view-projection matice, vertex a fragment shadery, GLSL, ukázka jednoduchého kódu. Slidy a záznam budou k dispozici.
Bluebear | Komentářů: 0
dnes 01:23 | Komunita
Po písmenech R, S a T následuje U. Po Raring Ringtail, Saucy Salamander a Trusty Tahr následuje Utopic Unicorn. Mark Shuttleworth oznámil, že příští Ubuntu ponese jméno Utopic Unicorn.
Ladislav Hagara | Komentářů: 31
včera 01:23 | Zajímavý software
Google vydal verzi 1.0.5 svého Google Web Designeru (GWD). Jednou z novinek je podpora Linuxu, konkrétně linuxových distribucí Ubuntu, Debian, openSUSE a Fedora. Dle nápovědy: Google Web Designer je pokročilá webová aplikace vytvořená pomocí technologií HTML5, která umožňuje návrh a vytváření reklam HTML5 a jiného webového obsahu pomocí integrovaného vizuálního a kódového rozhraní.
Ladislav Hagara | Komentářů: 13
22.4. 21:08 | Nová verze
Vyšlo GCC 4.9.0. Přináší podporu OpenMP 4.0, hodně práce na ještě nevydaném C++1y, vylepšení pro platformy ARM, lepší schopnosti optimalizace nebo UndefinedBehaviorSanitizer (nový detektor nedefinovaného chování).
Luboš Doležel (Doli) | Komentářů: 25
22.4. 14:55 | Zajímavý projekt
Vývojáři OpenBSD nedávno forkli OpenSSL za účelem pročištění, odlehčení a opravy chyb. Nyní má tento projekt jméno a oficiální stránku. Po dokončení "čistky" je plánována i podpora jiných operačních systémů (kromě OpenBSD).
Hans1024 | Komentářů: 84
22.4. 14:46 | Pozvánky
Jarní konference EurOpen 2014 v Herbertově je otevřena pro přihlášení. Zaměření konference je Cloud, DNSSEC a embedded systémy. Více informací a přihlášení na www.europen.cz
cuba | Komentářů: 0
22.4. 11:01 | Komunita
Google zveřejnil seznam studentů přijatých do letošního Google Summer of Code. Z celkového počtu 4420 přihlášených studentů bylo vybráno 1307 studentů. Přehled studentů, projektů, organizací a mentorů je k dispozici ve zveřejněné tabulce. Například pro KDE bude pracovat 42 studentů, pro Apache Software Foundation 39 studentů, pro GNOME 35 studentů, pro openSUSE 14 studentů, pro Fedora Project 10 studentů, …
Ladislav Hagara | Komentářů: 8
19.4. 01:01 | Zajímavý článek
Společnost Coverity vydala Coverity Scan Open Source Report za rok 2013. Dle nejnovější zprávy je například v open-source C/C++ projektech průměrně 0,59 chyby na 1000 řádků kódu, kdežto u proprietárních projektů je to 0,79 chyby na 1000 řádků kódu. Službu Coverity Scan využívá více než 1700 open-source projektů.
Ladislav Hagara | Komentářů: 11
18.4. 01:23 | Komunita
ISC (Internet Systems Consortium) vydalo verzi 1.2.0 DNS serveru BIND 10. Současně bylo ale oznámeno, že se jedná o poslední verzi BIND 10. Projekt byl přejmenován na Bundy a předán komunitě. ISC bude nadále rozvíjet BIND 9 a ISC DHCP.
Ladislav Hagara | Komentářů: 21
17.4. 23:22 | Nová verze
Vyšlo Ubuntu 14.04 (Trusty Tahr) a jeho deriváty jako Kubuntu nebo Xubuntu. Jedná se o vydání s dlouhodobou podporou: pět let v případě Ubuntu Desktop/Server/Core/Kylin, Edubuntu a Kubuntu, tři roky jinak.
davkol | Komentářů: 44
Máte na svém notebooku zašifrovaný pevný disk?
 (84%)
 (16%)
Celkem 1170 hlasů
 Komentářů: 22, poslední 20.4. 20:15
Rozcestník
Reklama
Autoškola testy online Levný benzín
Štítky: není přiřazen žádný štítek

Vložit další komentář
davkol avatar 22.4.2012 22:18 davkol | skóre: 80 | blog: Mahuleno, Mahuleno, ty máš doma nahuleno | Hanáko, máš mocho na repáko
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Jyxo?
"Would you rather be smart or happy?" | Přejděte na ErgoDox! | Raise your dongers! | \m/_d^_^b_\m/
Blbec z Horní Dolní avatar 22.4.2012 22:21 Blbec z Horní Dolní | blog: blbeczhornidolni
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Outsourcuj to do Indie.
Patička je na dovolené.
23.4.2012 00:20 Adam
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
:-D Sa smejes ale ono pri CAPTCHA to funguje
22.4.2012 22:29 retroslava | skóre: 8 | blog: TryCatch | Žižkoff
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Třeba http://postgres.cz/wiki/Instalace_PostgreSQL#Instalace_Fulltextu ?
Pozor! Jsem naprostý idiot. Co jsem napsal včera dnes už dávno neplatí. Zavazuji se, že budu diskutovat nezávazně.
Johny z Podoli avatar 22.4.2012 22:36 Johny z Podoli | skóre: 26 | blog: rocfdebian
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
to už jsem viděl, bohužel mám firebird (interbase) ;-)
Můj web o táborech: Letní dětské tábory, Hudební tábor , Můj nový blog na Nul.cz
bazil avatar 22.4.2012 23:03 bazil | skóre: 33 | blog: sluje | Miroslav
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
No nevím, jak ve Firebirdu, nicméně v MySQL se to řeší buď: přidáním fulltextu nad sloupcem, což se může negativně projevit na výkonu dotazů nad danou tabulkou nebo (podle mě lepší řešení): se vytvoří v DB jedna tabulka navíc, každý text v DB má na ni vazbu a při každé úpravě textu se musí upravit i tabulka. Potom se vybuduje fulltext nad touto tabulkou. Prioritizace nadpisů by se dala zařídit vlastním sloupcem pro nadpisy v tabulce pro vyhledávání.

Nevýhodou tohoto řešení je vyšší režije při aktualizaci textu v DB (ale to se děje jen při vkládání nového článku, nebo úpravě starého), naopak výhodou je, že se zachová rychlost selectů nad stávajícími tabulkami s texty (při normálním prohlížení webu nejčastější dotaz) a zároveň se získá fulltextový klíč pro vyhledávací skript, který je tedy poté trochu pomalejší, ale zase vyhledávací select se nebude pouštět tak často.
22.4.2012 23:05 Martin B. | skóre: 27 | blog: hromada
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Kdybych si s tím chtěl hrát, zkusil bych provozovat vlastní instanci lucene, sphinx nebo nějakého jiného open source search engine.
I think warning here is a bug. The biggest cloud service provider. There is no point in being so cool in a cold world.
limit_false avatar 23.4.2012 12:52 limit_false | skóre: 20 | blog: limit_false
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Taky bych doporučil Sphinx. Ze začátku to bude trocha pruda, ale fungovalo to celkem rozumně, později se ladily jenom váhy a možná občas příliš pomalé dotazy.
22.4.2012 23:35 Ondra
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Josef Kufner avatar 22.4.2012 23:42 Josef Kufner | skóre: 63
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Kdysi na Rootovi a tuším, že i tady, vyšlo pár článků. Je to ale už hodně dávno... cca kolem roku 2005. Leoš tu tou dobou také řešil něco kolem Lucene.
Hello world ! Segmentation fault (core dumped)
22.4.2012 23:49 dad
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
my pouzivame mnogosearch
mess avatar 23.4.2012 00:25 mess | skóre: 43 | blog: bordel | Háj ve Slezsku - Smolkov
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
SELECT * FROM articles WHERE title LIKE %neco% AND content LIKE %neco%;
:-D
Cez párne mesiace zošíváš vaginy, cez neparne montuješ hajzle.
Johny z Podoli avatar 23.4.2012 00:41 Johny z Podoli | skóre: 26 | blog: rocfdebian
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
nojo, kdyby těch tabulek nebyly desítky, sloupců stovky a hromada dat není z databáze ale je generovaná onfly scrpty a podobně ;-) bohužel...
Můj web o táborech: Letní dětské tábory, Hudební tábor , Můj nový blog na Nul.cz
Migilenik avatar 23.4.2012 01:32 Migilenik | skóre: 58 | blog: Mig_Alley
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Off Topic:

Nevim už kde, ale nedavno jsem četl jakysi članek doporučující rodičům webové stránky s katalogy táborů. Takové ty články "kam poslat děti na prazdniny at maji rodiče pokoj".

Ten tvůj portál byl na prvním místě a dlužno říci že ze všech zmíněných webů působil naprosto nejšpičkověji.

Takže gratuluju k úspěchu a drceni konkurence :-) .
GIMP 2.8 Cage Transformation - what is it good for? http://www.youtube.com/watch?v=S4whULCb8t0
23.4.2012 07:31 JK
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Nepomuze starsi clanek? Cestinu jsem resil prevodem diakritiky na znaky bez diakritiky a s vyhledavanim jsem spokojen.
Aleš Janda avatar 23.4.2012 08:28 Aleš Janda | skóre: 20 | blog: programátorské hádanky a tak podobně | Kralupy nad Vltavou
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
http://search.seznam.cz/vlastni - ale vrchní reklama je tam taky (může se však strefovat do jiných slov než Google).

Anebo jsem kdysi zkoušel rozběhnout Sphinx, přičemž každé slovo se lemmatizovalo (tím se do značné míry vyřešilo skloňování a diakritika).
23.4.2012 08:39 Jan Grmela | skóre: 45 | blog: Kilo šťávy z lachtana | Brno
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Píšu pro Pivní recenze a protože mě to IT už fakt nebaví, tak jsme si s klukama postavili pivovar Lucky Bastard
pek avatar 23.4.2012 08:57 pek | skóre: 20
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Používám sphider, ale to je spíš pro menší weby.
23.4.2012 09:06 Sajfi | skóre: 5
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Ja si teď po večerech hraju s Sherlockem z nasi Ceske kotliny a je to moc hezká hračka :-).
xkucf03 avatar 23.4.2012 11:02 xkucf03 | skóre: 43 | blog: xkucf03
Rozbalit Rozbalit vše Diakritika
K té diakritice: skutečně je to nutné? Předpokládám, že v databázi máš obsah s diakritikou, takže jde o to, jak budou hledat uživatelé. Je lepší 1) vyhledávat i nesmysly a zatěžovat irelevantními výsledky uživatele, kteří si „dali tu práci“ se zadáváním hledaného textu s diakritikou nebo 2) dávat špatné výsledky uživatelům, kteří jsou líní/neschopní zadat hledaný text včetně háčků a čárek?
Mám rád, když se lidé přou, znamená to, že vědí, co dělají, a že mají směr. Frantovo.cz, SQL-Výuka.cz, Nekuřák.net
Marek Stopka avatar 23.4.2012 12:17 Marek Stopka | skóre: 57 | blog: Paranoidní blog | London, United Kingdom
Rozbalit Rozbalit vše Re: Diakritika
3) podle toho jestli hledaný řetězec obsahuje nebo neobsahuje diakritiku vyhledávat v indexu s diakritikou, nebo ne (často potřebuju něco najít z blackberry, hledání pouze s diakritikou mě irituje :-) )
Josef Kufner avatar 23.4.2012 12:18 Josef Kufner | skóre: 63
Rozbalit Rozbalit vše Re: Diakritika
Obdobný problém je například se skloňováním a s překlepy. Jako rozumné se mi jeví přiřadit přesné shodě lepší skóre a částečné shodě (překlep, chybějící diakritika) nebo jinému tvaru stejného slova přiřadit skóre o něco horší. Takže irelevantní výsledky budou až za relevantními a líný uživatel dostane, co chtěl.

V praxi se mi osvědčilo (z pohledu uživatele) i vyhledávání podle začátků slov. Krásná ukázka toho je na wowhead.com.
Hello world ! Segmentation fault (core dumped)
23.4.2012 15:37 Roman Schulz | skóre: 8 | Brno
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Taky bych doporučil Sphinx, je snadno konfigurovatelný, indexace může probíhat pomocí zadaného SQL dotazu. Používáme ho i na velkých projektech k naprosté spokojenosti
Programování v OpenGL, můj Blog, linkedin.com profil
23.4.2012 17:33 joka x3m | skóre: 1
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Stiahnut obsah webu rekurzivne cez perl, natlacit texty do db, 2 stlpce, jeden s diakritikou, druhy bez, zapnut index pre fulltext na stlpci bez diakritiky, pri hladani ocistit diakritiku a zvazit jednoduchy fulltext select alebo rozsireny. Robil som specialne parsovanie webu, a vsetko mi funguje presne tak ako ja chcem :) ak chces napis na kalus bodka jozef zavinac gmail bodka com a mozem ti dat blizsie info o tom, nie je to az tak komplikovane ak tvoja db podporuje fulltext :)
23.4.2012 19:27 Kvakor
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
A pokud nejsou data čistý text (což většinou nejsou, buď je to (X)HTML nebo nějaký značkovací jazyk redakčího systému), tak se musí text prvně převést. Když je zdroj nějak strukturovaný, je ještě možné vytahat "zvýrazněné" části bokem do separátního sloupce, když jsem něco takového kdysi dělal, tak tam šlo všechno z <strong>, <em>, vnitřku nadpisů a toho, co se vkládalo do klíčových slov v hlavičce.

Zákazník chtěl ještě podporu skoňování a časování, ale protože se mi nepovedlo najít volně dostupná data, tak se to nakonec neřešilo. Stejně dodnes nevím, jak to elegantně řešit, návrh byl pro každé slovo, které se najde v "sloňovací/časovací" tabulce, provést dotazy na všechny další slova se stejným identifikátorem. V praxi to mohlo znamenat zhruba zdeseti-zdvacetinásobení dotazů, protože se počítalo i zahrnutí nespisovných tvarů (typu "myšmi/myšma/myšima/myšema/myšmami/myšmama"). Docela by mně zajímalo, jak tohle řeší hoši v Seznamu :-)
xkucf03 avatar 23.4.2012 19:49 xkucf03 | skóre: 43 | blog: xkucf03
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Stejně dodnes nevím, jak to elegantně řešit, návrh byl pro každé slovo, které se najde v "sloňovací/časovací" tabulce, provést dotazy na všechny další slova se stejným identifikátorem. V praxi to mohlo znamenat zhruba zdeseti-zdvacetinásobení dotazů
Proto se to řeší tak, že se do indexu ukládají pouze slova v základním tvaru a dotazy se převádějí opět na základní tvar (pokud např. nejsou v uvozovkách).
Mám rád, když se lidé přou, znamená to, že vědí, co dělají, a že mají směr. Frantovo.cz, SQL-Výuka.cz, Nekuřák.net
23.4.2012 21:10 Kvakor
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
To by šlo, sice by generování zabralo šíleně času, ale vyhledávání by to moc nezpomalilo. Ale tenkrát jsem to už neřešil, protože bych nakonec mohl skončit u implementovani plnohodnotného vyhledavaciho enginu jen kvůli pár stránkám :-)
24.4.2012 12:12 Ladicek | skóre: 28 | blog: variace | Havlíčkův brod
Rozbalit Rozbalit vše Re: Jak na vlastní fulltextové vyhledávání?
Obvykle úplně stačí jenom odřezávat přípony, na to není ani potřeba slovník, seznam českých přípon se dá najít někde v ispellu.
Ještě na tom nejsem tak špatně, abych četl Viewegha.

Založit nové vláknoNahoru

Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

ISSN 1214-1267   Powered by Hosting 90 Server hosting
© 1999-2013 Argonit s. r. o. Všechna práva vyhrazena.