abclinuxu.cz AbcLinuxu.cz itbiz.cz ITBiz.cz HDmag.cz HDmag.cz abcprace.cz AbcPráce.cz
AbcLinuxu hledá autory!
Inzerujte na AbcPráce.cz od 950 Kč
Rozšířené hledání
×
    včera 17:33 | IT novinky

    Apple oznámil, že iPhone a iPad jako první a jediná zařízení pro koncové uživatele splňují požadavky členských států NATO na zabezpečení informací. Díky tomu je možné je používat pro práci s utajovanými informacemi až do stupně „NATO Restricted“, a to bez nutnosti instalovat speciální software nebo měnit nastavení. Žádné jiné běžně dostupné mobilní zařízení tak vysokou úroveň státní certifikace dosud nezískalo.

    Ladislav Hagara | Komentářů: 11
    včera 13:00 | IT novinky

    Americký provozovatel streamovací platformy Netflix odmítl zvýšit nabídku na převzetí filmových studií a streamovací divize konglomerátu Warner Bros. Discovery (WBD). Netflix to ve čtvrtek oznámil v tiskové zprávě. Jeho krok po několikaměsíčním boji o převzetí otevírá dveře k akvizici WBD mediální skupině Paramount Skydance, a to zhruba za 111 miliard dolarů (2,28 bilionu Kč).

    Ladislav Hagara | Komentářů: 5
    včera 12:44 | IT novinky

    Americká společnosti Apple přesune část výroby svého malého stolního počítače Mac mini z Asie do Spojených států. Výroba v závodě v Houstonu by měla začít ještě v letošním roce, uvedla firma na svém webu. Apple také plánuje rozšířit svůj závod v Houstonu o nové školicí centrum pro pokročilou výrobu. V Houstonu by měly vzniknout tisíce nových pracovních míst.

    Ladislav Hagara | Komentářů: 19
    včera 12:11 | Zajímavý článek

    Vědci Biotechnologické společnosti Cortical Labs vytvořili biopočítač nazvaný CL1, který využívá živé lidské mozkové buňky vypěstované z kmenových buněk na čipu. Po úspěchu se hrou PONG se ho nyní snaží naučit hrát DOOM. Neurony přijímají signály podle toho, co se ve hře děje, a jejich reakce jsou převáděny na akce jako pohyb nebo střelba. V tuto chvíli systém hraje velmi špatně, ale dokáže reagovat, trochu se učit a v reálném čase se hrou

    … více »
    karkar | Komentářů: 8
    včera 01:55 | Nová verze Ladislav Hagara | Komentářů: 0
    26.2. 21:33 | Nová verze

    Ben Sturmfels oznámil vydání MediaGoblinu 0.15.0. Přehled novinek v poznámkách k vydání. MediaGoblin (Wikipedie) je svobodná multimediální publikační platforma a decentralizovaná alternativa ke službám jako Flickr, YouTube, SoundCloud atd. Ukázka například na LibrePlanet.

    Ladislav Hagara | Komentářů: 0
    26.2. 15:44 | Zajímavý software

    TerminalPhone (png) je skript v Bashi pro push-to-talk hlasovou a textovou komunikaci přes Tor využívající .onion adresy.

    Ladislav Hagara | Komentářů: 6
    26.2. 12:22 | IT novinky

    Před dvěma lety zavedli operátoři ochranu proti podvrženým hovorům, kdy volající falšuje čísla anebo se vydává za někoho jiného. Nyní v roce 2026 blokují operátoři díky nasazeným technologiím v průměru 3 miliony pokusů o podvodný hovor měsíčně (tzn., že k propojení na zákazníka vůbec nedojde). Ochrana před tzv. spoofingem je pro zákazníky a zákaznice všech tří operátorů zdarma, ať už jde o mobilní čísla nebo pevné linky.

    Ladislav Hagara | Komentářů: 10
    26.2. 03:44 | Komunita

    Společnost Meta (Facebook) předává React, React Native a související projekty jako JSX nadaci React Foundation patřící pod Linux Foundation. Zakládajícími členy React Foundation jsou Amazon, Callstack, Expo, Huawei, Meta, Microsoft, Software Mansion a Vercel.

    Ladislav Hagara | Komentářů: 3
    26.2. 01:22 | IT novinky

    Samsung na akci Galaxy Unpacked February 2026 (YouTube) představil své nové telefony Galaxy S26, S26+ a S26 Ultra a sluchátka Galaxy Buds4 a Buds4 Pro. Telefon Galaxy S26 Ultra má nový typ displeje (Privacy Display) chránící obsah na obrazovce před zvědavými pohledy (YouTube).

    Ladislav Hagara | Komentářů: 13
    Které desktopové prostředí na Linuxu používáte?
     (17%)
     (6%)
     (0%)
     (11%)
     (27%)
     (2%)
     (5%)
     (2%)
     (13%)
     (26%)
    Celkem 972 hlasů
     Komentářů: 25, poslední 3.2. 19:50
    Rozcestník

    Nekonečně spolehlivé diskové pole

    28.4.2006 15:35 | Přečteno: 1676×

    Byl jsem tázán, proč nemám důvěru k RAID řadičům, jaké se strkají do běžných počítačů. Váže se k nim následující historka. Před pár lety jsem si vymyslel, že si jako koupíme diskové pole, které bude tak spolehlivé, že nebude nutné ho zálohovat. Ono zálohování stovek GB a víc bývá pracné. Ještě i dnes si myslím, že to byla správná myšlenka. Můžeme přece mít dvě stejná pole jedno pracovní, druhé záložní obsahující mirror, a jednu paní, která v případě poruchy toho pracovního ho vypne, připojí to záložní a zase to spustí. To je velmi stabilní mechanismus. Při tom stačí paní nahradit robotem a máme co jsme chtěli, vlastně takový SAN. Jenže peníze na skutečný SAN nebyly.

    Jedna seriózní firma od toho dala ruce pryč, druhá dobrodružnější to ale docela hezky vymyslela. Linuxový server, v něm ADAPTEC 2100S nakonfigurovaný tak, aby mirroroval, a k tomu dvě stejná políčka EasyStor SB-2803T s vnějším vývodem SCSI, obě připojená do SCSI chainu k tomu Adaptecu. Více než dva roky to běželo bez nejmenšího problému.

    Na každém tom poli byly vytvořeny tři oddíly jakoby virtuální disky. Ten typ pole to umožňuje tak, že každý virtuální disk má stejné SCSI id ale různý LUN. Každý ten virtuální disk byl v mirroru se stejným na druhém poli. Jak říkám, dlouho to běželo pěkně a ti tři odvážlivci, kteří nám to navrhli a jaksi garantovali, mezitím vzali kramle.

    Potom se mirror rozpadnul, běželo to na polovině a tedy bez zálohy a Adaptec ošklivě pištěl (nedivím se mu). To odpojené pole podle všech testů dál fungovalo, dalo se i připojit jinam a data tam byla. V logu polí nic, v logu linuxu taky nic. V logu Adaptecu velmi stručná hláška, že ten a ten disk chybuje a byl odpojen. Pokus o rebuild mirror obvykle během pár minut zhavaroval. Někdy taky doběhl, ale potom v provozu se to znovu rozpojilo. Přivolaný technik od té dodavatelské firmy se nás zdvořile zeptal, kdo nám takovou pitomou architekturu navrhnul. Nevěděl, co je na tom špatně, ale pořád říkal, že to přece nemůže fungovat.

    Nazdařbůh jsme vyměnili ten Adaptec, ale ne za stejný, ten nebyl k mání. Za nějaký novější. Mělo by to být jedno. Raid řadič si píše služební údaje přímo na připojené disky, a to nejpíš na úplný začátek, kam souborové systémy nikdy nelezou. (Někdo jiný tam může lézt, např. Informix.) Dáte tam nový raid řadič, zapnete a má to hned zase běžet... skutečně bez nehod to naběhlo pro LUN=0 a hned se spustil rebuild správným směrem z dobrého na špatný. Ale pro vyšší LUNy to psalo, že mu chybějí obě poloviny mirroru, zato ale viděl pár nových disků, které tam ve skutečnosti nebyly. Po ručním zrušení mirrorů a jejich znovu vytvoření se to podařilo správně rozjet včetně toho správného směru buildu z dobrého na špatný. Jenže po pár dnech provozu se to znovu odpojilo, jak správně tušíte. Mezitím nám snaživý servisák na našem starém Adaptecu upgradoval firmware a při další výměně nazpátek se to už ani nenabootovalo. Vrátili jsme tam zase ten dočasný Adaptec a na něm to běží už skoro rok bez mirrorování. Mirror si děláme sami pomocí rsync.

    Pominu určité emoční prožitky, které s naznačenými operacemi byly spojeny. Můžu pominout i to, že při jedné z manipulací nám data z jednoho oddílu zmizela, asi se spustil rebuild nesprávným směrem. Data jsme obnovili ze zálohy, protože v té době jsme na absolutní spolehlivost už tolik nevěřili. Ale stejně, co se vlastně stalo?

    Něco očividně hnije v jednom z těch polí nebo v serveru. Ještě to nevyhnilo a tedy se to nedá poznat. Trapné selhání Adaptecu je vázáno na vyšší LUNy a to mu třeba můžeme odpustit. Možná má Adaptec milion instalací podobných destiček, ale nejspíš jednu jedinou s LUN != 0, takže to není odladěné.

    No a ti tři mládenci, co nám to navrhli, škoda že vymizeli. Jeden z nich byl opravdu šikovný, možná by nám to spravil. Pořád nevím, že by na té jejich konstrukci bylo něco špatně. Až na to že nefunguje.

           

    Hodnocení: 100 %

            špatnédobré        

    Tiskni Sdílej: Linkuj Jaggni to Vybrali.sme.sk Google Del.icio.us Facebook

    Komentáře

    Vložit další komentář

    28.4.2006 15:45 xxxxxxxx | skóre: 16 | blog: mrtvy blog | v nebi
    Rozbalit Rozbalit vše Re: Nekonečně spolehlivé diskové pole

    V logu Adaptecu velmi stručná hláška, že ten a ten disk chybuje a byl odpojen.

    Hm, mozna ze mam divny myslenkovy pochody, ale IMHO bych nejdriv vymenil ten a ten disk

    28.4.2006 16:31 Jiří Veselský | skóre: 30 | blog: Jirkovo | Ostrava
    Rozbalit Rozbalit vše Re: Nekonečně spolehlivé diskové pole

    Obávám se, že neexistuje způsob, jak se vyhnout plnohodnotnému zálohování. I když bych vzal dvě velmi kvalitní disková pole, připojil je každé k jinému počítači a zajistil jejich mirrorování, dostávám pouze systém, který mě s vysokou mírou spolehlivosti chrání před jakoukoliv myslitelnou hardwarovou závadou nebo jejich různými kombinacemi. (Nechrání samozřejmě úplně dokonale, protože se může stát, že odejde najednou 2xN disků ve dvou polích, ale to je natolik nepravděpodobné, že to můžeme vyloučit.)

    V této fázi je značně eliminováno riziko hardwarového selhání a na povrch vystupuje nezanedbatelné riziko chyby lidského faktoru / softwarového selhání.

    Pokud "master" té dvojice polí usoudí, že mají být obě smazána, jste prostě v háji. Přičemž k tomu může dojít z naprosto prozaické příčiny, například příkazem delete from xxx, kde člověk zapomněl dopsat where yyy - to se mi skutečně podařilo :-(.

    Pokud máte celé zálohovací řešení online, k takovéto situaci dříve či později dojde. Proto by tam měl být vždycky nějaký offline prvek, který vaši chybu ihned slepě nezreplikuje, a vy budete mít šanci odněkud data získat zpět...

    28.4.2006 16:51 krnoha | skóre: 10 | blog: prizpevy
    Rozbalit Rozbalit vše Re: Nekonečně spolehlivé diskové pole

    V této fázi je značně eliminováno riziko hardwarového selhání a na povrch vystupuje nezanedbatelné riziko chyby lidského faktoru / softwarového selhání.


    Pokud máte celé zálohovací řešení online, k takovéto situaci dříve či později dojde. Proto by tam měl být vždycky nějaký offline prvek, který vaši chybu ihned slepě nezreplikuje, a vy budete mít šanci odněkud data získat zpět...

    Samozřejmě. Tím není řečeno, že to nemůže být chytřejší robot. V našem řešení to dořešeno nebylo, to uznávám.

    28.4.2006 18:08 coques | skóre: 21 | blog: FailSystem
    Rozbalit Rozbalit vše Re: Nekonečně spolehlivé diskové pole
    Problem pri online zalohovani este moze vzniknut ak sa ti ktokolvek nepovolany dostane na server :)
    Polívčička byla..
    28.4.2006 19:42 miho | skóre: 24 | blog: Mihovy_sochory | Orlová
    Rozbalit Rozbalit vše Re: Nekonečně spolehlivé diskové pole
    Znamy ITik z male firmy si taktez myslel, ze si podobnym zpusobem usnadni praci se zalohovanim. Nebudu zde popisovat celou historku, to je myslim zbytecne. Postaci myslim posledni veta pribehu se spatnym koncem: "A pak jednoho krasneho dne vyhorela serverovna."

    Alternativni a nemene humorna zakonceni teto pohadky pro zlobive deticky: "... se tam naboural cracker a vsechno smazal." "... udelal root preklep v prikazu." "... se zblaznil ovladac radice a zacal zapisovat na disk na pozici pozadovana_pozice modulo 128GiB" (toto jsem BTW skutecne jednou zazil) ...

    Povinne cist vsem detem inklinujicim k pocitacum u kterych hrozi, ze se stanou spravci serveru protoze pak jim nocni mura z detstvi mozna pripomene, ze, jak napsal klasik: Tudy ne, pratele! :-)
    28.4.2006 20:29 Jiří (BoodOk) Kadeřávek | skóre: 19 | blog: BoodOk | Brno
    Rozbalit Rozbalit vše Re: Nekonečně spolehlivé diskové pole
    Neni levnejsi RAID-5 na SCSI a normalni pulnocni zalohy na pole s IDE disky (nejlepe ve vedlejsi budove)? Takhle jste to meli IMO zbytecne nakladne, protoze vysokokapacitni SCSI RAID neni nic levneho.
    Věda má v sobě určitou zpupnost, že čím dokonalejší techniku vyvineme, čím více se dozvíme, tím lepší budou naše životy.
    28.4.2006 22:06 vagojan | skóre: 16
    Rozbalit Rozbalit vše Proč to zlobí?
    V práci se nám vyskytl nestabilní raid... podezření padlo na řadič, disky.. OS.. na všechno. Nakonec se zjistilo že za to mohl vadý hotswap backplane. Náhodou v té době ležely vedle nové servery, ještě nenainstalované, tak se z nich jeden autobus i s backplanem vypůjčil a bylo to tu.. řešení.

    Server běží dodnes, třebaže je mu 6 let, má v sobě 3 generaci disků a autobus diskového pole je z intel case o 4 generace novější.. tj připevněno jak se dá.

    Někdy fakt stačí trivialita jako nestabilní oddělovače v backplane. Zkoušeli jste zaměnit ty pole? Tj jejich disky?

    Jinak projev chyb... z počátku klesání výkonu raid, pak timeouty, pak divné hlášky.. pak občasné zamrznutí systému.. na závěr totální výtuh co se už neprobral (nějakou dobu pomáhalo k částečnému obnovení funkčnosti i delší vypnutí serveru (jen fyzické odpojení od veškerého napájení).
    29.4.2006 02:35 Radek Hladik | skóre: 20
    Rozbalit Rozbalit vše Re: Proč to zlobí?
    No, to my tady ted delame diskove pole s Highpointem 2220 a SATA Seagaty. Cele to fungovalo, dokud se nezacalo hodne kopirovat, pak to nahlasilo "hpt_reset" a konec, cely pocitac mrtvy, pomohl jedine restart. Castecne pomahalo nepouzivat backplane, ale problem byl porad...

    Jen tak namatkou jsme zkusili vymenit SATA kabely a ehjle... Originalni od highpointu (takove pekne, modre) zlobi a obycejne noname cervene (zatim) fungujou jako po masle...

    Ted jeste zkusim zapatrat, zda do toho nejak nevstupuje SATA1/SATA2. Treba ze by to zlobilo pri SATA2 a na tech obycejnych kabelech by si to troufalo maximalne SATA1...

    Ale co se tyce online zaloh, tak uz jsem zazil nekolik padu filesystemu, takze vzdycky k RAIDu doporucuju nejaky zpusob zalohy na jiny filesystem a u dulezitych dat i nekolik dni zpatky.

    Radek
    29.4.2006 10:09 Jiri Bajer | skóre: 34 | blog: Sarimuv koutek | Praha
    Rozbalit Rozbalit vše Re: Nekonečně spolehlivé diskové pole
    Taky bych se pripojil k nazoru, ze bez offline zaloh nepomuze sebechytrejsi online mirrorovani mezi vice poli. Ztratu dat typicky zpusobuji dve varianty prusvihu: korektni pozadavek na odstraneni/prepsani dat (chyba administratora/sw) a hw chyba controlleru. U automagickych policek, kde clovek nema sanci dostatecne videt do vnitrni architektury a nenedokaze externe zazalohovat rozlozeni LUNu a RAID levely se dost casto stava, ze pri vypadku controlleru se v poslednim zachvevu zivota pokusi umirajici controller vnutit svemu protejsku to, ze spravnou kopii konfigurace ma on a nestesti je na svete...

    To, ze obcas umre disk, by si melo kazde rozumne pole ohlidat a tady vetsinou nebyvaji problemy, nejvetsi prusvihy byvaji s firmware v controlleru a prave automagickou architekturou pole. Rozhodne bych se tedy nespolehal na to, ze kdyz je ridici logika (controller) zdvojena, ze se nemuze nic stat.

    Jen mala perlicka na okraj: uz jsem videl ztracena data jen proto, ze administrator pri odstavce nespravnym zpusobem vypnul pole. Pole melo nekolik shelfu, jeden mel na sobe controllery i disky, zbyle byly jen JBODy (just a bunch of disks - tj. sbernice bez ridici logiky) - a jemu se podarilo povypinat nejprve JBODy a az nakonec controller. Obnova nekolika TB dat z Ultrium pasek pak trvala minimalne cely vikend. Nemit ty offline zalohy, mohli se rozloucit s datama...

    Založit nové vláknoNahoru

    ISSN 1214-1267   www.czech-server.cz
    © 1999-2015 Nitemedia s. r. o. Všechna práva vyhrazena.