Vedci hľadajú nové spôsoby, ako spracovať denne vygenerované petabajty dát.
Vedci z CERN-u sa pripravujú na "záplavu" nových dát, ktoré majú získať z kolízií častíc, ktoré sa udejú vo Veľkom hadrónovom urýchľovači častíc. Aktuálne používané back-end databázové systémy nie sú schopné spracovať petbajty dát, ktoré sa denne vygenerujú. Tieto dáta sa majú získať počas novej fázy výskumov, známej ako LHC Run 3, pričom výskmníci očakávajú, že každý deň získajú petabajt dát, ktoré bude treba následne spracovať, pre získanie relevantných výsledkov. Vedci doteraz používali open-source datbázový systém - Databáza časových radov (TSDB) - InfluxDB. Tento systém používal kompresné algoritmy pre spracovanie výskumom získaných informácií a spolupracoval s monitorovacou databázou Prometheus. Bohužiaľ počas testovania nových systémov narazili oba systémy na svoje limity.
Preto sa vedci rozhodli systémy nahradiť novým - Victoria Metrics TSDB. Nový systém bude slúžiť aj ako back-end a monitorovanie pre CMS (The Compact Muon Solenoid - Kompaktný miónový solenoid). Ten je dôležitou súčasťou experimentov, nakoľko ide o univerzálny detektor v rámci LHC. Vedci sa pomocou tohto detektoru snažia študovať a hľadať nové dimenzie, častice, či preverovať Štandardný model, skúmať Higgsov bozón, ale aj objaviť pôvod temnej hmoty. Počas testov systémov sa ukázalo, že vedci vygenerovali 30 petabajtov dát za jeden mesiac. Výskumník Brij Kishor Jashal, pracujúci na úseku CMS vysvetlil, že za masívny nárast dát je zodpovedná "vysoká svietivosť", čo viedlo k podstatnému nárastu objemu získaných informácií. Vedec zároveň vyjadril spokojnosť s novým databázovým systémom, ktorý je možné dodatočne škálovať.
Zdroj: Techspot,

Add new comment