• Open Daily: 10am - 10pm
    Alley-side Pickup: 10am - 7pm

    3038 Hennepin Ave Minneapolis, MN
    612-822-4611

Open Daily: 10am - 10pm | Alley-side Pickup: 10am - 7pm
3038 Hennepin Ave Minneapolis, MN
612-822-4611
Efektywna deduplikacja danych w Hadoop

Efektywna deduplikacja danych w Hadoop

Paperback

General Computers

ISBN10: 6202087420
ISBN13: 9786202087421
Publisher: Wydawnictwo Nasza Wiedza
Published: Sep 18 2025
Pages: 76
Weight: 0.25
Height: 0.18 Width: 6.00 Depth: 9.00
Language: Polish
Hadoop jest szeroko stosowany do masowego przechowywania danych. Mimo że jest bardzo odporny na awarie, skalowalny i dziala na standardowym sprzęcie, nie zapewnia wydajnego i zoptymalizowanego rozwiązania do przechowywania danych. Gdy użytkownik przesyla pliki o tej samej zawartości do Hadoop, wszystkie pliki są przechowywane w HDFS (Hadoop Distributed File System), nawet jeśli zawartośc jest taka sama, co prowadzi do powielania treści, a tym samym do marnowania przestrzeni dyskowej. Deduplikacja danych to proces mający na celu zmniejszenie wymaganej pojemności pamięci, ponieważ przechowywane są tylko unikalne instancje danych. Proces deduplikacji danych jest szeroko stosowany w serwerach plików, systemach zarządzania bazami danych, pamięciach kopii zapasowych i wielu innych rozwiązaniach pamięci masowej. Odpowiednia strategia deduplikacji pozwala na wystarczające wykorzystanie przestrzeni dyskowej w ramach ograniczonych urządzeń pamięci masowej. Hadoop nie zapewnia rozwiązania w zakresie deduplikacji danych. W niniejszej pracy modul deduplikacji zostal zintegrowany z frameworkiem Hadoop w celu uzyskania zoptymalizowanego przechowywania danych.

Also from

Prajapati, Priteshkumar

Also in

General Computers