Hem Personliga finanser Begränsningarna för provtagning i Hadoop

Begränsningarna för provtagning i Hadoop

Video: Total retropubisk prostatektomi - kort version 2025

Video: Total retropubisk prostatektomi - kort version 2025
Anonim

Statistisk analys är långt ifrån att vara ett nytt barn i kvarteret, och det är säkert gamla nyheter att det beror på att man hanterar stora mängder data för att få ny insikt. Mängden data som traditionellt bearbetas av dessa system var emellertid inom intervallet mellan 10 och 100 (eller hundratals) gigabyte - inte terabyte- eller petabyteområdena som ses idag, med andra ord.

Och det krävde ofta en dyr symmetrisk multi-bearbetning (SMP) maskin med så mycket minne som möjligt för att hålla data som analyseras. Det beror på att många av de algoritmer som användes av de analytiska metoderna var ganska "beräkna intensiva" och utformades för att köra i minnet - eftersom de kräver flera, och ofta frekventa, passerar igenom data.

Människor försökte göra analysen av arbetsbelastningen lite mer rimlig genom att analysera enbart en sampling av data, med tanke på dyra hårdvara och ett ganska stort engagemang när det gäller tid och RAM. Tanken var att hålla bergen på databerättelser säkert stashed i datalager, bara att flytta en statistiskt signifikant sampling av data från sina förråd till en statistisk motor.

Medan provtagning är en bra ide i teorin är det i praktiken ofta en opålitlig taktik. Att hitta en statistiskt signifikant provtagning kan vara utmanande för glesa och / eller skevda dataset, vilket är ganska vanligt. Detta leder till dåligt bedömda provtagningar, som kan introducera avvikande och avvikande datapunkter, och kan i sin tur förspänna resultaten av din analys.

Begränsningarna för provtagning i Hadoop

Redaktörens val

Hur man konfigurerar Outlook's skräppostfilter - dummies

Hur man konfigurerar Outlook's skräppostfilter - dummies

Du kan anpassa känsligheten för Outlook's skräppostfilter i Outlook-alternativ. Om du anger att det är mycket aggressivt, kommer färre skräppostmeddelanden att komma igenom, men det kan ibland markera legitima meddelanden som skräp. Om du ställer in det för att vara mindre aggressivt får du mer skräp i inkorgen. Outlook kommer med ...

Hur man skapar en kontaktgrupp i Outlook 2013 - dummies

Hur man skapar en kontaktgrupp i Outlook 2013 - dummies

Skapa en kontaktgrupp i Outlook 2013 är en enkel fråga om att skapa ett namn på din lista och välja från samlingen av namn du har lagrat på ditt system. En kontaktgrupp följer inte telefonnummer och adresser, bara e-postadresser. För att skapa en kontaktgrupp i din Kontakter-modul, ...

Hur man skapar ett möte med Outlook på din mobila enhet - dummies

Hur man skapar ett möte med Outlook på din mobila enhet - dummies

Båda versionerna av mobil Outlook Kalender har ett framstående plustecken du kan knacka på för att öppna det nya mötesformuläret. För att ställa in specifika detaljer om det avtal du har tänkt på, tryck på varje textrad på formuläret för att visa inställningar för den detaljen. Du kan ställa in datum, tid, plats och mer med ...

Redaktörens val

Externa kontroller på Canon Rebel T5i / 700D-kameran - dummies

Externa kontroller på Canon Rebel T5i / 700D-kameran - dummies

Få hjälp med att hitta knapparna, ratt och andra externa kontroller på din Canon Rebel T5i / 700D dSLR digitalkamera. Spela in filmer, spela upp bilder och välja fotograferingslägen börjar här. Linsen som visas på den digitala kameran nedan är Canon EF-S 18-55 mm (S (Bildstabiliserings) -modell som säljs med kameran. Andra objektiv kan variera. ...

Exponeringslägen för Canon EOS Rebel T3 Series-kameror - dummies

Exponeringslägen för Canon EOS Rebel T3 Series-kameror - dummies

Den allra första inställningen för bildtagning överväga med din Canon Rebel T3 eller T3i är exponeringsläget, som du väljer via lägesratten. Ditt val bestämmer hur mycket kontroll du har över två kritiska exponeringsinställningar - bländare och slutartid - liksom många andra alternativ, inklusive de som är relaterade till färg ...

Redaktörens val

Hur man säkrar din webbhotellsserver server - dummies

Hur man säkrar din webbhotellsserver server - dummies

Säkerhet är en stor sak online och Det finns inga magiska lösningar för att göra din webbhanteringsserver absolut säker, oavsett vad någon annan kan berätta för dig. Famously tidigare, säkra nätverk av banker, internationella företag, myndigheter, CIA, försvarsdepartementet - även Microsoft, Google och Apple - ...

Hur man konfigurerar webbhotell med webbhotell - dummies

Hur man konfigurerar webbhotell med webbhotell - dummies

När en användare begär en sida från Din webbplats, en av de saker som din webbplats gör är att returnera en statuskod på en fel sida, som signalerar antingen en framgång eller ett fel. Servern loggar alla dessa koder så att du kan se hur många sidor som blir fel och hur många är ...

Hur man uppdaterar webbhotellsserverprogramvaran - dummies

Hur man uppdaterar webbhotellsserverprogramvaran - dummies

Det finns ingen enda plats för att säkerställa att alla webbhotellsserverprogramvaror är aktuella. Det finns helt enkelt för många olika programstycken och olika alternativ för att göra det möjligt. Du kan dock göra vissa serveruppdateringar automatiskt eller manuellt genom att använda följande metoder: Automatiska WHM-uppdateringar Så här konfigurerar du servern ...