Hem Personliga finanser Tillämpning av huvudkomponentanalys till prediktiv analys - dummies

Tillämpning av huvudkomponentanalys till prediktiv analys - dummies

Video: Tillämpning av andragradsfunktioner 2025

Video: Tillämpning av andragradsfunktioner 2025
Anonim

Huvudkomponentanalysen (PCA) är en värdefull teknik som används allmänt i prediktiv analys och datavetenskap. Den studerar en dataset för att lära sig de mest relevanta variablerna som ansvarar för den högsta variationen i datasetet. PCA används mest som en datareduktionsteknik.

När du bygger prediktiva modeller kan du behöva minska antalet funktioner som beskriver datasetet. Det är väldigt användbart att minska denna höga dimensionering av data genom approximationstekniker, vid vilken PCA utmärker sig. Den approximerade data sammanfattar alla viktiga variationer av de ursprungliga data.

Exempelvis kan funktionsuppsättningen av data om lager innehålla aktiekurser, dagliga höjder och låga volymer, 200-dagars glidande medelvärden, prisfördelning, relativ styrka till andra marknader, räntor och styrka av valutor.

Att hitta de viktigaste prediktiva variablerna är kärnan i att bygga en prediktiv modell. Det sätt på vilket många har gjort det är att använda en brute force approach. Tanken är att börja med så många relevanta variabler som möjligt, och använd sedan en trappanordning för att eliminera funktioner som inte har någon inverkan eller inget prediktivt värde.

Intelligensen och insikten kommer till den här metoden genom att engagera affärsintressenter, eftersom de har några hunches om vilka variabler som kommer att få störst inverkan i analysen. Upplevelsen av datavetenskaparna som deltar i projektet är också viktigt för att veta vilka variabler som ska fungera med och vilka algoritmer som ska användas för en specifik datatyp eller ett domänspecifik problem.

För att hjälpa till med processen använder datavetenskapare många prediktiva analysverktyg som gör det enklare och snabbare att köra flera permutationer och analyser på en dataset för att mäta inverkan av varje variabel på datasetet.

Att veta att det finns en stor mängd data att arbeta med, kan du använda PCA för hjälp.

Att minska antalet variabler du tittar på är skäl nog att använda PCA. Genom att använda PCA skyddar du dessutom automatiskt mot övermontering av modellen.

Visst kan du hitta korrelation mellan väderdata i ett visst land och prestanda på aktiemarknaden. Eller med färgen på en persons skor och rutten som han eller hon tar till kontoret, och prestandan i deras portfölj för den dagen. Men inklusive de variablerna i en prediktiv modell är mer än bara övermontering, det är vilseledande och leder till falska förutsägelser.

PCA använder en matematiskt giltig metod för att bestämma delmängden av ditt dataset som innehåller de viktigaste funktionerna; När du bygger din modell på den mindre datamängden kommer du att ha en modell som har förutsägbart värde för den övergripande, större dataset du jobbar med. Kortfattat borde PCA hjälpa dig att känna av dina variabler genom att identifiera delmängden av variabler som ansvarar för den mest variationen med din ursprungliga dataset. Det hjälper dig att upptäcka redundans. Det hjälper dig att ta reda på att två (eller flera variabler) berättar samma sak.

Dessutom tar huvudkomponentanalys din multidimensionella dataset och producerar en ny dataset vars variabler är representativa för variablernas linjäritet i originaldatasetet. Dessutom har den utmatade datasatsen individuellt okorrelerade variabler, och deras varians ordnas av sina huvudkomponenter där den första är störst och så vidare. I detta avseende kan PCA också betraktas som en teknik för konstruktion av funktioner.

Medan du använder PCA eller andra liknande tekniker som bidrar till att minska dimensionerna för datasetet du har att göra med, måste du alltid vara försiktig så att den inte påverkar modellens prestanda negativt. Att minska storleken på data borde inte komma på bekostnad av att prestanda negativt påverkar prestandan (prediktionsmodellens noggrannhet). Skydda säkert och hantera din datablad med försiktighet.

Den ökade komplexiteten hos en modell översätter inte till högre kvalitet i utfallet.

För att behålla modellens prestanda kan du behöva noggrant utvärdera effektiviteten av varje variabel, mäta användbarheten vid utformningen av den slutliga modellen.

Att veta att PCA kan vara särskilt användbart när variablerna är högt korrelerade inom en given dataset, kan då en dataset med okorrelerade prediktiva variabler komplicera uppgiften att minska dimensioneringen av multivariata data. Många andra tekniker kan användas här förutom PCA, till exempel framåtval och avlägsnande av funktionen bakåt.

PCA är inte en magisk kula som löser alla problem med multidimensionell data. Dess framgång är mycket beroende av de data du jobbar med. Den statistiska variansen kanske inte anpassas till variabler med de mest förutsägda värdena, trots att det är säkert att arbeta med sådana approximationer.

Tillämpning av huvudkomponentanalys till prediktiv analys - dummies

Redaktörens val

Skapa multimediamixfiler med InDesign CS5 - dummies

Skapa multimediamixfiler med InDesign CS5 - dummies

Du kan exportera InDesign Creative Suite 5-dokument till Flash SWF så att de kan ses med hjälp av Flash Player eller redigeras med hjälp av Flash Professional. Sidövergångar kan användas och du kan också använda en interaktiv sidflip som inte är tillgänglig inom Acrobat. Gör så här för att exportera ditt InDesign-dokument till Flash:

Skapa text på ett sökväg i en InDesign CS5-publikation - dummies

Skapa text på ett sökväg i en InDesign CS5-publikation - dummies

Genom att placera text på en väg I en InDesign Creative Suite 5-publikation kan du kurva den längs en linje eller form. Text på en sökväg är särskilt användbar när du vill skapa intressanta titlingseffekter på en sida. Använd pennverktyget för att skapa en sökväg på sidan. Skapa minst en ...

Skapa textramar i InDesign CS5 - dummies

Skapa textramar i InDesign CS5 - dummies

Textramar innehåller vilken text du lägger till i en InDesign Creative Suite 5-publikation . Du kan skapa en ny textram i en InDesign CS5-publikation på många olika sätt: med verktyget Typ, Ramverktyg eller genom att skriva en form. Textramar skapas ibland automatiskt när du importerar text till en publikation. Skapa ...

Redaktörens val

Word 2010 Tangentbordsgenvägar - dummies

Word 2010 Tangentbordsgenvägar - dummies

Word 2010 erbjuder ett antal användbara kortkommandon för att snabbt utföra uppgifter. Här är några genvägar för vanlig Word-formatering, redigering och fil- och dokumentuppgifter. Word 2010 Formateringsgenvägar Kommando Genväg Band Plats Fet Ctrl + B Hemflik, Fontgrupp Kursiv Ctrl + I Hemflik, Teckengrupp Understruken Ctrl + U Hemflik, Teckengrupp Center Ctrl + E ...

Word 2007 För Dummies Cheat Sheet - Dummies

Word 2007 För Dummies Cheat Sheet - Dummies

Word 2007 ser annorlunda ut, men erbjuder fortfarande de praktiska Word-staplarna som Tangentbordsgenvägar som hjälper dig att skapa, formatera, infoga saker och flytta igenom dina Word-dokument. Och Word 2007 erbjuder också ett par nya funktioner för att hjälpa dig att hantera din ordbehandling med lätthet.

Word 2010 Ribbon Commands - dummies

Word 2010 Ribbon Commands - dummies

ÄR du vilse i bandet? Om du nyligen har uppgraderat från Word 2003 kan det vara utmanande att använda Word 2010-bandet för att utföra vanliga Word-operationer. För att göra övergången lättare, är här kommandona för Word 2010 för vanliga kommandon för Word 2003. Word 2003 Command Equivalent Word 2010 Kommandofil → Ny fil ...

Redaktörens val

Hur man använder SketchUps Push / Pull Tool - dummies

Hur man använder SketchUps Push / Pull Tool - dummies

Push / Pull-verktyget är en enkel varelse; Använd den för att extrudera platta ytor i 3D-former. Det fungerar (som allt annat i SketchUp) genom att klicka. Du klickar på ett ansikte en gång för att börja skjuta / dra den, flytta markören tills du gillar vad du ser och klicka sedan igen för att sluta trycka / dra. Det är allt. Push / Pull fungerar bara ...

Hur man använder SketchUps skuggningsfunktion - dummies

Hur man använder SketchUps skuggningsfunktion - dummies

Du ska använda en av SketchUps bästa funktioner: Skuggor. När du aktiverar Shadows aktiverar du SketchUps inbyggda sol. Skuggorna du ser i ditt modelleringsfönster är exakta för vilken tid och plats du ställer in. I det här exemplet är det dock inte oroande om noggrannhet. Gå igenom dessa steg för att låta ...

Hur man använder SketchUps stämpelverktyg - dummies

Hur man använder SketchUps stämpelverktyg - dummies

Så småningom kan du behöva plunka ner en byggnad (eller någon annan struktur) på terrängen som du har skapat kärleksfullt i SketchUp. Stämpelverktyget ger ett enkelt sätt att - du gissade det - stämpla ett byggfotavtryck i en terrängyta, skapa en platt "pad" för att sitta på. Detta verktyg ger också ...