Arvutage andmehulga valimi dispersioon (s²) ja üldkogumi dispersioon (σ²).
Näidise dispersioon
Rahvastiku dispersioon
1. Aritmeetiline keskmine (x):
Lisand () / =
2. Lahutage kõigist andmetest keskmine ja ruudustage:
(xi - x)2 iga numbri jaoks
3. Erinevuste ruudu summa:
Σ(xi - x)2 =
4. Lõpliku dispersiooni arvutamine:
• Valimi dispersioon (s²): / ( - 1) =
• Populatsiooni dispersioon (σ²): / =
| # | xᵢ | xᵢ - x̄ | (xᵢ - x̄)² |
|---|---|---|---|
| Summa (Σ) | 0 |
Dispersioon on statistiline mõõt, mis kvantifitseerib andmehulga hajumist või varieeruvust selle statistilise keskmise suhtes. Põhimõtteliselt näitab dispersioon, kui kaugel on üksikud väärtused andmekogumi keskmisest.
Lihtsamalt öeldes, kui kõik kogumi andmed on üksteisega väga sarnased, on dispersioon väike, mis näitab väikest hajumist. Vastupidi, kui andmed oluliselt erinevad, on dispersioon suur, mis näitab suuremat hajumist.
Statistikas kasutatakse andmete hajuvuse mõõtmiseks kahte peamist dispersiooni tüüpi: valimi dispersioon ja populatsiooni dispersioon. Igaüht neist rakendatakse erinevates kontekstides olenevalt sellest, kas töötate valimi või kogu populatsiooniga.
Valimi dispersioon arvutatakse, kui saadaval on ainult üldkogumi valim. Seda kasutatakse üldkogumi dispersiooni hindamiseks ja see arvutatakse, jagades iga andmepunkti ja valimi keskmise erinevuste ruutude summa valimi andmepunktide arvuga, millest on lahutatud üks (n-1). See korrigeerimine, mida tuntakse Besseli korrektsioonina, korrigeerib populatsiooni dispersiooni hinnangu nihket.
Populatsiooni dispersioon arvutatakse siis, kui andmed on kättesaadavad kogu populatsiooni kohta. See saadakse, jagades iga andmepunkti ja üldkogumi keskmise vaheliste erinevuste ruutude summa üldkogumi andmepunktide koguarvuga (N). See valem ei vaja parandamist, kuna see põhineb kõigil saadaolevatel andmetel.
Dispersiooni arvutamiseks peate esmalt leidma oma andmete statistilise keskmise. Seejärel lahutage igast üksikust väärtusest arvutatud keskmine, ruudustage tulemus ja liitke need ruudud. Kui töötate valimiga, jagage ruutude summa valimi suurusega miinus üks (n-1). Kui töötate kogu populatsiooniga, jagage ruutude summa andmepunktide koguarvuga (N).
Kus:
Kus:
Statistiline keskmine x̄ saadakse kõigi valimi väärtuste liitmisel ja jagamisel andmepunktide koguarvuga.
Kus:
Dispersioon aitab teil mõista, kui järjepidevad või muutuvad andmed on komplektis. Kujutage ette, et hindate õpilaste rühma eksamitulemusi. Kui dispersioon on väike, tähendab see, et enamik õpilasi teenis sarnased hinded, mis viitab sellele, et eksam oli kõigi suhtes õiglane. Seevastu suur dispersioon näitab, et hinded on laialt hajutatud, mis võib viidata sellele, et mõnel õpilasel oli eksam palju raskem kui teistel.
Lühidalt, dispersioon võimaldab teil näha, kuidas andmed on rühmitatud keskmise ümber ja kas komplektis on palju või vähe varieeruvust.