whycomputer.com >> Počítačové znalosti >  >> Software

Jak číst výstup K‑Means v SPSS

Clusterová analýza je statistická technika, která seskupuje případy do kategorií tak, aby případy v jedné skupině byly co nejvíce podobné a zároveň se lišily od případů v jiných skupinách. Každá skupina se nazývá klastr. Sociální vědci často používají SPSS (Statistical Package for the Social Sciences) k provádění takových analýz. U algoritmu K‑Means výzkumník předem určuje požadovaný počet klastrů – označuje jej písmenem K. Tento algoritmus je vhodný i pro velké datové soubory.

Provádění analýzy v SPSS

Krok 1 – Výběr nástroje

V horní liště SPSS klikněte na Analyze, v rozbalovací nabídce vyberte Classify a poté K‑Means Cluster.

Krok 2 – Nastavení vzorku a proměnných

Vyberte soubor případů, které chcete analyzovat. V dialogovém okně klikněte na Variables a zaškrtněte proměnné, které mají být zahrnuty do první (pilotní) analýzy. Pomocí šipky přesunujte vybrané proměnné do pole Variables. Do pole Number of Clusters zadejte požadovaný počet klastrů (obvykle 5 u středně velkých datových souborů). Počet klastrů musí být alespoň 2 a nesmí převyšovat počet případů. Zaškrtněte Iterate and classify a poté Write final, aby se uložené centrály použily při finální analýze.

Krok 3 – Finální analýza

Použijte celý datový soubor. Opět zvolte Analyze → Classify → K‑Means Cluster. V dialogu vyberte stejné proměnné jako v kroku 2. Nastavte stejný počet klastrů (např. 5). Klikněte na Classify, v sekci Initial cluster centers zvolte Read Initial, aby se použily centrály získané z pilotního vzorku. Zaškrtněte Save a poté Cluster membership. Klikněte na Continue a spusťte analýzu.

Čtení výstupu

Krok 1 – Finální středy klastrů

První tabulka výstupu nese název Final Cluster Centers. V horní řadě jsou sloupce označené čísly 1‑5, což odpovídá jednotlivým klastrům. Levý sloupec uvádí názvy proměnných (např. REGR faktorový skóre). Hodnoty v řádcích představují průměrné skóre dané proměnné v jednotlivých klastrech.

Krok 2 – Počet případů v každém klastru

Druhá tabulka Number of Cases in each Cluster ukazuje, kolik případů bylo přiřazeno k jednotlivým klastrům. V levém sloupci jsou čísla klastrů (1‑5) a v pravém sloupci odpovídající počty případů.

Krok 3 – Příslušnost případů ke klastrům

Tabulka Cluster Membership obsahuje seznam všech případů (levý sloupec) a přiřazené číslo klastru (pravý sloupec). Pomocí této tabulky můžete zjistit, do kterého klastru konkrétní případ spadá.

Tip

  • Odstraňte extrémní hodnoty (outliery) před provedením analýzy, aby nedošlo k jejich zkreslení výsledků.

URL:https://cs.whycomputer.com/Software/100107233.html

Software
  • Jak zjistit, komu patří telefonní číslo

    Znám vám toto telefonní číslo? Možná máte číslo bez jména napsané na papíře nebo se objevilo na účtu za telefon, který nepoznáváte. Nebo jste našli zajímavý inzerát, ale po dlouhém rozhovoru s prodávajícím jste zjistili, že se předmět nachází 160 km daleko a cesta se nevyplatí. Reverzní vyhledávání

  • Jak zjistit počet souborů na pevném disku ve Windows

    Proč znát počet souborů na disku? Počet souborů na pevném disku vám pomůže lépe pochopit, jak je využíváno dostupné úložné místo a může ovlivnit výkon počítače. Následující jednoduchý postup vám ukáže, jak rychle získat tuto informaci ve Windows. Krok 1 – Otevřete Tento počítač Na ploše nebo v nabíd

Počítačové znalosti © https://cs.whycomputer.com