Hey,
ich hab folgendes Problem:
Muss nun bald ne Clusteranalyse durchführen und meine Ergebnisse/mein Vorgehen präsentieren. Hab mich heute mal drangesetzt und komme an folgender Stelle nicht weiter:
Ich hab ne Itembatterie mit 6-8 Variablen, die alle metrisch (1-7) codiert sind und damit ne hierarchische Clusteranalyse nach WARD-Verfahren durchgeführt. Distanzmaß quadrierte euklidische Distanz. Klappt auch alles, soweit ich das nachvollziehen kann, wunderbar, komme auf 4 Cluster und speicher diese ab (Variable "CLU4_1").
Mein Problem liegt nun dadrin, zu beschreiben, was die Cluster inhaltlich bedeuten. Im Prinzip würde mir nen Linienplot reichen, wo links die Mittelwerte (1-7), unten die 6-8 verschiedenen Variablen abgebildet werden und ich 4 verschiedene Linien angezeigt bekomme (für jedes Cluster eine), sodass ich vergleichen kann, wie sich die Mittelwerte der Antworten bei den verschiedenen Variablen unterscheiden.
Find darauf in meinen Büchern und in den 3 Scripten die ich habe keine Antwort oder bin einfach zu blöd. Das einzige was wir weitergeholfen hat, war ne Syntax, die ich aus dem Seminar hatte. Die war natürlich für nen anderen Datensatz udn ich konnte diese nun für meinen umschreiben, allerdings weiß ich an einer Stelle nicht was ich machen soll. Die Syntax sieht wie folgt aus:
Spoiler
Hab erst ne 3%ige Stichprobe gezogen und so ~100 Fälle in die Rechnung miteinbezogen
CLUSTER v71 v72 v73 v74 v75 v76
/METHOD WARD
/MEASURE=SEUCLID
/PRINT SCHEDULE
/PRINT DISTANCE
/PLOT DENDROGRAM VICICLE
/SAVE CLUSTER(4).
DATASET DECLARE XY.
AGGREGATE
/OUTFILE='XY'
/BREAK=CLU4_1
/v71_mean_1=MEAN(v71)
/v72_mean_1=MEAN(v72)
/v73_mean_1=MEAN(v73)
/v74_mean_1=MEAN(v74)
/v75_mean_1=MEAN(v75)
/v76_mean_1=MEAN(v76).
FLIP VARIABLES=v71_mean_1 v72_mean_1 v73_mean_1 v74_mean_1 v75_mean_1 v76_mean_1.
GRAPH
/LINE(MULTIPLE)=MEAN(var001) MEAN(var002) MEAN(var003) MEAN(var004) MEAN(var005) BY CASE_LBL
/MISSING=LISTWISE.
Die fettgeruckte Stelle, ist die Stelle, wo ich nciht weiß was ich machen soll. In meiner Beispielsyntax waren in der Clusteranalyse 40 Variablen (bei mir sinds nun 6, v71-v76) und dort wurden halt nur die ersten 4 Variablen "geflipt". Da ich nicht weiß, was dieser Befehl macht, weiß ich nun auch nicht, ob ich für meine Rechnung mit weniger Variablen hinter den FLIP Befehl alle Variablen packen muss oder nur eine oder ebenfalls 4. Weiß auch nich warum ich nach dem Flip Befehl dann var001 bis var005 habe und so weiter.
Dachte mir ich frage hier mal nach, ob mir jemand behilflich sein könnte, vielleicht weiß wo mein Problem liegt oder mir ne Beispielsytax schicken könnte. Wär super, wenn mir hier jmd. weiterhelfen könnte, würde mich bei umfangreicher Hilfe auch in meinen Möglichkeiten erkenntlich zeigen
Gruß Stefan
/edit:
Außerdem hab ich das Problem, dass der mir im Output jeden Graphen soooo breit anzeigt, dass es immer Minuten dauert bis der fertig geladen ist und ich den weder genau anschauen, noch benutzen kann. Vielleicht kann mir da ja auch wer helfen. Nutz leider SPSS16.