MCA-Rechner

Prüfe Zeilen, Variablen, Kategorien und Dimensionen kategorialer CSV-Daten als Grundlage einer multiplen Korrespondenzanalyse.

Kategoriale Datenstruktur analysieren
Füge eine Kopfzeile und mindestens zwei Beobachtungen ein und gib das Trennzeichen zwischen den Feldern an.

Dieses Browserwerkzeug prüft die MCA-taugliche Struktur und Dimensionalität. Für vollständige Inferenz ist Statistiksoftware nötig, die Singulärwerte, Koordinaten, Beiträge und Korrekturen berechnet.

Über die multiple Korrespondenzanalyse

Die multiple Korrespondenzanalyse, kurz MCA, ist ein exploratives Verfahren zum Auffinden von Mustern zwischen mehreren kategorialen Variablen. Sie erfüllt eine ähnliche Rolle wie die Hauptkomponentenanalyse, arbeitet aber mit Kategoriezugehörigkeiten statt kontinuierlichen Messwerten. Typische Eingaben sind Umfrageantworten, Symptome, Diagnosen, demografische Gruppen, Verhaltensweisen und Behandlungskategorien. Die MCA ordnet Beobachtungen und Kategorieausprägungen in einem niedrigdimensionalen geometrischen Raum an, um Zusammenhänge visuell und quantitativ zu untersuchen. Zu Beginn wird jede Kategorieausprägung als eigene Indikatorspalte dargestellt. Eine Beobachtung erhält in der Spalte ihrer Ausprägung eine Eins und in den übrigen Ausprägungen dieser Variablen null. Auf diese vollständige disjunktive Tabelle wird anschließend eine Korrespondenzanalyse mit Chi-Quadrat-Distanzen und Kategoriehäufigkeiten angewendet. Kategorien mit ähnlichen Antwortprofilen liegen in einer Karte tendenziell nahe beieinander; stark unterscheidende Kategorien können mehr zu einer Achse beitragen. Dieser Rechner übernimmt den wichtigen ersten Strukturschritt. Er liest eine getrennte Tabelle mit Variablennamen in der ersten Zeile, prüft die gleiche Feldzahl aller Zeilen, zählt Beobachtungen und Variablen und summiert die unterschiedlichen Kategorieausprägungen. Die maximale nichttriviale Dimensionalität hängt mit der Anzahl der Ausprägungen minus der Variablenzahl zusammen. Die Oberfläche meldet bis zu zwei unmittelbar darstellbare Dimensionen, berechnet aber keine Eigenwerte, Trägheit, Koordinaten oder statistische Signifikanz. Die Datenvorbereitung beeinflusst die Interpretation erheblich. Fehlende Werte sollten gezielt behandelt werden, nicht durch uneinheitlich leere Zellen. Seltene Kategorien können unverhältnismäßig starken Einfluss haben; abweichende Schreibweise oder Groß- und Kleinschreibung führt zu getrennten Kategorien. Kennungsspalten sollten meist keine aktiven Variablen sein, weil jede eindeutige Kennung eine eigene bedeutungslose Kategorie erzeugt. Kontinuierliche Werte sollten nur mit tragfähiger Begründung kategorisiert werden, da willkürliche Klasseneinteilung Information verliert. Ein vollständiger MCA-Ablauf prüft Eigenwerte oder korrigierte Trägheit, Beiträge, quadrierte Kosinuswerte, Kategorie- und Beobachtungskoordinaten sowie die Sensitivität gegenüber Kodierungsentscheidungen. Nähe in einer zweidimensionalen Karte bedeutet nicht automatisch Kausalität oder statistisch signifikanten Zusammenhang. Supplementäre Variablen können die Interpretation unterstützen, ohne die Achsen zu bestimmen; vorsichtig eingesetzte Clusteranalysen auf MCA-Koordinaten können Profile aufdecken. Prüfe mit dieser Strukturübersicht die Daten, bevor du etablierte Statistiksoftware verwendest und jede Vorverarbeitungsentscheidung dokumentierst.

Beispiele für MCA-Daten

Kleine kategoriale Tabellen zeigen, wie Beobachtungen und Ausprägungen den verfügbaren Raum bestimmen.

DatensatzStrukturInterpretation
3 Zeilen; Geschlecht und Raucherstatus2 Variablen; 4 Ausprägungen; 2 DimensionenJede binäre Variable liefert zwei verschiedene Kategorieausprägungen.
4 Zeilen; Ernährung, Bewegung und Schlaf3 Variablen; 7 Ausprägungen; 2 angezeigte DimensionenErnährung hat drei Ausprägungen, die beiden anderen Variablen jeweils zwei.
10 Zeilen; vier binäre Umfragefragen4 Variablen; bis zu 8 AusprägungenDie genaue Gesamtzahl hängt davon ab, ob beide Antworten in jeder Spalte vorkommen.

So bereitest du Daten für die MCA vor

  1. Schreibe Variablennamen in die erste Zeile und je eine Beobachtung in jede weitere Zeile.
  2. Vereinheitliche die Kategorieschreibweise und entferne Kennungs- oder Freitextspalten.
  3. Füge die Tabelle ein und gib das genaue einstellige Trennzeichen an.
  4. Wähle Kategoriale Daten analysieren und prüfe die Struktur vor der vollständigen Analyse.

Häufige Fragen zur MCA

Welche Daten kann die MCA analysieren?

Die MCA ist für mehrere kategoriale Variablen gedacht, darunter nominale und vorsichtig interpretierte ordinale Kategorien. Rohe kontinuierliche Messwerte erfordern meist ein anderes Verfahren oder eine begründete Kategorisierung.

Wie unterscheidet sich MCA von PCA?

PCA analysiert Varianz und lineare Beziehungen kontinuierlicher Variablen. MCA untersucht Zusammenhänge zwischen Kategorien durch Indikatorkodierung und Chi-Quadrat-Geometrie.

Was bedeutet Trägheit in der MCA?

Trägheit quantifiziert die Streuung der kategorialen Punktwolke und wird auf Dimensionen zerlegt. Rohe Prozentwerte können Korrekturen erfordern, da die Indikatorkodierung strukturelle Trägheit erzeugt.

Wie sollten fehlende Werte behandelt werden?

Wähle ein dokumentiertes, zur Studie passendes Verfahren, etwa explizite Fehlwertkategorien, Imputation oder Ausschluss. Verhindere uneinheitliche Zeilen durch versehentlich leere Felder.

Beweist Nähe in einer MCA-Karte einen Zusammenhang?

Nein. Koordinaten, Beiträge, Darstellungsqualität, Achsenträgheit, Stichprobendesign und inhaltlicher Kontext müssen gemeinsam geprüft werden.