Du befindest dich hier: FSI Informatik » Prüfungsfragen und Altklausuren » Nebenfächer » Aufgabe 1
Inhaltsverzeichnis
Gedächtnisprotokoll von der Klausur 2025, so gut ich mich erinnere. Bitte gerne ergänzen!
Die Aufgaben waren recht ausführlich und oft mehr Fragestellungen als Punkte im Fließtext enthalten.
Zeit war kein Problem.
Beim Berechnen der Werte (ohne Taschenrechner) wäre schriftliches Dividieren von zwei-bis dreistelligen Zahlen ggf. ein nützlicher Skill.
Aufgabe 1
[Abbildung, die als Symbolbild eine Tabelle von APACHE II zeigt]
- Was sagt der Apache-II-Score voraus?
- Inwiefern kombiniert der Apache-II-Score die explizite Modellierung von Wissen mit einer automatisierten Ableitung aus den Daten?
Aufgabe 2
(ähnlich medmining_aug2017, Aufgabe 9)
- Berechnen von Spezifität, Sensitivität und Missclassification Rate
- Warum kann Class-Imbalance bei der Interpretation der berechneten Werte irreführend sein?
Aufgabe 3
[Tabelle mit 4-Felder-Tafel (raucher/Nichtraucher vs Lunkenkrankheit/keine Lungenkrankheit]
- Berechne eine Maßzahl und ein Assoziationsmaß
- Interpretiere das Ergebnis des Assoziationsmaßes
Aufgabe 4
[Bild eines Entscheidungsbaums]
'R-Code:
library(rpart)
model ← rpart(Diabetes~ Gewicht, data = meineDaten, method = „class“)
x ← predict(model, newdata=c(110, 121, 180))
- Was für eine Art von Model ist gezeigt
- Was sind praktische Vorteile des Models?
- Welche Werte enthält x nach der Ausführung?
Aufgabe 5
[Gegeben ROC, in dem 2 Kurven waren für 2 verschiedene Verfahren. Ein Punkt auf einer der Kurve ist mit einem Pfeil markiert]
- Was Kennzeichnet der Punkt, bzw. welches Verhältnis?
- Wie kann man das Ergebnis für ein Verfahren in einer Maßzahl zusammenfassen (→ Vermute AUC)
- Schätze die Maßzahl für beide Verfahren und bewerten Sie im Hinblick auf die maximal möglichen Werte
- Welches Verfahren kann man zusätzlich dem im Diagramm gemessenen Diskriminierung zur Berechnung der Güte anwenden? (→ Vermute das war eine Referenz auf Kalibrierung und Verfahren wie Brier-Test)
Aufgabe 6
Was ist der Unterschied zwischen einem Data Warehouse und einem Data Lake in Hinsicht auf die Daten?
Aufgabe 7
Was ist Reproduktion und und Replikation? Welche technische Maßnahme (1 oder 2) gibt es, um Reproduzierbarkeit zu erreichen?
Aufgabe 8
[Bild eines Dendrogramms gegeben (siehe ältere Klausuren)]
- In wie viele Cluster sollten die Beobachtungen eingeteilt werden und warum?
- Erklären, was ein agglomeratives Verfahren ist
- Erklären, was complete Linkage ist
Aufgabe 9
Beschreiben Sie kurz die Funktion folgender R-Funktionen.
- tapply
- ecdf
- ifelse
- merge
- reshape
- table
- pairs
- [ + 1, habe vergessen welches, aber war schon in einer der Altklausuren]
Aufgabe 10
Welche Probleme treten bei der Analyse von zensierten Ereigniszeiten auf? Nennen Sie eine Methode, um zensierte Ereigniszeiten graphisch oder statistisch zu analysieren?
Aufgabe 11
Beim mittleren arteriellen Druck werden auch Schwankungen miteinberechnet. Welche statistischen oder grafischen Verfahren gibt es, die jeweils kurzfristige Schwankungen und Dauer eines zu niedrigen Blutdrucks feststellen
