Proxy-Variable

Eine Proxy-Variable (von lat.: proximus „der Nächste“) oder kurz einfach nur ein Proxy ist eine Stellvertreter-Variable, mithin eine Ersatzgröße, durch deren Messung man sich mittelbar Auskunft über eine andere Eigenschaft zu verschaffen versucht, die selbst einer Messung nicht ohne Weiteres zugänglich ist – jedenfalls nicht objektiv, nicht reliabel, nicht valide oder nicht mit vertretbarem Aufwand. Die Ergebnisse der Messung der Proxy-Variablen sollen also dabei helfen, eine Abschätzung über andere Variablen zu gewinnen. Wichtig ist zu beachten, dass die über Proxy-Variablen gewonnenen Messwerte nur eine ungefähre, innerhalb einer gewissen Streubreite liegende, Aussage über die Zielgröße erlauben. Wie groß diese Streubreite ist, darüber kann eine Korrelationsanalyse Auskunft geben.

Dies bedeutet andererseits, dass zwar die Bestimmung der Proxy-Variablen unter Umständen mit sehr hoher Güte und Genauigkeit vorgenommen werden kann, dies aber über die so erlangte Genauigkeit der Bestimmung der eigentlich zu messenden Variablen nichts aussagt. Entscheidend ist hier die Korrelation zwischen der Proxy-Variablen und der eigentlichen Zielvariablen.

Auf dem medizinischen Gebiet ist der Begriff des Surrogatmarkers nahe verwandt, mit dem man die Wirkung einer Therapie zu objektivieren versucht.

Beispiele für Proxy-Variablen

Probleme

Am letztgenannten Beispiel soll die Problematik der Proxy-Variablen näher erläutert werden. Die eigentliche Zielgröße ist z. B. die Fähigkeit einer Person zur Teilnahme am Straßenverkehr unter Alkoholeinfluss. Die bestmögliche Variable für deren Einschätzung wäre eigentlich die Alkoholkonzentration an den entsprechenden Stellen des Gehirns, die selbstverständlich nicht messbar ist (wobei aufgrund der interindividuellen Streubreite nicht einmal dieser Parameter eine völlig zuverlässige Aussage über die Verkehrstauglichkeit erlauben würde). Ersatzweise, also als Proxy-Variable, kommt die Alkoholkonzentration im Blut in Betracht: deutlich einfacher zu bestimmen, aber hinsichtlich der Zielgröße „Straßenverkehrstauglichkeit“ nicht ganz so zuverlässig; verantwortlich dafür sind die von Mensch zu Mensch unterschiedlichen Verteilungs- und Abbauvorgänge im Körper. Ersatzweise hierfür wiederum, also als Proxy-Variable der Proxy-Variablen, kommt schließlich die Atemalkoholkonzentration in Betracht: sie ist zwar noch weniger zuverlässig, aber dafür preisgünstig und mit minimalem Aufwand erhältlich. (Nur am Rande sei erwähnt, dass alle genannten Bestimmungen die Verhältnisse mit zeitlichem Verzug wiedergeben und so wiederum eine Streuung verursachen; die nach einem Verkehrsunfall ermittelte Blutalkoholkonzentration ist also selbst nur eine Proxy-Variable der Blutalkoholkonzentration zum Unfallzeitpunkt bzw. bei Fahrtantritt.)

Um die Abschätzung eines schwer zugänglichen Parameters zu verbessern, bedient man sich gern mehrerer Proxy-Variablen zugleich, nicht zuletzt in der Medizin (Beispiel: Blutzuckerkonzentration und Konzentration des HbA1C zur Abschätzung des Vorliegens bzw. des Schweregrades einer Zuckerkrankheit). Ähnliche Funktionen erfüllen die verschiedenen medinischen Score-Systeme, die z. B. Auskunft über den Schweregrad einer Krankheit oder die Überlebenschancen geben sollen (etwa: SOFA-Score, APACHE-Score).[1]

Einzelnachweise

  1. R. Pirrachio: Mortality Prediction in the ICU based on MIMIC-II results from the Super ICU Learner Algorithm (SICULA) Project. In: Secondary analysis of electronic health records. Springer, 10. September 2016, abgerufen am 4. Dezember 2021 (englisch).

Literatur

  • Helge Toutenburg, Götz Trenkler: Proxy variables and mean square error dominance in linear regression. In: Regensburger Beiträge zur Statistik und Ökonometrie. Band 28, 1991, S. 14 (englisch).
  • Götz Trenkler, Helge Toutenburg: Proxy variables and mean square error dominance in linear regression. In: Journal of Quantitative Economics. 8. Jahrgang, 1992, S. 433–442 (englisch).
  • Peter Stahlecker, Götz Trenkler: Some further results on the use of proxy variables in prediction. In: The Review of Economics and Statistics. 75. Jahrgang. The MIT Press, 1993, S. 707–711 (englisch).
  • Götz Trenkler, Peter Stahlecker: Dropping variables versus use of proxy variables in linear regression. In: Journal of Statistical Planning and Inference. 50. Jahrgang, Nr. 1. NORTH-HOLLAND, 1996, S. 65–75, doi:10.1016/0378-3758(95)00045-3 (englisch).

Content Disclaimer

Informasi ini disarikan dari Wikipedia dan disajikan kembali untuk tujuan edukasi. Konten tersedia di bawah lisensi CC BY-SA 3.0. Kami tidak bertanggung jawab atas ketidakakuratan data yang bersumber dari kontribusi publik tersebut.

  1. The information displayed on this website is sourced in part or in whole from Wikipedia and has been adapted for the purpose of restating it. We strive to provide accurate and relevant information, however:
  2. There is no guarantee of absolute accuracy. Wikipedia is an open, collaborative project that can be edited by anyone, so information is subject to change.
  3. It is not intended to constitute professional advice. The content displayed is for informational and educational purposes only. For important decisions (e.g., medical, legal, or financial), please consult a professional.
  4. Content copyright. Wikipedia is licensed under the Creative Commons Attribution-ShareAlike License (CC BY-SA). This means that content may be reused with appropriate attribution and shared under a similar license.
  5. Responsible use. Any risk arising from the use of information from this website is entirely the responsibility of the user.