Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español
Los registros de salud provenientes de historias clínicas electrónicas (HCE) son una fuente valiosa de información para múltiples usos secundarios de investigación, planeamiento, etc. Sin embargo, son datos sensibles y se encuentran legalmente protegidos por su potencial impacto en derechos fundamen...
Autores principales: | , , , , |
---|---|
Formato: | Objeto de conferencia |
Lenguaje: | Español |
Publicado: |
2023
|
Materias: | |
Acceso en línea: | http://sedici.unlp.edu.ar/handle/10915/166479 |
Aporte de: |
id |
I19-R120-10915-166479 |
---|---|
record_format |
dspace |
spelling |
I19-R120-10915-1664792024-05-28T20:06:00Z http://sedici.unlp.edu.ar/handle/10915/166479 Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español Development and bias analysis of a de-identification model for electronic health records in Spanish Rajngewerc, Mariela López, Sabrina Silvi, Luciano Ación, Laura Alonso Alemany, Laura 2023-09 2023 2024-05-28T14:44:57Z es Ciencias Informáticas Historia clínica electrónica anonimización sesgos Los registros de salud provenientes de historias clínicas electrónicas (HCE) son una fuente valiosa de información para múltiples usos secundarios de investigación, planeamiento, etc. Sin embargo, son datos sensibles y se encuentran legalmente protegidos por su potencial impacto en derechos fundamentales, como el derecho a la intimidad o a la no discriminación (por ej. en el acceso al mercado de trabajo).Por ello, para adecuar los registros de salud a un uso secundario, resulta imprescindible aplicar procesos que eliminen aquella información que permita identificar al titular de los datos (desidentificación).En este trabajo presentamos una prueba de factibilidad de la desidentificación automática de texto libre en HCE. Se analizó una aproximación a la tarea, con especial atención a los potenciales sesgos en su funcionamiento, que pueden resultar en comportamientos discriminatorios. Teniendo en cuenta las particularidades de los datos: homogeneidad, heterogeneidad y proporción de entidades identificatorias, se aplicaron las métricas: Treatment Equality, Equal Opportunity, Equalized Odds y Conditional Use Accuracy Equality, para analizar la existencia de sesgos producidos por el modelo. Health records from electronic health records (EHR) are a valuable source of information for multiple secondary uses of research, planning, etc. However, they are sensitive data legally protected due to their potential impact on fundamental rights, such as the right to privacy or non-discrimination (for example, in access to the labor market).For this reason, to adapt health records to secondary use, it is essential to apply processes that eliminate information that allows the owner of the data to be identified (de-identification).This paper presents a feasibility test of the automatic de-identification of free text in EHR. An approach to the task was analyzed, with particular attention to the potential biases in its functioning, which can result in discriminatory behaviors. Taking into account the particularities of the data: homogeneity, heterogeneity, and proportion of identifying entities, the metrics: Treatment Equality, Equal Opportunity, Equalized Odds, and Conditional Use Accuracy Equality were applied to analyze the existence of biases produced by the model. Sociedad Argentina de Informática e Investigación Operativa Objeto de conferencia Objeto de conferencia http://creativecommons.org/licenses/by-nc-sa/4.0/ Creative Commons Attribution-NonCommercial-ShareAlike 4.0 International (CC BY-NC-SA 4.0) application/pdf 102-107 |
institution |
Universidad Nacional de La Plata |
institution_str |
I-19 |
repository_str |
R-120 |
collection |
SEDICI (UNLP) |
language |
Español |
topic |
Ciencias Informáticas Historia clínica electrónica anonimización sesgos |
spellingShingle |
Ciencias Informáticas Historia clínica electrónica anonimización sesgos Rajngewerc, Mariela López, Sabrina Silvi, Luciano Ación, Laura Alonso Alemany, Laura Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español |
topic_facet |
Ciencias Informáticas Historia clínica electrónica anonimización sesgos |
description |
Los registros de salud provenientes de historias clínicas electrónicas (HCE) son una fuente valiosa de información para múltiples usos secundarios de investigación, planeamiento, etc. Sin embargo, son datos sensibles y se encuentran legalmente protegidos por su potencial impacto en derechos fundamentales, como el derecho a la intimidad o a la no discriminación (por ej. en el acceso al mercado de trabajo).Por ello, para adecuar los registros de salud a un uso secundario, resulta imprescindible aplicar procesos que eliminen aquella información que permita identificar al titular de los datos (desidentificación).En este trabajo presentamos una prueba de factibilidad de la desidentificación automática de texto libre en HCE. Se analizó una aproximación a la tarea, con especial atención a los potenciales sesgos en su funcionamiento, que pueden resultar en comportamientos discriminatorios. Teniendo en cuenta las particularidades de los datos: homogeneidad, heterogeneidad y proporción de entidades identificatorias, se aplicaron las métricas: Treatment Equality, Equal Opportunity, Equalized Odds y Conditional Use Accuracy Equality, para analizar la existencia de sesgos producidos por el modelo. |
format |
Objeto de conferencia Objeto de conferencia |
author |
Rajngewerc, Mariela López, Sabrina Silvi, Luciano Ación, Laura Alonso Alemany, Laura |
author_facet |
Rajngewerc, Mariela López, Sabrina Silvi, Luciano Ación, Laura Alonso Alemany, Laura |
author_sort |
Rajngewerc, Mariela |
title |
Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español |
title_short |
Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español |
title_full |
Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español |
title_fullStr |
Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español |
title_full_unstemmed |
Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español |
title_sort |
desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español |
publishDate |
2023 |
url |
http://sedici.unlp.edu.ar/handle/10915/166479 |
work_keys_str_mv |
AT rajngewercmariela desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol AT lopezsabrina desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol AT silviluciano desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol AT acionlaura desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol AT alonsoalemanylaura desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol AT rajngewercmariela developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish AT lopezsabrina developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish AT silviluciano developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish AT acionlaura developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish AT alonsoalemanylaura developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish |
_version_ |
1807223111462944768 |