Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español

Los registros de salud provenientes de historias clínicas electrónicas (HCE) son una fuente valiosa de información para múltiples usos secundarios de investigación, planeamiento, etc. Sin embargo, son datos sensibles y se encuentran legalmente protegidos por su potencial impacto en derechos fundamen...

Descripción completa

Detalles Bibliográficos
Autores principales: Rajngewerc, Mariela, López, Sabrina, Silvi, Luciano, Ación, Laura, Alonso Alemany, Laura
Formato: Objeto de conferencia
Lenguaje:Español
Publicado: 2023
Materias:
Acceso en línea:http://sedici.unlp.edu.ar/handle/10915/166479
Aporte de:
id I19-R120-10915-166479
record_format dspace
spelling I19-R120-10915-1664792024-05-28T20:06:00Z http://sedici.unlp.edu.ar/handle/10915/166479 Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español Development and bias analysis of a de-identification model for electronic health records in Spanish Rajngewerc, Mariela López, Sabrina Silvi, Luciano Ación, Laura Alonso Alemany, Laura 2023-09 2023 2024-05-28T14:44:57Z es Ciencias Informáticas Historia clínica electrónica anonimización sesgos Los registros de salud provenientes de historias clínicas electrónicas (HCE) son una fuente valiosa de información para múltiples usos secundarios de investigación, planeamiento, etc. Sin embargo, son datos sensibles y se encuentran legalmente protegidos por su potencial impacto en derechos fundamentales, como el derecho a la intimidad o a la no discriminación (por ej. en el acceso al mercado de trabajo).Por ello, para adecuar los registros de salud a un uso secundario, resulta imprescindible aplicar procesos que eliminen aquella información que permita identificar al titular de los datos (desidentificación).En este trabajo presentamos una prueba de factibilidad de la desidentificación automática de texto libre en HCE. Se analizó una aproximación a la tarea, con especial atención a los potenciales sesgos en su funcionamiento, que pueden resultar en comportamientos discriminatorios. Teniendo en cuenta las particularidades de los datos: homogeneidad, heterogeneidad y proporción de entidades identificatorias, se aplicaron las métricas: Treatment Equality, Equal Opportunity, Equalized Odds y Conditional Use Accuracy Equality, para analizar la existencia de sesgos producidos por el modelo. Health records from electronic health records (EHR) are a valuable source of information for multiple secondary uses of research, planning, etc. However, they are sensitive data legally protected due to their potential impact on fundamental rights, such as the right to privacy or non-discrimination (for example, in access to the labor market).For this reason, to adapt health records to secondary use, it is essential to apply processes that eliminate information that allows the owner of the data to be identified (de-identification).This paper presents a feasibility test of the automatic de-identification of free text in EHR. An approach to the task was analyzed, with particular attention to the potential biases in its functioning, which can result in discriminatory behaviors. Taking into account the particularities of the data: homogeneity, heterogeneity, and proportion of identifying entities, the metrics: Treatment Equality, Equal Opportunity, Equalized Odds, and Conditional Use Accuracy Equality were applied to analyze the existence of biases produced by the model. Sociedad Argentina de Informática e Investigación Operativa Objeto de conferencia Objeto de conferencia http://creativecommons.org/licenses/by-nc-sa/4.0/ Creative Commons Attribution-NonCommercial-ShareAlike 4.0 International (CC BY-NC-SA 4.0) application/pdf 102-107
institution Universidad Nacional de La Plata
institution_str I-19
repository_str R-120
collection SEDICI (UNLP)
language Español
topic Ciencias Informáticas
Historia clínica electrónica
anonimización
sesgos
spellingShingle Ciencias Informáticas
Historia clínica electrónica
anonimización
sesgos
Rajngewerc, Mariela
López, Sabrina
Silvi, Luciano
Ación, Laura
Alonso Alemany, Laura
Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español
topic_facet Ciencias Informáticas
Historia clínica electrónica
anonimización
sesgos
description Los registros de salud provenientes de historias clínicas electrónicas (HCE) son una fuente valiosa de información para múltiples usos secundarios de investigación, planeamiento, etc. Sin embargo, son datos sensibles y se encuentran legalmente protegidos por su potencial impacto en derechos fundamentales, como el derecho a la intimidad o a la no discriminación (por ej. en el acceso al mercado de trabajo).Por ello, para adecuar los registros de salud a un uso secundario, resulta imprescindible aplicar procesos que eliminen aquella información que permita identificar al titular de los datos (desidentificación).En este trabajo presentamos una prueba de factibilidad de la desidentificación automática de texto libre en HCE. Se analizó una aproximación a la tarea, con especial atención a los potenciales sesgos en su funcionamiento, que pueden resultar en comportamientos discriminatorios. Teniendo en cuenta las particularidades de los datos: homogeneidad, heterogeneidad y proporción de entidades identificatorias, se aplicaron las métricas: Treatment Equality, Equal Opportunity, Equalized Odds y Conditional Use Accuracy Equality, para analizar la existencia de sesgos producidos por el modelo.
format Objeto de conferencia
Objeto de conferencia
author Rajngewerc, Mariela
López, Sabrina
Silvi, Luciano
Ación, Laura
Alonso Alemany, Laura
author_facet Rajngewerc, Mariela
López, Sabrina
Silvi, Luciano
Ación, Laura
Alonso Alemany, Laura
author_sort Rajngewerc, Mariela
title Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español
title_short Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español
title_full Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español
title_fullStr Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español
title_full_unstemmed Desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español
title_sort desarrollo y análisis de sesgos de un modelo de desidentificación de historias clínicas electrónicas en español
publishDate 2023
url http://sedici.unlp.edu.ar/handle/10915/166479
work_keys_str_mv AT rajngewercmariela desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol
AT lopezsabrina desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol
AT silviluciano desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol
AT acionlaura desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol
AT alonsoalemanylaura desarrolloyanalisisdesesgosdeunmodelodedesidentificaciondehistoriasclinicaselectronicasenespanol
AT rajngewercmariela developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish
AT lopezsabrina developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish
AT silviluciano developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish
AT acionlaura developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish
AT alonsoalemanylaura developmentandbiasanalysisofadeidentificationmodelforelectronichealthrecordsinspanish
_version_ 1807223111462944768