Suscribirse

Optimisation de la constitution de cohortes issues de bases de données médico-administratives : mise à disposition d’un algorithme pour l’intégration et la normalisation des données adapté au Système national d’information inter-régimes de l’assurance maladie (SNIIRAM) - 16/09/16

Doi : 10.1016/j.respe.2016.02.011 
C. Ferdynus a, , b , L. Huiart a, b
a Unité de soutien méthodologique, département d’informatique médicale, CHU La-Réunion, allée des Topazes, CS11021, 97400 Saint-Denis, France 
b Inserm, CIC 1410, 97410 Saint-Pierre, France 

Auteur correspondant.

Bienvenido a EM-consulte, la referencia de los profesionales de la salud.
El acceso al texto completo de este artículo requiere una suscripción.

páginas 7
Iconografías 1
Vídeos 0
Otros 0

Résumé

Position du problème

Les bases médico-administratives telles que le SNIIRAM sont des sources de données incontournables pour répondre à de nombreuses questions de recherche en santé publique. L’exploitation des données contenues dans ces bases pour constituer des cohortes nécessite des traitements complexes et chronophages. L’objectif de notre travail était de développer et de mettre à disposition un outil permettant d’optimiser la constitution de cohortes issues de bases médico-administratives.

Méthodes

Nous avons développé un algorithme pour extraire, transformer et intégrer différentes sources de données hétérogènes dans un entrepôt de données normalisé. Cet entrepôt est architecturé selon un schéma en étoile correspondant au modèle i2b2. Nous avons ensuite évalué les performances de cet algorithme dans le cadre d’un projet de recherche en pharmaco-épidémiologie utilisant les bases de données du SNIIRAM.

Résultats

L’algorithme développé comprend un ensemble de fonctionnalités permettant la création de scripts SAS. Il permet d’intégrer des données dans un entrepôt normalisé. Dans le cadre de l’évaluation des performances de cet algorithme, nous avons pu intégrer plus de 900 000 000 de lignes provenant du SNIIRAM en moins de 3heures à l’aide d’un ordinateur de bureau. Nous avons ensuite pu sélectionner les patients de l’entrepôt ainsi obtenu avec des requêtes n’excédant pas quelques secondes.

Conclusion

L’algorithme présenté dans cet article permet de disposer d’un outil performant et compatible avec l’ensemble des bases de données médico-administratives, sans avoir recours à des serveurs de bases de données complexes. Cet outil permet ensuite de simplifier la constitution de cohortes issues de ces bases et, en raison de la normalisation de l’entrepôt de données, facilite le travail collaboratif entre équipes.

El texto completo de este artículo está disponible en PDF.

Abstract

Aim

Administrative health databases such as the French National Heath Insurance Database – SNIIRAM – are a major tool to answer numerous public health research questions. However the use of such data requires complex and time-consuming data management. Our objective was to develop and make available a tool to optimize cohort constitution within administrative health databases.

Methods

We developed a process to extract, transform and load (ETL) data from various heterogeneous sources in a standardized data warehouse. This data warehouse is architected as a star schema corresponding to an i2b2 star schema model. We then evaluated the performance of this ETL using data from a pharmacoepidemiology research project conducted in the SNIIRAM database.

Results

The ETL we developed comprises a set of functionalities for creating SAS scripts. Data can be integrated into a standardized data warehouse. As part of the performance assessment of this ETL, we achieved integration of a dataset from the SNIIRAM comprising more than 900 million lines in less than three hours using a desktop computer. This enables patient selection from the standardized data warehouse within seconds of the request.

Conclusion

The ETL described in this paper provides a tool which is effective and compatible with all administrative health databases, without requiring complex database servers. This tool should simplify cohort constitution in health databases; the standardization of warehouse data facilitates collaborative work between research teams.

El texto completo de este artículo está disponible en PDF.

Mots clés : Cohorte, SNIIRAM, I2b2, Pharmaco-épidémiologie, Base de données, SAS, Algorithme

Keywords : Cohort, SNIIRAM, I2b2, Pharmacoepidemiology, Database, SAS, Algorithm


Esquema


© 2016  Elsevier Masson SAS. Reservados todos los derechos.
Añadir a mi biblioteca Eliminar de mi biblioteca Imprimir
Exportación

    Exportación citas

  • Fichero

  • Contenido

Vol 64 - N° 4

P. 263-269 - septembre 2016 Regresar al número
Artículo precedente Artículo precedente
  • Substance use capital: Social resources enhancing youth substance use
  • S. Baggio, M. Mohler-Kuo, M. Dupuis, Y. Henchoz, J. Studer, A.A. N’Goran, G. Gmel
| Artículo siguiente Artículo siguiente
  • Couverture vaccinale et déterminants socioéconomiques de la vaccination BCG chez l’enfant avant 3 mois : résultats de la cohorte Elfe, 2011
  • J.-P. Guthmann, M. Ragot, M. Ben Boutieb, C. Bois, M.-N. Dufourg, D. Lévy-Bruhl

Bienvenido a EM-consulte, la referencia de los profesionales de la salud.
El acceso al texto completo de este artículo requiere una suscripción.

Bienvenido a EM-consulte, la referencia de los profesionales de la salud.
La compra de artículos no está disponible en este momento.

¿Ya suscrito a @@106933@@ revista ?

@@150455@@ Voir plus

Mi cuenta


Declaración CNIL

EM-CONSULTE.COM se declara a la CNIL, la declaración N º 1286925.

En virtud de la Ley N º 78-17 del 6 de enero de 1978, relativa a las computadoras, archivos y libertades, usted tiene el derecho de oposición (art.26 de la ley), el acceso (art.34 a 38 Ley), y correcta (artículo 36 de la ley) los datos que le conciernen. Por lo tanto, usted puede pedir que se corrija, complementado, clarificado, actualizado o suprimido información sobre usted que son inexactos, incompletos, engañosos, obsoletos o cuya recogida o de conservación o uso está prohibido.
La información personal sobre los visitantes de nuestro sitio, incluyendo su identidad, son confidenciales.
El jefe del sitio en el honor se compromete a respetar la confidencialidad de los requisitos legales aplicables en Francia y no de revelar dicha información a terceros.


Todo el contenido en este sitio: Copyright © 2026 Elsevier, sus licenciantes y colaboradores. Se reservan todos los derechos, incluidos los de minería de texto y datos, entrenamiento de IA y tecnologías similares. Para todo el contenido de acceso abierto, se aplican los términos de licencia de Creative Commons.