32 resultados para Multivari
Resumo:
Les logiciels utilisés sont Splus et R.
Resumo:
La prééclampsie est responsable du quart des mortalités maternelles et est la deuxième cause de décès maternels associés à la grossesse au Canada et dans le monde. L’identification d’une stratégie efficace pour la prévention de la prééclampsie est une priorité et un défi primordial dans les milieux de recherche en obstétrique. Le rôle des éléments nutritifs dans le développement de la prééclampsie a récemment reçu davantage d’attention. Plusieurs études cliniques et épidémiologiques ont été menées pour déterminer les facteurs de risque alimentaires potentiels et examiner les effets d’une supplémentation nutritive dans le développement de troubles hypertensifs de la grossesse. Pour déterminer les effets de suppléments antioxydants pris pendant la grossesse sur le risque d’hypertension gestationnelle (HG) et de prééclampsie, un essai multicentrique contrôlé à double insu a été mené au Canada et au Mexique (An International Trial of Antioxidants in the Prevention of Preeclampsia – INTAPP). Les femmes, stratifiées par risque, étaient assignées au traitement expérimental quotidien (1 gramme de vitamine C et 400 UI de vitamine E) ou au placebo. En raison des effets secondaires potentiels, le recrutement pour l’essai a été arrêté avant que l’échantillon complet ait été constitué. Au total, 2640 femmes éligibles ont accepté d’être recrutées, dont 2363 (89.5%) furent incluses dans les analyses finales. Nous n’avons retrouvé aucune évidence qu’une supplémentation prénatale de vitamines C et E réduisait le risque d’HG et de ses effets secondaires (RR 0,99; IC 95% 0,78-1,26), HG (RR 1,04; IC 95% 0,89-1,22) et prééclampsie (RR 1,04; IC 95% 0,75-1,44). Toutefois, une analyse secondaire a révélé que les vitamines C et E augmentaient le risque de « perte fœtale ou de décès périnatal » (une mesure non spécifiée au préalable) ainsi qu’une rupture prématurée des membranes avant terme. Nous avons mené une étude de cohorte prospective chez les femmes enceintes recrutées dans l’INTAPP afin d’évaluer les relations entre le régime alimentaire maternel en début et fin de grossesse et le risque de prééclampsie et d’HG. Un questionnaire de fréquence alimentaire validé était administré deux fois pendant la grossesse (12-18 semaines, 32-34 semaines). Les analyses furent faites séparément pour les 1537 Canadiennes et les 799 Mexicaines en raison de l’hétérogénéité des régimes alimentaires des deux pays. Parmi les canadiennes, après ajustement pour l’indice de masse corporelle (IMC) précédant la grossesse, le groupe de traitement, le niveau de risque (élevé versus faible) et les autres facteurs de base, nous avons constaté une association significative entre un faible apport alimentaire (quartile inférieur) de potassium (OR 1,79; IC 95% 1,03-3,11) et de zinc (OR 1,90; IC 95% 1,07-3,39) et un risque augmenté de prééclampsie. Toujours chez les Canadiennes, le quartile inférieur de consommation d’acides gras polyinsaturés était associé à un risque augmenté d’HG (OR 1,49; IC 95% 1,09-2,02). Aucun des nutriments analysés n’affectait les risques d’HG ou de prééclampsie chez les Mexicaines. Nous avons entrepris une étude cas-témoins à l’intérieur de la cohorte de l’INTAPP pour établir le lien entre la concentration sérique de vitamines antioxydantes et le risque de prééclampsie. Un total de 115 cas de prééclampsie et 229 témoins ont été inclus. Les concentrations de vitamine E ont été mesurées de façon longitudinale à 12-18 semaines (avant la prise de suppléments), à 24-26 semaines et à 32-34 semaines de grossesse en utilisant la chromatographie liquide de haute performance. Lorsqu’examinée en tant que variable continue et après ajustement multivarié, une concentration de base élevée de gamma-tocophérol était associée à un risque augmenté de prééclampsie (quartile supérieur vs quartile inférieur à 24-26 semaines : OR 2,99, IC 95% 1,13-7,89; à 32-34 semaines : OR 4,37, IC 95% 1,35-14,15). Nous n’avons pas trouvé de lien entre les concentrations de alpha-tocophérol et le risque de prééclampsie. En résumé, nous n’avons pas trouvé d’effets de la supplémentation en vitamines C et E sur le risque de prééclampsie dans l’INTAPP. Nous avons toutefois trouvé, dans la cohorte canadienne, qu’une faible prise de potassium et de zinc, tel qu’estimée par les questionnaires de fréquence alimentaire, était associée à un risque augmenté de prééclampsie. Aussi, une plus grande concentration sérique de gamma-tocophérol pendant la grossesse était associée à un risque augmenté de prééclampsie.
Resumo:
Les modèles de séries chronologiques avec variances conditionnellement hétéroscédastiques sont devenus quasi incontournables afin de modéliser les séries chronologiques dans le contexte des données financières. Dans beaucoup d'applications, vérifier l'existence d'une relation entre deux séries chronologiques représente un enjeu important. Dans ce mémoire, nous généralisons dans plusieurs directions et dans un cadre multivarié, la procédure dévéloppée par Cheung et Ng (1996) conçue pour examiner la causalité en variance dans le cas de deux séries univariées. Reposant sur le travail de El Himdi et Roy (1997) et Duchesne (2004), nous proposons un test basé sur les matrices de corrélation croisée des résidus standardisés carrés et des produits croisés de ces résidus. Sous l'hypothèse nulle de l'absence de causalité en variance, nous établissons que les statistiques de test convergent en distribution vers des variables aléatoires khi-carrées. Dans une deuxième approche, nous définissons comme dans Ling et Li (1997) une transformation des résidus pour chaque série résiduelle vectorielle. Les statistiques de test sont construites à partir des corrélations croisées de ces résidus transformés. Dans les deux approches, des statistiques de test pour les délais individuels sont proposées ainsi que des tests de type portemanteau. Cette méthodologie est également utilisée pour déterminer la direction de la causalité en variance. Les résultats de simulation montrent que les tests proposés offrent des propriétés empiriques satisfaisantes. Une application avec des données réelles est également présentée afin d'illustrer les méthodes
Resumo:
Contexte: la survenue d’IRA chez les patients ayant subi un traumatisme est une problématique qui a été peu étudiée jusqu’à ce jour. La présence de cette atteinte rénale a été démontrée comme étant associée à un risque accru de morbidités et de mortalité chez les sujets atteints. Objectifs: identifier les facteurs prédictifs d’insuffisance rénale ou plus récemment appelée atteinte rénale dans cette population particulière et tenter de trouver des facteurs qui peuvent être mesurés dans les premières heures de la prise en charge du patient. Aussi, nous avons cherché à savoir si l’injection de produit de contraste est associée à un risque accru d’insuffisance rénale aiguë dans cette population. Méthodes et résultats: la recherche a eu lieu à l’Hôpital du Sacré-Coeur de Montréal, un centre de traumatologie tertiaire en milieu urbain. Nous avons utilisé le registre des patients hospitalisés en traumatologie dans notre centre hospitalier entre 2002 et mars 2007 de même que les banques de données de laboratoire et de radiologie pour obtenir les données sur la créatinine et les examens avec produits de contraste. Finalement, une revue de dossiers structurée fut conduite pour recueillir le reste de l’information requise. L’incidence d’IRA dans la population étudiée est estimée à environ 5 %. Une analyse cas témoins fut conduite pour identifier les facteurs prédictifs d’IRA. Quarante-neuf cas d’IRA diagnostiqués par le médecin traitant et 101 témoins sélectionnés au hasard ont été analysés. Les facteurs prédictifs suivants ont été identifiés à l’analyse univariée : la première valeur de créatinine obtenue (p<0,001), l’instabilité hémodynamique (p<0,001), les antécédents d’insuffisance rénale chronique tels que notés dans le dossier par le médecin traitant (p=0,009), une maladie cardiaque (p=0,007), une chirurgie dans les 48 premières heures suivant le traumatisme (p=0,053), le niveau de gravité du traumatisme (Injury Severity Score) (p=0,046) et l’injection de produit de contraste au cours des 48 heures suivant le trauma (p=0,077). Parmi ces facteurs, deux ont été identifiés comme prédicteurs indépendants d’IRA à l’analyse multivariée. Une des valeurs était la première valeur de créatinine obtenue RC = 6,17 (p<0,001, IC95 % 2,81 – 13,53) pour chaque augmentation de 0.5mg/dL de créatinine. L’autre facteur était la présence d’instabilité hémodynamique RC 11,61 (p<0,001, IC95 % 3,71 – 36,29). Conclusion: des informations obtenues tôt dans la prise en charge du patient permettent de prédire le risque d’IRA chez ces patients. L’administration de contraste (intraveineuse ou intra-artérielle) ne s’est pas avérée un facteur indépendant de prédiction d’insuffisance rénale aiguë dans cette population dans le modèle multivarié.
Resumo:
L’utilisation des mesures d’isolement et de contentions en milieu psychiatrique intrahospitalier se produit fréquemment en réponse à des comportements agressifs et continue de soulever la controverse. À cet égard, de plus en plus d’études tendent à démontrer que le personnel soignant travaillant sur ces unités est influencé par plusieurs facteurs de nature différente, notamment la perception de l’agressivité, quand vient le temps de prendre une décision quant à l’utilisation (ou non) de ces mesures coercitives. Méthodologie : Plus de trois cents membres du personnel soignant travaillant en milieu psychiatrique intrahospitalier ont été recrutés dans huit établissements psychiatriques du Québec. Dans un premier temps, un questionnaire leur a été distribué afin de mettre en relief les différents facteurs (individuels et organisationnels) ayant un impact sur l’utilisation des mesures coercitives. Simultanément, l’analyse factorielle de la version française de deux échelles permettant de mesurer la perception de l’agressivité en milieu hospitalier (le MOAS et le POAS) a été faite. Résultats : Un modèle final multivarié a démontré que le type d’unité psychiatrique, l’expression de la colère et de l’agressivité parmi les membres de l’équipe de soins, la perception de la fréquence de gestes autoagressifs et la perception de mesures de sécurité insuffisantes dans le milieu de travail étaient des prédicteurs indépendants de l’utilisation de procédures d’isolement et de contentions. L’analyse factorielle a pour sa part mis en évidence une structure à 4 facteurs pour le MOAS et à 3 facteurs pour le POAS, conformément à ce que l’on retrouvait dans la littérature scientifique. Conclusion : Ces résultats soulignent l’importance des facteurs organisationnels par rapport aux facteurs individuels dans l’utilisation des mesures coercitives en psychiatrie et la nécessité d’évaluer les perceptions quant à l’agressivité et à la sécurité chez le personnel soignant. En comprenant mieux les phénomènes qui amènent leur utilisation, il sera possible de trouver des alternatives aux mesures d’isolement et de contentions et ainsi réduire le recours à ces dernières.
Resumo:
La pollution microbienne des eaux récréatives peut engendrer un risque pour la santé des populations exposées. La contamination fécale de ces eaux représente une composante importante de ce risque, notamment par la présence possible d’agents pathogènes et par l’exposition à des micro-organismes résistants aux antimicrobiens. Les sources de pollution fécale sont multiples et incluent entre autres les activités agricoles et les productions animales. Ce projet visait donc à mieux comprendre les facteurs influençant la qualité microbiologique des eaux récréatives du Québec méridional, en ciblant le rôle possible des activités agricoles, ainsi qu`à proposer et évaluer de nouvelles sources de données pouvant contribuer à l’identification de ces facteurs. Dans un premier temps, une évaluation de la présence d’Escherichia coli résistants aux antimicrobiens dans les eaux récréatives à l’étude a été effectuée. À la lumière des résultats de cette première étude, ces eaux représenteraient une source de micro-organismes résistants aux antimicrobiens pour les personnes pratiquant des activités aquatiques, mais l’impact en santé publique d’une telle exposition demeure à déterminer. Les déterminants agroenvironnementaux associés à la présence de micro-organismes résistants aux antimicrobiens ont par la suite été explorés. Les résultats de ce chapitre suggèrent que les activités agricoles, et plus spécifiquement l’épandage de fumier liquide, seraient reliées à la contamination des eaux récréatives par des bactéries résistantes aux antimicrobiens. Le chapitre suivant visait à identifier des déterminants agroenvironnementaux temps-indépendants d’importance associés à la contamination fécale des eaux à l’étude. Différentes variables, regroupées en trois classes (activités agricoles, humaines et caractéristiques géohydrologiques), ont été explorées à travers un modèle de régression logistique multivarié. Il en est ressorti que les eaux récréatives ayant des sites de productions de ruminants à proximité, et en particulier à l’intérieur d’un rayon de 2 km, possédaient un risque plus élevé de contamination fécale. Une association positive a également été notée entre le niveau de contamination fécale et le fait que les plages soient situées à l’intérieur d’une zone urbaine. Cette composante nous permet donc de conclure qu’en regard à la santé publique, les eaux récréatives pourraient être contaminées par des sources de pollution fécale tant animales qu’humaines, et que celles-ci pourraient représenter un risque pour la santé des utilisateurs. Pour terminer, un modèle de régression logistique construit à l’aide de données issues de la télédétection et mettant en association un groupe de déterminants agroenvironnementaux et la contamination fécale des eaux récréatives a été mis au point. Ce chapitre visait à évaluer l’utilité de telles données dans l’identification de ces déterminants, de même qu`à discuter des avantages et contraintes associées à leur emploi dans le contexte de la surveillance de la qualité microbiologique des eaux récréatives. À travers cette étude, des associations positives ont été mises en évidence entre le niveau de contamination fécale des eaux et la superficie des terres agricoles adjacentes, de même qu’avec la présence de surfaces imperméables. Les données issues des images d’observation de la Terre pourraient donc constituer une valeur ajoutée pour les programmes de suivi de la qualité microbiologique de ces eaux en permettant une surveillance des déterminants y étant associés.
Resumo:
Les calculs statistiques ont été effectués à l'aide du logiciel SPSS.
Resumo:
Ma thèse est composée de trois chapitres reliés à l'estimation des modèles espace-état et volatilité stochastique. Dans le première article, nous développons une procédure de lissage de l'état, avec efficacité computationnelle, dans un modèle espace-état linéaire et gaussien. Nous montrons comment exploiter la structure particulière des modèles espace-état pour tirer les états latents efficacement. Nous analysons l'efficacité computationnelle des méthodes basées sur le filtre de Kalman, l'algorithme facteur de Cholesky et notre nouvelle méthode utilisant le compte d'opérations et d'expériences de calcul. Nous montrons que pour de nombreux cas importants, notre méthode est plus efficace. Les gains sont particulièrement grands pour les cas où la dimension des variables observées est grande ou dans les cas où il faut faire des tirages répétés des états pour les mêmes valeurs de paramètres. Comme application, on considère un modèle multivarié de Poisson avec le temps des intensités variables, lequel est utilisé pour analyser le compte de données des transactions sur les marchés financières. Dans le deuxième chapitre, nous proposons une nouvelle technique pour analyser des modèles multivariés à volatilité stochastique. La méthode proposée est basée sur le tirage efficace de la volatilité de son densité conditionnelle sachant les paramètres et les données. Notre méthodologie s'applique aux modèles avec plusieurs types de dépendance dans la coupe transversale. Nous pouvons modeler des matrices de corrélation conditionnelles variant dans le temps en incorporant des facteurs dans l'équation de rendements, où les facteurs sont des processus de volatilité stochastique indépendants. Nous pouvons incorporer des copules pour permettre la dépendance conditionnelle des rendements sachant la volatilité, permettant avoir différent lois marginaux de Student avec des degrés de liberté spécifiques pour capturer l'hétérogénéité des rendements. On tire la volatilité comme un bloc dans la dimension du temps et un à la fois dans la dimension de la coupe transversale. Nous appliquons la méthode introduite par McCausland (2012) pour obtenir une bonne approximation de la distribution conditionnelle à posteriori de la volatilité d'un rendement sachant les volatilités d'autres rendements, les paramètres et les corrélations dynamiques. Le modèle est évalué en utilisant des données réelles pour dix taux de change. Nous rapportons des résultats pour des modèles univariés de volatilité stochastique et deux modèles multivariés. Dans le troisième chapitre, nous évaluons l'information contribuée par des variations de volatilite réalisée à l'évaluation et prévision de la volatilité quand des prix sont mesurés avec et sans erreur. Nous utilisons de modèles de volatilité stochastique. Nous considérons le point de vue d'un investisseur pour qui la volatilité est une variable latent inconnu et la volatilité réalisée est une quantité d'échantillon qui contient des informations sur lui. Nous employons des méthodes bayésiennes de Monte Carlo par chaîne de Markov pour estimer les modèles, qui permettent la formulation, non seulement des densités a posteriori de la volatilité, mais aussi les densités prédictives de la volatilité future. Nous comparons les prévisions de volatilité et les taux de succès des prévisions qui emploient et n'emploient pas l'information contenue dans la volatilité réalisée. Cette approche se distingue de celles existantes dans la littérature empirique en ce sens que ces dernières se limitent le plus souvent à documenter la capacité de la volatilité réalisée à se prévoir à elle-même. Nous présentons des applications empiriques en utilisant les rendements journaliers des indices et de taux de change. Les différents modèles concurrents sont appliqués à la seconde moitié de 2008, une période marquante dans la récente crise financière.
Resumo:
Nous y introduisons une nouvelle classe de distributions bivariées de type Marshall-Olkin, la distribution Erlang bivariée. La transformée de Laplace, les moments et les densités conditionnelles y sont obtenus. Les applications potentielles en assurance-vie et en finance sont prises en considération. Les estimateurs du maximum de vraisemblance des paramètres sont calculés par l'algorithme Espérance-Maximisation. Ensuite, notre projet de recherche est consacré à l'étude des processus de risque multivariés, qui peuvent être utiles dans l'étude des problèmes de la ruine des compagnies d'assurance avec des classes dépendantes. Nous appliquons les résultats de la théorie des processus de Markov déterministes par morceaux afin d'obtenir les martingales exponentielles, nécessaires pour établir des bornes supérieures calculables pour la probabilité de ruine, dont les expressions sont intraitables.
Resumo:
L'objectif du présent mémoire vise à présenter des modèles de séries chronologiques multivariés impliquant des vecteurs aléatoires dont chaque composante est non-négative. Nous considérons les modèles vMEM (modèles vectoriels et multiplicatifs avec erreurs non-négatives) présentés par Cipollini, Engle et Gallo (2006) et Cipollini et Gallo (2010). Ces modèles représentent une généralisation au cas multivarié des modèles MEM introduits par Engle (2002). Ces modèles trouvent notamment des applications avec les séries chronologiques financières. Les modèles vMEM permettent de modéliser des séries chronologiques impliquant des volumes d'actif, des durées, des variances conditionnelles, pour ne citer que ces applications. Il est également possible de faire une modélisation conjointe et d'étudier les dynamiques présentes entre les séries chronologiques formant le système étudié. Afin de modéliser des séries chronologiques multivariées à composantes non-négatives, plusieurs spécifications du terme d'erreur vectoriel ont été proposées dans la littérature. Une première approche consiste à considérer l'utilisation de vecteurs aléatoires dont la distribution du terme d'erreur est telle que chaque composante est non-négative. Cependant, trouver une distribution multivariée suffisamment souple définie sur le support positif est plutôt difficile, au moins avec les applications citées précédemment. Comme indiqué par Cipollini, Engle et Gallo (2006), un candidat possible est une distribution gamma multivariée, qui impose cependant des restrictions sévères sur les corrélations contemporaines entre les variables. Compte tenu que les possibilités sont limitées, une approche possible est d'utiliser la théorie des copules. Ainsi, selon cette approche, des distributions marginales (ou marges) peuvent être spécifiées, dont les distributions en cause ont des supports non-négatifs, et une fonction de copule permet de tenir compte de la dépendance entre les composantes. Une technique d'estimation possible est la méthode du maximum de vraisemblance. Une approche alternative est la méthode des moments généralisés (GMM). Cette dernière méthode présente l'avantage d'être semi-paramétrique dans le sens que contrairement à l'approche imposant une loi multivariée, il n'est pas nécessaire de spécifier une distribution multivariée pour le terme d'erreur. De manière générale, l'estimation des modèles vMEM est compliquée. Les algorithmes existants doivent tenir compte du grand nombre de paramètres et de la nature élaborée de la fonction de vraisemblance. Dans le cas de l'estimation par la méthode GMM, le système à résoudre nécessite également l'utilisation de solveurs pour systèmes non-linéaires. Dans ce mémoire, beaucoup d'énergies ont été consacrées à l'élaboration de code informatique (dans le langage R) pour estimer les différents paramètres du modèle. Dans le premier chapitre, nous définissons les processus stationnaires, les processus autorégressifs, les processus autorégressifs conditionnellement hétéroscédastiques (ARCH) et les processus ARCH généralisés (GARCH). Nous présentons aussi les modèles de durées ACD et les modèles MEM. Dans le deuxième chapitre, nous présentons la théorie des copules nécessaire pour notre travail, dans le cadre des modèles vectoriels et multiplicatifs avec erreurs non-négatives vMEM. Nous discutons également des méthodes possibles d'estimation. Dans le troisième chapitre, nous discutons les résultats des simulations pour plusieurs méthodes d'estimation. Dans le dernier chapitre, des applications sur des séries financières sont présentées. Le code R est fourni dans une annexe. Une conclusion complète ce mémoire.
Resumo:
Objectif : Étudier l'association entre l’utilisation de contraceptifs hormonaux et le risque d'acquisition du VIH-1 chez les femmes au Malawi, en Afrique du Sud, en Zambie et au Zimbabwe. Devis : Analyses secondaires de 2887 femmes âgées de 17-55 ans ayant participé à l’étude HPTN 035, une étude de phase II/IIb sur l’efficacité de deux gels microbicides pour prévenir la transmission du VIH chez les femmes à risque. Méthodes : L'association entre l'utilisation de contraceptifs hormonaux et le risque d'acquisition du VIH-1 a été évaluée en utilisant des modèles de Cox. Des risques relatifs sont estimés où le groupe de référence est celui des femmes qui n’utilisent pas de contraceptifs hormonaux. De plus, un modèle multivarié de Cox est utilisé afin de contrôler pour les facteurs potentiellement confondants. Résultats : Les contraceptifs injectables ont été utilisés par 52,1% des femmes, alors que les contraceptifs oraux ont été utilisés par 20,7% de celles-ci. Pendant l'étude, il y a eu 192 séroconversions. L'incidence observée du VIH était de 2,28; 4,19 et 4,69 pour 100 personne-années pour les contraceptifs oraux, injectables et non hormonaux, respectivement. Lors de l’analyse multivariée, nous n'avons trouvé aucune association significative entre l’usage des contraceptifs hormonaux et l’acquisition du VIH-1. Le risque relatif ajusté (RRa) pour les contraceptifs oraux est de 0,573 (IC de 95% : [0,31-1,06]) et 0,981 (IC de 95% : [0,69 ; 1,39]) pour les contraceptifs injectables. Conclusions : Bien que cette étude ne démontre pas d’association entre l’usage des contraceptifs hormonaux et le VIH-1, nous concluons toutefois que ces méthodes de contraception ne protègent pas contre le VIH-1, et il est ainsi recommandé aux femmes utilisant des hormones contraceptives de toujours utiliser le condom pour prévenir l'infection au VIH-1.
Resumo:
Dans cette thèse, nous étudions quelques problèmes fondamentaux en mathématiques financières et actuarielles, ainsi que leurs applications. Cette thèse est constituée de trois contributions portant principalement sur la théorie de la mesure de risques, le problème de l’allocation du capital et la théorie des fluctuations. Dans le chapitre 2, nous construisons de nouvelles mesures de risque cohérentes et étudions l’allocation de capital dans le cadre de la théorie des risques collectifs. Pour ce faire, nous introduisons la famille des "mesures de risque entropique cumulatifs" (Cumulative Entropic Risk Measures). Le chapitre 3 étudie le problème du portefeuille optimal pour le Entropic Value at Risk dans le cas où les rendements sont modélisés par un processus de diffusion à sauts (Jump-Diffusion). Dans le chapitre 4, nous généralisons la notion de "statistiques naturelles de risque" (natural risk statistics) au cadre multivarié. Cette extension non-triviale produit des mesures de risque multivariées construites à partir des données financiéres et de données d’assurance. Le chapitre 5 introduit les concepts de "drawdown" et de la "vitesse d’épuisement" (speed of depletion) dans la théorie de la ruine. Nous étudions ces concepts pour des modeles de risque décrits par une famille de processus de Lévy spectrallement négatifs.
Resumo:
La plupart des modèles en statistique classique repose sur une hypothèse sur la distribution des données ou sur une distribution sous-jacente aux données. La validité de cette hypothèse permet de faire de l’inférence, de construire des intervalles de confiance ou encore de tester la fiabilité du modèle. La problématique des tests d’ajustement vise à s’assurer de la conformité ou de la cohérence de l’hypothèse avec les données disponibles. Dans la présente thèse, nous proposons des tests d’ajustement à la loi normale dans le cadre des séries chronologiques univariées et vectorielles. Nous nous sommes limités à une classe de séries chronologiques linéaires, à savoir les modèles autorégressifs à moyenne mobile (ARMA ou VARMA dans le cas vectoriel). Dans un premier temps, au cas univarié, nous proposons une généralisation du travail de Ducharme et Lafaye de Micheaux (2004) dans le cas où la moyenne est inconnue et estimée. Nous avons estimé les paramètres par une méthode rarement utilisée dans la littérature et pourtant asymptotiquement efficace. En effet, nous avons rigoureusement montré que l’estimateur proposé par Brockwell et Davis (1991, section 10.8) converge presque sûrement vers la vraie valeur inconnue du paramètre. De plus, nous fournissons une preuve rigoureuse de l’inversibilité de la matrice des variances et des covariances de la statistique de test à partir de certaines propriétés d’algèbre linéaire. Le résultat s’applique aussi au cas où la moyenne est supposée connue et égale à zéro. Enfin, nous proposons une méthode de sélection de la dimension de la famille d’alternatives de type AIC, et nous étudions les propriétés asymptotiques de cette méthode. L’outil proposé ici est basé sur une famille spécifique de polynômes orthogonaux, à savoir les polynômes de Legendre. Dans un second temps, dans le cas vectoriel, nous proposons un test d’ajustement pour les modèles autorégressifs à moyenne mobile avec une paramétrisation structurée. La paramétrisation structurée permet de réduire le nombre élevé de paramètres dans ces modèles ou encore de tenir compte de certaines contraintes particulières. Ce projet inclut le cas standard d’absence de paramétrisation. Le test que nous proposons s’applique à une famille quelconque de fonctions orthogonales. Nous illustrons cela dans le cas particulier des polynômes de Legendre et d’Hermite. Dans le cas particulier des polynômes d’Hermite, nous montrons que le test obtenu est invariant aux transformations affines et qu’il est en fait une généralisation de nombreux tests existants dans la littérature. Ce projet peut être vu comme une généralisation du premier dans trois directions, notamment le passage de l’univarié au multivarié ; le choix d’une famille quelconque de fonctions orthogonales ; et enfin la possibilité de spécifier des relations ou des contraintes dans la formulation VARMA. Nous avons procédé dans chacun des projets à une étude de simulation afin d’évaluer le niveau et la puissance des tests proposés ainsi que de les comparer aux tests existants. De plus des applications aux données réelles sont fournies. Nous avons appliqué les tests à la prévision de la température moyenne annuelle du globe terrestre (univarié), ainsi qu’aux données relatives au marché du travail canadien (bivarié). Ces travaux ont été exposés à plusieurs congrès (voir par exemple Tagne, Duchesne et Lafaye de Micheaux (2013a, 2013b, 2014) pour plus de détails). Un article basé sur le premier projet est également soumis dans une revue avec comité de lecture (Voir Duchesne, Lafaye de Micheaux et Tagne (2016)).
Resumo:
La plupart des modèles en statistique classique repose sur une hypothèse sur la distribution des données ou sur une distribution sous-jacente aux données. La validité de cette hypothèse permet de faire de l’inférence, de construire des intervalles de confiance ou encore de tester la fiabilité du modèle. La problématique des tests d’ajustement vise à s’assurer de la conformité ou de la cohérence de l’hypothèse avec les données disponibles. Dans la présente thèse, nous proposons des tests d’ajustement à la loi normale dans le cadre des séries chronologiques univariées et vectorielles. Nous nous sommes limités à une classe de séries chronologiques linéaires, à savoir les modèles autorégressifs à moyenne mobile (ARMA ou VARMA dans le cas vectoriel). Dans un premier temps, au cas univarié, nous proposons une généralisation du travail de Ducharme et Lafaye de Micheaux (2004) dans le cas où la moyenne est inconnue et estimée. Nous avons estimé les paramètres par une méthode rarement utilisée dans la littérature et pourtant asymptotiquement efficace. En effet, nous avons rigoureusement montré que l’estimateur proposé par Brockwell et Davis (1991, section 10.8) converge presque sûrement vers la vraie valeur inconnue du paramètre. De plus, nous fournissons une preuve rigoureuse de l’inversibilité de la matrice des variances et des covariances de la statistique de test à partir de certaines propriétés d’algèbre linéaire. Le résultat s’applique aussi au cas où la moyenne est supposée connue et égale à zéro. Enfin, nous proposons une méthode de sélection de la dimension de la famille d’alternatives de type AIC, et nous étudions les propriétés asymptotiques de cette méthode. L’outil proposé ici est basé sur une famille spécifique de polynômes orthogonaux, à savoir les polynômes de Legendre. Dans un second temps, dans le cas vectoriel, nous proposons un test d’ajustement pour les modèles autorégressifs à moyenne mobile avec une paramétrisation structurée. La paramétrisation structurée permet de réduire le nombre élevé de paramètres dans ces modèles ou encore de tenir compte de certaines contraintes particulières. Ce projet inclut le cas standard d’absence de paramétrisation. Le test que nous proposons s’applique à une famille quelconque de fonctions orthogonales. Nous illustrons cela dans le cas particulier des polynômes de Legendre et d’Hermite. Dans le cas particulier des polynômes d’Hermite, nous montrons que le test obtenu est invariant aux transformations affines et qu’il est en fait une généralisation de nombreux tests existants dans la littérature. Ce projet peut être vu comme une généralisation du premier dans trois directions, notamment le passage de l’univarié au multivarié ; le choix d’une famille quelconque de fonctions orthogonales ; et enfin la possibilité de spécifier des relations ou des contraintes dans la formulation VARMA. Nous avons procédé dans chacun des projets à une étude de simulation afin d’évaluer le niveau et la puissance des tests proposés ainsi que de les comparer aux tests existants. De plus des applications aux données réelles sont fournies. Nous avons appliqué les tests à la prévision de la température moyenne annuelle du globe terrestre (univarié), ainsi qu’aux données relatives au marché du travail canadien (bivarié). Ces travaux ont été exposés à plusieurs congrès (voir par exemple Tagne, Duchesne et Lafaye de Micheaux (2013a, 2013b, 2014) pour plus de détails). Un article basé sur le premier projet est également soumis dans une revue avec comité de lecture (Voir Duchesne, Lafaye de Micheaux et Tagne (2016)).
Resumo:
Mémoire numérisé par la Direction des bibliothèques de l'Université de Montréal.