1000 resultados para Bootstrap par blocs
Resumo:
Suite à un stage avec la compagnie Hatch, nous possédons des jeux de données composés de séries chronologiques de vitesses de vent mesurées à divers sites dans le monde, sur plusieurs années. Les ingénieurs éoliens de la compagnie Hatch utilisent ces jeux de données conjointement aux banques de données d’Environnement Canada pour évaluer le potentiel éolien afin de savoir s’il vaut la peine d’installer des éoliennes à ces endroits. Depuis quelques années, des compagnies offrent des simulations méso-échelle de vitesses de vent, basées sur divers indices environnementaux de l’endroit à évaluer. Les ingénieurs éoliens veulent savoir s’il vaut la peine de payer pour ces données simulées, donc si celles-ci peuvent être utiles lors de l’estimation de la production d’énergie éolienne et si elles pourraient être utilisées lors de la prévision de la vitesse du vent long terme. De plus, comme l’on possède des données mesurées de vitesses de vent, l’on en profitera pour tester à partir de diverses méthodes statistiques différentes étapes de l’estimation de la production d’énergie. L’on verra les méthodes d’extrapolation de la vitesse du vent à la hauteur d’une turbine éolienne et l’on évaluera ces méthodes à l’aide de l’erreur quadratique moyenne. Aussi, on étudiera la modélisation de la vitesse du vent par la distributionWeibull et la variation de la distribution de la vitesse dans le temps. Finalement, l’on verra à partir de la validation croisée et du bootstrap si l’utilisation de données méso-échelle est préférable à celle de données des stations de référence, en plus de tester un modèle où les deux types de données sont utilisées pour prédire la vitesse du vent. Nous testerons la méthodologie globale présentement utilisée par les ingénieurs éoliens pour l’estimation de la production d’énergie d’un point de vue statistique, puis tenterons de proposer des changements à cette méthodologie, qui pourraient améliorer l’estimation de la production d’énergie annuelle.
Resumo:
Presently, conditions ensuring the validity of bootstrap methods for the sample mean of (possibly heterogeneous) near epoch dependent (NED) functions of mixing processes are unknown. Here we establish the validity of the bootstrap in this context, extending the applicability of bootstrap methods to a class of processes broadly relevant for applications in economics and finance. Our results apply to two block bootstrap methods: the moving blocks bootstrap of Künsch ( 989) and Liu and Singh ( 992), and the stationary bootstrap of Politis and Romano ( 994). In particular, the consistency of the bootstrap variance estimator for the sample mean is shown to be robust against heteroskedasticity and dependence of unknown form. The first order asymptotic validity of the bootstrap approximation to the actual distribution of the sample mean is also established in this heterogeneous NED context.
Resumo:
Nous développons dans cette thèse, des méthodes de bootstrap pour les données financières de hautes fréquences. Les deux premiers essais focalisent sur les méthodes de bootstrap appliquées à l’approche de "pré-moyennement" et robustes à la présence d’erreurs de microstructure. Le "pré-moyennement" permet de réduire l’influence de l’effet de microstructure avant d’appliquer la volatilité réalisée. En se basant sur cette ap- proche d’estimation de la volatilité intégrée en présence d’erreurs de microstructure, nous développons plusieurs méthodes de bootstrap qui préservent la structure de dépendance et l’hétérogénéité dans la moyenne des données originelles. Le troisième essai développe une méthode de bootstrap sous l’hypothèse de Gaussianité locale des données financières de hautes fréquences. Le premier chapitre est intitulé: "Bootstrap inference for pre-averaged realized volatility based on non-overlapping returns". Nous proposons dans ce chapitre, des méthodes de bootstrap robustes à la présence d’erreurs de microstructure. Particulièrement nous nous sommes focalisés sur la volatilité réalisée utilisant des rendements "pré-moyennés" proposés par Podolskij et Vetter (2009), où les rendements "pré-moyennés" sont construits sur des blocs de rendements à hautes fréquences consécutifs qui ne se chevauchent pas. Le "pré-moyennement" permet de réduire l’influence de l’effet de microstructure avant d’appliquer la volatilité réalisée. Le non-chevauchement des blocs fait que les rendements "pré-moyennés" sont asymptotiquement indépendants, mais possiblement hétéroscédastiques. Ce qui motive l’application du wild bootstrap dans ce contexte. Nous montrons la validité théorique du bootstrap pour construire des intervalles de type percentile et percentile-t. Les simulations Monte Carlo montrent que le bootstrap peut améliorer les propriétés en échantillon fini de l’estimateur de la volatilité intégrée par rapport aux résultats asymptotiques, pourvu que le choix de la variable externe soit fait de façon appropriée. Nous illustrons ces méthodes en utilisant des données financières réelles. Le deuxième chapitre est intitulé : "Bootstrapping pre-averaged realized volatility under market microstructure noise". Nous développons dans ce chapitre une méthode de bootstrap par bloc basée sur l’approche "pré-moyennement" de Jacod et al. (2009), où les rendements "pré-moyennés" sont construits sur des blocs de rendements à haute fréquences consécutifs qui se chevauchent. Le chevauchement des blocs induit une forte dépendance dans la structure des rendements "pré-moyennés". En effet les rendements "pré-moyennés" sont m-dépendant avec m qui croît à une vitesse plus faible que la taille d’échantillon n. Ceci motive l’application d’un bootstrap par bloc spécifique. Nous montrons que le bloc bootstrap suggéré par Bühlmann et Künsch (1995) n’est valide que lorsque la volatilité est constante. Ceci est dû à l’hétérogénéité dans la moyenne des rendements "pré-moyennés" au carré lorsque la volatilité est stochastique. Nous proposons donc une nouvelle procédure de bootstrap qui combine le wild bootstrap et le bootstrap par bloc, de telle sorte que la dépendance sérielle des rendements "pré-moyennés" est préservée à l’intérieur des blocs et la condition d’homogénéité nécessaire pour la validité du bootstrap est respectée. Sous des conditions de taille de bloc, nous montrons que cette méthode est convergente. Les simulations Monte Carlo montrent que le bootstrap améliore les propriétés en échantillon fini de l’estimateur de la volatilité intégrée par rapport aux résultats asymptotiques. Nous illustrons cette méthode en utilisant des données financières réelles. Le troisième chapitre est intitulé: "Bootstrapping realized covolatility measures under local Gaussianity assumption". Dans ce chapitre nous montrons, comment et dans quelle mesure on peut approximer les distributions des estimateurs de mesures de co-volatilité sous l’hypothèse de Gaussianité locale des rendements. En particulier nous proposons une nouvelle méthode de bootstrap sous ces hypothèses. Nous nous sommes focalisés sur la volatilité réalisée et sur le beta réalisé. Nous montrons que la nouvelle méthode de bootstrap appliquée au beta réalisé était capable de répliquer les cummulants au deuxième ordre, tandis qu’il procurait une amélioration au troisième degré lorsqu’elle est appliquée à la volatilité réalisée. Ces résultats améliorent donc les résultats existants dans cette littérature, notamment ceux de Gonçalves et Meddahi (2009) et de Dovonon, Gonçalves et Meddahi (2013). Les simulations Monte Carlo montrent que le bootstrap améliore les propriétés en échantillon fini de l’estimateur de la volatilité intégrée par rapport aux résultats asymptotiques et les résultats de bootstrap existants. Nous illustrons cette méthode en utilisant des données financières réelles.
Resumo:
Conditional heteroskedasticity is an important feature of many macroeconomic and financial time series. Standard residual-based bootstrap procedures for dynamic regression models treat the regression error as i.i.d. These procedures are invalid in the presence of conditional heteroskedasticity. We establish the asymptotic validity of three easy-to-implement alternative bootstrap proposals for stationary autoregressive processes with m.d.s. errors subject to possible conditional heteroskedasticity of unknown form. These proposals are the fixed-design wild bootstrap, the recursive-design wild bootstrap and the pairwise bootstrap. In a simulation study all three procedures tend to be more accurate in small samples than the conventional large-sample approximation based on robust standard errors. In contrast, standard residual-based bootstrap methods for models with i.i.d. errors may be very inaccurate if the i.i.d. assumption is violated. We conclude that in many empirical applications the proposed robust bootstrap procedures should routinely replace conventional bootstrap procedures for autoregressions based on the i.i.d. error assumption.
Resumo:
Le sujet principal de cette thèse porte sur l'étude de l'estimation de la variance d'une statistique basée sur des données d'enquête imputées via le bootstrap (ou la méthode de Cyrano). L'application d'une méthode bootstrap conçue pour des données d'enquête complètes (en absence de non-réponse) en présence de valeurs imputées et faire comme si celles-ci étaient de vraies observations peut conduire à une sous-estimation de la variance. Dans ce contexte, Shao et Sitter (1996) ont introduit une procédure bootstrap dans laquelle la variable étudiée et l'indicateur de réponse sont rééchantillonnés ensemble et les non-répondants bootstrap sont imputés de la même manière qu'est traité l'échantillon original. L'estimation bootstrap de la variance obtenue est valide lorsque la fraction de sondage est faible. Dans le chapitre 1, nous commençons par faire une revue des méthodes bootstrap existantes pour les données d'enquête (complètes et imputées) et les présentons dans un cadre unifié pour la première fois dans la littérature. Dans le chapitre 2, nous introduisons une nouvelle procédure bootstrap pour estimer la variance sous l'approche du modèle de non-réponse lorsque le mécanisme de non-réponse uniforme est présumé. En utilisant seulement les informations sur le taux de réponse, contrairement à Shao et Sitter (1996) qui nécessite l'indicateur de réponse individuelle, l'indicateur de réponse bootstrap est généré pour chaque échantillon bootstrap menant à un estimateur bootstrap de la variance valide même pour les fractions de sondage non-négligeables. Dans le chapitre 3, nous étudions les approches bootstrap par pseudo-population et nous considérons une classe plus générale de mécanismes de non-réponse. Nous développons deux procédures bootstrap par pseudo-population pour estimer la variance d'un estimateur imputé par rapport à l'approche du modèle de non-réponse et à celle du modèle d'imputation. Ces procédures sont également valides même pour des fractions de sondage non-négligeables.
Resumo:
Mémoire numérisé par la Division de la gestion de documents et des archives de l'Université de Montréal
Resumo:
Copyright © 2013 Springer Netherlands.
Resumo:
Este trabalho avaliou a fauna de Arctiinae em Altamira, Pará, numa área com forte ação antrópica, por meio de armadilhas luminosas, com capturas de duas noites a cada fase de lua nova por mês, no período de dezembro de 2007 a novembro de 2008. Na avaliação foram utilizados os parâmetros: riqueza, abundância, constância, índices de diversidade e uniformidade de Shannon (H e E) e Brillouin (H e E), dominância de Berger-Parker (BP). As estimativas de riqueza foram feitas através dos procedimentos não paramétricos, Bootstrap, Chao 1, Chao 2, Jackknife 1, Jackknife 2 e Michaelis-Mentem. Foram capturados 420 espécimes pertencentes a 64 táxons de Arctiinae, sendo 19 espécies registradas pela primeira vez no estado do Pará. Os valores dos parâmetros analisados para todo o período foram: H= 4,69, E= 0,781, H= 4,37, E= 0,732 e BP= 0,183. Durante o período menos chuvoso (junho-novembro) foram encontrados os valores mais significativos para todos os parâmetros analisados. No período mais chuvoso (dezembro-maio) foram encontrados os mais significativos percentuais de similaridade entre os meses. Os estimadores previram o encontro de mais espécies, entre 18,7% a 60,9%.
Resumo:
O presente estudo avaliou a fauna de Arctiinae numa área de pastagem na Amazônia Oriental em Altamira-Pará, por meio de armadilha luminosa, com duas capturas mensais noturnas a cada fase da lua nova, no período de dezembro de 2008 a novembro de 2010. Foram avaliados os seguintes parâmetros: riqueza, abundância, dominância, constância, índices de diversidade e uniformidade de Shannon (H' e E') e Brillouin (H e E), dominância de Berger-Parker (BP). As estimativas de riqueza foram feitas através dos procedimentos não paramétricos, "Bootstrap", "Chao1", "Chao2", "Jackknife1", "Jackknife2", e "Michaelis-Mentem". Foram capturados 910 exemplares pertencentes a 85 espécies de Arctiinae. Os valores dos parâmetros analisados para o período total foram: H'= 2,58, E'= 0,581, H= 2,45, E= 0,576 e BP= 0,433. Para os anos, tanto a riqueza quanto a abundância foi maior em 2009-2010. A diversidade e uniformidade de Shannon e Brillouin foram maiores para o ano de 2008-2009. Os estimadores previram um aumento entre 18,8% e 85,9 % na riqueza de espécies.
Resumo:
Investigation of the aetiology of viral meningitis in Brazil is most often restricted to cases that occur in the Southern and Southeastern Regions; therefore, the purpose of this study is to describe the viral meningitis cases that occurred in state of Pará, Northern Brazil, from January 2005-December 2006. The detection of enterovirus (EV) in cerebrospinal fluid was performed using cell culture techniques, RT-PCR, nested PCR and nucleotide sequencing. The ages of the 91 patients ranged from < one year old to > 60 years old (median age 15.90 years). Fever (87.1%), headache (77.0%), vomiting (61.5%) and stiffness (61.5%) were the most frequent symptoms. Of 91 samples analyzed, 18 (19.8%) were positive for EV. Twelve were detected only by RT- PCR followed by nested PCR, whereas six were found by both cell culture and RT-PCR. From the last group, five were sequenced and classified as echovirus 30 (Echo 30). Phylogenetic analyses revealed that Echo 30 detected in Northern Brazil clustered within a unique group with a bootstrap value of 100% and could constitute a new subgroup (4c) according to the phylogenetic tree described by Oberste et al. (1999). This study described the first molecular characterization of Echo 30 in Brazil and this will certainly contribute to future molecular analyses involving strains detected in other regions of Brazil.
Resumo:
Nous nous sommes intéressés à l’analyse et à la mise à jour d’une typologie de l’aide reçue par les personnes âgées de 65 ans et plus vivant à domicile. Cette étude secondaire s’est basée sur les données recueuillies dans deux milieux francophones, Hochelaga-Maisonneuve (HM) et Moncton (MCT). La collecte de données avait été faite par l’entremise d’un questionnaire administré par entrevue face à face. Les deux objectifs, de cette thèse sont : 1) Établir une typologie des réseaux d’aide, résultant de la combinaison des sources d’aide et des tâches accomplies ; 2) Identifier les principaux déterminants d’appartenance aux réseaux. La typologie obtenue met en relation les ressources, formelles ou informelles, utilisées par les personnes âgées et l’aide instrumentale reçue. La capacité ou l’incapacité à effectuer neuf activités de la vie quotidienne et huit de la vie domestique ont servi à évaluer l’aide reçue. Six ressources formelles et dix informelles ont été examinées selon qu’elles étaient les 1ères, 2ièmes ou 3ièmes sources d’aide utilisées par les personnes âgées. L’approche privilégiée s’est inspirée de celle des réseaux sociaux et du modèle de Pescosolido. C’est l’influence des caractéristiques sociodémographiques des personnes âgées, de leurs états de santé, de leurs habitudes de vie sur leurs réseaux qui nous ont intéressés. Les résultats sont présentés à chaque fois pour nos deux milieux séparément. Nous commençons par un descriptif des sources d’aide utilisées et des aides reçues. Puis les profils des sources d’aide utilisées et des activités accomplies sont exposés pour l’ensemble des personnes âgées. Ces profils servent de base pour obtenir notre typologie. Elle comprend cinq catégories. Ces catégories sont toutes composées de personnes âgées faisant appel à de l’aide formelle, informelle ou mixte pour accomplir des tâches uniques ou multiples. La première catégorie « Transitoire », comprend 39% (HM) et 46% (MCT) des personnes âgées qui débute un processus d’incapacité. Elles font appel à des ressources informelles pour accomplir une tâche unique. La deuxième catégorie « Personnes âgées seules » en rassemble 14% (HM et MCT), majoritairement des femmes, avec peu d’incapacités. Ces dernières utilisent de l’aide formelle pour une tâche unique. La troisième catégorie « Familiale » regroupe 12% (HM et MCT) des personnes âgées bien entourées qui ont plusieurs incapacités. Ces gens font appel à des sources d’aide informelles pour réaliser des tâches multiples. La quatrième catégorie « Très fragile » rassemble 30% (HM) et 25% (MCT) des personnes âgées peu entourées ayant beaucoup d’incapacités. Elles utilisent des ressources d’aide mixtes pour effectuer des tâches multiples. La cinquième catégorie « Pré institutionnel » comprend 4% (HM et MCT) des personnes âgées qui ont le plus d’incapacités et qui sont seules. Ces gens font appel à de l’aide formelle pour des tâches multiples. Les déterminants d’appartenance à ces catégories proviennent des blocs sociodémographiques, état de santé et réseaux sociaux de notre modèle théorique. Une des contributions importantes de cette thèse a été de pouvoir identifier cinq catégories bien distinctes composant une typologie de l’aide reçue, indépendamment du milieu, par des personnes âgées vivant à domicile. MOTS CLÉS : Typologie, réseaux sociaux, personnes âgées, services de soins, formels, informels, aides reçues, sources d’aide, incapacités, déterminants d’appartenance, fragilité
Resumo:
L'activité cérébrale, reliée spécifiquement à la rétention d'information en mémoire à court-terme tactile, a été investiguée à l'aide de l'enregistrement des champs magnétiques produits par l'activité neuronale générée durant la période de rétention par une tâche de mémoire tactile. Une, deux, trois ou quatre positions, sur une possibilité de huit sur les phalangines et les phalangettes, de la main gauche ou droite, lors de blocs d'essai différents, ont été stimulées simultanément. Le patron de stimulation tactile devait être retenu pendant 1800 ms avant d'être comparé avec un patron test qui était, soit identique, soit différent par une seule position. Nos analyses se sont concentrées sur les régions du cerveau qui montraient une augmentation monotone du niveau d'activité soutenu durant la période de rétention pour un nombre croissant de positions à retenir dans le patron de stimulation. Ces régions ont plus de chance de participer à la rétention active de l'information à maintenir en mémoire à court-terme tactile. Le gyrus cingulaire (BA32), le gyrus frontal supérieur droit (BA 8), le precuneus gauche (BA 7, 19), le gyrus postcentral gauche (BA 7), le gyrus precentral droit (BA 6), le gyrus frontal supérieur gauche (BA 6) et le lobule pariétal inférieur droit (BA 40) semblent tous impliqués dans un réseau mnésique qui maintient les informations sensorielles tactiles dans un système de mémoire à court-terme spécialisé pour l'information tactile.
Resumo:
Thomas G. Brown, Ph.D., co-directeur de recherche
Resumo:
Le réalisme des images en infographie exige de créer des objets (ou des scènes) de plus en plus complexes, ce qui entraîne des coûts considérables. La modélisation procédurale peut aider à automatiser le processus de création, à simplifier le processus de modification ou à générer de multiples variantes d'une instance d'objet. Cependant même si plusieurs méthodes procédurales existent, aucune méthode unique permet de créer tous les types d'objets complexes, dont en particulier un édifice complet. Les travaux réalisés dans le cadre de cette thèse proposent deux solutions au problème de la modélisation procédurale: une solution au niveau de la géométrie de base, et l’autre sous forme d'un système général adapté à la modélisation des objets complexes. Premièrement, nous présentons le bloc, une nouvelle primitive de modélisation simple et générale, basée sur une forme cubique généralisée. Les blocs sont disposés et connectés entre eux pour constituer la forme de base des objets, à partir de laquelle est extrait un maillage de contrôle pouvant produire des arêtes lisses et vives. La nature volumétrique des blocs permet une spécification simple de la topologie, ainsi que le support des opérations de CSG entre les blocs. La paramétrisation de la surface, héritée des faces des blocs, fournit un soutien pour les textures et les fonctions de déplacements afin d'appliquer des détails de surface. Une variété d'exemples illustrent la généralité des blocs dans des contextes de modélisation à la fois interactive et procédurale. Deuxièmement, nous présentons un nouveau système de modélisation procédurale qui unifie diverses techniques dans un cadre commun. Notre système repose sur le concept de composants pour définir spatialement et sémantiquement divers éléments. À travers une série de déclarations successives exécutées sur un sous-ensemble de composants obtenus à l'aide de requêtes, nous créons un arbre de composants définissant ultimement un objet dont la géométrie est générée à l'aide des blocs. Nous avons appliqué notre concept de modélisation par composants à la génération d'édifices complets, avec intérieurs et extérieurs cohérents. Ce nouveau système s'avère général et bien adapté pour le partionnement des espaces, l'insertion d'ouvertures (portes et fenêtres), l'intégration d'escaliers, la décoration de façades et de murs, l'agencement de meubles, et diverses autres opérations nécessaires lors de la construction d'un édifice complet.
Resumo:
Le but de cette thèse est d étendre la théorie du bootstrap aux modèles de données de panel. Les données de panel s obtiennent en observant plusieurs unités statistiques sur plusieurs périodes de temps. Leur double dimension individuelle et temporelle permet de contrôler l 'hétérogénéité non observable entre individus et entre les périodes de temps et donc de faire des études plus riches que les séries chronologiques ou les données en coupe instantanée. L 'avantage du bootstrap est de permettre d obtenir une inférence plus précise que celle avec la théorie asymptotique classique ou une inférence impossible en cas de paramètre de nuisance. La méthode consiste à tirer des échantillons aléatoires qui ressemblent le plus possible à l échantillon d analyse. L 'objet statitstique d intérêt est estimé sur chacun de ses échantillons aléatoires et on utilise l ensemble des valeurs estimées pour faire de l inférence. Il existe dans la littérature certaines application du bootstrap aux données de panels sans justi cation théorique rigoureuse ou sous de fortes hypothèses. Cette thèse propose une méthode de bootstrap plus appropriée aux données de panels. Les trois chapitres analysent sa validité et son application. Le premier chapitre postule un modèle simple avec un seul paramètre et s 'attaque aux propriétés théoriques de l estimateur de la moyenne. Nous montrons que le double rééchantillonnage que nous proposons et qui tient compte à la fois de la dimension individuelle et la dimension temporelle est valide avec ces modèles. Le rééchantillonnage seulement dans la dimension individuelle n est pas valide en présence d hétérogénéité temporelle. Le ré-échantillonnage dans la dimension temporelle n est pas valide en présence d'hétérogénéité individuelle. Le deuxième chapitre étend le précédent au modèle panel de régression. linéaire. Trois types de régresseurs sont considérés : les caractéristiques individuelles, les caractéristiques temporelles et les régresseurs qui évoluent dans le temps et par individu. En utilisant un modèle à erreurs composées doubles, l'estimateur des moindres carrés ordinaires et la méthode de bootstrap des résidus, on montre que le rééchantillonnage dans la seule dimension individuelle est valide pour l'inférence sur les coe¢ cients associés aux régresseurs qui changent uniquement par individu. Le rééchantillonnage dans la dimen- sion temporelle est valide seulement pour le sous vecteur des paramètres associés aux régresseurs qui évoluent uniquement dans le temps. Le double rééchantillonnage est quand à lui est valide pour faire de l inférence pour tout le vecteur des paramètres. Le troisième chapitre re-examine l exercice de l estimateur de différence en di¤érence de Bertrand, Duflo et Mullainathan (2004). Cet estimateur est couramment utilisé dans la littérature pour évaluer l impact de certaines poli- tiques publiques. L exercice empirique utilise des données de panel provenant du Current Population Survey sur le salaire des femmes dans les 50 états des Etats-Unis d Amérique de 1979 à 1999. Des variables de pseudo-interventions publiques au niveau des états sont générées et on s attend à ce que les tests arrivent à la conclusion qu il n y a pas d e¤et de ces politiques placebos sur le salaire des femmes. Bertrand, Du o et Mullainathan (2004) montre que la non-prise en compte de l hétérogénéité et de la dépendance temporelle entraîne d importantes distorsions de niveau de test lorsqu'on évalue l'impact de politiques publiques en utilisant des données de panel. Une des solutions préconisées est d utiliser la méthode de bootstrap. La méthode de double ré-échantillonnage développée dans cette thèse permet de corriger le problème de niveau de test et donc d'évaluer correctement l'impact des politiques publiques.