Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

2
Quelle est la logique de la fonction de covariance de Matérn?
La fonction de covariance de Matérn est couramment utilisée comme fonction de noyau dans le processus gaussien. Il est défini comme ceci Cν(d)=σ221−νΓ(ν)(2ν−−√dρ)νKν(2ν−−√dρ)Cν(d)=σ221−νΓ(ν)(2νdρ)νKν(2νdρ) {\displaystyle C_{\nu }(d)=\sigma ^{2}{\frac {2^{1-\nu }}{\Gamma (\nu )}}{\Bigg (}{\sqrt {2\nu }}{\frac {d}{\rho }}{\Bigg )}^{\nu }K_{\nu }{\Bigg (}{\sqrt {2\nu }}{\frac {d}{\rho }}{\Bigg )}} où ddd est une fonction …



6
Le réglage d'hyperparamètre sur un échantillon de jeu de données est-il une mauvaise idée?
J'ai un ensemble de données de 140000 exemples et 30 fonctionnalités pour lesquelles je forme plusieurs classificateurs pour une classification binaire (SVM, régression logistique, forêt aléatoire, etc.) Dans de nombreux cas, le réglage hyperparamétrique de l'ensemble de données à l'aide de la recherche par grille ou aléatoire est trop coûteux …


2
Méthodologie de prévision VAR
Je construis un modèle VAR pour prévoir le prix d'un actif et je voudrais savoir si ma méthode est statistiquement solide, si les tests que j'ai inclus sont pertinents et si d'autres sont nécessaires pour assurer une prévision fiable basée sur mes variables d'entrée. Ci-dessous se trouve mon processus actuel …
19 r  forecasting  modeling  var 



1
Qualité de l'ajustement et quel modèle choisir la régression linéaire ou Poisson
J'ai besoin de conseils concernant deux dilemmes principaux dans ma recherche, qui est une étude de cas de 3 grands produits pharmaceutiques et de l'innovation. Le nombre de brevets par an est la variable dépendante. Mes questions sont Quels sont les critères les plus importants pour un bon modèle? Qu'est-ce …



5
Comment recoder une variable catégorielle en variable numérique lors de l'utilisation de SVM ou de Neural Network
Pour utiliser SVM ou Neural Network, il doit transformer (encoder) des variables catégorielles en variables numériques, la méthode normale dans ce cas est d'utiliser des valeurs binaires 0-1 avec la k-ème valeur catégorielle transformée en (0,0, .. ., 1,0, ... 0) (1 est en position k-ème). Existe-t-il d'autres méthodes pour …


3
Pourquoi la distribution t devient-elle plus normale à mesure que la taille de l'échantillon augmente?
Selon Wikipedia, je comprends que la distribution t est la distribution d'échantillonnage de la valeur t lorsque les échantillons sont des observations provenant d'une population normalement distribuée. Cependant, je ne comprends pas intuitivement pourquoi cela fait passer la forme de la distribution t de la queue grasse à presque parfaitement …

3
Distribution asymptotique de la variance de l'échantillon d'un échantillon non normal
Il s'agit d'un traitement plus général de la question posée par cette question . Après avoir dérivé la distribution asymptotique de la variance de l'échantillon, nous pouvons appliquer la méthode Delta pour arriver à la distribution correspondante pour l'écart type. Soit un échantillon de taille de iid variables aléatoires non …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.