Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

4
Dans un réseau neuronal convolutif (CNN), lors de la convolution de l'image, l'opération est-elle utilisée le produit scalaire ou la somme de la multiplication par élément?
L'exemple ci-dessous est tiré des conférences de deeplearning.ai montre que le résultat est la somme du produit élément par élément (ou "multiplication par élément". Les nombres rouges représentent les poids dans le filtre: ( 1 ∗ 1 ) + ( 1 ∗ 0 ) + ( 1 ∗ 1 ) …

2
Problèmes de causalité de Judea Pearl Book
Je commence à lire Causal Inference in Statistics, A Primer de Judea Pearl et. Al. J'ai une maîtrise en mathématiques, mais je n'ai jamais suivi de cours de statistique. Je suis un peu confus par l'une des premières questions de l'étude, et je ne peux poser aucune question à ce …
12 causality 


1
RMSE vs écart-type de la population
RMSE (erreur quadratique moyenne) et SD (écart-type) ont des formules similaires. Ce lien dit La seule différence est que vous divisez par et non par puisque vous ne soustrayez pas la moyenne de l'échantillon ici. Le RMSE correspondrait alors à . Par conséquent, la population RMSE est et vous voulez …



1
Distribution de l'erreur de somme des carrés pour la régression linéaire?
Je sais que la distribution de la variance de l'échantillon C'est du fait que peut être exprimée sous forme de matrice, (où A: symétrique), et elle pourrait être à nouveau exprimée en: (où Q: orthonormé, D: matrice diagonale). ∑(Xi−X¯)2σ2∼χ2(n−1)∑(Xi−X¯)2σ2∼χ(n−1)2 \sum\frac{(X_i-\bar{X})^2}{\sigma^2}\sim \chi^2_{(n-1)} ∑(Xi−X¯)2n−1∼σ2n−1χ2(n−1)∑(Xi−X¯)2n−1∼σ2n−1χ(n−1)2 \sum\frac{(X_i-\bar{X})^2}{n-1}\sim \frac{\sigma^2}{n-1}\chi^2_{(n-1)} (X−X¯)2(X−X¯)2(X-\bar{X})^2xAx′xAx′xAx'x′QDQ′xx′QDQ′xx'QDQ'x Qu'en est-il de , étant …

2
Comment dois-je gérer les variables catégorielles à plusieurs niveaux lors de l'élimination en amont?
Je fais un modèle d'élimination rétrograde simple basé sur AIC où certaines variables sont des variables catégorielles à plusieurs niveaux. Ces variables sont modélisées comme un ensemble de variables fictives. Lors d'une élimination en amont, dois-je supprimer tous les niveaux d'une variable ensemble? Ou dois-je traiter chaque variable fictive séparément? …



3
Comment discuter d'un nuage de points avec plusieurs lignes émergentes?
Nous avons mesuré deux variables et le nuage de points semble suggérer plusieurs modèles "linéaires". Y a-t-il un moyen d'essayer de distiller ces modèles? L'identification d'autres variables indépendantes s'est avérée difficile. Les deux variables sont fortement biaisées vers la gauche (vers les petits nombres), c'est une distribution attendue dans notre …


2
Ajustement de la régression linéaire multiple dans R: résidus autocorrélés
J'essaie d'estimer une régression linéaire multiple dans R avec une équation comme celle-ci: regr <- lm(rate ~ constant + askings + questions + 0) les demandes et les questions sont des séries chronologiques de données trimestrielles, construites avec askings <- ts(...). Le problème est que j'ai obtenu des résidus autocorrélés. …


2
Définition de «centile»
Je lis maintenant une note sur la biostatistique écrite par PMT Education, et je remarque les phrases suivantes dans la section 2.7: Un bébé né au 50e centile pour la masse est plus lourd que 50% des bébés. Un bébé né au 25e centile pour la masse est plus lourd …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.