Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Quand est-il OK d'écrire «nous avons supposé une distribution normale» d'une mesure empirique?
Il est ancré dans l'enseignement des disciplines appliquées, comme la médecine, que les mesures des quantités biomédicales dans la population suivent une «courbe en cloche» normale. Une recherche Google de la chaîne "nous avons supposé une distribution normale" renvoie résultats! Ils sonnent comme «étant donné le petit nombre de points …


2
Prédire la confiance d'un réseau de neurones
Supposons que je veuille former un réseau neuronal profond pour effectuer une classification ou une régression, mais je veux savoir dans quelle mesure la prédiction sera sûre. Comment pourrais-je y parvenir? Mon idée est de calculer l'entropie croisée pour chaque donnée d'entraînement, sur la base de ses performances de prédiction …



2
Convolution 1D dans les réseaux de neurones
Je comprends comment fonctionne la convolution mais je ne comprends pas comment les convolutions 1D sont appliquées aux données 2D. Dans cet exemple, vous pouvez voir une convolution 2D dans une donnée 2D. Mais comment serait-il si c'était une convolution 1D? Juste un noyau 1D glissant de la même manière? …

2
Aide à la maximisation des attentes à partir du papier: comment inclure la distribution préalable?
La question est basée sur l'article intitulé: Reconstruction d'images en tomographie optique diffuse à l'aide du modèle couplé de transport et de diffusion radiatifs Lien de téléchargement Les auteurs appliquent l'algorithme EM avec régularisation de densité d'un vecteur inconnu pour estimer les pixels d'une image. Le modèle est donné parl1l1l_1μμ\mu …




2
Pourquoi le critère d'information ( non ajusté ) est-il utilisé pour sélectionner l'ordre de décalage approprié dans le modèle de série chronologique?
Dans les modèles de séries chronologiques, comme ARMA-GARCH, pour sélectionner le décalage ou l'ordre approprié du modèle, différents critères d'information, comme AIC, BIC, SIC, etc., sont utilisés. Ma question est très simple, pourquoi ne pas utiliser le ajusté pour choisir le modèle approprié? Nous pouvons sélectionner un modèle qui conduit …

1
Intervalles de chevauchement aléatoires
Comment trouver une expression analytique dans le problème suivant?D(n,l,L)D(n,l,L)D(n,l,L) Je dépose aléatoirement "barres" de longueur dans un intervalle . Les "barres" peuvent se chevaucher. Je voudrais trouver la longueur totale moyenne de l'intervalle occupée par au moins une "barre".nnnlll[0,L][0,L][0,L]DDD[0,L][0,L][0,L] Dans la limite "basse densité", le chevauchement doit être négligeable et …

2
Quelle est la différence entre ces deux tests de Breusch-Pagan?
En utilisant R sur certaines données et en essayant de voir si mes données sont hétéroscédastiques, j'ai trouvé deux implémentations du test de Breusch-Pagan, bptest (package lmtest) et ncvTest (package car). Cependant, ceux-ci produisent des résultats différents. Quelle est la différence entre les deux? Quand devriez-vous choisir d'utiliser l'un ou …

1
Espace de données, espace variable, espace d'observation, espace modèle (par exemple en régression linéaire)
Supposons que nous ayons la matrice de données , qui est par- , et le vecteur d'étiquette , qui est -par-un. Ici, chaque ligne de la matrice est une observation, et chaque colonne correspond à une dimension / variable. (supposez )XX\mathbf{X}nnnpppOuiOuiYnnnn > pn>pn>p Alors qu'est-ce que data space, variable space, …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.