Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

2
Quand les approximations de la série Taylor aux attentes des fonctions (entières) convergent-elles?
Prenez une espérance de la forme pour une variable aléatoire univariée et une fonction entière (c.-à-d., L'intervalle de convergence est la ligne réelle entière)E(f(X))E(f(X))E(f(X))XXXf(⋅)f(⋅)f(\cdot) J'ai une fonction de génération de moment pour et je peux donc facilement calculer des moments entiers. Utilisez une série de Taylor autour de puis appliquez …

1
Pourquoi le système de notation Elo utilise-t-il une mauvaise règle de mise à jour?
Le système de notation Elo utilise un algorithme de minimisation de descente de gradient de la fonction de perte d'entropie croisée entre la probabilité attendue et observée d'un résultat dans des comparaisons appariées. Nous pouvons écrire les fonctions de perte générales comme E=−∑n,ipiLog(qi)E=−∑n,ipiLog(qi) E=-\sum_{n,i} p_i Log (q_i) où la somme …




1
Pourquoi tous les composants PLS ensemble n'expliquent-ils qu'une partie de la variance des données d'origine?
J'ai un ensemble de données composé de 10 variables. J'ai exécuté des moindres carrés partiels (PLS) pour prédire une seule variable de réponse par ces 10 variables, extrait 10 composantes PLS, puis calculé la variance de chaque composante. Sur les données originales, j'ai pris la somme des variances de toutes …

1
Pourquoi une proportion d'échantillon n'a-t-elle pas également une distribution binomiale
Dans un cadre binomial, la variable aléatoire, X, qui donne le nombre de succès est distribuée binomialement. La proportion d'échantillon peut alors être calculée comme où est la taille de votre échantillon. Mon manuel déclare queXnXn\frac{X}{n}nnn Cette proportion n'a pas de distribution binomiale cependant, comme est simplement une version à …

2
L'ordre convexe implique-t-il une domination de la queue droite?
Étant donné deux distributions continues et , il n'est pas clair pour moi si la relation de dominance convexe entre elles:FXFX\mathcal{F}_XFOuiFOui\mathcal{F}_Y ( 0 )FX&lt;cFOui(0)FX&lt;cFOui(0)\quad \mathcal{F}_X <_c \mathcal{F}_Y implique que ( 1 )F- 1Oui( q) ≤ F- 1X( q) ,∀ q∈ [ 0,5 , 1 ](1)FOui-1(q)≤FX-1(q),∀q∈[0,5,1](1)\quad F_Y^{-1}(q) \leq F_X^{-1}(q),\quad \forall q\in[0.5,1] …


2
La pondération basée sur la précision (c.-à-d. La variance inverse) fait-elle partie intégrante de la méta-analyse?
La pondération basée sur la précision est-elle au cœur de la méta-analyse? Borenstein et al. (2009) écrivent que pour qu'une méta-analyse soit possible, il suffit que: Les études rapportent une estimation ponctuelle qui peut être exprimée sous la forme d'un nombre unique. La variance peut être calculée pour cette estimation …


4
Est-ce correct ? (génération d'une gaussienne multivariée à normes tronquées)
Si c'est-à-dire X∈Rn, X∼N(0–,σ2I)X∈Rn, X∼N(0_,σ2I)X\in\mathbb{R}^n,~X\sim \mathcal{N}(\underline{0},\sigma^2\mathbf{I})fX(x)=1(2πσ2)n/2exp(−||x||22σ2)fX(x)=1(2πσ2)n/2exp⁡(−||x||22σ2) f_X(x) = \frac{1}{{(2\pi\sigma^2)}^{n/2}} \exp\left(-\frac{||x||^2}{2\sigma^2}\right) Je veux une version analogue d'une distribution normale tronquée dans un cas multivarié. Plus précisément, je veux générer une norme-contrainte (à une valeur ) gaussienne multivariée st oùY f Y ( y ) = { c . f X ( …


1
Dérivation de la fonction de vraisemblance pour IV-probit
J'ai donc un modèle binaire où est la variable latente non observée et l'observé. détermine et est donc mon instrument. Bref, le modèle est. Puisque les termes d'erreur ne sont pas indépendants mais, J'utilise un modèle IV-probit.y∗1y1∗y_1^*y1∈{0,1}y1∈{0,1}y_1 \in \{0,1\}y2y2y_2y1y1y_1z2z2z_2y∗1y2y1===δ1z1+α1y2+u1δ21z1+δ22z2+v2=zδ+v21[y∗&gt;0]y1∗=δ1z1+α1y2+u1y2=δ21z1+δ22z2+v2=zδ+v2y1=1[y∗&gt;0]\begin{eqnarray} y_1^*&=& \delta_1 z_1 + \alpha_1 y_2 + u_1 \\ y_2 &=& …

2
Mis à part Durbin-Watson, quels tests d'hypothèse peuvent produire des résultats non concluants?
La statistique du test de Durbin-Watson peut se situer dans une région non concluante, où il n'est pas possible de rejeter ou de rejeter l'hypothèse nulle (dans ce cas, d'autocorrélation nulle). Quels autres tests statistiques peuvent produire des résultats "non concluants"? Y a-t-il une explication générale (agitant la main est …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.