Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



2
Que se passe-t-il ici, lorsque j'utilise la perte au carré dans le cadre de la régression logistique?
J'essaie d'utiliser la perte au carré pour effectuer une classification binaire sur un ensemble de données de jouets. J'utilise mtcarsun ensemble de données, utilise le mile par gallon et le poids pour prédire le type de transmission. Le graphique ci-dessous montre les deux types de données de type de transmission …

2
Asymétrie du logarithme d'une variable aléatoire gamma
Considérons la variable aléatoire gamma X∼ Γ ( α , θ )X∼Γ(α,θ)X\sim\Gamma(\alpha, \theta) . Il existe des formules soignées pour la moyenne, la variance et l'asymétrie: E [X]Var[ X]Asymétrie[ X]= α θ= α θ2= 1 / α ⋅ E [ X]2= 2 / α--√E[X]=αθVar⁡[X]=αθ2=1/α⋅E[X]2Asymétrie⁡[X]=2/α\begin{align} \mathbb E[X]&=\alpha\theta\\ \operatorname{Var}[X]&=\alpha\theta^2=1/\alpha\cdot\mathbb E[X]^2\\ \operatorname{Skewness}[X]&=2/\sqrt{\alpha} \end{align} …


2
Comment calculer la durée moyenne d'adhésion au végétarisme alors que nous ne disposons que de données d'enquête sur les végétariens actuels?
Un échantillon de population aléatoire a été sondé. On leur a demandé s'ils avaient un régime végétarien. S'ils ont répondu oui, on leur a également demandé de préciser depuis combien de temps ils suivaient un régime végétarien sans interruption. Je veux utiliser ces données pour calculer la durée moyenne d'adhésion …



4
Que signifie «comme»?
Je lisais un article et j'ai vu la phrase suivante: Pour une martingale donnée, si elle a une limite supérieure ou inférieure, alors la martingale doit converger (comme). Étant donné que la probabilité est toujours non négative, 0 est une borne inférieure. Que signifie "comme"? Est-ce un usage courant? Ma …



3
Qu'est-ce qu'un modèle nul en régression et comment est-il lié à l'hypothèse nulle?
Qu'est-ce qu'un modèle nul en régression et quelle est la relation entre le modèle nul et l'hypothèse nulle? Pour ma compréhension, cela signifie-t-il Utiliser la «moyenne de la variable de réponse» pour prédire la variable de réponse continue? Utiliser la «distribution d'étiquettes» pour prédire les variables de réponse discrètes? Si …

1
Écart maximal entre les échantillons prélevés sans remplacement à partir d'une distribution uniforme discrète
Ce problème est lié aux recherches de mon laboratoire sur la couverture robotique: Tirez au hasard nnn nombres de l'ensemble {1,2,…,m}{1,2,…,m}\{1,2,\ldots,m\} sans remplacement et triez les nombres dans l'ordre croissant. 1≤n≤m1≤n≤m1\le n\le m . À partir de cette liste triée de nombres {a(1),a(2),…,a(n)}{a(1),a(2),…,a(n)}\{a_{(1)},a_{(2)},…,a_{(n)}\} , générez la différence entre les nombres …



En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.