Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai une série chronologique quotidienne assez prévisible avec une saisonnalité hebdomadaire. Je peux proposer des prédictions qui semblent assez précises (confirmées par validation croisée) quand il n'y a pas de vacances. Cependant, quand il y a des vacances, j'ai les problèmes suivants: J'obtiens des nombres non nuls pour les vacances …
Les analyses de régression modérée sont souvent utilisées en sciences sociales pour évaluer l'interaction entre deux ou plusieurs prédicteurs / covariables. En règle générale, avec deux variables prédictives, le modèle suivant est appliqué: Y=β0+β1∗X+β2∗M+β3∗XM+eY=β0+β1∗X+β2∗M+β3∗XM+eY = β_0 + β_1*X + β_2*M + β_3*XM + e Notez que le test de modération …
Disons que nous avons une variable aléatoire avec une plage de valeurs délimitées par et , où est la valeur minimale et la valeur maximale.b a buneaabbbuneaabbb On m'a dit que comme , où est notre taille d'échantillon, la distribution d'échantillonnage de nos moyennes d'échantillon est une distribution normale. Autrement …
J'utilise des modèles linéaires pour effectuer des tests de proportion à 2 échantillons depuis un certain temps, mais je me suis rendu compte que cela pourrait ne pas être complètement correct. Il semble que l'utilisation d'un modèle linéaire généralisé avec un lien famille binomiale + identité donne exactement les résultats …
Zou et al. "Sur les" degrés de liberté "du lasso" (2007) montrent que le nombre de coefficients non nuls est une estimation non biaisée et cohérente des degrés de liberté du lasso. Cela me semble un peu contre-intuitif. Supposons que nous ayons un modèle de régression (où les variables sont …
J'ai lu le paradoxe des paris de Blackwell sur le placard Futility . Voici le résumé: vous êtes présenté avec deux enveloppes, et . Les enveloppes contiennent une somme d'argent aléatoire, mais vous ne savez rien de la distribution de l'argent. Vous en ouvrez un, vérifiez combien il y a …
J'ai créé cette courbe d'apprentissage et je veux savoir si mon modèle SVM souffre de biais ou de variance? Comment puis-je conclure cela à partir de ce graphique?
Quel est un exemple de colinéarité parfaite en termes de matrice de conception XXX ? Je voudrais un exemple où β = ( X ' X ) - 1 X ' Y ne peut pas être estimée parce que ( X ' X ) n'est pas inversible.β^=(X′X)−1X′Yβ^=(X′X)−1X′Y\hat \beta = (X'X)^{-1}X'Y(X′X)(X′X)(X'X)
Fermé . Cette question est basée sur l'opinion . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin d'y répondre avec des faits et des citations en modifiant ce message . Fermé il y a 3 ans . Dans cet article, nous posons …
Restons sur une situation idéale avec un échantillonnage aléatoire, des populations gaussiennes, des variances égales, pas de piratage P, etc. Étape 1. Vous exécutez une expérience, par exemple en comparant deux moyennes d'échantillon, et calculez un intervalle de confiance à 95% pour la différence entre les deux moyennes de population. …
En lisant la vraie signification de l'ellipse de confiance à 95%, j'ai tendance à trouver 2 explications: L'ellipse qui contient 95% des données Pas ce qui précède, mais l'ellipse qui explique la variance des données. Je ne suis pas sûr de bien comprendre, mais ils semblent signifier que si un …
Par exemple, dans R si vous appelez la acf()fonction, elle trace un corrélogramme par défaut et trace un intervalle de confiance à 95%. En regardant le code, si vous appelez plot(acf_object, ci.type="white"), vous voyez: qnorm((1 + ci)/2)/sqrt(x$n.used) comme limite supérieure pour le bruit blanc de type. Quelqu'un peut-il expliquer la …
Si est un discret et est une variable aléatoire continue, alors que pouvons-nous dire de la distribution de ? Est-ce continu ou mélangé?Y X + YXXXOuiYYX+ YX+YX+Y Qu'en est-il du produit ?XOuiXYXY
Un étranger au domaine ML / DL; a commencé le cours Udacity Deep Learning basé sur Tensorflow; faire la tâche 3 problème 4; essayer de régler le taux d'apprentissage avec la configuration suivante: Taille du lot 128 Nombre d'étapes: suffisant pour remplir 2 époques Tailles des calques masqués: 1024, 305, …
Je comprends donc que la sélection des variables fait partie de la sélection du modèle. Mais en quoi consiste exactement la sélection du modèle? Est-ce plus que ce qui suit: 1) choisissez une distribution pour votre modèle 2) choisir des variables explicatives,? Je pose cette question parce que je lis …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.