Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Qu'est-ce qui explique les différences de valeurs de p dans ce qui suit aovet dans les lmappels? La différence est-elle uniquement due à différents types de calculs de sommes de carrés? set.seed(10) data=rnorm(12) f1=rep(c(1,2),6) f2=c(rep(1,6),rep(2,6)) summary(aov(data~f1*f2)) summary(lm(data~f1*f2))$coeff
J'utilise actuellement un classificateur binaire. Lorsque je trace la courbe ROC, j'obtiens une bonne portance au début, puis elle change de direction et traverse la diagonale, puis bien sûr en remontant, faisant de la courbe une forme inclinée en S. Quelle peut être une interprétation / explication à cet effet? …
J'ai un histogramme, la densité du noyau et une distribution normale ajustée des rendements du journal financier, qui sont transformés en pertes (les signes sont modifiés), et un tracé QQ normal de ces données: Le tracé QQ montre clairement que les queues ne sont pas ajustées correctement. Mais si je …
Une forêt aléatoire peut-elle être formée pour prédire correctement les données de comptage? Comment cela se passerait-il? J'ai une gamme de valeurs assez étendue, donc la classification n'a pas vraiment de sens. Si j'utilisais la régression, est-ce que je tronquerais simplement les résultats? Je suis assez perdu ici. Des idées?
Pour analyser les données d'une expérience de biophysique, j'essaie actuellement de faire un ajustement de courbe avec un modèle hautement non linéaire. La fonction modèle ressemble essentiellement à: y= a x + b x- 1 / deuxy=ax+bx−1/2y = ax + bx^{-1/2} Ici, la valeur de est particulièrement intéressante.bbb Un tracé …
Le tennis a un système de notation à trois niveaux particulier, et je me demande si cela a un avantage statistique, du point de vue d'un match comme une expérience pour déterminer le meilleur joueur. Pour ceux qui ne sont pas familiers, dans les règles normales, une partie est gagnée …
J'ai deux variables aléatoires et .X>0X>0X > 0Y>0Y>0Y > 0 Étant donné que je peux estimer comment puis-je estimerCov(X,Y),Cov(X,Y),\text{Cov}(X, Y),Cov(log(X),log(Y))?Cov(log(X),log(Y))?\text{Cov}(\log(X), \log(Y))?
Étant donné le même ensemble de covariables et de familles de distribution, comment comparer des modèles ayant différentes fonctions de liaison? Je pense que la bonne réponse ici est "AIC / BIC", mais je ne suis pas sûr à 100%. Est-il possible d'avoir des modèles imbriqués s'ils ont un lien …
J'ai un ensemble de données qui augmente clairement au fil du temps (taux de change d'une monnaie, données mensuelles sur 20 ans), ma question est: puis-je détourner les données et ensuite les différencier également pour les rendre stationnaires, si la tendance est en soi n'y parvient pas? Et si oui, …
La corrélation, , est une mesure de l'association linéaire entre deux variables. Le coefficient de détermination, , est une mesure de la proportion de la variabilité d'une variable qui peut être "expliquée par" la variation de l'autre.r 2rrrr2r2r^2 Par exemple, si est la corrélation entre deux variables, alors . Ainsi, …
Je travaille sur un problème de prédiction d'attrition classique en utilisant le nombre de visites d'un utilisateur donné sur un site et je pensais que la régression de Poisson était le bon outil pour modéliser l'engagement futur de cet utilisateur. À ce moment-là, je suis tombé sur un livre sur …
Je veux comparer deux méthodes différentes pour détecter un changement d'état dans une analyse de survie. Un groupe de sujets est suivi pendant une période plus longue (plusieurs années) et deux méthodes d'examen ont été utilisées pour déterminer si un changement de statut s'est produit; une méthode a été utilisée …
J'ai un petit problème avec la syntaxe Stata. J'ai besoin de faire la régression suivante: y= a x + b z+ c ( x z) + ey=ax+bz+c(xz)+ey = ax + bz + c(xz) + e où et sont tous les deux instrumentés et le terme d'interaction utilise les valeurs instrumentées …
J'ai du mal à comprendre des statistiques suffisantes et complètes? Soit une statistique suffisante.T= Σ xjeT=ΣXjeT=\Sigma x_i Si avec probabilité 1, pour une fonction g , alors c'est une statistique complète suffisante.E[ g( T) ] = 0E[g(T)]=0E[g(T)]=0ggg mais qu'est ce que ça veut dire? J'ai vu des exemples d'uniformes et …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.