La page Wikipedia sur R2 dit que peut prendre une valeur supérieure à 1. Je ne vois pas comment cela est possible.R2R2R^2 Des valeurs de R2R2R^2 dehors de la plage de 0 à 1 peuvent apparaître lorsqu'elles sont utilisées pour mesurer l'accord entre les valeurs observées et modélisées et lorsque …
TLDR: Les splines de régression en plaques minces ont-elles une interprétation probabiliste / bayésienne? Étant donné les paires entrée-sortie , ; Je veux estimer une fonction comme suit où est une fonction du noyau et est un vecteur caractéristique de taille . Les coefficients et peuvent être trouvés en résolvant …
Supposons que régression linéaire multivariée suivante Comment puis-je tester cette ?y=β0+β1x1+β2x2+β3x3+β4x4+ϵy=β0+β1x1+β2x2+β3x3+β4x4+ϵ y = \beta_0 +\beta_1 x_1 +\beta_2 x_2+\beta_3x_3+\beta_4x_4 + \epsilonβ1=β2=β3β1=β2=β3\beta_1=\beta_2=\beta_3 Je sais que pour tester si vous pouvez simplement construire un test avec β1=β2β1=β2\beta_1=\beta_2ZZZZ=β1−β2se2β1+se2β2−−−−−−−−−√Z=β1−β2seβ12+seβ22 Z = \frac{\beta_1-\beta_2}{\sqrt{se_{\beta_1}^2+se_{\beta_2}^2}} Existe-t-il un analogue pour les estimations de coefficients multiples?
Cette question semble suffisamment fondamentale pour que je sois convaincue qu'il y ait une réponse ici quelque part, mais je ne l'ai pas trouvée. Je comprends que si la variable dépendante d'une régression est normalement distribuée, la probabilité maximale et les moindres carrés ordinaires produisent les mêmes estimations de paramètres. …
Dans tous les articles sur la forêt aléatoire (de régression) que j'ai lus, quand vient le temps de rassembler les prédictions de tous les arbres, nous prenons la valeur moyenne comme prédiction. Ma question est pourquoi faisons-nous cela? Existe-t-il une justification statistique pour prendre la moyenne? EDIT: Pour clarifier la …
Je comprends certains des nombreux problèmes de régression pas à pas. Cependant, en tant qu'entreprise universitaire, supposons que je souhaite utiliser la régression pas à pas pour un modèle prédictif et que je souhaite mieux comprendre les impacts qu'il peut avoir sur la performance. Étant donné un modèle linéaire, par …
Supposons que j'aimerais accéder à la taille de l' effet et la signification entre le résultat Y et variable X ajustée par confusionnelle Z . Ma question est que s'il y a une différence pour déterminer la taille de l'effet et la signification de X entre le scénario suivant. mettre …
L'article trace pour 100 femmes qui utilisent un certain type de méthode de contraception le nombre de grossesses non planifiées au fil du temps. https://www.nytimes.com/interactive/2014/09/14/sunday-review/unplanned-pregnancies.html?_r=0 En particulier, à la fin de l'article, ils disent: Les nombres sont calculés comme suit: P (pas enceinte après la première année N)= P (pas …
Quelqu'un peut-il fournir une vue intuitive sur pourquoi il est préférable d'avoir une version bêta plus petite? Pour LASSO, je peux comprendre cela, il y a un composant de sélection de fonctionnalités ici. Moins de fonctionnalités rendent le modèle plus simple et donc moins susceptible d'être sur-ajusté. Cependant, pour l'arête, …
Nouveau dans l'apprentissage statistique et automatique et prenant des cours en ligne. J'essaie de comprendre la régression logistique plus en détail et j'ai remarqué une différence dans la formule entre le cours Andrew Ng et le cours d'apprentissage statistique de Stanford. Ci-dessous, je poste une image de lien vers les …
Nature a publié cette année l'article suivant: Preuve d'une limite à la durée de vie humaine 1 , dans laquelle les auteurs soutiennent que leurs "résultats suggèrent fortement que la durée de vie maximale des humains est fixe et soumise à des contraintes naturelles". L'une des analyses statistiques de ce …
Je lisais cette page sur Princeton.edu . Ils effectuent une régression logistique (avec R). À un moment donné, ils calculent la probabilité d'obtenir une déviance résiduelle supérieure à celle qu'ils ont obtenue sur une avec des degrés de liberté égaux aux degrés de liberté du modèle. Copier-coller à partir de …
J'essaie de voir si les variables x et y ensemble ou séparément affectent significativement Q_7 (dont l'histogramme est ci-dessus). J'ai exécuté un test de normalité Shapiro-Wilk et j'ai obtenu ce qui suit shapiro.test(Q_7) ## data: Q_7 ## W = 0.68439, p-value < 2.2e-16 Avec cette distribution, la régression suivante fonctionnera-t-elle? …
Je suis nouveau dans la conversion de formules en formulaire matriciel. Mais cela est nécessaire pour un code d'apprentissage automatique efficace. Je veux donc comprendre la "bonne" façon, pas les trucs de cow-boy que je fais. D'accord, j'essaie de convertir la somme pondérée des carrés de la forme ci-dessous en …
De Wikipédia: En modélisation statistique, l' analyse de régression est un processus statistique permettant d'estimer les relations entre les variables. Il comprend de nombreuses techniques de modélisation et d'analyse de plusieurs variables, lorsque l'accent est mis sur la relation entre une variable dépendante et une ou plusieurs variables indépendantes (ou …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.