Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai un modèle de régression logistique (ajustement via glmnet en R avec régularisation nette élastique), et je voudrais maximiser la différence entre les vrais positifs et les faux positifs. Pour ce faire, la procédure suivante est venue à l'esprit: Ajuster le modèle de régression logistique standard En utilisant un seuil …
Dans Dixon, Coles ( 1997 ), ils ont utilisé l'estimation du maximum de vraisemblance pour les deux modèles de Poisson indépendants modifiés en (4.3) pour modéliser les scores au soccer. J'essaie d'utiliser R afin de "reproduire" les paramètres alpha et bêta ainsi que les paramètres de l'effet home (p. 274, …
Je souhaite trouver une procédure pour simuler des données cohérentes avec un modèle de médiation spécifié. Selon le cadre général du modèle d'équation structurelle linéaire pour tester les modèles de médiation décrit pour la première fois par Barron et Kenny (1986) et décrit ailleurs comme Judd, Yzerbyt et Muller (2013) …
J'ai un modèle dynamique de Naive Bayes formé sur quelques variables temporelles. La sortie du modèle est la prédiction de P(Event) @ t+1, estimée à chacun t. L'intrigue de P(Event)versus timeest indiquée dans la figure ci-dessous. Dans cette figure, la ligne noire représente P(Event)comme prévu par mon modèle; la ligne …
Salut, j'ai du mal à comprendre Ref.df dans l'écran de sortie dans R: Approximate significance of smooth terms: edf Ref.df F p-value s(meangrain) 1.779 2.209 3.193 0.0451 * s(depth) 2.108 2.697 3.538 0.0254 * Qu'est-ce que cela signifie et est-il nécessaire d'inclure ce terme pour présenter les résultats de l'AMG …
Je prends un cours d'introduction à Bayes et j'ai du mal à comprendre les distributions prédictives. Je comprends pourquoi ils sont utiles et je connais la définition, mais il y a certaines choses que je ne comprends pas très bien. 1) Comment obtenir la bonne distribution prédictive pour un vecteur …
J'utilise le régresseur RandomForest sur mes données et j'ai pu voir que le score oob a été obtenu à 0,83. Je ne sais pas comment ça s'est passé comme ça. Je veux dire que mes cibles sont des valeurs élevées de l'ordre de 10 ^ 7. Donc, si c'est MSE, …
J'analyse un ensemble de données concernant les communautés intertidales. Les données sont le pourcentage de couverture (d'algues, bernaches, moules, etc.) en quadrats. J'ai l'habitude de penser à l'analyse des correspondances (AC) en termes de dénombrement des espèces et à l'analyse en composantes principales (ACP) comme quelque chose de plus utile …
D'un point de vue mathématique, le théorème de Bayes est parfaitement logique pour moi (c'est-à-dire dériver et prouver), mais ce que je ne sais pas, c'est s'il existe ou non un bel argument géométrique ou graphique qui peut être montré pour expliquer le théorème de Bayes. J'ai essayé Google pour …
J'ai un ensemble de données d'informations sur les clients de téléphones portables avec deux colonnes. La première colonne contient la certaine catégorie dans laquelle un compte appartient (A, B ou C) et la deuxième colonne contient une valeur binaire pour savoir si ce compte a été annulé. par exemple A …
Les algorithmes d'apprentissage automatique évolutifs semblent être à la mode ces jours-ci. Chaque entreprise ne gère rien de moins que les mégadonnées . Existe-t-il un manuel qui explique quels algorithmes d'apprentissage automatique peuvent être mis à l'échelle en utilisant des architectures parallèles comme Map-Reduce, et quels algorithmes ne le peuvent …
Je sais que cette question a été posée auparavant: Ouvrage de référence pour les études écologiques mais ce n'est pas ce que je recherche. Ce que je recherche, c'est si quelqu'un pourrait recommander un bon livre (ou une référence canonique) sur l'écologie statistique? J'ai une très bonne compréhension des statistiques …
J'ai récemment reçu une révision de mon article de recherche et voici le commentaire de l'examinateur sur mon article: les résultats obtenus à partir d'un modèle ne sont pas tout à fait convaincants, en particulier la régression linéaire présente généralement des lacunes dans le traitement des valeurs aberrantes. Je suggère …
J'ai les données suivantes situées ici . J'essaie de calculer l'intervalle de confiance à 95% sur la pureté moyenne lorsque le pourcentage d'hydrocarbures est de 1,0. Dans R, je saisis ce qui suit. > predict(purity.lm, newdata=list(hydro=1.0), interval="confidence", level=.95) fit lwr upr 1 89.66431 87.51017 91.81845 Cependant, comment puis-je obtenir ce …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.