Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'incorpore une approche de Bayesian Model Averaging (BMA) dans mes recherches et je ferai bientôt une présentation de mon travail à mes collègues. Cependant, BMA n'est pas vraiment bien connu dans mon domaine, donc après leur avoir présenté toute la théorie et avant de l'appliquer à mon problème, je veux …
J'ai effectué une régression logistique multivariée avec la variable dépendante Yétant le décès dans une maison de soins infirmiers dans une certaine période d'entrée et j'ai obtenu les résultats suivants (notez que si les variables commencent dans Ac'est une valeur continue tandis que celles qui commencent dans Bsont catégoriques): Call: …
Est-il possible d'appliquer la procédure MLE habituelle à la distribution triangulaire? - J'essaie mais je semble être bloqué à un moment ou à un autre dans les mathématiques par la façon dont la distribution est définie. J'essaie d'utiliser le fait que je connais le nombre d'échantillons au-dessus et au-dessous de …
Quels sont les paramètres start, etastart, mustartdans la fonction GLM () ? J'ai cherché dans les documents et sur Internet, mais je n'ai trouvé aucune explication claire de ce que cela signifie. Cela ressemble aux "valeurs initiales" bayésiennes pour les chaînes, mais je doute que cela soit lié, car la …
Comment la matrice d'erreur var / cov est-elle calculée par les progiciels d'analyse statistique dans la pratique? Cette idée m'est claire en théorie. Mais pas en pratique. Je veux dire, si j'ai un vecteur de variables aléatoires , je comprends que la matrice de variance / covariance recevra le produit …
Il est conseillé de définir une graine aléatoire afin que les résultats puissent être reproduits. Cependant, comme la graine est avancée à mesure que des nombres pseudo-aléatoires sont tirés, les résultats peuvent changer si un morceau de code tire un nombre supplémentaire. À première vue, le contrôle de version semble …
J'essaie un modèle très simple: ajuster un Normal où je suppose que je connais la précision, et je veux juste trouver la moyenne. Le code ci-dessous semble correspondre correctement à la normale. Mais après l'ajustement, je veux échantillonner à partir du modèle, c'est-à-dire générer de nouvelles données similaires à ma …
Je ne sais pas quelle fonction de distance entre les individus utiliser en cas d'attributs nominaux (catégoriques non ordonnés). Je lisais un manuel et ils suggèrent une fonction de correspondance simple , mais certains livres suggèrent que je devrais changer le nominal en attributs binaires et utiliser le coefficient de …
Je lis Éléments d'apprentissage statistique et à la page 12 (section 2.3) un modèle linéaire est noté comme: Yˆ=XTβˆY^=XTβ^\widehat{Y} = X^{T} \widehat{\beta} ... où est la transposition d'un vecteur colonne des prédicteurs / variables indépendantes / entrées. (Il déclare plus tôt "tous les vecteurs sont supposés être des vecteurs de …
Je travaille sur certaines techniques de regroupement, où pour un groupe donné de vecteurs de dimension d, je suppose une distribution normale multivariée et je calcule le vecteur moyen d'échantillon d et la matrice de covariance de l'échantillon. Ensuite , lorsque vous essayez de décider si un nouveau vecteur invisible, …
Supposons que j'ai une matrice X qui est n par p, c'est-à-dire qu'elle a n observations, avec chaque observation dans l'espace p-dimensionnel. Comment trouver la variance de ces n observations? Dans le cas où p = 1, il me suffit d'utiliser la formule de variance régulière. Qu'en est-il des cas …
Existe-t-il un moyen plus scientifique de déterminer le nombre de chiffres significatifs à déclarer pour une moyenne ou un intervalle de confiance dans une situation qui est assez standard - par exemple, la première année au collège. J'ai vu Nombre de chiffres significatifs à mettre dans un tableau , Pourquoi …
Quelqu'un peut-il expliquer pourquoi nous utilisons les modèles logarithmiques linéaires en termes très profanes? Je viens du milieu de l'ingénierie, et cela s'avère vraiment être un sujet difficile pour moi, les statistiques. Je serai reconnaissant pour une réponse.
Disons que j'ai les données suivantes et que j'utilise un modèle de régression: df=data.frame(income=c(5,3,47,8,6,5), won=c(0,0,1,1,1,0), age=c(18,18,23,50,19,39), home=c(0,0,1,0,0,1)) D'une part, je lance un modèle linéaire pour prédire le revenu: md1 = lm(income ~ age + home + home, data=df) Deuxièmement, je lance un modèle logit pour prédire la variable won: md2 …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.