Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je travaille sur un algorithme qui prend un vecteur du point de données le plus récent d'un certain nombre de flux de capteurs et compare la distance euclidienne aux vecteurs précédents. Le problème est que les différents flux de données proviennent de capteurs complètement différents, donc prendre une simple distance …
Je suis actuellement en train de suivre le cours PGM de Daphne Koller sur Coursera. En cela, nous modélisons généralement un réseau bayésien comme un graphe orienté de cause à effet des variables qui font partie des données observées. Mais sur les tutoriels et les exemples PyMC, je vois généralement …
Contexte: J'ai lu un article dans lequel les auteurs rapportent une corrélation de Pearson de 0,754 à partir de la taille de l'échantillon 878. La valeur de p résultante pour le test de corrélation est significative "deux étoiles" (c'est-à-dire p <0,01). Cependant, je pense qu'avec une taille d'échantillon aussi grande, …
Wikipédia dit la taille de l'effet est une mesure de la force d'un phénomène ou une estimation basée sur un échantillon de cette quantité. Une taille d'effet calculée à partir des données est une statistique descriptive qui transmet l'ampleur estimée d'une relation sans indiquer si la relation apparente dans les …
J'essaie de comprendre comment utiliser l'apprentissage automatique pour prédire la série financière 1 étape ou plus dans le futur. J'ai une série temporelle financière avec des données descriptives et je voudrais former un modèle et ensuite utiliser le modèle pour prédire n étapes à venir. Ce que j'ai fait jusqu'à …
Dans le livre d'Andrew Gelman "Red State, Blue State", il analyse le fait que les riches dans certains États ont tendance à voter plus républicains que les pauvres, mais que les États riches ont tendance à voter plus démocratiques que les États pauvres. Y a-t-il un nom pour ce paradoxe? …
Les données gaussiennes distribuées dans une seule dimension nécessitent deux paramètres pour la caractériser (moyenne, variance), et la rumeur veut qu'une trentaine d'échantillons sélectionnés au hasard est généralement suffisant pour estimer ces paramètres avec une confiance raisonnablement élevée. Mais que se passe-t-il lorsque le nombre de dimensions augmente? En deux …
Je suis en train de prototyper mon propre modèle Naive Bayes bag o 'words, et j'avais une question sur le calcul des probabilités de fonctionnalité. Disons que j'ai deux classes, je vais juste utiliser le spam et non-spam car c'est ce que tout le monde utilise. Et prenons le mot …
J'exécute un modèle linéaire généralisé, où je dois spécifier une famille différente de la normale. Quelle est la distribution attendue des résidus? Par exemple, les résidus devraient-ils être distribués normalement?
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Je suis très nouveau à R. J'apprends l'apprentissage automatique en ce moment. Désolé, si cette question semble très basique. J'essaie de …
J'ai des références qui ont conseillé d'envisager une taille d'échantillon d'au moins 20 pour la distribution de l'ajustement des données. Y a-t-il un sens à cela? Merci
J'ai un ensemble de données avec 8000 grappes et 4 millions d'observations. Malheureusement, mon logiciel statistique, Stata, fonctionne assez lentement lorsque j'utilise sa fonction de données de panel pour la régression logistique: xtlogitmême avec un sous-échantillon de 10%. Cependant, lorsque vous utilisez la logitfonction non- panneau , les résultats apparaissent …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.