Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



5
Puis-je tester l'hypothèse pour les données normales asymétriques?
J'ai une collection de données, que je pensais à l'origine être normalement distribuée. Ensuite, je l'ai regardé et j'ai réalisé que ce n'était pas le cas, principalement parce que les données sont biaisées, et j'ai également fait un test de shapiro-wilks. Je voudrais toujours l'analyser en utilisant des méthodes statistiques, …

2
Utilisation d'Adaboost avec SVM pour la classification
Je sais qu'Adaboost essaie de générer un classificateur fort en utilisant une combinaison linéaire d'un ensemble de classificateurs faibles. Cependant, j'ai lu certains articles suggérant qu'Adaboost et les SVM fonctionnent en harmonie (même si SVM est un classificateur puissant) dans certaines conditions et dans certains cas . Je ne suis …


2
Existe-t-il une mort équitable?
Existe-t-il une mort équitable? Sur les dés où le nombre est représenté par un point évidé, cela fait-il une différence? Quelqu'un a-t-il fait des recherches? En fait, en y réfléchissant, pourquoi un tirage au sort serait-il juste? la physique de chaque côté est complètement différente.
11 dice 

1
Sélection du modèle ABC
Il a été démontré que le choix du modèle ABC utilisant des facteurs de Bayes n'est pas recommandé en raison de la présence d'une erreur provenant de l'utilisation de statistiques sommaires. La conclusion de cet article repose sur l'étude du comportement d'une méthode populaire d'approximation du facteur Bayes (algorithme 2). …

2
Les prédicteurs significatifs deviennent non significatifs dans la régression logistique multiple
Lorsque j'analyse mes variables dans deux modèles de régression logistique distincts (univariés), j'obtiens ce qui suit: Predictor 1: B= 1.049, SE=.352, Exp(B)=2.85, 95% CI=(1.43, 5.69), p=.003 Constant: B=-0.434, SE=.217, Exp(B)=0.65, p=.046 Predictor 2: B= 1.379, SE=.386, Exp(B)=3.97, 95% CI=(1.86, 8.47), p<.001 Constant: B=-0.447, SE=.205, Exp(B)=0.64, p=.029 mais quand je les …

3
Comment puis-je trouver l'écart-type de l'écart-type de l'échantillon à partir d'une distribution normale?
Pardonnez-moi si j'ai raté quelque chose d'assez évident. Je suis physicien avec ce qui est essentiellement une distribution (histogramme) centrée sur une valeur moyenne qui se rapproche d'une distribution normale. La valeur importante pour moi est l'écart type de cette variable aléatoire gaussienne. Comment pourrais-je essayer de trouver l'erreur sur …


3
Amélioration des noms de variables dans un ensemble de données
Les bons noms de variables sont: a) court / facile à taper, b) facile à retenir, c) compréhensible / communicatif. Suis-je en train d'oublier quelque chose? La cohérence est quelque chose à rechercher. La façon dont je dirais que les conventions de dénomination cohérentes contribuent aux qualités ci-dessus. La cohérence …

1
La transformation de r en Fisher z profite-t-elle d'une méta-analyse?
Habituellement, est transformé en Fisher pour tester la différence entre deux valeurs . Mais, lorsqu'une méta-analyse doit être effectuée, pourquoi devrions-nous prendre une telle mesure? Corrige-t-il l'erreur de mesure ou l'erreur non due à l'échantillonnage et pourquoi devrions-nous supposer que est une estimation imparfaite de la corrélation de la population?z …




En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.