Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



2
Comment visualiser les pourcentages par rapport au nombre d'entrées.
J'essaie de trouver la meilleure façon de visualiser le tableau ci-dessous et de souligner l'efficacité du traitement par rapport au nombre de patients qui ont essayé le traitement. Voici le lien vers la page actuelle: http://curetogether.com/cluster-headaches/treatments/ Quelle est la meilleure façon de souligner l'efficacité tout en facilitant la comparaison des …

3
Quels sont les critères et la prise de décision pour la non-linéarité dans les modèles statistiques?
J'espère que la question générale suivante aura un sens. Veuillez garder à l'esprit qu'aux fins de cette question particulière, je ne suis pas intéressé par les raisons théoriques (domaine) d'introduire la non-linéarité. Par conséquent, je formulerai la question complète comme suit: Qu'est-ce qu'un cadre logique ( critères et, si possible, …

3
Une série chronologique saisonnière implique-t-elle une série chronologique stationnaire ou non stationnaire
Si j'ai une série chronologique qui a une saisonnalité, cela rend-il automatiquement la série non stationnaire? Mon intuition (probablement éteinte) est que non. La saisonnalité signifie que la série monte et descend autour d'une valeur constante ... quelque chose comme une onde sinusoïdale. Ainsi, selon cette logique, une série chronologique …






3
Analyse de séries chronologiques vs apprentissage automatique?
Juste une question générale. Si vous avez des données de séries chronologiques, quand est-il préférable d'utiliser des techniques de séries chronologiques (aka, ARCH, GARCH, etc.) plutôt que des techniques d'apprentissage machine / statistique (KNN, régression)? S'il y a une question similaire qui existe sur la validation croisée, veuillez m'orienter vers …



1
Prédiction probabiliste de forêt aléatoire vs vote majoritaire
Scikit learn semble utiliser la prédiction probabiliste au lieu du vote majoritaire pour la technique d'agrégation du modèle sans expliquer pourquoi (1.9.2.1. Forêts aléatoires). Y a-t-il une explication claire pourquoi? De plus, existe-t-il un bon article ou article de synthèse sur les différentes techniques d'agrégation de modèles pouvant être utilisées …

1
bayesglm (bras) contre MCMCpack
Les deux bayesglm()(dans le bras package R) et diverses fonctions dans le paquet MCMCpack sont destinés à faire l' estimation bayésienne des modèles linéaires généralisés, mais je ne suis pas sûr qu'ils calcul fait la même chose. Les fonctions MCMCpack utilisent la chaîne de Markov Monte Carlo pour obtenir un …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.