Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Analyser un match de football: des joueurs similaires avec DBSCAN et des trajectoires similaires avec TRACLUS
J'essaie d'analyser un ensemble de données qui provient de capteurs situés près des chaussures des joueurs dans un match ( http://www.orgs.ttu.edu/debs2013/index.php?goto=cfchallengedetails ). J'ai décidé de regarder le clustering pour identifier: Trajectoires similaires des joueurs dans le match en utilisant l' algorithme de clustering TRACLUS Joueurs similaires en comptant certaines caractéristiques …




2
Naive Bayes sur les variables continues
Veuillez me permettre de poser une question de base. Je comprends la mécanique des Naive Bayes pour les variables discrètes, et peux refaire les calculs "à la main". (code de HouseVotes84 tout le chemin ci-dessous). Cependant - j'ai du mal à voir comment la mécanique fonctionne pour les variables continues …
8 r  naive-bayes  bayes 



1
Analyse des points de changement
Quelqu'un pourrait-il m'expliquer le point de changement? J'utilise le package en R, et je ne comprends pas vraiment ce que signifient les différentes méthodes, les avantages et les inconvénients de chacune, et je ne comprends surtout pas la valeur de la pénalité. Lorsque vous augmentez la valeur de la pénalité, …

1
Comment peut-on effectuer une analyse de puissance binomiale à deux groupes sans utiliser d'approximations normales?
Je voudrais faire des analyses de puissance pour des tests d'hypothèses de (non) égalité de proportions dans lesquelles les proportions sont très petites. Je voudrais le faire sans utiliser d'approximations normales (ou Poisson) de la distribution binomiale. Il y a plusieurs types généraux de questions de pouvoir que j'aimerais pouvoir …



1
Codage fictif des contrastes: 0,1 vs 1, -1
Je cherche votre aide pour comprendre la différence entre deux contrastes différents pour les variables dichotomiques. Sur cette page: http://www.psychstat.missouristate.edu/multibook/mlt08.htm sous "Variables des prédicteurs dichotomiques", il existe deux façons de coder les prédicteurs dichotomiques: en utilisant le contraste 0,1 ou le contraste 1, -1 . Je comprends en quelque sorte …

2
Les méthodes d'apprentissage automatique peuvent-elles être utiles pour résoudre des équations différentielles?
J'ai noté que la tâche de régression dans l'apprentissage automatique est en quelque sorte liée à la résolution approximative d'équations différentielles - les deux tentent d'approximer une fonction inconnue. Alors, ma question est: le ML peut-il être d'une manière ou d'une autre utile pour résoudre des équations différentielles? Merci d'avance.

2
Pourquoi est-ce que j'obtiens les mêmes résultats pour OLS et GLS dans R?
Lorsque j'exécute ce code: require(nlme) a <- matrix(c(1,3,5,7,4,5,6,4,7,8,9)) b <- matrix(c(3,5,6,2,4,6,7,8,7,8,9)) res <- lm(a ~ b) print(summary(res)) res_gls <- gls(a ~ b) print(summary(res_gls)) J'obtiens les mêmes coefficients et la même signification statistique sur les coefficients: Loading required package: nlme Call: lm(formula = a ~ b) Residuals: Min 1Q Median 3Q …

1
Identification causale et splines pénalisées
Je viens de recevoir un rejet d'un journal économique. Parmi les raisons invoquées pour le rejet figurent: les avantages de l'utilisation de la méthode semi-paramétrique ne sont pas clairement mis en évidence par rapport à d'autres techniques plus simples avec une identification claire des relations causales Il est certainement possible …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.