Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



3
Est-il tout à fait défendable de stratifier un ensemble de données en fonction de la taille du résidu et de faire une comparaison à deux échantillons?
C'est quelque chose que je vois comme une sorte de méthode ad hoc et cela me semble très louche, mais peut-être que je manque quelque chose. J'ai vu cela en régression multiple, mais restons simples: yi=β0+β1xi+εiyi=β0+β1xi+εi y_{i} = \beta_{0} + \beta_{1} x_{i} + \varepsilon_{i} Maintenant, prenez les résidus du modèle …



1
Comment analyser les données de comptage longitudinal: prise en compte de l'autocorrélation temporelle dans le GLMM?
Bonjour gourous statistiques et assistants de programmation R, Je m'intéresse à la modélisation des captures d'animaux en fonction des conditions environnementales et du jour de l'année. Dans le cadre d'une autre étude, j'ai dénombré des captures sur environ 160 jours sur trois ans. Chaque jour, j'ai la température, les précipitations, …

4
Intuition derrière la distribution de la loi de puissance
Je sais que le pdf d'une loi de puissance est p(x)=α−1xmin(xxmin)−αp(x)=α−1xmin(xxmin)−α p(x) = \frac{\alpha-1}{x_{\text{min}}} \left(\frac{x}{x_{\text{min}}} \right)^{-\alpha} Mais qu'est-ce que cela signifie intuitivement si, par exemple, les cours des actions suivent une distribution de loi de puissance? Cela signifie-t-il que les pertes peuvent être très élevées mais peu fréquentes?

2
Expliquer les tests bilatéraux
Je cherche différentes façons d'expliquer à mes élèves (dans un cours de statistique élémentaire) ce qu'est un test bilatéral et comment sa valeur P est calculée. Comment expliquez-vous à vos élèves le test bilatéral ou unilatéral?


6
Où trouver un grand corpus de texte? [fermé]
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement de réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 6 ans . Je recherche un grand (> 1000) corpus de texte à …
16 dataset 



3
Faire de gros paris (er) intelligents
J'ai essayé de coder un algorithme pour suggérer des paris dans des jeux 1X2 (pondérés). Fondamentalement, chaque match a un ensemble de matchs (équipes à domicile vs équipes à l'extérieur): 1: victoires à domicile X: dessiner 2: victoires à l'extérieur Pour chaque correspondance et symbole ( 1, Xet 2), j'attribuerai …

11
Comment commencer et apprendre le R?
J'ai essayé plusieurs fois de "faire cavalier seul" - mais avec un succès limité. Je suis un utilisateur occasionnel de SPSS et j'ai une certaine expérience SAS. J'apprécierais un pointeur ou deux de quelqu'un qui a des antécédents similaires et utilise maintenant R.
16 r  references 

4
Regroupement de données 1D
J'ai un ensemble de données, je veux créer des clusters sur ces données en fonction d'une seule variable (il n'y a pas de valeurs manquantes). Je veux créer 3 clusters basés sur cette variable. Quel algorithme de clustering utiliser, k-means, EM, DBSCAN etc.? Ma question principale est, dans quelles circonstances …
16 clustering 

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.