Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données


9
Arbres de décision boostés en python? [fermé]
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 5 mois . Existe-t-il une bonne bibliothèque python pour l'entraînement des arbres de décision …
13 python  cart  boosting 

6
De courtes vidéos en ligne qui pourraient aider à une conférence sur les statistiques
Lors de la présentation de statistiques, il peut être utile d'incorporer la courte vidéo occasionnelle. Mes premières pensées ont inclus: Animations et visualisations de concepts statistiques Histoires concernant l'application d'une technique particulière Vidéos humoristiques pertinentes pour une idée statistique Entrevues avec un statisticien ou un chercheur qui utilise des statistiques …




3
Réponses expresses en termes d'unités originales, en données transformées Box-Cox
Pour certaines mesures, les résultats d'une analyse sont présentés de manière appropriée sur l'échelle transformée. Dans la plupart des cas, cependant, il est souhaitable de présenter les résultats sur l'échelle de mesure d'origine (sinon votre travail est plus ou moins sans valeur). Par exemple, dans le cas de données transformées …


5
Traitement cognitif / interprétation des techniques de visualisation des données
Quelqu'un connaît-il des recherches qui examinent l'efficacité (compréhensibilité?) De différentes techniques de visualisation? Par exemple, à quelle vitesse les gens comprennent-ils une forme de visualisation par rapport à une autre? L'interactivité avec la visualisation aide-t-elle les gens à se souvenir des données? N'importe quoi dans ce sens. Un exemple de …


5
Réduction de dimensionnalité SVD pour des séries temporelles de différentes longueurs
J'utilise la décomposition en valeurs singulières comme technique de réduction de dimensionnalité. Étant donné des Nvecteurs de dimension D, l'idée est de représenter les entités dans un espace transformé de dimensions non corrélées, qui condense la plupart des informations des données dans les vecteurs propres de cet espace dans un …

3
Modèles d'effets mixtes linéaires
J'ai souvent entendu que les modèles LME sont plus solides dans l'analyse des données de précision (c'est-à-dire dans les expériences de psychologie), en ce sens qu'ils peuvent fonctionner avec des distributions binomiales et autres distributions non normales que les approches traditionnelles (par exemple, l'ANOVA) ne peuvent pas. Quelle est la …

4
Séparer deux populations de l'échantillon
J'essaie de séparer deux groupes de valeurs d'un même ensemble de données. Je peux supposer que l'une des populations est normalement distribuée et représente au moins la moitié de la taille de l'échantillon. Les valeurs du second sont à la fois inférieures ou supérieures aux valeurs du premier (la distribution …

4
Logiciel d'anonymisation des données
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Quelqu'un connaît-il un bon logiciel d'anonymisation des données? Ou peut-être un package pour R qui fait l'anonymisation des données? Évidemment, ne …
13 software 


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.