Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Pourquoi devrions-nous discuter des comportements de convergence de différents estimateurs dans différentes topologies?
Dans le premier chapitre de l'ouvrage Algebraic Geometry and Statistical Learning Theory qui parle de la convergence des estimations dans différents espaces fonctionnels, il mentionne que l'estimation bayésienne correspond à la topologie de la distribution de Schwartz, tandis que l'estimation du maximum de vraisemblance correspond à la topologie sup-normale (à …

3
Quelqu'un peut-il expliquer la déformation temporelle dynamique pour déterminer la similitude des séries chronologiques?
J'essaie de saisir la mesure de déformation temporelle dynamique pour comparer les séries temporelles ensemble. J'ai trois séries de données chronologiques comme celle-ci: T1 <- structure(c(0.000213652387565, 0.000535045478866, 0, 0, 0.000219346347883, 0.000359669104424, 0.000269469145783, 0.00016051364366, 0.000181950509461, 0.000385579332948, 0.00078170803205, 0.000747244535774, 0, 0.000622858922454, 0.000689084895259, 0.000487983408564, 0.000224744353298, 0.000416449765747, 0.000308388157895, 0.000198906016907, 0.000179549331179, 9.06289650172e-05, 0.000253506844685, 0.000582896161212, 0.000386473429952, …





3
Que signifie la distribution tronquée?
Dans un article de recherche sur l'analyse de sensibilité d'un modèle d'équation différentielle ordinaire d'un système dynamique, l'auteur a fourni la distribution d'un paramètre de modèle en tant que distribution normale (moyenne = 1e-4, std = 3e-5) tronquée à la plage [0,5e -4 1,5e-4]. Il utilise ensuite des échantillons de …

1
Lorsque des classes déséquilibrées sont sur / sous-échantillonnées, maximiser la précision diffère-t-il de minimiser les coûts de mauvaise classification?
Tout d'abord, je voudrais décrire quelques dispositions courantes que les livres d'exploration de données utilisent pour expliquer comment traiter les ensembles de données non équilibrés . Habituellement, la section principale est intitulée Ensembles de données non équilibrés et couvre ces deux sous-sections: Techniques de classification et d'échantillonnage sensibles aux coûts. …



4
Comment digérer le contexte statistique?
Tout d' abord, je suppose que pas tous les membres actifs de ce site intéressant sont les statisticiens que leur travail. Sinon, la question posée comme suit n'a aucun sens! Je les respecte bien sûr, mais j'ai besoin d'une explication un peu plus pratique que conceptuelle. Je commence par un …

3
Comment utiliser la fonction de test de Levene dans R?
Je suis novice dans les statistiques et R et j'ai un problème avec l'utilisation de la fonction Levene (je voudrais vérifier l'égalité de variance de deux échantillons). La documentation indique que je devrais exécuter: levene.test (y, groupe) Mais je n'ai aucune idée de ce que je devrais mettre en tant …




En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.