Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données




3
Consistance asymptotique avec variance asymptotique non nulle - qu'est-ce que cela représente?
La question a déjà été soulevée, mais je veux poser une question spécifique qui tentera d'obtenir une réponse qui la clarifiera (et la classera): Dans "Poor Man's Asymptotics", on garde une distinction claire entre (a) une séquence de variables aléatoires qui converge en probabilité vers une constante contrairement à (b) …

1
Choisir entre les fonctions de perte pour la classification binaire
Je travaille dans un domaine problématique où les gens rapportent souvent ROC-AUC ou AveP (précision moyenne). Cependant, j'ai récemment trouvé des documents qui optimisent la perte de journal à la place, tandis que d'autres encore signalent une perte de charnière . Bien que je comprenne comment ces mesures sont calculées, …

4
Non-transitivité de la corrélation: corrélations entre le sexe et la taille du cerveau et entre la taille du cerveau et le QI, mais pas de corrélation entre le sexe et le QI
J'ai trouvé l'explication suivante sur un blog et j'aimerais obtenir plus d'informations sur la non-transitivité de la corrélation: Nous avons les faits incontestables suivants: En moyenne, il existe une différence de volume cérébral entre les hommes et les femmes Il existe une corrélation entre le QI et la taille du …




3
GLM binomial négatif ou transformation logarithmique pour les données de comptage: augmentation du taux d'erreur de type I
Certains d'entre vous ont peut-être lu ce bel article: O'Hara RB, Kotze DJ (2010) Ne pas enregistrer les données de comptage par transformation. Méthodes en écologie et évolution 1: 118-122. Klick . Dans mon domaine de recherche (écotoxicologie), nous avons affaire à des expériences mal reproduites et les GLM ne …

3
Pourquoi les statistiques bayésiennes ne sont-elles pas plus populaires pour le contrôle statistique des processus?
Ma compréhension du débat bayésien vs fréquentiste est que les statistiques fréquentistes: est (ou prétend être) objectif ou du moins impartial donc différents chercheurs, en utilisant des hypothèses différentes, peuvent toujours obtenir des résultats quantitativement comparables tandis que les statistiques bayésiennes prétend faire de "meilleures" prévisions (c.-à-d. une perte attendue …



4
Formation d'un modèle de Markov caché, plusieurs instances de formation
J'ai implémenté un HMM discret selon ce tutoriel http://cs229.stanford.edu/section/cs229-hmm.pdf Ce tutoriel et d'autres parlent toujours de la formation d'un HMM à partir d'une séquence d'observation. Que se passe-t-il lorsque j'ai plusieurs séquences d'entraînement? Dois-je simplement les exécuter séquentiellement, en entraînant le modèle après l'autre? Une autre option consiste à concaténer …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.