Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



1
Quelle est l'intuition derrière la fonction de score? [dupliquer]
Cette question a déjà des réponses ici : Quel type d'information est l'information Fisher? (3 réponses) Fermé il y a 7 mois . Wikipédia nous apprend que la partition joue un rôle important dans l'inégalité Cramér-Rao. Il énonce également la définition: V=∂∂θlogL(θ;X)V=∂∂θlog⁡L(θ;X)V = \frac{\partial}{\partial \theta} \log{L(\theta; X)} Cependant, je ne …

4
Différence entre biais, biais systématique et erreur systématique?
Y a-t-il une différence entre les termes suivants ou ils sont identiques? Biais Biais systématique Erreurs systématiques S'il existe des différences, veuillez les expliquer. Ces erreurs peuvent-elles être réduites lorsque l'on augmente la taille de l'échantillon? MISE À JOUR: Mon domaine d'intérêt est l'inférence statistique. Je veux dire que la …

3
Estimation des effets aléatoires et application d'une structure de corrélation / covariance définie par l'utilisateur avec le package R lme4 ou nlme
J'ai le type de données suivant. J'ai évalué 10 individus chacun répété 10 fois. J'ai une matrice de relations 10x10 (relation entre toutes les combinaisons des individus). set.seed(1234) mydata <- data.frame (gen = factor(rep(1:10, each = 10)), repl = factor(rep(1:10, 10)), yld = rnorm(10, 5, 0.5)) Cette génération est constituée …
9 r  mixed-model 

1
Cohérence du processus d'apprentissage
J'ai deux questions liées au concept de "cohérence d'apprentissage" pour ceux qui connaissent la théorie de l'apprentissage statistique à la Vapnik. Question 1. Le processus d'apprentissage est appelé cohérent (pour la classe de fonctions et la distribution de probabilité ) siFF\mathcal{F}PPP Remp(f∗l)→Pinff∈FR(f),l→∞Remp(fl∗)→Pinff∈FR(f),l→∞ R_{emp}(f^*_l) \buildrel P \over \to \inf_{f \in \mathcal{F}} …


2
Valeurs deux échantillons de Kolmogorov-Smirnov
J'utilise le test à deux échantillons de Kolmogorov – Smirnov pour comparer les distributions, et j'ai remarqué qu'une valeur de est fréquemment indiquée comme statistique de test. Comment cette valeur est-elle déterminée? Je sais que c'est la probabilité d'obtenir un résultat au moins aussi grand que celui obtenu, mais comment …

1
Processus de mélange et de division
Sur la figure suivante à gauche, deux réalisations de processus ponctuels avec une densité (intensité) différente et sont mélangées en faisant correspondre le centre des zones d'appartenance pour construire un processus ponctuel au milieu avec une intensité . Ensuite, des points sélectionnés au hasard sous forme de deux ensembles extraits …



2
L'informatique quantique permettra-t-elle de nouvelles techniques statistiques?
Je viens de lire que vous pouvez désormais acheter un ordinateur quantique (bien qu'il n'y en ait eu qu'un vendu jusqu'à présent!). L'informatique quantique aura-t-elle des applications en statistique? {edit - pour les besoins de la question, supposons que finalement les ordinateurs quantiques (sous une forme ou une autre) fonctionneront}
9 theory 

3
Test bayésien AB
J'exécute un test AB sur une page qui ne reçoit que 5 000 visites par mois. Il faudrait trop de temps pour atteindre les niveaux de trafic nécessaires pour mesurer une différence de + -1% entre le test et le contrôle. J'ai entendu dire que je peux utiliser les statistiques …


3
Conseils généraux sur la modélisation
La formulation d'un modèle mathématique pour un problème est l'un des aspects les plus subjectifs de la statistique, mais aussi l'un des plus importants. Quelles sont les meilleures références traitant de ce sujet crucial mais souvent négligé? Et quel célèbre statisticien a dit quelque chose dans le sens de: "Que …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.