Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Entropie bayésienne vs maximale
Supposons que la quantité que nous voulons inférer soit une distribution de probabilité. Tout ce que nous savons, c'est que la distribution provient d'un ensemble déterminé, disons, par certains de ses moments et nous avons un antérieur .EEEQQQ Le principe d'entropie maximale (MEP) dit que le qui a le moins …

2
Problème de calcul de la distribution conjointe et marginale de deux distributions uniformes
Supposons que nous ayons une variable aléatoire distribuée comme et distribuée comme , où signifie une distribution uniforme dans l'intervalle .X1X1X_1U[0,1]U[0,1]U[0,1]X2X2X_2U[0,X1]U[0,X1]U[0,X_1]U[a,b]U[a,b]U[a,b][a,b][a,b][a,b] J'ai pu calculer le pdf commun de et le pdf marginal de .(X1,X2)(X1,X2)(X_1,X_2)X1X1X_1 p(x1,x2)=1x1, for 0≤x1≤1,0≤x2≤x1,p(x1,x2)=1x1, for 0≤x1≤1,0≤x2≤x1, p(x_1,x_2) = \frac{1}{x_1}, \text{ for }\quad 0\le x_1\le 1, \quad 0\le …

1
Régression multiple avec de petits ensembles de données
J'ai un ensemble de données d'études de cas de projet pour un nouveau type de méthode de recherche pour les agences gouvernementales pour soutenir les activités de prise de décision. Ma tâche consiste à développer une méthode d'estimation basée sur l'expérience passée pour de futurs projets à des fins d'estimation. …

1
Distribution de la corrélation d'échantillon
Supposons que j'ai une grande population de points de données et que la corrélation de Pearson soit( x , y)(x,y)(x,y) corr (X, Y) = ρcorr(X,Y)=ρ\textrm{corr}(X,Y) = \rho Que puis-je raisonnablement dire sur la corrélation que je m'attends à observer dans un échantillon de taille ? Si la corrélation d'échantillon est …

2
Peut-on utiliser le Kappa de Cohen pour deux jugements seulement?
J'utilise le Kappa de Cohen pour calculer l'inter-accord entre deux juges. Il est calculé comme suit: P(A)−P(E)1−P(E)P(A)−P(E)1−P(E) \frac{P(A) - P(E)}{1 - P(E)} où est la proportion d'accord et la probabilité d'accord par hasard.P(A)P(A)P(A)P(E)P(E)P(E) Maintenant, pour l'ensemble de données suivant, j'obtiens les résultats attendus: User A judgements: - 1, true - …


1
Que signifient «cas témoins» et «transversaux» dans le contexte de la modélisation logistique?
En étudiant la modélisation logistique, j'ai lu la déclaration suivante Le fait que seuls les rapports de cotes, et non les risques individuels, puissent être estimés à partir de la modélisation logistique dans les études cas-témoins ou transversales n'est pas surprenant. Je ne sais pas ce que les "études cas-témoins" …



1
Quelqu'un peut-il m'aider à comprendre quel type de problème je regarde? Je ne sais pas si cela se classe comme test d'hypothèse
Veuillez m'excuser si cette question n'est pas claire. Je ne sais pas si j'utilise les bonnes terminologies. J'ai mené plusieurs fois une expérience dans différents environnements. Donc, mes données ressemblent à ceci: Environment1 1.2 2.1 1.1 1.5 1.6 Environment2 4.2 2.6 3.5 2.5 2.9 Environment3 7.2 4.6 5.3 4.5 1.6 …




3
Comment identifier les valeurs aberrantes dans les données de performances de disponibilité du serveur?
J'ai un script python qui crée une liste de listes de disponibilité du serveur et de données de performance, où chaque sous-liste (ou «ligne») contient les statistiques d'un cluster particulier. Par exemple, bien formaté, il ressemble à ceci: ------- ------------- ------------ ---------- ------------------- Cluster %Availability Requests/Sec Errors/Sec %Memory_Utilization ------- ------------- …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.