Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données


1
Est-ce que rstan ou mon approximation de grille est incorrecte: décider entre des estimations quantiles contradictoires dans l'inférence bayésienne
J'ai un modèle pour obtenir des estimations bayésiennes de la taille de la population NNNet probabilité de détection dans une distribution binomiale uniquement basée sur le nombre observé d’objets observés : pour . Pour simplifier, nous supposons que N est fixé à la même valeur inconnue pour chaque y_i . …

1
Pourquoi les gens optimisent souvent le déterminant de
Disons que j'ai un vecteur aléatoireY∼N(Xβ,Σ)Y∼N(Xβ,Σ)Y\sim N(X\beta,\Sigma) etΣ≠σ2IΣ≠σ2I\Sigma\neq\sigma^2 I. Autrement dit, les éléments deYYY (donné XβXβX\beta) sont corrélés. L'estimateur naturel de ββ\beta est (X′Σ−1X)−1X′Σ−1Y(X′Σ−1X)−1X′Σ−1Y(X'\Sigma^{-1}X)^{-1}X'\Sigma^{-1}Y, et var(β^)=(X′Σ−1X)−1var(β^)=(X′Σ−1X)−1\text{var}(\hat{\beta})=(X'\Sigma^{-1}X)^{-1} Dans un contexte de conception, l'expérimentateur peut jouer avec la conception, ce qui entraînera différentes XXX et ΣΣ\Sigma donc différent var(β^)var(β^)\text{var}(\hat{\beta}). Pour choisir une …




2
Existe-t-il un test / une technique / une méthode pour comparer les décompositions des composants principaux entre les échantillons?
Existe-t-il un moyen méthodique de comparer les directions, les grandeurs, etc. des résultats de l'ACP pour différents échantillons prélevés sur la même population? Je laisse la nature du test délibérément vague parce que j'aimerais entendre toutes les différentes possibilités ... par exemple, il pourrait y avoir (et je spécule ici) …



3
Utilisation de k-means avec d'autres mesures
Je me rends donc compte que cela a déjà été demandé: par exemple, quels sont les cas d'utilisation liés à l'analyse de cluster de différentes métriques de distance? mais j'ai trouvé les réponses quelque peu contradictoires avec ce qui est suggéré devrait être possible dans la littérature. Récemment, j'ai lu …


5
Intervalle de confiance sur une quantité aléatoire?
Supposons que est un vecteur inconnu et que l'on observe . Je voudrais calculer des intervalles de confiance sur la quantité aléatoire , basée uniquement sur le observé et le paramètre connu . Autrement dit, pour un , trouver tel que .a⃗ a→\vec{a}pppb⃗ ∼N(a⃗ ,I)b→∼N(a→,I)\vec{b} \sim \mathcal{N}\left(\vec{a}, I\right)b⃗ ⊤a⃗ b→⊤a→\vec{b}^{\top} …


1
Probabilité et estimations des effets mixtes Régression logistique
Simulons d'abord quelques données pour une régression logistique avec des parties fixes et aléatoires: set.seed(1) n <- 100 x <- runif(n) z <- sample(c(0,1), n, replace=TRUE) b <- rnorm(2) beta <- c(0.4, 0.8) X <- model.matrix(~x) Z <- cbind(z, 1-z) eta <- X%*%beta + Z%*%b pr <- 1/(1+exp(-eta)) y <- …

1
Test AB vs test de l'hypothèse nulle
J'essaie de comprendre la différence entre tester l'hypothèse nulle (c.-à-d. tester que la probabilité d'un «objectif» est la même pour 2 populations différentes, similaire au test prop. dans R) un test A / B utilisant une formule bayésienne telle que décrite ici: http://www.evanmiller.org/bayesian-ab-testing.html Y a-t-il une différence? Est-ce préférable? Le …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.