Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données


1
Visualiser les proportions successives
J'essaie de visualiser certaines données de consommation, qui ont 4 catégories. Les utilisateurs sont libres de basculer entre les différentes catégories. Je voudrais visualiser les trois ou quatre derniers commutateurs pour chaque individu. Nous commencerions donc par un tracé avec une colonne avec 4 proportions empilées. Après cela, nous aurions …

2
Validation croisée pour les modèles mixtes?
Mon collègue et moi ajustons une gamme de modèles d'effets mixtes linéaires et non linéaires dans R. On nous demande d'effectuer une validation croisée sur les modèles ajustés afin que l'on puisse vérifier que les effets observés sont relativement généralisables. C'est normalement une tâche triviale, mais dans notre cas, nous …



3
Un problème d'estimation dans le suivi GPS
Problème: Considérons deux voitures (considérées comme des objets ponctuels), nommées leader et suiveur , toutes deux équipées de dispositifs GPS qui communiquent entre elles. Le but de est de suivre plus près possible car ce dernier se déplace arbitrairement dans l'avion. Étant donné que tous les appareils GPS ont une …

1
Calcul manuel PACF
J'essaie de reproduire le calcul que font SAS et SPSS pour la fonction d'autocorrélation partielle (PACF). En SAS, il est produit par Proc Arima. Les valeurs PACF sont les coefficients d'une autorégression de la série d'intérêt sur les valeurs décalées de la série. Ma variable d'intérêt étant les ventes, je …

4
Trouver des intervalles de densité de probabilité
J'ai le vecteur x <- c(1,2,3,4,5,5,5,6,6,6,6, 7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7, 7,7,7,7,7,7,7,7,8,8,8,8,9,9,9,10) (mon vecteur réel a une longueur> 10 000) et je voudrais trouver les intervalles où se trouvent les 90% de la densité. Est-ce quantile(x, probs=c(0.05,0.95), type=5)le plus approprié ou existe-t-il une autre manière?
9 r 



1
Calcul de la fiabilité inter-évaluateurs en R avec un nombre variable de notes?
Wikipedia suggère qu'une façon d'examiner la fiabilité inter-évaluateurs consiste à utiliser un modèle à effets aléatoires pour calculer la corrélation intraclasse . L'exemple de la corrélation intraclasse parle de regarder σ2ασ2α+ σ2ϵσα2σα2+σϵ2\frac{\sigma_\alpha^2}{\sigma_\alpha^2+\sigma_\epsilon^2} à partir d'un modèle Ouije j= μ + αje+ ϵje jOuijej=μ+αje+ϵjejY_{ij} = \mu + \alpha_i + \epsilon_{ij} "où …


1
Lignes pointillées dans le tracé ACF en R
Je passe en revue le livre «Introductory Time Series with R» de Cowpertwait et Metcalfe. À la page 36, il indique que les lignes sont à: . J'ai lu ici R forum que les lignes sont à . −1/n±2/n−−√−1/n±2/n-1/n \pm 2/\sqrt{n}±1.96/n−−√±1.96/n\pm 1.96/\sqrt{n} J'ai exécuté le code suivant: b = c(3,1,4,1) …
9 r  time-series 

1
Comment calculer
J'essaie de résoudre un problème pour ma thèse et je ne vois pas comment le faire. J'ai 4 observations tirées au hasard d'une distribution uniforme ( 0 , 1 )(0,1)(0,1) . Je veux calculer la probabilité que 3 X( 1 )≥ X( 2 )+ X( 3 )3X(1)≥X(2)+X(3)3 X_{(1)}\ge X_{(2)}+X_{(3)} . …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.