Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Comparaison de l'entropie et de la distribution des octets dans les données compressées / cryptées
J'ai une question qui m'occupe depuis un moment. Le test d'entropie est souvent utilisé pour identifier les données chiffrées. L'entropie atteint son maximum lorsque les octets des données analysées sont distribués uniformément. Le test d'entropie identifie les données chiffrées, car ces données ont une distribution uniforme, comme les données compressées, …

2
Quel package R utiliser pour effectuer une analyse de croissance de classe latente (LCGA) / modèle de mélange de croissance (GMM)?
J'essaie d'effectuer une analyse de croissance de classe latente (LCGA) et / ou des modèles de mélange de croissance (GMM) dans R. Les données que j'utilise sont un nombre croissant de fourchettes de référentiels git (variable discrète, non catégorique), comme vous pouvez voir dans cet ensemble de données . J'ai …


3
Comment comparer les données classées?
J'ai des questions sur la façon d'analyser les données classées. Les données ressemblent à ceci: 4 groupes de personnes vivant avec le VIH et 16 autres groupes de personnes vivant dans le même village ont été invités à classer 12 défis pour les personnes vivant avec le VIH selon leur …

2
Comment interpréter une boîte à moustaches?
J'ai quelques données dans lesquelles il y a 5 variables explicatives catégoriques ( concern, breath, weath, sleep, act) et 1 variable de réponse continue ( tto). De plus, chaque variable explicative catégorielle est divisée en 5 niveaux qui montrent à quel point une personne en est convaincue. les niveaux 1 …


2
Deux périodes saisonnières dans ARIMA avec R
J'utilise actuellement R pour prédire une série chronologique avec ces instructions: X <- ts(datas, frequency=24) X.arima <- Arima(X, order=c(2,1,0), seasonal=c(1,1,1)) pred <- predict(X.arima, n.ahead=24) plot.ts(pred$pred) Comme vous pouvez le voir, j'ai des données toutes les heures, et j'ai choisi la période saisonnière de 24 (un jour). Je voudrais améliorer mes …

5
Lissage des données 2D
Les données sont constituées de spectres optiques (intensité lumineuse en fonction de la fréquence) enregistrés à différents moments. Les points ont été acquis sur une grille régulière en x (temps), y (fréquence). Afin d'analyser l'évolution du temps à des fréquences spécifiques (une montée rapide, suivie d'une décroissance exponentielle), je voudrais …



1
Génération aléatoire de notes de musique
Je travaille sur un petit projet, qui est actuellement au stade de développement précoce. Ce que j'essaie de comprendre, c'est comment générer de la musique aléatoire, en particulier des notes. En faisant des recherches sur Google, je n'ai réussi qu'à trouver un générateur de notes de rançon et beaucoup de …

2
Estimateur d'un taux d'incidence
Tout en suivant un cours de statistique pour les étudiants en médecine, j'ai rencontré un problème lié aux taux d'incidence. Le contexte du problème est un chapitre sur la distribution de Poisson. Dans le problème, 2300 fumeurs sont suivis sur une période d'un an au cours de laquelle 24 d'entre …




En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.