Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données





1
Moyennes de moyennes (de moyennes, de moyennes…)
Considérez l'expérience de biologie cellulaire suivante. Nous comparons différents traitements de cellules en culture. Chaque traitement est répliqué dans plusieurs puits (microtitrage) , indexés par la variable . Pour mesurer la réponse au traitement dans le puits , un total de micrographies ou champs non chevauchants sont enregistrés. Ensuite, pour …

2
Identification des modèles séquentiels
Je travaille avec des données de séquence qui sont de longues listes d'appels win-api de logiciels malveillants. J'essaie de jeter le problème de l'identification du «comportement de malware» dans celui de trouver des modèles séquentiels. Je traite chaque appel d'API comme un élément unique. Le nombre d'éléments différents possibles (appels …


1
Bootstrapping avec un petit nombre d'observations
Disons que j'ai collecté un petit nombre (N) d'observations pour une hypothèse que j'aimerais tester. Je pourrais utiliser la méthode bootstrap pour produire une distribution d'échantillon pour le résultat moyen de N observations, mais je crains que ce modèle ne se décompose lorsque N devient très petit, introduisant une erreur …
8 bootstrap 

2
k-fold CV des prévisions de séries chronologiques financières - les performances du dernier pli sont-elles plus pertinentes?
Je travaille sur un modèle de prévision basé sur ANN pour une série temporelle financière. J'utilise la validation croisée 5 fois et les performances moyennes sont ainsi. Les performances sur le dernier pli (l'itération où le dernier segment est omis de la formation et utilisé pour la validation) sont meilleures …





1
Terrain divisé en R
J'ai un ensemble de données de repères et sous-échantillons dans chaque repère. J'exécute ces benchmarks et leurs sous-échantillons sur machines soumises. Les «individus» étudiés par les sous-échantillons sont les mêmes pour chaque machine sujet, et les repères sont les mêmes pour chaque machine sujet.nnnmmmppp Comment réaliser une ANOVA en R …
8 r  anova  split-plot 


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.