Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

2
Parallélisation du paquet caret à l'aide de doSMP
MISE À JOUR: caret utilise désormais en foreachinterne, donc cette question n'est plus vraiment pertinente. Si vous pouvez enregistrer un backend parallèle fonctionnel foreach, caret l'utilisera. J'ai le package caret pour R, et je suis intéressé par l'utilisation de la trainfonction pour effectuer une validation croisée de mes modèles. Cependant, …

3
Test d'hypothèse sur données continues gonflées à zéro
J'apprécierais grandement vos conseils sur le problème suivant: J'ai un grand ensemble de données continu avec beaucoup de zéros (~ 95%) et je dois trouver la meilleure façon de tester si certains sous-ensembles sont "intéressants", c'est-à-dire qu'ils ne semblent pas provenir de la même distribution que le reste. L'inflation nulle …


2
Comparaison d'un modèle mixte (sujet comme effet aléatoire) à un modèle linéaire simple (sujet comme effet fixe)
Je termine une analyse sur un grand ensemble de données. Je voudrais prendre le modèle linéaire utilisé dans la première partie du travail et le réajuster en utilisant un modèle mixte linéaire (LME). Le LME serait très similaire à l'exception que l'une des variables utilisées dans le modèle serait utilisée …

1
Choisissez le niveau de facteur comme base factice en lm () en R
Disons que je régresse Y sur X1 et X2, où X1 est une variable numérique et X2 est un facteur à quatre niveaux (A: D). Existe-t-il un moyen d'écrire la fonction de régression linéaire lm(Y ~ X1 + as.factor(X2))afin que je puisse choisir un niveau particulier de X2 - disons, …
10 r 


1
Génération de vecteurs aléatoires avec contraintes
J'ai besoin de créer des vecteurs aléatoires de nombres réels a_i satisfaisant aux contraintes suivantes: abs(a_i) < c_i; sum(a_i)< A; # sum of elements smaller than A sum(b_i * a_i) < B; # weighted sum is smaller than B aT*A*a < D # quadratic multiplication with A smaller than D …

1
Comment rendre une matrice positive définie?
J'essaie d'implémenter un algorithme EM pour le modèle d'analyse factorielle suivant; Wj=μ+Baj+ejforj=1,…,nWj=μ+Baj+ejforj=1,…,nW_j = \mu+B a_j+e_j \quad\text{for}\quad j=1,\ldots,n où est un vecteur aléatoire à p dimensions, a j est un vecteur à q dimensions de variables latentes et B est une matrice pxq de paramètres.WjWjW_jajaja_jBBB En raison d'autres hypothèses utilisées pour …



3
Comment pouvez-vous savoir si les bonnes performances sont consécutives?
Je résous les cubes de Rubik comme passe-temps. J'enregistre le temps qu'il m'a fallu pour résoudre le cube en utilisant un logiciel, et maintenant j'ai des données de milliers de résolutions. Les données sont essentiellement une longue liste de nombres représentant le temps pris par chaque résolution séquentielle (par exemple …

4
Combiner les probabilités d'accidents nucléaires
Les récents événements au Japon m'ont fait penser à ce qui suit. Les centrales nucléaires sont généralement conçues pour limiter le risque d'accidents graves à une «probabilité de référence», par exemple 10E-6 / an. Ce sont les critères d'une seule usine. Cependant, lorsqu'il y a une population de centaines de …



1
Méta-analyse dans R utilisant le package metafor
Comment dois-je syntaxer la rmafonction du package metafor afin d'obtenir des résultats dans l'exemple réel d'une petite méta-analyse suivante? (statistique aléatoire SMD à effet aléatoire) study, mean1, sd1, n1, mean2, sd2, n2 Foo2000, 0.78, 0.05, 20, 0.82, 0.07, 25 Sun2003, 0.74, 0.08, 30, 0.72, 0.05, 19 Pric2005, 0.75, 0.12, 20, …
10 r  meta-analysis 

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.