Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



3
La distribution stable positive dans R
Les distributions stables positives sont décrites par quatre paramètres: le paramètre d'asymétrie , le paramètre d'échelle , le paramètre de localisation , etc. -index appelé paramètre . Lorsque est nul la distribution est symétrique autour de , quand elle est positive (resp. négative) la distribution est biaisée vers la droite …


1
Mesurer la corrélation des réseaux de neurones entraînés
J'entraîne un réseau neuronal artificiel (rétropropagation, feed-forward) avec des données distribuées non normales. En plus de l'erreur quadratique moyenne, la littérature suggère souvent le coefficient de corrélation de Pearson pour évaluer la qualité du filet formé. Mais, le coefficient de corrélation de Pearson est-il raisonnable, si les données d'entraînement ne …

1
R implémentation du coefficient de détermination partielle
Quelqu'un a-t-il des suggestions ou des packages pour calculer le coefficient de détermination partielle? Le coefficient de détermination partielle peut être défini comme le pourcentage de variation qui ne peut pas être expliqué dans un modèle réduit, mais peut être expliqué par les prédicteurs spécifiés dans un modèle complet (er). …
9 r  regression  anova 

2
Suis-je en train de spécifier correctement mon modèle lmer?
J'ai parcouru Google et ce site et je suis toujours confus à propos de la fonction lmer dans la bibliothèque lme4. J'ai quelques données recueillies auprès de différents services psychiatriques, qui ont une structure à plusieurs niveaux. Pour simplifier, je vais choisir deux variables de niveau 2 et deux de …


4
Comment rechercher une procédure statistique en R?
Existe-t-il un package R, un site Web ou une commande qui permettra de rechercher une procédure statistique spécifique qu'ils souhaitent? Par exemple, si je voulais trouver un package qui avait la transformation Box-Cox, le site Web / package / command pourrait retourner "MASS" et me référer à la boxcox()fonction. C'est …
9 r 

2
Premiers pas avec le biclustering
J'ai fait des recherches occasionnelles sur Internet sur les biclusters. (J'ai lu l'article Wiki plusieurs fois.) Jusqu'à présent, il semble qu'il y ait peu de définitions ou de terminologie standard. Je me demandais s'il y avait des articles ou des livres standard que toute personne intéressée par les algorithmes pour …


1
La variable de code dans la fonction nlm ()
Dans R, il existe une fonction nlm () qui effectue une minimisation d'une fonction f en utilisant l'algorithme de Newton-Raphson. En particulier, cette fonction génère la valeur du code variable défini comme suit: codez un entier indiquant pourquoi le processus d'optimisation s'est terminé. 1: le gradient relatif est proche de …
9 r  minimum 

1
Comment un test Tukey HSD pourrait-il être plus significatif que la valeur P non corrigée de t.test?
Je suis venu par le post " Comparaisons par paires post-hoc de l'ANOVA bidirectionnelle " (répondant à ce post ), qui montre ce qui suit: dataTwoWayComparisons <- read.csv("http://www.dailyi.org/blogFiles/RTutorialSeries/dataset_ANOVA_TwoWayComparisons.csv") model1 <- aov(StressReduction~Treatment+Age, data =dataTwoWayComparisons) summary(model1) # Treatment is signif pairwise.t.test(dataTwoWayComparisons$StressReduction, dataTwoWayComparisons$Treatment, p.adj = "none") # no signif pair TukeyHSD(model1, "Treatment") # …


3
Comment accélérer le calcul des effets fixes dans un GLMM?
Je fais une étude de simulation qui nécessite des estimations d'amorçage obtenues à partir d'un modèle mixte linéaire généralisé (en fait, le produit de deux estimations pour les effets fixes, une à partir d'un GLMM et l'autre à partir d'un LMM). Pour bien faire l'étude, il faudrait environ 1000 simulations …
9 r  mixed-model 

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.