Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je veux tester un modèle de chemin à plusieurs étapes (par exemple, A prédit B, B prédit C, C prédit D) où toutes mes variables sont des observations individuelles imbriquées dans des groupes. Jusqu'à présent, je l'ai fait à travers plusieurs analyses multiniveaux uniques dans R. Je préférerais utiliser une …
J'utilise R. Chaque jour. Je pense qu'en termes de data.frames, la famille de fonctions apply (), la programmation orientée objet, la vectorisation et les géométries / esthétiques ggplot2. Je viens de commencer à travailler pour une organisation qui utilise principalement SAS. Je sais qu'il existe un livre sur l' apprentissage …
Le contexte: À partir d'une question sur Mathematics Stack Exchange (Puis-je créer un programme) , quelqu'un a un ensemble de points et veut y adapter une courbe, linéaire, exponentielle ou logarithmique. La méthode habituelle consiste à commencer par choisir l'un d'entre eux (qui spécifie le modèle), puis à effectuer les …
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Pourriez-vous recommander un package d'analyse conjointe facile à utiliser ou complet pour R?
J'ai des données très corrélées. Si je lance une régression linéaire, j'obtiens une droite de régression avec une pente proche de une (= 0,93). Ce que je voudrais faire, c'est tester si cette pente est significativement différente de 1.0. Je m'attends à ce que ce ne soit pas le cas. …
Contexte Je supervise l'entrée des données de la littérature primaire dans une base de données . Le processus de saisie des données est sujet aux erreurs, en particulier parce que les utilisateurs doivent interpréter la conception expérimentale, extraire les données des graphiques et des tableaux et transformer les résultats en …
Prenons l'exemple suivant: set.seed(342) x1 <- runif(100) x2 <- runif(100) y <- x1+x2 + 2*x1*x2 + rnorm(100) fit <- lm(y~x1*x2) Cela crée un modèle de y basé sur x1 et x2, en utilisant une régression OLS. Si nous souhaitons prédire y pour un x_vec donné, nous pourrions simplement utiliser la …
Quels sont les principaux pièges de l'utilisation de modèles linéaires à effets mixtes? Quelles sont les choses les plus importantes à tester / surveiller lors de l'évaluation de la pertinence de votre modèle? Lorsque vous comparez des modèles du même ensemble de données, quelles sont les choses les plus importantes …
En utilisant le coefficient de corrélation de Pearson, j'ai plusieurs variables qui sont hautement corrélées ( et pour 2 paires de variables qui sont dans mon modèle).ρ = 0,978ρ=0,978\rho = 0.978ρ = 0,989ρ=0,989\rho = 0.989 La raison pour laquelle certaines variables sont fortement corrélées est qu’une variable est utilisée dans …
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Je recherche des jeux de données de réseaux sociaux (twitter, friendfeed, facebook, lastfm, etc.) pour les tâches de classification, de préférence …
Évidemment, les événements A et B sont indépendants si Sf = Pr Pr . Définissons une quantité associée Q:(A∩B)(A∩B)(A\cap B)(A)(A)(A)(B)(B)(B) Q≡Pr(A∩B)Pr(A)Pr(B)Q≡Pr(A∩B)Pr(A)Pr(B)Q\equiv\frac{\mathrm{Pr}(A\cap B)}{\mathrm{Pr}(A)\mathrm{Pr}(B)} A et B sont donc indépendants si Q = 1 (en supposant que le dénominateur est différent de zéro). Q a-t-il réellement un nom? J'ai l'impression que cela …
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Considérez le graphique suivant: x <- 1:100 y1 <- rnorm(100) y2 <- rnorm(100)+100 par(mar=c(5,5,5,5)) plot(x,y1,pch=0,type="b",col="red",yaxt="n",ylim=c(-8,2),ylab="") axis(side=2, at=c(-2,0,2)) mtext("red line", side = …
J'ai des données comme celle-ci: > table(A,B,C) , , C = FALSE B A FALSE TRUE FALSE 177 42 TRUE 6 8 , , C = TRUE B A FALSE TRUE FALSE 5 31 TRUE 4 10 Comment puis-je tracer cela sur un seul graphique, éventuellement sans imposer de hiérarchie?
Dans un modèle logit, existe-t-il un moyen plus intelligent de déterminer l'effet d'une variable ordinale indépendante que d'utiliser des variables fictives pour chaque niveau?
J'ai récemment lu le livre de Skillicorn sur les décompositions matricielles et j'ai été un peu déçu, car il était destiné à un public de premier cycle. Je voudrais compiler (pour moi et pour les autres) une courte bibliographie des articles essentiels (enquêtes, mais aussi des articles révolutionnaires) sur les …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.