Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Simulation de novo des données d'un bloc de données de conception expérimentale. En mettant l'accent sur R (même si une autre solution linguistique serait formidable). Lors de la conception d'une expérience ou d'une enquête, la simulation de données et la réalisation d'une analyse sur ces données simulées peuvent fournir un …
La normalisation des données (pour avoir une moyenne nulle et un écart-type unitaire) avant d'effectuer une validation croisée multipliée par k a-t-elle des conséquences négatives telles qu'un sur-ajustement? Remarque: c'est pour une situation où #cases> total #features Je transforme certaines de mes données à l'aide d'une transformation de journal, puis …
J'ai toujours du mal à expliquer les techniques statistiques à un public sans fond statistique. Si je voulais expliquer ce qu'est le GLM à un tel public (sans jeter de jargon statistique), quelle serait la meilleure façon ou la plus efficace? J'explique généralement le GLM en trois parties - (1) …
J'ai une application basée sur servlet dans laquelle je mesure le temps nécessaire pour terminer chaque demande à ce servlet. Je calcule déjà des statistiques simples comme la moyenne et le maximum; Je voudrais cependant produire une analyse plus sophistiquée, et pour ce faire, je pense que je dois modéliser …
Voici mon expérience: J'utilise la findPeaksfonction dans le package quantmod : Je veux détecter les pics "locaux" dans une tolérance de 5, c'est-à-dire les premiers emplacements après que la série chronologique ait chuté des pics locaux de 5: aa=100:1 bb=sin(aa/3) cc=aa*bb plot(cc, type="l") p=findPeaks(cc, 5) points(p, cc[p]) p La sortie …
Je me rends compte que c'est subjectif, mais j'ai pensé que ce serait bien de parler de nos ensembles de données préférés et de ce que nous pensons les rend intéressants. Il y a une multitude de données là-bas, et avec toutes les API (par exemple, Datamob ) ainsi que …
J'ai des données de comptage (analyse de l'offre / de la demande avec le nombre de clients, en fonction - éventuellement - de nombreux facteurs) J'ai essayé une régression linéaire avec des erreurs normales, mais mon tracé QQ n'est pas vraiment bon. J'ai essayé une transformation logarithmique de la réponse: …
Considérez la régression linéaire avec une certaine régularisation: par exemple, trouver qui minimisexxx||Ax−b||2+λ||x||1||Ax−b||2+λ||x||1||Ax - b||^2+\lambda||x||_1 Habituellement, les colonnes de A sont normalisées pour avoir une moyenne et une norme unitaire nul, tandis que est centrée pour avoir une moyenne nulle. Je veux m'assurer que ma compréhension de la raison de …
J'ai été chargé de déplacer l'un de nos grands modèles stochastiques actuels hors de SAS et dans un nouveau langage. Personnellement, je préfère un langage compilé traditionnel, mais le PI veut que je vérifie R, que je n'ai jamais utilisé. Notre motivation pour sortir le modèle de SAS est (1) …
Je suis assez nouveau dans ce domaine, j'espère donc que vous me pardonnerez si la question est naïve. (Contexte: j'apprends l'économétrie à partir du livre de Davidson & MacKinnon "Econometric Theory and Methods" , et ils ne semblent pas l'expliquer; j'ai également regardé le livre d'optimisation de Luenberger qui traite …
J'ai un modèle linéaire classique, avec 5 régresseurs possibles. Ils ne sont pas corrélés entre eux et ont une corrélation assez faible avec la réponse. Je suis arrivé à un modèle où 3 des régresseurs ont des coefficients significatifs pour leur statistique t (p <0,05). L'ajout de l'une des deux …
J'ai un ensemble de données où chaque donnée se compose de mesures différentes. Pour chaque mesure, j'ai une valeur de référence. Je voudrais savoir à quel point chaque donnée est proche de la valeur de référence.nnn J'ai pensé à utiliser la distance euclidienne pondérée comme ceci: réx , b= ( …
La page d'aide de Prism donne l'explication suivante sur la façon dont il calcule les bandes de prédiction pour la régression non linéaire. Veuillez excuser la longue citation, mais je ne suis pas le deuxième paragraphe (qui explique comment est défini et est calculé). Toute aide serait grandement appréciée.G|xg|XG|xdY/dPréOui/réPdY/dP Le …
C'est en quelque sorte une question de débutant, mais comment interpréter un résultat exp (B) de 6.012 dans un modèle de régression logistique multinomial? 1) est-ce 6,012-1,0 = 5,012 = 5012% d'augmentation du risque? ou 2) 6,012 / (1 + 6,012) = 0,857 = 85,7% d'augmentation du risque? Dans le …
On me demande d'écrire une introduction aux statistiques et je n'arrive pas à montrer graphiquement la relation entre la valeur p et la puissance. Je suis venu avec ce graphique: Ma question: existe-t-il une meilleure façon d'afficher cela? Voici mon code R x <- seq(-4, 4, length=1000) hx <- dnorm(x, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.