Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Quelle est la stratégie appropriée pour décider quel modèle utiliser avec les données de comptage? J'ai des données de comptage que j'ai besoin de modéliser en tant que modèle à plusieurs niveaux et il m'a été recommandé (sur ce site) que la meilleure façon de le faire soit par le …
Comme la modélisation de régression est souvent plus «artistique» que scientifique, je me retrouve souvent à tester de nombreuses itérations d'une structure de régression. Quels sont les moyens efficaces de résumer les informations de ces multiples exécutions de modèle pour essayer de trouver le "meilleur" modèle? Une approche que j'ai …
Étant donné X1X1X_1 et X2X2X_2 variables aléatoires normales avec coefficient de corrélation ρρ\rho , comment puis-je trouver la corrélation entre les variables aléatoires lognormales suivantes Y1Y1Y_1 et Y2Y2Y_2 ? Y1=a1exp(μ1T+T−−√X1)Y1=a1exp(μ1T+TX1)Y_1 = a_1 \exp(\mu_1 T + \sqrt{T}X_1) Y2=a2exp(μ2T+T−−√X2)Y2=a2exp(μ2T+TX2)Y_2 = a_2 \exp(\mu_2 T + \sqrt{T}X_2) Maintenant, si et X 2 = σ …
Comment définir une formule de modèle dans R, lorsqu'une (ou plusieurs) restrictions linéaires exactes liant les coefficients est disponible. Par exemple, disons que vous savez que b1 = 2 * b0 dans un modèle de régression linéaire simple. Je vous remercie!
Je pense qu'il est juste de dire que les statistiques sont une science appliquée, donc lorsque les moyennes et les écarts-types sont calculés, c'est parce que quelqu'un cherche à prendre des décisions en fonction de ces chiffres. Pour être un bon statisticien, j'espère que c'est en mesure de «sentir» quand …
J'essaie d'implémenter l'algorithme hit and run MCMC, mais j'ai un peu de mal à comprendre comment s'y prendre. L'idée générale est la suivante: Pour générer un saut de proposition dans MH, nous: Générer une direction partir d'une distribution à la surface de la sphère unitaire OdddOO\mathcal{O} Générez une distance signée …
Dans la régression logistique, est-il nécessaire de se préoccuper autant de la multicolinéarité que dans une régression OLS directe? Par exemple, avec une régression logistique, où la multicolinéarité existe, auriez-vous besoin d'être prudent (comme vous le feriez dans la régression OLS) en prenant des déductions à partir des coefficients bêta? …
J'ai développé le package ez pour R comme un moyen d'aider les gens à passer des packages de statistiques comme SPSS à R. Ceci est (espérons-le) réalisé en simplifiant la spécification des différentes versions d'ANOVA et en fournissant une sortie de type SPSS (y compris les tailles d'effet et l'hypothèse …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement de réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 6 ans . Cette question est liée à ma question précédente . Je …
Qui de vous dans ce forum utilise "> R avec le multicœur , les packages snow ou CUDA , donc pour des calculs avancés qui nécessitent plus de puissance qu'un processeur de station de travail? Sur quel matériel calculez-vous ces scripts? À la maison / au travail ou avez-vous accès …
Quelqu'un peut-il m'aider à interpréter les scores PCA? Mes données proviennent d'un questionnaire sur les attitudes envers les ours. Selon les chargements, j'ai interprété l'une de mes principales composantes comme "la peur des ours". Les scores de cette composante principale seraient-ils liés à la façon dont chaque répondant se mesure …
J'ai une série chronologique simple avec 5 à 10 points de données par ensemble de données à intervalles réguliers. Je me demande quelle est la meilleure façon de déterminer si deux ensembles de données sont différents. Dois-je essayer des tests t sur chaque point de données, ou regarder la zone …
Il y a quelques mois, j'ai posté une question sur les tests d'homoscédasticité dans R sur SO, et Ian Fellows a répondu à cela (je vais paraphraser sa réponse de manière très lâche): Les tests d'homoscédasticité ne sont pas un bon outil pour tester la qualité de l'ajustement de votre …
Si vous ajustez une fonction non linéaire à un ensemble de points (en supposant qu'il n'y a qu'une seule ordonnée pour chaque abscisse), le résultat peut être: une fonction très complexe avec de petits résidus une fonction très simple avec de gros résidus La validation croisée est couramment utilisée pour …
J'ai un petit problème qui me fait paniquer. Je dois écrire une procédure pour un processus d'acquisition en ligne d'une série temporelle multivariée. À chaque intervalle de temps (par exemple 1 seconde), j'obtiens un nouvel échantillon, qui est essentiellement un vecteur à virgule flottante de taille N. L'opération que je …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.