Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je voulais juste voir si quelqu'un avait une expérience de l'application de la régression de processus gaussienne (GPR) à des ensembles de données de grande dimension. J'examine certaines des diverses méthodes GPR clairsemées (par exemple, les pseudo-entrées GPR clairsemées) pour voir ce qui pourrait fonctionner pour les ensembles de données …
Pour une régression linéaire avec plusieurs groupes (groupes naturels définis a priori), est-il acceptable d'exécuter deux modèles différents sur le même ensemble de données pour répondre aux deux questions suivantes? Chaque groupe a-t-il une pente non nulle et une intersection non nulle et quels sont les paramètres pour chaque régression …
Cela doit venir --- la prévision des choses coincées entre 0 et 1. Dans ma série, je soupçonne un composant d'auto-régression, et aussi un composant de retour à la moyenne, donc je veux quelque chose que je peux interpréter comme un ARIMA --- mais je ne veux pas qu'il tire …
Le rapport de vraisemblance (aka déviance) statistique et test de manque d'ajustement (ou qualité d'ajustement) est assez simple à obtenir pour un modèle de régression logistique (ajustement à l'aide de la fonction) dans R. Cependant, il peut être il est facile de faire en sorte que le nombre de cellules …
Ceci est juste un exemple que j'ai rencontré plusieurs fois, donc je n'ai pas d'échantillons de données. Exécution d'un modèle de régression linéaire dans R: a.lm = lm(Y ~ x1 + x2) x1est une variable continue. x2est catégorique et a trois valeurs, par exemple "Low", "Medium" et "High". Cependant, la …
Disons que j'ai un certain nombre de séries chronologiques, par exemple un certain nombre d'enregistrements de température de diverses stations dans une région. Je veux obtenir un enregistrement de température unique pour toute la région avec lequel je pourrais décrire les aspects du climat régional. L'approche intuitive pourrait être de …
Quel est le rapport cas / témoins optimal dans une étude cas-témoins? Pourquoi la plupart des manuels ou des monographies suggèrent-ils qu'il est supérieur à 1? Peut-il être inférieur à 1 (quels sont les inconvénients?)? Je vous remercie.
En écologie, nous utilisons souvent l'équation de croissance logistique: Nt= KN0er tK+ N0er t - 1Nt=KN0ertK+N0ert-1 N_t = \frac{ K N_0 e^{rt} }{K + N_0 e^{rt-1}} ou Nt= KN0N0+ ( K- N0) e- r tNt=KN0N0+(K-N0)e-rt N_t = \frac{ K N_0}{N_0 + (K -N_0)e^{-rt}} où est la capacité de charge (densité …
Je discute actuellement avec someoe sur la façon de traiter correctement les données avec plusieurs mesures pour chaque sujet. Dans ce cas, les données ont été recueillies pour chaque sujet dans un court laps de temps pour différentes conditions au sein de chaque sujet. Toutes les mesures rassemblent exactement la …
Dans une équation de régression multiple linéaire, si les poids bêta reflètent la contribution de chaque variable indépendante individuelle au-delà de la contribution de tous les autres IV, où dans l'équation de régression la variance est-elle partagée par tous les IV qui prédit la DV? Par exemple, si le diagramme …
Tout d'abord, permettez-moi de reconnaître dès le départ que je ne suis pas aussi doué en statistique et en mathématiques que je le souhaiterais. Certains pourraient dire avoir juste assez de connaissances pour être dangereux. : Je m'excuse si je n'utilise pas la terminologie correctement. J'essaie de modéliser les probabilités …
La plupart des situations, nous ne traitons qu'avec une variable de résultat / réponse telle que . Cependant, dans certains scénarios, en particulier dans les données cliniques, les variables de résultat peuvent être de grande dimension / multivariées. Tels que , où contient les , et et ces résultats sont …
J'ai une matrice , où est le nombre de gènes et est le nombre de patients. Quiconque a travaillé avec de telles données sait que est toujours supérieur à . En utilisant la sélection des fonctionnalités, j'ai réduit à un nombre plus raisonnable, mais est toujours supérieur à .p n …
Je suis en train de créer un système de recommandation et je veux intégrer à la fois les évaluations d'utilisateurs "similaires" et les caractéristiques des articles. La sortie est une note prédite [0-1]. J'envisage un réseau neuronal (pour commencer). Ainsi, les entrées sont une combinaison des caractéristiques des articles et …
Gelman & Hill (2006) disent: Dans Bugs, les résultats manquants dans une régression peuvent être facilement gérés en incluant simplement le vecteur de données, les NA et tout. Les bogues modélisent explicitement la variable de résultat, et il est donc trivial d'utiliser ce modèle pour, en e ff et, imputer …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.