Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'espère que quelqu'un peut aider avec ce que je pense être une question relativement simple, et je pense que je connais la réponse, mais sans confirmation, c'est devenu quelque chose dont je ne peux tout simplement pas être certain. J'ai des données de comptage comme variable de réponse et je …
Quels sont les moyens les plus acceptés pour visualiser les résultats d'un test t indépendant à deux échantillons? Est-ce qu'un tableau numérique est plus souvent utilisé ou une sorte de graphique? L'objectif est pour un observateur occasionnel de regarder la figure et de voir immédiatement qu'ils proviennent probablement de deux …
Je fais du prétraitement des données et je vais ensuite construire un Convonets sur mes données. Ma question est: disons que j'ai un total de jeux de données avec 100 images, je calculais la moyenne pour chacune des 100 images, puis je la soustrais de chacune des images, puis je …
Considérons un modèle AR ( ) (en supposant une moyenne nulle pour la simplicité):ppp Xt= φ1Xt - 1+ … + ΦpXt - p+ εtXt=φ1Xt-1+…+φpXt-p+εt x_t = \varphi_1 x_{t-1} + \dotsc + \varphi_p x_{t-p} + \varepsilon_t L'estimateur OLS (équivalent à l' estimateur du maximum de vraisemblance conditionnel ) pour est connu …
(message assez long, désolé. Il comprend de nombreuses informations générales, alors n'hésitez pas à passer à la question en bas.) Intro: Je travaille sur un projet où nous essayons d'identifier l'effet d'une variable endogène binaire, , sur un résultat continu, . Nous avons mis au point un instrument, , que …
Lorsqu'un ensemble d'équations ne peut pas être résolu analytiquement, alors nous pouvons utiliser un algorithme de descente de gradient. Mais il semble qu'il y ait aussi la méthode de simulation de Monte Carlo qui peut être utilisée pour résoudre des problèmes qui n'ont pas de solutions analytiques. Comment savoir quand …
Problème de base Voici mon problème de base: j'essaie de regrouper un ensemble de données contenant des variables très asymétriques avec des nombres. Les variables contiennent de nombreux zéros et ne sont donc pas très informatives pour ma procédure de clustering - qui est probablement l'algorithme k-means. Très bien, dites-vous, …
J'analyse une table 2x2 à partir d'un petit ensemble de données de 30 patients. Nous essayons rétrospectivement de trouver des variables qui donnent un indice sur le traitement à choisir. Les variables (obs normal / étrange) et la décision de traitement (A / B) sont d'un intérêt particulier et donc …
La question est la suivante: Un échantillon aléatoire de n valeurs est collecté à partir d'une distribution binomiale négative avec le paramètre k = 3. Trouvez l'estimateur du maximum de vraisemblance du paramètre π. Trouvez une formule asymptotique pour l'erreur standard de cet estimateur. Expliquez pourquoi la distribution binomiale négative …
J'essaie de modéliser les intensités moyennes des parasites affectant un hôte dans R en utilisant un modèle binomial négatif. Je reçois toujours 50 avertissements ou plus qui disent: In dpois(y, mu, log = TRUE) : non-integer x = 251.529000 Comment puis-je gérer cela? Mon code ressemble à ceci: mst.nb = …
Après un commentaire d' un fil précédent , je veux savoir comment on peut tester l'hypothèse d'une tendance commune entre le groupe de traitement et le groupe témoin dans la méthode Différence de différence? Puis-je tester cette hypothèse avec des données de deux points dans le temps (par exemple, enquête …
Je lis le livre de Kevin Murphy: Machine Learning-A probabilistic Perspective. Dans le premier chapitre, l'auteur explique la malédiction de la dimensionnalité et il y a une partie que je ne comprends pas. À titre d'exemple, l'auteur déclare: Considérez que les entrées sont uniformément réparties le long d'un cube unitaire …
Je souhaite implémenter Adaboost à l'aide de Decision Stump. Est-il correct de prendre autant de décisions que les fonctionnalités de notre ensemble de données à chaque itération d'Adaboost? Par exemple, si j'ai un ensemble de données avec 24 fonctionnalités, dois-je avoir 24 classificateur de moignon de décision à chaque itération? …
Je comprends la différence entre k médoïde et k signifie. Mais pouvez-vous me donner un exemple avec un petit ensemble de données où la sortie médoïde k est différente de la sortie k signifie.
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.