Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je conçois un algorithme d'échantillonnage hybride de Monte Carlo pour PyMC , et j'essaie de le rendre aussi simple et général que possible, donc je cherche de bons conseils sur la conception d'un algorithme HMC. J'ai lu le chapitre d'enquête de Radford et Beskos et. L'article récent de al. sur …
Pouvez-vous recommander un package d'exploration de texte dans R qui peut être utilisé contre de gros volumes de données? Deuxièmement, existe-t-il une interface graphique disponible pour l'un des packages d'exploration de texte dans R? Troisièmement, existe-t-il un autre programme d'exploration de texte open source qui est facile et intuitif à …
Je voudrais poser cette question en deux parties. Les deux traitent d'un modèle linéaire généralisé, mais le premier traite de la sélection du modèle et les autres de la régularisation. Contexte: J'utilise des modèles GLM (linéaire, logistique, régression gamma) à la fois pour la prédiction et pour la description. Quand …
Cela a été inspiré par la régression linéaire en ligne efficace , que j'ai trouvée très intéressante. Existe-t-il des textes ou des ressources consacrés au calcul statistique à grande échelle, par lesquels le calcul avec des ensembles de données trop volumineux pour tenir dans la mémoire principale, et peut-être trop …
Salut, je suis en train d'analyser les données de vent pour estimer l'énergie d'une éolienne. J'ai pris 10 ans de données de vent et tracé un histogramme; ma deuxième étape a été d'adapter une distribution de Weibull aux données. J'ai utilisé R avec le package lmompour calculer la forme et …
Le contexte J'ai deux ensembles de données que je veux comparer. Chaque élément de données dans les deux ensembles est un vecteur contenant 22 angles (tous entre et ). Les angles se rapportent à une configuration de pose humaine donnée, donc une pose est définie par 22 angles communs.π−π−π-\piππ\pi Ce …
Il existe de nombreuses méthodes d'estimation des paramètres. MLE, UMVUE, MoM, décision-théorique, et d'autres semblent tous avoir un cas assez logique pour expliquer pourquoi ils sont utiles pour l'estimation des paramètres. Une méthode est-elle meilleure que les autres, ou s'agit-il simplement de savoir comment définir l'estimateur «le mieux adapté» (semblable …
Comment puis-je tester les effets dans une ANOVA Split-Plot en utilisant des comparaisons de modèles appropriées à utiliser avec les arguments Xet Mde anova.mlm()dans R? Je connais bien ?anova.mlmDalgaard (2007) [1]. Malheureusement, il ne brosse que les conceptions Split-Plot. Faire cela dans une conception entièrement randomisée avec deux facteurs intra-sujets: …
Il y a une variable dans mes données qui ont 80% de données manquantes. Les données sont manquantes en raison de leur inexistence (c'est-à-dire du montant du prêt bancaire que l'entreprise doit). Je suis tombé sur un article disant que la méthode d'ajustement variable factice est la solution à ce …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 3 ans . Il y a quelques jours, j'ai vu un article sur la …
Il semble que vous puissiez utiliser le codage pour une variable catégorielle, mais j'ai deux variables prédictives catégoriques et une variable prédictive continue. Puis-je utiliser la régression multiple pour cela dans SPSS et si oui, comment? Merci!
Je lisais un article et j'ai vu un tableau avec une comparaison entre PPV (Positive Predictive Value) et NPV (Negative Predictive Value). Ils ont fait une sorte de test statistique pour eux, voici un croquis du tableau: PPV NPV p-value 65.9 100 < 0.00001 ... Chaque ligne fait référence à …
Toujours en train d'apprendre les fonctions de base dans R, la fonction de sous-ensemble semble filtrer uniquement une condition basée sur une seule colonne avec ou sans plusieurs conditions? Comment filtrer facilement les données d'une trame de données? lorsque plusieurs conditions vous sont proposées Lorsque la condition doit être appliquée …
Contexte: Je suis un programmeur avec une expérience (à moitié oubliée) en statistiques de cours uni. Récemment, je suis tombé sur http://akinator.com et j'ai passé un certain temps à essayer de le faire échouer. Et qui ne l'était pas? :) J'ai décidé de découvrir comment cela pouvait fonctionner. Après avoir …
Les SVM pour la classification ont un sens intuitif pour moi: je comprends comment minimiser donne la marge maximale. Cependant, je ne comprends pas cet objectif dans le contexte de la régression. Divers textes ( ici et ici ) décrivent cela comme maximisant la «planéité». Pourquoi voudrions-nous faire ça? Qu'est-ce …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.