Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai une assez bonne expérience pratique de l'échantillonnage de Metropolis-Hastings et Gibbs, mais je veux obtenir une meilleure compréhension mathématique de ces algorithmes. Quels sont les bons manuels ou articles qui prouvent l'exactitude de ces échantillonneurs (plus d'algorithmes seraient également excellents)?
Considérez le contexte d'un regroupement de dendrogrammes. Appelons dissemblances originales les distances entre les individus. Après avoir construit le dendrogramme, nous définissons la dissimilarité cophénétique entre deux individus comme la distance entre les grappes auxquelles ces individus appartiennent. Certaines personnes considèrent que la corrélation entre les dissemblances originales et les …
J'ai trouvé beaucoup de formules montrant comment trouver le temps de survie moyen pour une distribution exponentielle ou de Weibull, mais j'ai beaucoup moins de chance pour les fonctions de survie log-normales. Étant donné la fonction de survie suivante: S( t ) = 1 - ϕ [ ln( t ) …
J'essaie de trouver la meilleure façon de prédire le montant du paiement pour une agence de recouvrement. La variable dépendante n'est non nulle que lorsqu'un paiement a été effectué. Naturellement, il y a un nombre écrasant de zéros parce que la plupart des gens ne peuvent pas être joints ou …
J'ai remarqué que lorsque j'essaie de trouver les valeurs critiques pour le Mann-Whitney U en utilisant R, les valeurs sont toujours 1 + valeur critique. Par exemple, pour , la valeur critique (bilatérale) est 8, tandis que pour , la (bilatérale) ) la valeur critique est 22 (consultez les tableaux …
Les modèles de pièces biaisées ont généralement un paramètre . Une façon d'estimer la partir d'une série de tirages est d'utiliser une distribution bêta a priori et de calculer la distribution postérieure avec vraisemblance binomiale.θθ=P(Head|θ)θ=P(Head|θ)\theta = P(\text{Head} | \theta)θθ\theta Dans mes paramètres, en raison d'un processus physique étrange, les propriétés …
J'ai adapté un modèle lognormal utilisant R avec un ensemble de données. Les paramètres résultants étaient: meanlog = 4.2991610 sdlog = 0.5511349 J'aimerais transférer ce modèle sur Scipy, que je n'ai jamais utilisé auparavant. En utilisant Scipy, j'ai pu obtenir une forme et une échelle de 1 et 3,1626716539637488e + …
Voici mes données d'entraînement: 200 000 exemples x 10 000 fonctionnalités. Ma matrice de données d'entraînement est donc de - 200 000 x 10 000. J'ai réussi à enregistrer cela dans un fichier plat sans avoir de problèmes de mémoire en enregistrant chaque ensemble de données un par un (un …
Supposons que j'ai 400 étudiants (c'est dans une grande université) qui doivent faire un projet d'informatique et qu'ils doivent travailler seuls (pas de groupe d'étudiants). Un exemple de projet pourrait être laissé "implémenter un algorithme de transformée de Fourier rapide dans fortran" (je sais, cela ne semble pas sexy mais …
Le modèle de régression de Poisson gonflé à zéro est défini pour un échantillon par et il suppose en outre que les paramètres et satisfontY i = { 0 avec probabilité p i + ( 1 - p i ) e - λ i k avec probabilité ( 1 - …
J'essaie d'analyser le décalage entre les séries chronologiques de deux cours boursiers. Dans l'analyse de séries chronologiques régulières, nous pouvons faire Cross Correlaton, VECM (Granger Causality). Cependant, comment peut-on gérer la même chose dans des séries temporelles irrégulièrement espacées. L'hypothèse est que l'un des instruments mène l'autre. J'ai des données …
Je souhaite modéliser deux variables temporelles différentes, dont certaines sont fortement colinéaires dans mes données (âge + cohorte = période). Ce faisant, j'ai rencontré des problèmes avec lmeret et les interactions de poly(), mais ce n'est probablement pas limité à lmer, j'ai obtenu les mêmes résultats avec l' nlmeIIRC. De …
Question : Comment puis-je construire un test pour déterminer si la fréquence des allèles "montagne" observée (Fig 1) est significativement plus basse dans les montagnes du centre au sud que celle prédite (Fig 2) par le modèle de sélection écologique ( voir ci-dessous pour plus de détails )? Problème : …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.