Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai lu sur les SVM et j'ai appris qu'ils résolvaient un problème d'optimisation et l'idée de marge maximale était très raisonnable. Maintenant, en utilisant des noyaux, ils peuvent même trouver des limites de séparation non linéaires, ce qui était génial. Jusqu'à présent, je n'ai vraiment aucune idée de la façon …
Je n'ai pas d'expérience dans l'industrie de l'exploration de données ou des mégadonnées, donc j'aimerais vous entendre partager votre expérience. Les gens exécutent-ils réellement k-means, PAM, CLARA, etc. sur un très grand ensemble de données? Ou bien ils en choisissent simplement un échantillon au hasard? S'ils ne prennent qu'un échantillon …
C'est plus une question conceptuelle, mais comme je l'utilise, Rje ferai référence aux packages de R. Si l'objectif est d'adapter un modèle linéaire à des fins de prédiction, puis de faire des prédictions là où les effets aléatoires pourraient ne pas être disponibles, y a-t-il un avantage à utiliser un …
La dynamique hamiltonienne surpasse toujours la marche aléatoire dans l'algorithme de Metropolis dans certains cas. Quelqu'un pourrait-il expliquer la raison avec des mots simples sans trop de mathématiques?
S'excuse pour l'utilisation abusive des termes techniques. Je travaille sur un projet de segmentation sémantique via des réseaux de neurones convolutifs (CNN); essayer d'implémenter une architecture de type Encodeur-Décodeur, donc la sortie est de la même taille que l'entrée. Comment concevez-vous les étiquettes? Quelle fonction de perte doit-on appliquer? Surtout …
J'essaie d'évaluer les performances de clustering. Je lisais la documentation skiscit-learn sur les métriques . Je ne comprends pas la différence entre ARI et AMI. Il me semble qu'ils font la même chose de deux manières différentes. Citant de la documentation: Compte tenu de la connaissance des affectations de classe …
Ou quelles conditions le garantissent? En général (et pas seulement les modèles normaux et binomiaux), je suppose que la principale raison qui a brisé cette affirmation est qu'il y a incohérence entre le modèle d'échantillonnage et le précédent, mais quoi d'autre? Je commence par ce sujet, donc j'apprécie vraiment les …
\newcommand{\E}{\mathbb{E}}\newcommand{\P}{\mathbb{P}} Le théorème de la limite centrale (CLT) indique que pour indépendants et répartis de manière identique (iid) avec et , la somme converge vers une distribution normale comme : X1,X2,…X1,X2,…X_1,X_2,\dotsE[Xi]=0E[Xi]=0\E[X_i]=0Var(Xi)<∞Var(Xi)<∞\operatorname{ Var} (X_i)<\inftyn→∞n→∞n\to\infty∑i=1nXi→N(0,n−−√).∑i=1nXi→N(0,n). \sum_{i=1}^n X_i \to N\left(0, \sqrt{n}\right). Supposons plutôt que forment une chaîne de Markov à états finis avec …
J'utilise un RNN bidirectionnel pour détecter un événement d'occurrence déséquilibrée. La classe positive est 100 fois moins souvent que la classe négative. Sans utilisation de régularisation, je peux obtenir une précision de 100% sur le train et de 30% sur le jeu de validation. J'active la régularisation l2 et le …
J'ai lu cette légende dans un journal et je n'ai jamais vu AUC décrit de cette façon ailleurs. Est-ce vrai? Existe-t-il une preuve ou un moyen simple de voir cela? La figure 2 montre la précision de prédiction des variables dichotomiques exprimées en termes d'aire sous la courbe caractéristique de …
Je souhaite approfondir le Machine Learning (théorie et application en Finance). Je veux savoir dans quelle mesure l' analyse complexe et l'analyse fonctionnelle sont pertinentes comme base de l'apprentissage automatique? Dois-je apprendre ces sujets ou dois-je me concentrer sur un autre sujet (si oui, sur quoi?)
Supposons que j'ai le minimum, la moyenne et le maximum de certains ensembles de données, disons 10, 20 et 25. Y a-t-il un moyen de: créer une distribution à partir de ces données, et savoir quel pourcentage de la population se situe probablement au-dessus ou au-dessous de la moyenne Éditer: …
Dans mon programme, je dois exécuter N threads séparés chacun avec leur propre RNG qui est utilisé pour échantillonner un grand ensemble de données. J'ai besoin de pouvoir semer tout ce processus avec une seule valeur afin de pouvoir reproduire les résultats. Suffit-il d'augmenter simplement séquentiellement le germe pour chaque …
Existe-t-il une définition formelle (mathématique) de ce que les fréquentistes entendent par «probabilité»? J'ai lu que c'est la fréquence relative d'occurrence «à long terme», mais existe-t-il un moyen formel de la définir? Y a-t-il des références connues où je peux trouver cette définition? ÉDITER: Par fréquentiste (voir le commentaire de …
Je suis conscient de tester l'hypothèse des risques proportionnels dans le contexte des modèles Cox PH, mais je n'ai rien rencontré concernant les modèles paramétriques? Existe-t-il un moyen réalisable de tester l'hypothèse de PH de certains modèles paramétriques? Il semble qu'il faille préciser que les modèles paramétriques ne sont que …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.