Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
D'après ce que j'ai appris, nous utilisons plusieurs filtres dans une couche Conv d'un CNN pour apprendre différents détecteurs de fonctionnalités. Mais puisque ces filtres sont appliqués de la même manière (c'est-à-dire glissés et multipliés aux régions de l'entrée), n'apprendraient-ils pas simplement les mêmes paramètres pendant l'entraînement? Par conséquent, l'utilisation …
Il peut parfois être nécessaire de différencier une série de temps pour la rendre fixe. Cependant, je ne comprends pas comment la différenciation de second ordre peut aider à la rendre stationnaire lorsque la différenciation de premier ordre ne suffit pas. Pourriez-vous donner une explication intuitive pour la différenciation de …
Existe-t-il un moyen d'obtenir un score de confiance (on peut également l'appeler valeur de confiance ou probabilité) pour chaque valeur prédite lors de l'utilisation d'algorithmes comme Random Forests ou Extreme Gradient Boosting (XGBoost)? Supposons que ce score de confiance varie de 0 à 1 et montre à quel point je …
Je lis le chapitre 13 "Adventures in Covariance" dans le ( superbe ) livre Statistical Rethinking de Richard McElreath où il présente le modèle hiérarchique suivant: ( REst une matrice de corrélation) L'auteur explique qu'il LKJcorrs'agit d'un a priori faiblement informatif qui fonctionne comme un a priori de régularisation pour …
Je suis conscient du fait que les variables catégorielles avec k niveaux doivent être codées avec k-1 variables dans le codage factice (de même pour les variables catégorielles à valeurs multiples). Je me demandais combien de problème un codage à chaud (c'est-à-dire en utilisant k variables à la place) sur …
Pourquoi les valeurs de p et les statistiques du test ks diminuent avec l'augmentation de la taille de l'échantillon? Prenez ce code Python comme exemple: import numpy as np from scipy.stats import norm, ks_2samp np.random.seed(0) for n in [10, 100, 1000, 10000, 100000, 1000000]: x = norm(0, 4).rvs(n) y = …
Je viens d'apprendre le concept de bootstrap, et une question naïve m'est venue à l'esprit: si nous pouvons toujours générer de nombreux échantillons bootstrap de nos données, pourquoi se donner la peine d'obtenir davantage de données "réelles"? Je pense avoir une explication, dites-moi si j'ai raison: je pense que le …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé l'année dernière . La formation après 15 époques sur l'ensemble de données CIFAR-10 semble faire en …
Dans un test t moyen des moyens, en utilisant les méthodes habituelles de test d'hypothèse, nous rejetons le nul ou ne le rejetons pas mais nous n'acceptons jamais le nul. Une des raisons à cela est que si nous obtenions plus de preuves, la même taille d'effet deviendrait significative. Mais …
J'adapte un ensemble de données avec une classe cible binaire par la forêt aléatoire. En python, je peux le faire soit par randomforestclassifier ou randomforestregressor. Je peux obtenir la classification directement à partir de randomforestclassifier ou je pourrais d'abord exécuter randomforestregressor et récupérer un ensemble de scores estimés (valeur continue). …
J'essaie de comprendre pourquoi OLS donne un estimateur biaisé d'un processus AR (1). Considérez Dans ce modèle, l'exogénéité stricte est violée, c'est-à-dire que et sont corrélés mais et sont pas corrélés. Mais si cela est vrai, pourquoi la dérivation simple suivante ne tient-elle pas? ytεtyt-1εtplim βytϵt=α+βyt−1+ϵt,∼iidN(0,1).yt=α+βyt−1+ϵt,ϵt∼iidN(0,1). \begin{aligned} y_{t} &= \alpha …
Ma question porte sur la différence conceptuelle entre Holt-Winters et ARIMA. Autant que je sache, Holt-Winters est un cas particulier d'ARIMA. Mais quand un algorithme est-il préféré à l'autre? Peut-être que Holt-Winters est incrémental et sert donc d'algorithme en ligne (plus rapide)? Dans l'attente de quelques informations ici.
J'expérimente la régression pas à pas pour des raisons de diversité dans mon approche du problème. Donc, j'ai 2 questions: Quels sont les avantages de la régression pas à pas? Quelles sont ses forces spécifiques? Que pensez-vous de l'approche hybride, où vous utilisez la régression pas à pas pour sélectionner …
Pour une tâche de traitement du langage naturel (NLP), on utilise souvent des vecteurs word2vec comme incorporation pour les mots. Cependant, il peut y avoir de nombreux mots inconnus qui ne sont pas capturés par les vecteurs word2vec simplement parce que ces mots ne sont pas assez souvent vus dans …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.