Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je rencontre le coefficient de dés pour la similitude du volume ( https://en.wikipedia.org/wiki/S%C3%B8rensen%E2%80%93Dice_coefficient ) et la précision ( https://en.wikipedia.org/wiki/Accuracy_and_precision ). Il me semble que ces deux mesures sont identiques. Des pensées?
Est-il possible d'avoir des poids négatifs (après suffisamment d'époques) pour les réseaux neuronaux convolutionnels profonds lorsque nous utilisons ReLU pour toutes les couches d'activation?
Je connais le concept de variables catégorielles et le codage des variables fictives respectif qui nous permet d'ajuster un niveau comme ligne de base afin d'éviter la colinéarité. Je suis également familier avec la façon d'interpréter les estimations de paramètres à partir de ces modèles: le changement prévu dans le …
J'ai 17 variables numériques et 5 variables binaires (0-1), avec 73 échantillons dans mon jeu de données. J'ai besoin d'exécuter une analyse de cluster. Je sais que la distance de Gower est une bonne métrique pour les ensembles de données avec des variables mixtes. Cependant, je ne pouvais pas comprendre …
J'ai cette confusion liée aux avantages des processus gaussiens. Je veux le comparer à une simple régression linéaire, où nous avons défini que la fonction linéaire modélise les données. Cependant, dans les processus gaussiens, nous définissons la distribution des fonctions signifie que nous ne définissons pas spécifiquement que la fonction …
Je connais la formule de l'erreur quadratique moyenne et comment la calculer. Lorsque nous parlons d'une régression, nous pouvons calculer l'erreur quadratique moyenne. Mais peut-on parler d'un MSE pour un problème de classification et comment le calculer?
J'ai deux groupes inégaux (94 et 52) et je veux effectuer un test U de Mann-Whitney pour voir si leurs scores sur une variable mesurée diffèrent. Je vois que c'est OK pour Kruskall-Wallis, est-ce la même chose pour Mann-Whitney?
J'espère que quelqu'un sur ces forums pourra m'aider avec ce problème de base dans les études d'expression génique. J'ai fait un séquençage profond d'un tissu expérimental et d'un tissu témoin. J'ai ensuite obtenu des valeurs d'enrichissement par repli des gènes dans l'échantillon expérimental par rapport au contrôle. Le génome de …
Pour autant que je le comprends, la norme de lot normalise toutes les caractéristiques d'entrée d'une couche à une distribution normale unitaire, . La moyenne et la variance μ , σ 2 sont estimées en mesurant leurs valeurs pour le mini-lot actuel.N(μ=0,σ=1)N(μ=0,σ=1)\mathcal{N}(\mu=0,\sigma=1)μ,σ2μ,σ2\mu, \sigma^2 Après la normalisation, les entrées sont mises …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 10 mois . Je sais qu'il y a beaucoup de bibliothèques pour l'apprentissage …
Lors du codage des caractéristiques catégorielles pour la régression linéaire, il existe une règle: le nombre de variables muettes doit être inférieur de un au nombre total de niveaux (pour éviter la colinéarité). Existe-t-il une règle similaire pour les arbres de décision (ensachés, boostés)? Je pose cette question car une …
J'utilise le RandomForestpackage R et je ne sais pas comment interpréter les valeurs de l'axe Y dans leurs graphiques de dépendance partielle. Les documents d'aide indiquent que l'intrigue est une "représentation graphique de l'effet marginal d'une variable sur la probabilité de classe". Cependant, je suis toujours confus quant à ce …
J'ai besoin de faire une simulation pour évaluer une intégrale d'une fonction à 3 paramètres, disons , qui a une formule très compliquée. Il est demandé d'utiliser la méthode MCMC pour le calculer et de mettre en œuvre l'algorithme Metropolis-Hastings pour générer les valeurs distribuées comme , et il a …
Permettez-moi de dire d'emblée que je suis très nouveau dans l'apprentissage automatique et que je ne suis pas très doué en mathématiques. Je comprends ce que fait TF-IDF, mais dans le livre que je lis, il note également ce qui suit (il explique comment scikit-learn fait les choses): Les deux …
Les RNN sont remarquablement bons pour capturer la dépendance temporelle des données séquentielles. Cependant, que se passe-t-il lorsque les éléments de séquence ne sont pas également espacés dans le temps? Par exemple, la première entrée dans la cellule LSTM se produit le lundi, puis aucune donnée du mardi au jeudi, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.