Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

3
Y a-t-il un problème sérieux avec la suppression des observations avec des valeurs manquantes lors du calcul de la matrice de corrélation?
J'ai cet énorme ensemble de données avec comme 2500 variables et comme 142 observations. Je veux exécuter une corrélation entre la variable X et le reste des variables. Mais pour de nombreuses colonnes, il manque des entrées. J'ai essayé de le faire dans R en utilisant l'argument "pairwise-complete" ( use=pairwise.complete.obs) …




2
Intuition mathématique de l'équation de biais-variance
J'ai récemment posé une question à la recherche d'une interprétation / intuition mathématique derrière l'équation élémentaire reliant la moyenne et la variance de l'échantillon: E[X2]=Var(X)+(E[X])2E[X2]=Var(X)+(E[X])2 E[X^2] = Var(X) +(E[X])^2 , géométrique ou autre. Mais maintenant, je suis curieux de savoir l'équation de compromis biais-variance superficiellement similaire. MSE(θ^)=E[(θ^−θ)2]==E[(θ^−E[θ^])2]+(E[θ^]−θ)2Var(θ^)+Bias(θ^,θ)2MSE(θ^)=E[(θ^−θ)2]=E[(θ^-E[θ^])2]+(E[θ^]-θ)2=Var(θ^)+Biais(θ^,θ)2 \begin{eqnarray} \text{MSE}(\hat{\theta}) = …
12 variance  bias 

4
Dans CNN, le suréchantillonnage et la transposition de convolution sont-ils les mêmes?
Les termes «suréchantillonnage» et «convolution transposée» sont tous deux utilisés lorsque vous effectuez une «déconvolution» (<- ce n'est pas un bon terme, mais permettez-moi de l'utiliser ici). À l'origine, je pensais qu'ils signifiaient la même chose, mais il me semble qu'ils sont différents après avoir lu ces articles. quelqu'un peut-il …


1
Qu'est-ce qu'un bloc d'apprentissage résiduel dans le contexte des réseaux résiduels profonds dans l'apprentissage profond?
Je lisais le document Deep Residual Learning for Image Recognition et j'avais du mal à comprendre avec 100% de certitude ce qu'implique un bloc résiduel sur le plan informatique. En lisant leur article, ils ont la figure 2: qui illustre ce qu'est un bloc résiduel. Le calcul d'un bloc résiduel …






2
Utiliser le coefficient de corrélation de Pearson comme objectif d'optimisation dans l'apprentissage automatique
Dans l'apprentissage automatique (pour les problèmes de régression), je vois souvent l'erreur quadratique moyenne (MSE) ou l'erreur absolue moyenne (MAE) utilisée comme fonction d'erreur pour minimiser (plus le terme de régularisation). Je me demande s'il existe des situations où l'utilisation d'un coefficient de corrélation serait plus appropriée? si une telle …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.