Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai fait face à une question d'entrevue pour un emploi où l'intervieweur m'a demandé de supposer que votre est très faible (entre 5 et 10%) pour un modèle d'élasticité-prix. Comment résoudriez-vous cette question?R2R2R^2 Je ne pouvais penser à rien d'autre que le fait que je ferai des diagnostics de régression …
Pourquoi j'obtiens des prévisions différentes pour l'expansion polynomiale manuelle et l'utilisation de la polyfonction R ? set.seed(0) x <- rnorm(10) y <- runif(10) plot(x,y,ylim=c(-0.5,1.5)) grid() # xp is a grid variable for ploting xp <- seq(-3,3,by=0.01) x_exp <- data.frame(f1=x,f2=x^2) fit <- lm(y~.-1,data=x_exp) xp_exp <- data.frame(f1=xp,f2=xp^2) yp <- predict(fit,xp_exp) lines(xp,yp) # …
Je comprends la mécanique du calcul des poids en utilisant les scores de propension : , puis en appliquant les poids dans une analyse de régression, et que les poids servent à «contrôler» ou dissocier les effets des covariables dans les populations des groupes de traitement et de contrôle avec …
Comment dois-je échantillonner efficacement la distribution suivante? x ∼ B ( α , β) , x > k x∼B(α,β), x>k x \sim B(\alpha, \beta),\space x > k Si n'est pas trop grand, l'échantillonnage de rejet peut être la meilleure approche, mais je ne sais pas comment procéder lorsque k est …
J'essaie de tester la capacité d'une forêt aléatoire à classer les échantillons entre 2 groupes; Il y a 54 échantillons et différents nombres de variables utilisés pour la classification. Je me demandais pourquoi les estimations hors du sac (OOB) peuvent varier jusqu'à 5% les unes des autres même lorsque j'utilise …
J'ai récemment assisté à quelques discussions sur les statistiques du Lasso (régularisation) et un point qui revient sans cesse est que nous ne comprenons pas vraiment pourquoi le Lasso fonctionne ou pourquoi il fonctionne si bien. Je me demande à quoi se réfère cette déclaration. Évidemment, je comprends pourquoi le …
Une fonction continue sur [a, b], où a et b sont des nombres réels, peut-elle être approximée ou arbitrairement proche de la fonction (dans une certaine norme) par des processus gaussiens (régression)?
J'essaie d'utiliser la régression RF pour faire des prédictions sur les performances d'une papeterie. J'ai des données minute par minute pour les intrants (taux et quantité de pâte de bois entrant dans etc ...) ainsi que pour les performances de la machine (papier produit, puissance tirée par la machine) et …
Je suis le tutoriel mnist Tensorflow ( https://github.com/tensorflow/tensorflow/blob/master/tensorflow/examples/tutorials/mnist/mnist_softmax.py ). Le didacticiel utilise tf.train.Optimizer.minimize(spécifiquement tf.train.GradientDescentOptimizer). Je ne vois aucun argument transmis nulle part pour définir des gradients. Le flux tenseur utilise-t-il la différenciation numérique par défaut? Existe-t-il un moyen de passer des dégradés comme vous le pouvez avec scipy.optimize.minimize?
J'ai vu cette notation pour les moindres carrés ordinaires ici . minw∥Xw−y∥22minw‖Xw−y‖22 \min_w \left\| Xw - y \right\|^2_2 Je n'ai jamais vu les doubles barres et les 2 en bas. Que signifient ces symboles? Ont-ils une terminologie spécifique pour eux?
Je programme et fais du développement piloté par les tests. Après avoir modifié mon code, je lance mes tests. Parfois, ils réussissent et parfois ils échouent. Avant d'exécuter un test, j'écris un nombre de 0,01 à 0,99 pour ma certitude que le test réussira. Je veux savoir si je m'améliore …
Après une discussion (ci-dessous), j'ai maintenant une image plus claire d'une question ciblée, donc voici une question révisée, bien que certains des commentaires puissent maintenant sembler sans rapport avec la question d'origine. Il semble que les tests t convergent rapidement pour les distributions symétriques , que le test de rang …
Je travaille sur un réseau de convolution pour la reconnaissance d'image, et je me demandais si je pouvais entrer des images de différentes tailles (pas très différentes cependant). Sur ce projet: https://github.com/harvardnlp/im2markup Ils disent: and group images of similar sizes to facilitate batching Ainsi, même après le prétraitement, les images …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.