Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Supposons que nous ayons une réponse Y et des prédicteurs X1, ...., Xn. Si nous devions essayer d'ajuster Y via un modèle linéaire de X1, ...., Xn, et il se trouve que la vraie relation entre Y et X1, ..., Xn n'était pas linéaire, nous pourrions être en mesure pour …
J'essaie de comprendre certains articles de Mark van der Laan. Il est un statisticien théorique à Berkeley travaillant sur des problèmes qui se chevauchent de manière significative avec l'apprentissage automatique. Un problème pour moi (en plus des mathématiques approfondies) est qu'il finit souvent par décrire des approches d'apprentissage machine familières …
Je lis un article scientifique sur la classification des images. Dans les résultats expérimentaux, ils parlent de la précision du top 1 et du top 5, mais je n'ai jamais entendu parler du terme et je ne le trouve pas en utilisant Google. Quelqu'un peut-il me donner une définition ou …
J'ai donc tracé l'ACF / PACF des retours de pétrole et je m'attendais à voir une autocorrélation positive, mais à ma grande surprise, je n'obtiens qu'une autocorrélation négative significative. Comment dois-je interpréter le graphique ci-dessus? Ils semblent indiquer que les rendements pétroliers ont tendance à augmenter lorsqu'ils ont diminué précédemment …
Disons que j'ai deux ou plusieurs populations d'échantillons de vecteurs à valeurs continues à n dimensions. Existe-t-il un moyen non paramétrique de tester si ces échantillons proviennent de la même distribution? Si oui, existe-t-il une fonction en R ou en python pour cela?
Lors de la réalisation de la classification SVM linéaire, il est souvent utile de normaliser les données d'entraînement, par exemple en soustrayant la moyenne et en les divisant par l'écart type, puis de mettre à l'échelle les données de test avec la moyenne et l'écart type des données d'entraînement. Pourquoi …
Supposons que deux groupes, comprenant et n 2 classent chacun un ensemble de 25 éléments du plus important au moins important. Quelles sont les meilleures façons de comparer ces classements?n1n1n_1n2n2n_2 De toute évidence, il est possible de faire 25 tests de Mann-Whitney U, mais cela entraînerait 25 résultats de tests …
Je travaille avec l'information mutuelle depuis un certain temps. Mais j'ai trouvé une mesure très récente dans le "monde de corrélation" qui peut également être utilisée pour mesurer l'indépendance de distribution, la soi-disant "corrélation de distance" (également appelée corrélation brownienne): http://en.wikipedia.org/wiki/Brownian_covariance . J'ai vérifié les papiers où cette mesure est …
J'ai reçu un résultat d'un test de classement de Mann-Whitney que je ne comprends pas. La médiane des 2 populations est identique (6,9). Les quantiles supérieurs et inférieurs de chaque population sont: 6.64 & 7.2 6.60 & 7.1 La valeur de p résultant du test comparant ces populations est de …
Soit une variable aléatoire distribuée khi carré avec k degrés de liberté. Quelles sont les limites connues les plus précises pour les probabilités suivantesX∼χ2kX∼χk2X \sim \chi^2_kkkk P[X>t]≤1−δ1(t,k)P[X>t]≤1−δ1(t,k) \mathbb{P}[X > t] \leq 1 - \delta_1(t, k) et P[X<z]≤1−δ2(z,k)P[X<z]≤1−δ2(z,k) \mathbb{P}[X < z] \leq 1 - \delta_2(z, k) où et δ 2 sont …
Je voudrais un conseil sur une méthode d'analyse que j'utilise, pour savoir si elle est statistiquement valable. J'ai mesuré deux points processus et T 2 = T 2 1 , T 2 2 , . . . , t 2 m et je veux déterminer si les événements de T …
Quelle est la dérivée de la fonction d'activation ReLU définie comme: ReLU(x)=max(0,x)ReLU(x)=max(0,x) \mathrm{ReLU}(x) = \mathrm{max}(0, x) Qu'en est-il du cas particulier où il y a une discontinuité dans la fonction à ?x=0x=0x=0
Je cherche à faire un projet de reconnaissance optique de caractères (OCR). Après avoir fait quelques recherches, je suis tombé sur une architecture qui semble intéressante: CNN + RNN + CTC. Je connais les réseaux de neurones alambiqués (CNN) et les réseaux de neurones récurrents (RNN), mais qu'est-ce que la …
Quelqu'un pourrait-il m'expliquer pourquoi vous devez normaliser les données lors de l'utilisation de K voisins les plus proches. J'ai essayé de chercher ça, mais je n'arrive toujours pas à le comprendre. J'ai trouvé le lien suivant: https://discuss.analyticsvidhya.com/t/why-it-is-necessary-to-normalize-in-knn/2715 Mais dans cette explication, je ne comprends pas pourquoi une plus grande plage …
J'ai du mal à comprendre les distributions zéro gonflées. Que sont-ils? À quoi ça sert? Si j'ai des données avec plusieurs zéros, alors je pourrais ajuster une régression logistique d'abord calculer la probabilité des zéros, puis je pourrais supprimer tous les zéros, puis ajuster une régression régulière en utilisant mon …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.