Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Considérons un problème statistique où vous avez une responsevariable que vous souhaitez décrire conditionnellement à une explanatoryvariable et une nestedvariable, où la variable imbriquée n'apparaît que comme une variable significative pour des valeurs particulières de la variable explicative . Dans les cas où la variable explicative n'admet pas de variable …
Définir X:=X:=X:= "la pièce a une probabilité 1 d'atterrir" Supposons que l'on ait la croyance préalable: P(X)=1P(X)=1P(X)= 1. Cependant, après avoir lancé la pièce une fois qu'elle a atterri la queue (E:=E:=E:= "pièces de monnaie atterri"). Comment un bayésien devrait-il mettre à jour ses croyances afin de rester cohérent? P(X|E)P(X|E)P(X|E) …
J'ai cherché sur la régression Bayesian Ridge sur Internet, mais la plupart du résultat que je suis devenu concerne la régression linéaire bayésienne. Je me demande si ce sont les deux mêmes choses parce que la formule est assez similaire
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement de réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 2 ans . En attendant le prochain cours d'Andrew Ng sur Coursera, j'essaie de …
Lorsque nous voulons estimer des paramètres de régression linéaire, nous faisons des équations normales autant que le modèle linéaire contient un nombre d'inconnues. Pourquoi ces équations sont-elles appelées équations normales?
Je travaille sur un projet de modélisation prédictive ces jours-ci: essayer d'apprendre un modèle et faire des prédictions en temps réel sur la base du modèle que j'ai appris hors ligne. J'ai commencé à utiliser la régression de crête récemment, car j'ai lu que la régularisation peut aider à réduire …
Je travaille sur un problème multiclasse avec 9 labels possibles, pour lesquels j'ai un jeu de données composé de ~ 50 000 exemples et ~ 200 fonctionnalités chacun. Chaque exemple ne peut appartenir qu'à une seule classe. Les données sont assez équilibrées entre les différentes étiquettes. Compte tenu de sa …
Comment puis-je calculer la valeur de p en fonction du Chi carré et des degrés de liberté? Par exemple, quelle serait la valeur de p exacte d'un Chi Squared = 15 avec df = 2?
J'ai un doute sur la formation exacte de la fonction de perte d'un réseau Deep Q-Learning. J'utilise un réseau feedforward à 2 couches avec une couche de sortie linéaire et des couches cachées relu. Supposons que j'ai 4 actions possibles. Ainsi, la sortie de mon réseau pour l'état actuelststs_t est …
L'analyse en composantes principales (ACP) élimine-t-elle le bruit dans l'ensemble de données? Si l'ACP n'élimine pas le bruit dans l'ensemble de données, que fait réellement l'ACP à l'ensemble de données? Quelqu'un peut-il m'aider à ce sujet.
En général, nous maximisons une fonction L ( θ ;X1, … ,Xn) =∏i = 1nF(Xje∣ θ )L(θ;x1,…,xn)=∏i=1nf(xi∣θ) L(\theta; x_1, \ldots, x_n) = \prod_{i=1}^n f(x_i \mid \theta) où est la fonction de densité de probabilité si la distribution sous-jacente est continue, et une fonction de masse de probabilité (avec sommation au …
Fermé . Cette question a besoin de détails ou de clarté . Il n'accepte pas actuellement de réponses. Voulez-vous améliorer cette question? Ajoutez des détails et clarifiez le problème en modifiant ce message . Fermé il y a 2 ans . Je tombe sur trois mesures statistiques différentes pour comparer …
Étant donné les variables aléatoires échantillonné iid à partir de , définissez X1,X2,⋯,XnX1,X2,⋯,XnX_1,X_2, \cdots, X_n∼N(0,σ2)∼N(0,σ2)\sim \mathcal{N}(0, \sigma^2)Z=maxi∈{1,2,⋯,n}XiZ=maxi∈{1,2,⋯,n}XiZ = \max_{i \in \{1,2,\cdots, n \}} X_i Nous avons cela E[Z]≤σ2logn−−−−−√E[Z]≤σ2logn\mathbb{E}[Z] \le \sigma \sqrt{2 \log n} . Je me demandais s'il y avait des limites supérieures / inférieures sur Var(Z)Var(Z)\text{Var}(Z) ?
Les variables catégorielles peuvent-elles être utilisées dans le clustering hiérarchique? J'ai entendu dire que seules des variables continues sont utilisées, mais j'ai vu des gens discuter des variables catégorielles peuvent / peuvent ne pas être utilisés également. Quelqu'un peut-il donner un aperçu?
Supposons que je fasse une régression avec des ensembles de formation, de validation et de test. Je peux trouver RMSE et R au carré (R ^ 2, le coefficient de détermination) à la sortie de mon logiciel (comme la fonction lm () de R). Ma compréhension est que le test …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.