Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Quelle a été la première dérivation de la distribution normale, pouvez-vous reproduire cette dérivation et également l' expliquer dans son contexte historique ? Je veux dire, si l'humanité oublie la distribution normale, quelle est la façon la plus probable de la redécouvrir et quelle serait la dérivation la plus probable? …
Je suis juste tombé sur "critère d'information Akaike", et j'ai remarqué cette grande quantité de littérature sur la sélection des modèles (aussi des choses comme BIC semblent exister). Pourquoi les méthodes modernes d'apprentissage automatique ne profitent-elles pas de ces critères de sélection des modèles BIC et AIC?
J'essaie d'utiliser la perte au carré pour effectuer une classification binaire sur un ensemble de données de jouets. J'utilise mtcarsun ensemble de données, utilise le mile par gallon et le poids pour prédire le type de transmission. Le graphique ci-dessous montre les deux types de données de type de transmission …
Formules de modèle en R telles que y ~ x + a*b + c:d sont basées sur la notation dite de Wilkinson : Wilkinson et Rogers 1973, Description symbolique des modèles factoriels pour l'analyse de la variance . Cet article n'a pas discuté des notations pour les modèles mixtes (qui …
Un échantillon de population aléatoire a été sondé. On leur a demandé s'ils avaient un régime végétarien. S'ils ont répondu oui, on leur a également demandé de préciser depuis combien de temps ils suivaient un régime végétarien sans interruption. Je veux utiliser ces données pour calculer la durée moyenne d'adhésion …
Bien que les résultats de l'ensemble de test privé ne puissent pas être utilisés pour affiner davantage le modèle, la sélection de modèle parmi un grand nombre de modèles n'est-elle pas effectuée sur la base des résultats de l'ensemble de test privé? Ne seriez-vous pas, grâce à ce seul processus, …
J'essaie de mieux comprendre la perte de journal et comment cela fonctionne, mais une chose que je n'arrive pas à trouver est de mettre le numéro de perte de journal dans une sorte de contexte. Si mon modèle a une perte de log de 0,5, est-ce bien? Qu'est-ce qui est …
Je lisais un article et j'ai vu la phrase suivante: Pour une martingale donnée, si elle a une limite supérieure ou inférieure, alors la martingale doit converger (comme). Étant donné que la probabilité est toujours non négative, 0 est une borne inférieure. Que signifie "comme"? Est-ce un usage courant? Ma …
La plupart du temps, lorsque les gens parlent de transformations variables (pour les variables prédictives et de réponse), ils discutent des moyens de traiter l'asymétrie des données (comme la transformation logarithmique, la transformation box et cox, etc.). Ce que je ne peux pas comprendre, c'est pourquoi la suppression de l'asymétrie …
Je suis un peu confus au sujet de l'apprentissage d'ensemble. En bref, il exécute k modèles et obtient la moyenne de ces k modèles. Comment peut-on garantir que la moyenne des modèles k serait meilleure que n'importe laquelle des modèles en soi? Je comprends que le biais est "étalé" ou …
Qu'est-ce qu'un modèle nul en régression et quelle est la relation entre le modèle nul et l'hypothèse nulle? Pour ma compréhension, cela signifie-t-il Utiliser la «moyenne de la variable de réponse» pour prédire la variable de réponse continue? Utiliser la «distribution d'étiquettes» pour prédire les variables de réponse discrètes? Si …
Ce problème est lié aux recherches de mon laboratoire sur la couverture robotique: Tirez au hasard nnn nombres de l'ensemble {1,2,…,m}{1,2,…,m}\{1,2,\ldots,m\} sans remplacement et triez les nombres dans l'ordre croissant. 1≤n≤m1≤n≤m1\le n\le m . À partir de cette liste triée de nombres {a(1),a(2),…,a(n)}{a(1),a(2),…,a(n)}\{a_{(1)},a_{(2)},…,a_{(n)}\} , générez la différence entre les nombres …
Quelles approches théoriques de la causalité devrais-je connaître en tant que statisticien / économètre appliqué? Je connais le (un tout petit peu) Modèle causal de Neyman – Rubin (et Roy , Haavelmo etc.) Le travail de Pearl sur la causalité Causalité de Granger (bien que moins axée sur le traitement) …
J'ai appris que la distribution normale standard est unique car la moyenne et la variance sont fixées à 0 et 1 respectivement. Par ce fait, je me demande si deux variables aléatoires standard doivent être indépendantes.
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.