Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je suis intéressé de savoir quel niveau de statistiques les enfants apprennent dans différents pays du monde. Pourriez-vous s'il vous plaît suggérer des données / liens qui éclairent ce qui se passe à cet égard? Je vais commencer. Israël: Les étudiants qui suivent des cours de mathématiques avancés étudient plus …
Dans PCA, les valeurs propres déterminent l'ordre des composants. Dans ICA, j'utilise kurtosis pour obtenir la commande. Quelles sont les méthodes acceptées pour évaluer le nombre (étant donné que j'ai la commande) de composants qui sont singuliers en dehors des connaissances préalables sur le signal?
J'utilise un modèle à effet fixe pour mes données de panel (9 ans, 1000+ obs), car mon test de Hausman indique une valeur . Lorsque j'ajoute des variables fictives pour les industries incluses dans mes entreprises, elles sont toujours omises. Je sais qu'il y a une grande différence en ce …
J'ai quelques données dans R, stockées dans une liste. Pense d <- c(1,2,3,4) bien que ce ne soit pas mes données. Si j'entre alors la commande plot(density(d, kernel="gaussian", width=1)) puis j'obtiens l'estimation de la densité de probabilité du noyau, où le noyau est normal normal. Si je remplace 1 par …
De nombreux articles d'essais contrôlés randomisés (ECR) rapportent des tests de signification sur les paramètres de base juste après / avant la randomisation pour montrer que les groupes sont effectivement similaires. Cela fait souvent partie d'un tableau des «caractéristiques de base». Cependant, les tests de signification mesurent la probabilité d'obtenir …
Je suis un peu confus en ce qui concerne le coefficient de corrélation intraclasse et l'ANOVA unidirectionnelle. Si je comprends bien, les deux vous indiquent à quel point les observations au sein d'un groupe sont similaires à celles des autres groupes. Quelqu'un pourrait-il expliquer cela un peu mieux, et peut-être …
J'exécute une régression basée sur GAM en utilisant le gamlss du package R et en supposant une distribution bêta gonflée à zéro des données. Je n'ai qu'une seule variable explicative dans mon modèle, il est donc essentiellement: mymodel = gamlss(response ~ input, family=BEZI). L'algorithme me donne le coefficient pour l'impact …
J'espère que cette question pour débutant est la bonne question pour ce site: Supposons que je souhaite comparer la composition des communautés écologiques sur deux sites A, B. Je sais que les trois sites ont des chiens, des chats, des vaches et des oiseaux, alors j'échantillonne leur abondance sur chaque …
Premièrement, en intégrant analytiquement, je veux dire, existe-t-il une règle d'intégration pour résoudre ce problème par opposition aux analyses numériques (telles que les règles trapézoïdales, Gauss-Legendre ou Simpson)? J'ai une fonction où g ( x ; μ , σ ) = 1F( x ) = x g( x ; μ …
Je construis un modèle de propension utilisant la régression logistique pour un client de service public. Ce qui m'inquiète, c'est que sur l'échantillon total, mes «mauvais» comptes ne représentent que 5%, et le reste est bon. Je prédit «mauvais». Le résultat sera-t-il biaisé? Quelle est la «proportion mauvaise à bonne» …
Je dois créer une application Web multi-utilisateurs qui concerne les mesures de trafic, les pronostics, etc. À ce stade, je sais que j'utiliserai des graphiques à barres et à secteurs. Malheureusement, ces types de graphiques ne sont pas riches en expression de toutes les données que je collecte et calcule. …
J'ai entendu parler de l'analyse de la survie et de l'analyse des données de la vie, mais je n'ai pas une vue d'ensemble. Je me demandais quels sujets ils couvrent? S'agit-il de statistiques pures ou simplement d'application de statistiques sur un domaine spécifique? L'analyse de la date de vie fait-elle …
J'utilise le package quantreg pour créer un modèle de régression en utilisant le 99e centile de mes valeurs dans un ensemble de données. Sur la base des conseils d'une question de stackoverflow précédente que j'ai posée, j'ai utilisé la structure de code suivante. mod <- rq(y ~ log(x), data=df, tau=.99) …
Je voudrais obtenir une représentation graphique des corrélations dans les articles que j'ai rassemblés jusqu'à présent pour explorer facilement les relations entre les variables. J'avais l'habitude de dessiner un graphique (désordonné) mais j'ai trop de données maintenant. En gros, j'ai une table avec: [0]: nom de la variable 1 [1]: …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.