Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'essaie de comprendre la notation matricielle et je travaille avec des vecteurs et des matrices. Pour l'instant, j'aimerais comprendre comment est calculé le vecteur d'estimation des coefficients en régression multiple.β^β^\hat{\beta} L'équation de base semble être ddβ(y−Xβ)′(y−Xβ)=0.ddβ(y−Xβ)′(y−Xβ)=0. \frac{d}{d\boldsymbol{\beta}} (\boldsymbol{y}-\boldsymbol{X\beta})'(\boldsymbol{y}-\boldsymbol{X\beta}) = 0 \>. Maintenant, comment pourrais-je résoudre un vecteur ββ\beta ici? Edit …
Je regarde des données extrêmement non linéaires pour lesquelles les modèles ARMA / ARIMA ne fonctionnent pas bien. Cependant, je vois une certaine autocorrélation et je pense avoir de meilleurs résultats pour l'autocorrélation non linéaire. 1 / existe-t-il un équivalent du PACF pour la corrélation des rangs? (en R?) 2 …
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Je suppose que R a cette fonction intégrée. Comment le référencer?
Mon ensemble de données comprend la mortalité totale ou la survie d'un organisme sur trois types de sites: côtier, médian et extracôtier. Les nombres dans le tableau ci-dessous représentent le nombre de sites. 100% Mortality 100% Survival Inshore 30 31 Midchannel 10 20 Offshore 1 10 Je voudrais savoir si …
J'ai écrit un script teste les données en utilisant le wilcox.test, mais quand j'ai obtenu les résultats, toutes les valeurs de p étaient égales à 1. J'ai lu sur certains sites Web que vous pouviez utiliser la gigue avant de tester les données (pour éviter les liens comme ils le …
Envisagez une expérience avec plusieurs participants humains, chacun mesuré plusieurs fois dans deux conditions. Un modèle d'effets mixtes peut être formulé (en utilisant la syntaxe lme4 ) comme: fit = lmer( formula = measure ~ (1|participant) + condition ) Supposons maintenant que je souhaite générer des intervalles de confiance bootstrap …
J'ai deux modèles de régression logistique en R réalisés avec glm(). Ils utilisent tous deux les mêmes variables, mais ont été créés en utilisant différents sous-ensembles d'une matrice. Existe-t-il un moyen facile d'obtenir un modèle moyen qui donne les moyennes des coefficients et de l'utiliser ensuite avec la fonction Predict …
Je veux exécuter des corrélations sur un certain nombre de mesures où des échelles de Likert ont été utilisées. En regardant les diagrammes de dispersion, il apparaît que les hypothèses de linéarité et d'homoscédasticité peuvent avoir été violées. Étant donné qu'il semble y avoir un débat autour de la notation …
Je souhaite effectuer une analyse du nombre de quadrat sur plusieurs processus ponctuels (ou un processus ponctuel marqué), puis appliquer des techniques de réduction de dimensionnalité. Les marques ne sont pas distribuées de manière identique, c'est-à-dire que certaines marques apparaissent assez souvent et certaines sont assez rares. Ainsi, je ne …
Comment calculer la couverture d'intervalle discret? Ce que je sais faire: Si j'avais un modèle continu, je pourrais définir un intervalle de confiance à 95% pour chacune de mes valeurs prédites, puis voir à quelle fréquence les valeurs réelles se trouvaient dans l'intervalle de confiance. Je pourrais trouver que seulement …
Je recherche une référence (ou des références) solides sur les techniques d'optimisation numérique destinées aux statisticiens, c'est-à-dire qu'elles appliqueraient ces méthodes à certains problèmes inférentiels standard (par exemple MAP / MLE dans les modèles courants). Des choses comme la descente de gradient (droite et stochastique), l'EM et ses retombées / …
J'ai un ensemble de données d'événements qui se sont produits au cours de la même période. Chaque événement a un type (il existe peu de types différents, moins de dix) et un emplacement, représentés comme un point 2D. Je voudrais vérifier s'il existe une corrélation entre les types d'événements ou …
J'utilise un didacticiel que j'ai trouvé et je trace des valeurs moyennes avec les erreurs standard pour afficher mes données. Mais j'ai du mal à discuter des résultats. Mon tracé est comme indiqué ci-dessous: certaines des erreurs standard (affichées sous forme de barre d'erreur) varient beaucoup et certaines sont très …
Nous créons un graphique montrant le trafic par heure de la journée sur une période donnée. Ainsi, l'axe des y est le trafic, l'axe des x est minuit, 1 h, 2 h, etc. Il peut également s'agir de jours de la semaine. Quel est le nom générique de ce type …
Est-il possible d'utiliser l'analyse du composant principal du noyau (kPCA) pour l'indexation sémantique latente (LSI) de la même manière que PCA est utilisé? J'exécute LSI dans R en utilisant la prcompfonction PCA et j'extrais les caractéristiques avec les charges les plus élevées à partir des premiers composants. Par cela, j'obtiens …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.