Questions marquées «data-mining»

L'exploration de données utilise des méthodes de l'intelligence artificielle dans un contexte de base de données pour découvrir des modèles inconnus auparavant. En tant que telles, les méthodes ne sont généralement pas supervisées. Il est étroitement lié mais pas identique à l'apprentissage automatique. Les tâches clés de l'exploration de données sont l'analyse des clusters, la détection des valeurs aberrantes et l'extraction des règles d'association.

131
Kappa de Cohen en anglais clair

Je lis un livre de data mining qui mentionnait la statistique Kappa comme moyen d’évaluer les performances de prévision des classificateurs. Cependant, je ne peux tout simplement pas comprendre cela. J'ai aussi vérifié Wikipedia mais cela n'a pas aidé aussi:

71
Générer une variable aléatoire avec une corrélation définie avec une ou plusieurs variables existantes

Pour une étude de simulation , je dois générer des variables aléatoires qui montrent une corrélation prefined (population) à une variable existante .YYY J'ai examiné les Rpackages copulaet ceux CDVinequi peuvent produire des distributions multivariées aléatoires avec une structure de dépendance...

36
Mesure de levage dans l'exploration de données

J'ai cherché de nombreux sites Web pour savoir ce que ferait exactement l'ascenseur? Les résultats que j'ai trouvés concernaient tous son utilisation dans des applications autres que celles-ci. Je connais la fonction de support et de confiance. D'après Wikipédia, dans l'exploration de données,...

34
Pourquoi y a-t-il une différence entre le calcul manuel d'un intervalle de confiance de 95% selon la régression logistique et l'utilisation de la fonction confint () dans R?

Cher tout le monde - J'ai remarqué quelque chose d'étrange que je ne peux pas expliquer, pouvez-vous? En résumé: l'approche manuelle pour calculer un intervalle de confiance dans un modèle de régression logistique et la fonction R confint()donnent des résultats différents. Je suis passé par la...