Accueil Finances personnelles Comment préparer les données pour un modèle d'analyse prédictive - les nuls

Comment préparer les données pour un modèle d'analyse prédictive - les nuls

Table des matières:

Vidéo: Comprendre l’analyse prédictive en 2 minutes 2025

Vidéo: Comprendre l’analyse prédictive en 2 minutes 2025
Anonim

Lorsque vous avez défini les objectifs du modèle pour l'analyse prédictive, l'étape suivante consiste à identifier et préparer les données que vous utiliserez pour construire votre modèle. La séquence générale des étapes ressemble à ceci:

  1. Identifiez vos sources de données.

    Les données peuvent être dans différents formats ou résider dans divers endroits.

  2. Identifiez comment vous allez accéder à ces données.

    Parfois, vous devez acquérir des données tierces ou des données appartenant à une autre division de votre organisation, etc.

  3. Pensez aux variables à inclure dans votre analyse.

    Une approche standard consiste à commencer avec un large éventail de variables et à éliminer celles qui n'offrent aucune valeur prédictive pour le modèle.

  4. Déterminez s'il faut utiliser des variables dérivées.

    Dans de nombreux cas, une variable dérivée (telle que le ratio prix / revenu utilisé pour analyser les prix des actions) aurait un impact direct plus important sur le modèle que la variable brute.

  5. Explorez la qualité de vos données, en cherchant à comprendre leur état et leurs limites.

    L'exactitude des prédictions du modèle est directement liée aux variables que vous sélectionnez et à la qualité de vos données. Vous souhaitez répondre à certaines questions spécifiques aux données à ce stade:

    • Les données sont-elles complètes?

    • Y a-t-il des valeurs aberrantes?

    • Les données doivent-elles être nettoyées?

    • Avez-vous besoin de remplir les valeurs manquantes, de les conserver telles quelles ou de les éliminer complètement?

La compréhension de vos données et de leurs propriétés peut vous aider à choisir l'algorithme qui vous sera le plus utile dans la construction de votre modèle. Par exemple:

  • Les algorithmes de régression peuvent être utilisés pour analyser des données de séries temporelles.

  • Les algorithmes de classification peuvent être utilisés pour analyser des données discrètes.

  • Les algorithmes d'association peuvent être utilisés pour les données avec des attributs corrélés.

L'ensemble de données utilisé pour former et tester le modèle doit contenir des informations commerciales pertinentes pour répondre au problème que vous tentez de résoudre. Si votre objectif est (par exemple) de déterminer quel client est susceptible de se retourner, l'ensemble de données que vous choisissez doit contenir des informations sur les clients qui ont déjà effectué un barème et sur les clients qui ne l'ont pas fait.

Certains modèles créés pour extraire des données et donner un sens à leurs relations sous-jacentes - par exemple, ceux construits avec des algorithmes de clustering - n'ont pas besoin d'avoir un résultat final particulier à l'esprit.

Deux problèmes se posent lorsque vous traitez des données lorsque vous construisez votre modèle: le sous-équipement et le surapprentissage.

Underfitting

Underfitting signifie que votre modèle ne peut détecter aucune relation dans vos données.C'est généralement une indication que les variables essentielles - celles ayant un pouvoir prédictif - n'ont pas été incluses dans votre analyse. Par exemple, une analyse de stock qui inclut uniquement les données d'un marché haussier (où les cours boursiers globaux augmentent) ne tient pas compte des crises ou des bulles qui peuvent apporter des corrections majeures à la performance globale des actions.

Le fait de ne pas inclure les données qui couvrent à la fois les marchés baissiers et (lorsque les cours boursiers globaux sont en baisse) empêche le modèle de produire la meilleure sélection de portefeuille possible.

Surajustement

Surajustement correspond à l'inclusion de données sans puissance prédictive dans votre modèle, mais uniquement pour l'ensemble de données que vous analysez. Le bruit - variations aléatoires dans l'ensemble de données - peut trouver sa place dans le modèle, de sorte que l'exécution du modèle sur un ensemble de données différent entraîne une baisse importante des performances prédictives et de la précision du modèle. La barre latérale associée fournit un exemple.

Si votre modèle fonctionne correctement sur un jeu de données particulier et ne fonctionne que lorsque vous le testez sur un jeu de données différent, suspectez un surapprentissage.

Comment préparer les données pour un modèle d'analyse prédictive - les nuls

Le choix des éditeurs

Conventions de dénomination pour Ruby on Rails - mannequins

Conventions de dénomination pour Ruby on Rails - mannequins

Vous utilisez Ruby on Rails pour créer un site Web application ou application de base de données Web, ce qui est très intelligent de votre part. En fonction de ce que vous utilisez (une application, une relation un-à-plusieurs ou une relation plusieurs-à-plusieurs), vous utilisez différentes variantes des protocoles d'attribution de noms Rails, qui sont expliquées dans les sections suivantes. Ruby Naming for ...

En orbite, panoramique et zoom dans la vue 3D de Blender - mannequins

En orbite, panoramique et zoom dans la vue 3D de Blender - mannequins

En essayant de naviguer dans un espace en trois dimensions à travers un écran bidimensionnel comme un écran d'ordinateur, vous ne pouvez pas interagir avec cet espace 3D virtuel exactement comme vous le feriez dans le monde réel, ou espace de vie. La meilleure façon de visualiser le travail en 3D à travers un programme comme Blender est d'imaginer la vue 3D comme vos yeux ...

Déplacement de clips sur la timeline dans Final Cut Pro HD - Ficelles

Déplacement de clips sur la timeline dans Final Cut Pro HD - Ficelles

Final Cut Pro HD Timeline vous permet d'organiser tous vos clips vidéo et audio afin qu'ils racontent l'histoire que vous voulez raconter. Pour comprendre le fonctionnement de la Timeline, imaginez-la comme une page de partitions, mais plutôt que de placer des notes de musique de différentes durées (noires, demi-notes, ...

Le choix des éditeurs

Contrôle et modification de l'associativité des dimensions dans AutoCAD - Dummies

Contrôle et modification de l'associativité des dimensions dans AutoCAD - Dummies

Lorsque vous ajoutez des dimensions en sélectionnant des objets ou en utilisant l'accrochage aux objets Pour sélectionner des points sur les objets, AutoCAD crée normalement des dimensions associatives, qui sont connectées aux objets et se déplacent avec eux. C'est le cas dans les nouveaux dessins créés à l'origine dans toute version d'AutoCAD à partir de 2002. Si vous ...

Copie de styles de cote existants dans AutoCAD 2008 - mannequins

Copie de styles de cote existants dans AutoCAD 2008 - mannequins

Si vous avez la chance de travailler dans un bureau Quelqu'un a mis en place des styles de cotes qui conviennent à votre secteur d'activité et à votre projet. Vous pouvez le copier et ainsi éviter de devoir créer vos propres styles de cote. (Un style de cote - ou dimstyle pour faire court - est une collection de paramètres de dessin appelée dimension ...

En choisissant un style d'édition AutoCAD -

En choisissant un style d'édition AutoCAD -

Dans AutoCAD vous passez généralement plus de temps à éditer que dessiner des objets. C'est en partie parce que le processus de conception et de rédaction est, par nature, sujet à des changements, et aussi parce que AutoCAD vous permet de modifier facilement les objets proprement. AutoCAD propose trois styles d'édition: Commande-première Sélection-première Objet-direct (poignée) AutoCAD fait référence à l'édition de commandes comme verbe-nom ...

Le choix des éditeurs

Praxis Examen d'éducation élémentaire - Présentations orales - mannequins

Praxis Examen d'éducation élémentaire - Présentations orales - mannequins

Parce que les élèves doivent généralement donner des présentations orales en classe , vous rencontrerez probablement une question sur ce sujet dans l'examen Praxis Elementary Education. Plus formelles que les discussions de groupe, les présentations orales ont leurs propres règles pour le conférencier. Lorsque vous donnez une présentation en classe, il y a plusieurs ...

Praxis Examen d'éducation élémentaire - Littérature et texte d'information - mannequins

Praxis Examen d'éducation élémentaire - Littérature et texte d'information - mannequins

L'examen Praxis Elementary Education sur la littérature et le texte d'information, c'est-à-dire la fiction et la non-fiction. Vous devrez donc vous familiariser avec les différents genres d'écriture. La compréhension du texte est un processus qui se produit au fil du temps.

Praxis Examen d'éducation élémentaire - Connaissance phonologique - mannequins

Praxis Examen d'éducation élémentaire - Connaissance phonologique - mannequins

Vous rencontrerez probablement une ou deux questions qui impliquent des questions phonologiques sensibilisation à l'examen Praxis Elementary Education. La conscience phonologique est une compétence large impliquant la reconnaissance de son. Les lecteurs débutants commencent par apprendre les sons individuels, ou phonèmes, dans des mots parlés. Par exemple, le mot chat a trois phonèmes: / c / / a / / t /. Un lecteur débutant apprend ...