NLP Financier : Résoudre le piège des coréférences journalistiques avec l’aide d’un LLM.

Si vous avez déjà tenté de construire un pipeline d’analyse de sentiment sur des flux d’actualités financières, vous vous êtes probablement heurté à un mur invisible. Sur le papier, l’architecture semble évidente : on ingère un flux RSS, on détecte le nom de l’entreprise cible, on isole la phrase, et on passe le tout dans

Extracting summarization avec TF-IDF

1. Le Bag of Words Le sac de mots (BoW) est une technique de traitement du langage naturel (NLP). La représentation de nos textes sous forme de sac de mot permet de vectoriser notre corpus et ainsi d’avoir une représentation numérique de chaque texte.Un sac de mots est basé sur l’occurrence des mots dans un document. Le processus commence par l’identification du

Flask-SQLAlchemy et Flask-Migrate : Le Guide de l’ORM

Lorsque l’on développe une application Flask, le choix de la gestion des données est crucial.Pour transformer vos objets Python en tables de base de données sans écrire une seule ligne de SQL, le duo Flask-SQLAlchemy et Flask-Migrate est l’outil standard de l’écosystème. 1. Flask-SQLAlchemy : La puissance de l’ORM Flask-SQLAlchemy simplifie l’utilisation d’SQLAlchemy. Un ORM (Object Relational Mapper) permet d’interagir

la programmation asynchrone avec Python

La programmation asynchrone est l’un des aspcts qui évolue le plus dans le langage python.Il s’agit d’une fonctionnalité très importante qui permet de faire gagner de la performance sans pour autant devoir trop complexifier les algorithmes.Python 3.4 avait apporté un nouveau module nommé asyncio qui a permis de mettre en place une meilleurs évolution que celles qui existaient déjà.Python 3.5 a

yield et les générateurs

Pourquoi yield existe-t-il ?Économie de mémoire : au lieu de charger toute une liste en RAM, vous produisez les éléments un par un, à la volée (lazy evaluation).Performance sur les flux infinis : vous pouvez itérer sans connaître la fin (logs, streaming, data science, IA temps réel).Composition élégante : enchaîne plusieurs générateurs sans perdre en

args et kwargs avec Python

En Python, *args et **kwargs permettent de passer un nombre variable d’arguments à une fonction. Voici une explication détaillée : Comprendre *args et **kwargs en Python *args Utilisation : *args permet de recevoir un nombre variable d’arguments positionnels. Fonctionnement : Les arguments passés après le paramètre formel marqué par *args sont collectés dans un tuple. Exemple : Dans cet exemple, *args recueille tous les arguments positionnels (1, 2, 3 ou 10, 20)

Les décorateurs avec Pyton

Un décorateur est une fonction qui prend une autre fonction en argument et retourne une nouvelle fonction modifiée (ou la même fonction avec des fonctionnalités supplémentaires). C’est un moyen pratique d’ajouter des fonctionnalités à des fonctions existantes sans modifier leur code source. Exemple de base Explications `@mon_decorateur` est équivalent à `dire_bonjour = mon_decorateur(dire_bonjour)`.Lors de l’appel à `dire_bonjour()`,

Le Concept de Portée (Scope) en Python

Le concept de portée (scope) définit la manière dont les variables et les noms sont recherchés dans votre code.Elle détermine la visibilité d’une variable dans le programme.La portée d’un nom ou d’une variable dépend de l’endroit où cette variable est créée dans le code.En Python, la gestion de la portée repose sur une règle appelée LEGB. La Règle LEGB L’acronyme LEGB signifie

Création d’une API avec FastAPI

API est l’abréviation de Application Programming Interface (interface de programmation d’applications).Une API est un intermédiaire logiciel qui permet à deux applications de communiquer entre elles. Une API reçoit une requête d’une application et l’envoie à un serveur.Le serveur traite ensuite la demande et renvoie les données à l’application. L’application interprète ensuite les données et les présente à

Le projet Rakuten

Le projet Rakuten est le projet fil rouge que j’ai réalisé pour mon diplôme de Data Scientist chez Datascientest.com. Description du projet L’objectif global est de classifier à grande échelle des produits du catalogue de Rakuten France en utilisant des données multimodales, principalement des textes et des images, pour les associer à leur catégorie correcte.La catégorisation des annonces de