Veille scientifique automatisée : recherche multi-sources, filtrage et classement des publications, puis synthèse par IA livrée chaque semaine.
Suivre la littérature de son domaine demande un temps que peu de chercheurs et d'équipes R&D peuvent y consacrer : le volume de publications croît bien plus vite que le temps disponible pour les lire.
my-research-digest automatise cette veille. À partir d'un sujet décrit en quelques lignes, le produit repère chaque semaine les publications récentes qui comptent et en restitue une synthèse lisible, livrée par e-mail.
La difficulté n'est pas de trouver des articles — les bases académiques en renvoient des milliers — mais de n'en garder que les bons. C'est là que se joue l'essentiel du travail, et c'est pourquoi la sélection passe par un enchaînement d'étapes plutôt que par une seule requête.
Produit personnel, conçu et développé de bout en bout : chaîne de traitement, choix des modèles, back-end, interface, déploiement et exploitation.
Publié en open source sous licence MIT, code et documentation publics.
Chercher, filtrer, classer, synthétiser. Le produit élargit d'abord la recherche — plusieurs requêtes, deux bases — puis resserre en deux passes successives : la pertinence, puis la qualité. La rédaction ne vient qu'en dernier, sur ce qui a survécu.
Découper ainsi a un intérêt concret : chaque étape s'évalue séparément. Quand un numéro déçoit, on sait si le problème vient de ce qui a été cherché, de ce qui a été gardé ou de ce qui a été écrit — et on corrige là sans toucher au reste.
Un LLM reformule le sujet et sa description en plusieurs requêtes complémentaires, pour couvrir le thème sous des angles qu'une seule formulation manquerait.
Chaque requête est jouée sur Semantic Scholar et OpenAlex, deux bases académiques complémentaires, puis les résultats sont dédoublonnés par titre normalisé.
Titre et résumé de chaque article passent devant un LLM qui joue le rôle de relecteur expert et écarte ce qui sort du sujet.
Deux stratégies, paramétrables par veille : autorité des auteurs (log1p(citations) + h-index maximal), ou proximité sémantique (similarité cosinus entre l'embedding du résumé et la description du sujet).
Les articles retenus sont analysés et résumés par LLM, compilés en numéro et envoyés par e-mail.
Trente minutes en visio, gratuitement : on regarde s'il y a un cas d'usage exploitable, et par où commencer.