Contenu principalNavigationPied de pageGestion des cookies
WeDoData - Accueil
    • Filtrer par
    • Tous nos projets
    • Par envies
    • Par formats
    • Par types de viz
    • Par thèmes
    • Conseil
    • Prototypage
    • Production
    • Notre équipe
    • Notre écosystème
    • Nos compétences
    • Nos engagements
    • Nos clients
    • Par mail
    • +33 6 63 28 95 17
    • 35 rue Chanzy
      75011 Paris
  • Newsletter
  • BlueSky
  • LinkedIn
  • Instagram
Copyright © 2026
  • Mentions légales
WeDoData - Accueil

Gestion de vos préférences sur les cookies

Les cookies ont une durée de vie de 13 mois et nous conservons votre données pendant 12 mois. Vous pouvez changer d’avis à tout moment en cliquant sur « Gestion des cookies » en bas de la page du site.

  1. Cookies fonctionnels

    Pour permettre au site de fonctionner de manière optimale (service vidéo optimisée, choix de la langue du site, filtres productions mémorisés...).

  2. Mesure d'audience (MATOMO)

    Pour permettre à MATOMO de mesurer l'audience de ce site.

Tous nos projets

2025

L’explorateur de podcasts

Radio France

MédiaSociétéInteractifCentré utilisateurR&DSolutions-outilsIntelligence artificielle

Quelle frustration de savoir qu’il y a forcément un moment dans un podcast qui correspond à votre recherche, mais de ne jamais pouvoir le trouver ! En effet, les moteurs de recherche vous conseillent des émissions en entier, car ils se contentent de la description générale du contenu d’un podcast. Sous l’impulsion de Radio France, WeDoData a innové en proposant un moteur de recherche d’extraits de podcasts : celui-ci va chercher le Top 5 des extraits des podcasts qui correspondent à votre besoin. Coulisses d’un projet R&D.

Techno
—

  • Google Sheets
  • , openAI

2025

L’explorateur de podcasts

Radio France

MédiaSociétéInteractifCentré utilisateurR&DSolutions-outilsIntelligence artificielle

Quelle frustration de savoir qu’il y a forcément un moment dans un podcast qui correspond à votre recherche, mais de ne jamais pouvoir le trouver ! En effet, les moteurs de recherche vous conseillent des émissions en entier, car ils se contentent de la description générale du contenu d’un podcast. Sous l’impulsion de Radio France, WeDoData a innové en proposant un moteur de recherche d’extraits de podcasts : celui-ci va chercher le Top 5 des extraits des podcasts qui correspondent à votre besoin. Coulisses d’un projet R&D.

Techno
—

  • Google Sheets
  • , openAI
L’explorateur de podcasts

A l’origine du projet

Pour développer cet explorateur de podcasts d’un genre nouveau, nous nous sommes d’abord appuyés sur l’expérience acquise avec l’explorateur du Collectif Famille.s. L’association de visibilité des familles LGBTQIA+ nous avait en effet confié 200 témoignages de familles (d’une heure chacun environ) dans lesquels il était devenu difficile de se retrouver. Le moteur que nous avons conçu permet désormais de découvrir les extraits pertinents face aux questions que les (futures) familles queer se posent.
Pour Radio France, deux corpus ont été ciblés pour ce nouveau défi : Un corpus généraliste de plus de 2 000 épisodes issus de l’émission “Grand bien vous fasse !” sur France Inter Un corpus thématique d’environ 300 épisodes traitant de la Seconde Guerre mondiale, issus d’une grande variété d’émissions de différentes chaînes de Radio France
Ce passage à l'échelle a soulevé des enjeux techniques concrets : le comportement de l'outil face à des contenus variés, l'optimisation de la qualité des résultats et le maintien de la rapidité d'exécution sur des volumes de données importants.

Un POC avec les équipes de Radio France

Ce projet a été conçu comme une preuve de concept (PoC) afin de permettre aux équipes de Radio France de valider la faisabilité et la pertinence d’un explorateur de podcasts. Pour ce faire, un processus d’amélioration continue a été structuré en quatre étapes :
1. Réplication et adaptation de l’existant : mise en place d'un workflow inspiré du projet Collectif Famille.s (découpage des transcriptions en chunks, traitement des métadonnées, nettoyage des segments parasites et développement de l’interface).
2. Phase de bêta-tests : sollicitation des équipes internes pour évaluer la qualité perçue des résultats. Une analyse quantitative de ces retours a permis d’identifier des axes d’optimisation.
3. Amélioration et innovation : tests de nouvelles fonctionnalités sur la base des retours (utilisation de tags, filtrage a posteriori par IA). Ces évolutions ont été éprouvées et validées par A/B testing.
4. Validation de la qualité : une évaluation finale a été réalisée pour confirmer la performance de l’explorateur et comparer les résultats sur les deux corpus.

Des phases de tests primordiales

Lors de la phase de test, nous avons souhaité rendre l’évaluation des résultats la plus fluide possible pour impliquer les équipes de Radio France. Ces phases sont cruciales dans les projets liés à l’IA, or les interfaces pour noter les résultats sont souvent non ergonomiques ou lourdes. WeDoData a donc eu l’idée d’intégrer le module de notation à l’interface de résultats. En clair, l’équipe de Radio France utilisait le site comme l’aurait fait n’importe quel futur internaute, mais elle bénéficiait sous chaque résultat d’un espace de notation (étoiles) et de commentaires si besoin.
Au total, ce dispositif a permis de collecter plus de 600 évaluations, issues de près de 170 requêtes réalisées par une dizaine de bêta-testeurs.

Cette phase de bêta-test et les ajustements réalisés grâce aux retours des utilisateurs ont nettement amélioré les performances de l’explorateur. Aujourd'hui, près de 70 % des résultats sont évalués comme bons ou très bons.

Comment ça marche ?

Le processus final repose sur 3 étapes clés : 1. Traitement des données brutes : découpage des transcriptions en segments (chunks), retrait des contenus indésirables, génération automatique de résumés et de tags, puis conversion en embeddings via les modèles OpenAI. 2. Traitement de la requête utilisateur : reformulation de la question si nécessaire et conversion en embeddings (OpenAI) pour permettre la comparaison. 3. Génération du top 5 des extraits : mise en correspondance de la requête et des segments par similarité cosinus (cosine similarity). Les résultats sont ensuite filtrés par un LLM (OpenAI) via un prompt en few-shot learning optimisé grâce aux phases de tests.

Les livrables

Ce projet a été mené comme une preuve de concept, Radio France souhaitant internaliser le développement à grande échelle sur ses propres serveurs et avec un accès direct à sa base d’épisodes. Une fois l’explorateur finalisé et validé, nous avons transmis l’intégralité du code (back et front), les données générées ainsi qu’une documentation détaillée de l’ensemble du projet.

Si vous souhaitez mettre en place un prototype fonctionnel, tester une idée ou initier un projet stratégique en profitant de l’expertise d'une agence de 15 ans, n’hésitez pas à nous contacter.

Projets similaires

radio_france_tour_de_france.png

De 2013 à 2016

101 Tours de France : l’application de la Grande Boucle

SportInteractifDashboardLudique

Radio France

france-bleue-regionales2015.png

2015

Élections régionales 2015

PolitiqueInteractif

Radio France

Municipales 2026 : la carte des enjeux  près de chez vous

2026

Municipales 2026 : la carte des enjeux près de chez vous

Climat et environnementPolitiqueSociétéMédiaCentré utilisateurInteractifEnquêteSolutions-outils

Reporterre

RADAR décortique les délibérations municipales grâce à l’IA

2025

RADAR décortique les délibérations municipales grâce à l’IA

MédiaPolitiqueSociétéSolutions-outilsEnquêteDashboard

Médiacités