đŸŽ€ L’IA vocale française veut rivaliser avec les gĂ©ants mondiaux (Patrick PĂ©rez, Kyutai) [REDIF]
Monde Numérique - Actu Tech

đŸŽ€ L’IA vocale française veut rivaliser avec les gĂ©ants mondiaux (Patrick PĂ©rez, Kyutai) [REDIF]

·34 min
Télécharger
Kyutai, laboratoire français de recherche en intelligence artificielle, dĂ©veloppe des modĂšles vocaux capables de dialoguer en temps rĂ©el, de traduire instantanĂ©ment et de fonctionner sur des appareils plus modestes. Patrick PĂ©rez explique comment un petit labo peut innover face aux gĂ©ants de l’IA. INTERVIEW : Patrick PĂ©rez - Directeur gĂ©nĂ©ral de KyutaiRediffusion du 29 octobre 2025 L'essentiel- Nous ne faisons pas de produit, nous sommes entiĂšrement consacrĂ©s Ă  la recherche.- Moshi permet des interactions vocales plus naturelles entre l’humain et la machine.- La finalitĂ© de l’open source, c’est que d’autres s’en saisissent.- Nous avons fait des choses que d’autres n’avaient pas fait avant nous.Comment Kyutai trouve-t-il sa place dans la course mondiale Ă  l’intelligence artificielle face aux gĂ©ants du secteur ?Nous sommes un laboratoire de recherche Ă  but non lucratif, financĂ© par du mĂ©cĂ©nat privĂ©. Notre objectif n’est pas de lancer des produits, mais de faire avancer la connaissance en dĂ©veloppant des prototypes et en partageant les rĂ©sultats, les modĂšles et le code. MĂȘme dans un domaine dominĂ© par de trĂšs grandes organisations, il reste possible pour de petites Ă©quipes de faire Ă©merger des innovations importantes. Avec Moshi, vous avez dĂ©veloppĂ© une IA vocale capable de conversations trĂšs naturelles. Quelle Ă©tait l’innovation principale ?Moshi est un modĂšle conversationnel vocal qui permet une interaction sans tour de parole imposĂ©. La machine peut couper la parole Ă  bon escient, comme dans une vraie conversation. Pour y arriver, nous avons Ă©vitĂ© de passer par une transcription textuelle intermĂ©diaire de la parole, ce qui permet d’aller plus vite et de conserver des informations importantes comme le timbre, l’émotion ou l’accent de la voix. Vos travaux portent aussi sur la traduction simultanĂ©e et la synthĂšse vocale. Quels sont les prochains dĂ©fis ?Nous travaillons beaucoup sur des IA multimodales capables de rester fluides dans la conversation tout en ayant accĂšs Ă  des informations nouvelles, comme des documents, des vidĂ©os ou des contenus audio. L’objectif est de crĂ©er des assistants qui peuvent comprendre diffĂ©rents types d’informations et interagir naturellement avec les utilisateurs. HĂ©bergĂ© par Audiomeans. Visitez audiomeans.fr/politique-de-confidentialite pour plus d'informations.

© 2026 FrancoPod

Language
Site