Google intègre un studio musical à Gemini. L’application permet désormais de générer à la demande des morceaux d’IA de 30 secondes, transformant de simples prompts en chansons abouties.
Cette mise à jour intègre directement le modèle Lyria 3 de DeepMind à Gemini, permettant de transformer du texte ou des photos en musique personnalisée, avec des paroles générées et un fichier audio partageable, selon une annonce de Google.
Du texte à la musique
Les utilisateurs peuvent décrire un genre, une ambiance, un souvenir ou une blague entre initiés, et le système compose un morceau original avec des voix ou un accompagnement instrumental. Il n’est pas nécessaire de fournir des paroles : elles peuvent être générées automatiquement à partir du prompt.
Les importations ajoutent une nouvelle dimension. Une photo ou une courte vidéo peut servir de point de départ créatif, le modèle créant une bande-son qui correspond à l’ambiance de la scène. Prompts peuvent également préciser des éléments comme le tempo, le style vocal et l’ambiance générale, donnant aux utilisateurs davantage de contrôle sur la façon dont le morceau final prend forme.
À partager en quelques secondes
Chaque morceau généré est accompagné d’une pochette personnalisée, offrant aux utilisateurs un visuel prêt à l’emploi assorti à l’audio. Les chansons peuvent être téléchargées directement ou partagées via un lien, pour un processus simple et immédiat.
Le déploiement commence sur ordinateur, et la version mobile suivra dans les prochains jours. L’accès est ouvert aux utilisateurs âgés de 18 ans et plus dans les langues prises en charge, tandis que les abonnés à Google AI Plus, Pro et Ultra bénéficient de limites de génération plus élevées.
La fonctionnalité est disponible aux États-Unis et s’étend à des créateurs dans d’autres pays, ce qui étend la génération musicale au-delà de l’application Gemini jusque dans les outils de création plus étendus de YouTube.
Détection intégrée de l’audio généré par l’IA
Tous les morceaux créés dans l’application intègrent SynthID, la technologie de filigrane imperceptible de Google conçue pour identifier les contenus générés par l’IA. Le marqueur est intégré directement à l’audio lors de sa création, ce qui permet de le détecter ultérieurement sans modifier le son de la musique.
Gemini prend désormais aussi en charge la vérification audio. Les utilisateurs peuvent importer un fichier et demander s’il a été généré
De Gemini aux Shorts
Lyria 3 alimente également la fonctionnalité Dream Track de YouTube, offrant aux créateurs de nouvelles façons de générer des bandes-son personnalisées pour les Shorts. Cette mise à niveau améliore la qualité audio et permet d’adapter davantage les couplets lyriques ou l’accompagnement instrumental aux vidéos courtes. Grâce à Google AI, le système recherchera la présence de SynthID tout en appliquant sa propre analyse avant de renvoyer un résultat.
Un style sans imitation
La génération musicale est conçue pour créer des œuvres originales, pas pour les reproduire. Lorsqu’un prompt mentionne un artiste précis, le système s’appuie sur des caractéristiques stylistiques générales plutôt que de copier une voix ou un catalogue.
Google a déclaré que Lyria 3 avait été développé en tenant compte des droits d’auteur et des accords conclus avec ses partenaires, avec un filtrage permettant de comparer les résultats aux œuvres existantes. Les utilisateurs peuvent signaler d’éventuelles violations de droits, et la fonctionnalité est régie par les conditions d’utilisation de l’entreprise et ses politiques en matière d’IA générative.
Les institutions n’adoptent pas toutes l’IA intégrée, le Parlement européen prenant des mesures pour la restreindre sur le matériel du personnel.


