Test du Google Lyria 3 Pro (2026) : qualité musicale, suggestions, prix et API

Test du Google Lyria 3 Pro (2026) : prix, invites et API

18 générations rémunérées · août 2026

Des morceaux puissants et aboutis. Une réelle variation dans le contrôle.

18/18tâches réussies
55,5 stemps de génération médian
$0.08par requête testée
17/18à moins de 5 s de la cible

Après 18 générations payantes, notre test de Google Lyria 3 Pro a révélé que le modèle est capable de générer une chanson complète avec des voix, des paroles, des couplets, des refrains, des ponts et un arrangement de près de trois minutes. Il est également moins déterministe que ne le laissent supposer les démos soignées. Toutes les tâches ont abouti et chaque résultat a été fourni au format MP3 stéréo à 44,1 kHz et 192 kbps, mais des demandes répétées ont tout de même entraîné l’absence d’un solo de synthé, la modification de paroles précises, un glissement vers un style inapproprié et le non-respect des contraintes “ pas de chant ” et “ pas de risers ”.

En bref : Lyria 3 Pro est un puissant générateur de chansons complètes destiné aux utilisateurs capables de créer plusieurs versions et de sélectionner la meilleure. Il ne s'agit pas d'un outil « en un clic » permettant d'obtenir des paroles exactes, un timing précis des sections ou de respecter des contraintes strictes. À $0,08 par requête API Gemini portant sur un morceau complet, ce processus de sélection est abordable, mais il nécessite tout de même un contrôle qualité par écoute et édition.

Statut du Lyria 3 Pro en 2026 : le Pro n'est pas le dernier modèle de la gamme Lyria

Au 10 août 2026, Google DeepMind présente Lyria 3.5 en tant que dernier modèle de sa gamme de lecteurs audio et en fait la promotion via Flow Music. Cela ne rend pas pour autant le Lyria 3 Pro obsolète.

Le page actuelle du modèle Lyria 3 de Google Cloud énumère toujours Aperçu de Lyria 3 Pro sous l'identifiant du modèle lyria-3-pro-aperçu, avec génération de morceaux complets, paroles fournies par l'utilisateur, conversion d'images en musique, contrôles structurels et extraits pouvant aller jusqu'à 184 secondes.

Le choix du nom est important car les interfaces sont différentes. Utilisez Lyria 3.5 lorsque vous souhaitez spécifiquement profiter de la toute dernière expérience Flow Music. Utilisez Lyria 3 Pro Preview lorsque vous avez besoin de l’API Gemini Interactions documentée ou de l’itinéraire de modélisation Google Cloud. Cette analyse porte sur ce workflow Pro, avec un itinéraire de test Broly Anywhere distinct utilisé pour générer les 18 échantillons.

Page de Google DeepMind présentant Lyria 3.5 comme son tout dernier modèle de génération musicale
Google DeepMind présente Lyria 3.5 comme son tout dernier modèle de génération musicale. Consulté le 10 août 2026.

Avis rapide : le Google Lyria 3 Pro est-il un bon appareil ?

Oui, à condition de le considérer comme un générateur aux possibilités illimitées plutôt que comme un outil de rendu musical déterministe. Les résultats les plus aboutis présentaient des arcs narratifs cohérents, des combinaisons d’instruments convaincantes, des fins nettes et suffisamment de structure pour donner l’impression d’une composition plutôt que d’une boucle. Le test de longue durée s’est révélé particulièrement utile : les deux requêtes de 180 secondes ont donné lieu à des morceaux cohérents d’une durée de 176,170 et 177,006 secondes.

Les faiblesses sont apparues au niveau de la répétabilité. Une même commande instrumentale a généré un morceau de science-fiction sobre, puis une pièce classique pour cordes de chambre dans laquelle plusieurs instruments demandés avaient disparu. Des paroles exactes ont fonctionné parfaitement une fois, mais ont changé lors de deux autres répétitions. Si la sortie de votre projet dépend de l’absence totale d’une réplique, d’un solo ou d’un élément interdit, prévoyez des alternatives et vérifiez chaque résultat.

Meilleur pourMoins adapté à
Des morceaux complets, avec un genre musical bien défini et une progression émotionnelle claireRécitation exacte des paroles en une seule prise
Morceaux instrumentaux de longue durée et montées en puissance cinématographiquesSynchronisation des sections au niveau de l'image, sans vérification via un logiciel de montage audio (DAW)
Élaboration d'idées vocales multilinguesContraintes négatives strictes
Les développeurs qui souhaitent bénéficier d'un tarif API simple, calculé par titreLes utilisateurs qui ont besoin d'une régénération déterministe

Pour une comparaison plus large entre les catégories, les modèles existants Test musical : ElevenLabs vs Lyria 3 Pro vs Mureka montre pourquoi Lyria est la solution la plus adaptée lorsque la structure musicale dans son ensemble prime sur le contrôle de la voix seule.

Qu'est-ce que Lyria 3 Pro ?

Lyria 3 Pro est le modèle de génération musicale de morceaux complets de Google, issu de la famille d'API Lyria 3. Google a annoncé le Lyria 3 Pro le 25 mars 2026, ce qui permet de créer des morceaux d'une durée maximale de trois minutes en contrôlant les intros, les couplets, les refrains, les ponts, les paroles, le tempo et l'instrumentation. Le modèle Lyria 3 Clip, plus compact, est destiné à la création de morceaux d'une durée fixe de 30 secondes, tandis que le modèle Pro est conçu pour les arrangements complets.

Le Guide actuel de création musicale Gemini précise que les deux modèles Lyria 3 acceptent du texte et des images et restituent un son stéréo à 44,1 kHz.

Le Guide d'utilisation de Google Cloud Lyria prend en charge un éventail plus large de fichiers côté cloud, notamment les PDF et jusqu’à 10 images de référence. Il s’agit de fonctionnalités spécifiques à la plateforme ; ne partez donc pas du principe que tous les types de fichiers sont pris en charge par tous les services tiers.

Annonce de Google indiquant que Lyria 3 Pro permet de créer des morceaux d'une durée maximale de trois minutes avec un contrôle de la structure
Google indique que les morceaux peuvent durer jusqu'à trois minutes et qu'il est possible de contrôler les intros, les couplets, les refrains et les ponts.

Comment nous avons testé le Lyria 3 Pro

Le test pratique a utilisé le point de terminaison de l'API Broly Anywhere Tasks avec l'ID de modèle lyria-3-pro. Il s'agissait d'un environnement de test autorisé pour l'utilisateur, et non de l'interface utilisateur officielle Gemini destinée au grand public. Nous avons réalisé 18 tâches portant sur la répétabilité à partir d'une même consigne, les paroles personnalisées, la structure chronométrée, la fidélité instrumentale, la cohérence des textes longs, le contrôle du BPM, de la tonalité et des instruments, les voix en espagnol et en japonais, ainsi que les artefacts de l'API.

Les données probantes comportent trois niveaux. Les informations relatives aux fichiers et à l’API — durée, format MP3, fréquence d’échantillonnage, débit binaire, nombre de canaux, temps de traitement et coût indiqué — proviennent directement des réponses et des fichiers audio téléchargés. Un passage audio Flash Gemini 3.6 a permis d’obtenir les descriptions d’écoute et les transcriptions des paroles « au mieux » utilisées ci-dessous. Il s’agit d’une évaluation d’écoute assistée par un modèle, et non d’un panel humain ou d’un MOS humain. Le BPM exact, la tonalité et les horodatages des sections sont considérés comme provisoires lorsqu’ils n’ont pas été mesurés de manière indépendante dans un DAW.

Indicateur de testRésultat de la mesure
Tâches réussies18/18
Volume total de données audio générées1 858,195 secondes
Livraison des fichiersMP3, 44,1 kHz, 192 kbps, stéréo sur 18/18
Temps de génération46 à 75 secondes ; médiane de 55,5 secondes
Coût du lieu indiqué$0,08 par tâche ; $1,44 au total
Précision de la durée17/18 à moins de cinq secondes de la cible
Erreur moyenne absolue de durée2,913 secondes

Deux lectures réseau ont échoué alors que les tâches avaient déjà été créées. Le runner a repris ces identifiants de tâches existants au lieu de les soumettre à nouveau ; l'ensemble contenait donc toujours 18 tâches uniques et 18 résultats uniques.

Fiche d'évaluation pratique du Lyria 3 Pro présentant les 18 générations d'API réussies, les spécifications audio, la vitesse, le coût, la précision de la durée et les défaillances de contrôle
Dix-huit tâches du Lyria 3 Pro ont été menées à bien sur le site testé ; les données objectives relatives aux fichiers et aux API sont distinguées des observations issues de l'assistance par modèle.

Qualité sonore du Lyria 3 Pro : un son raffiné, mais des commandes inégales

Musicalité générale et mixage

Les commentaires issus de l'évaluation auditive ont systématiquement qualifié les meilleurs morceaux de ’ soignés ’, « cohérents » et « bien mixés ». Les morceaux de synth-pop du T01 ont conservé les synthés arpégés lumineux, la batterie électronique, les accents de guitare, la voix féminine principale et le ton plein d’espoir. Les deux morceaux de post-rock du T05 ont conservé une progression reconnaissable sur une longue durée, au lieu de se résumer à une boucle courte et prévisible.

Cela ne signifie pas pour autant que tous les détails demandés aient été conservés. La version T01-R1 a intégré le lead de synthé demandé dans l'outro au lieu de créer un solo à part entière, tandis que la version T01-R3 a omis le solo et présentait de légers artefacts de synthèse vocale sur les notes aiguës. La version T01-R2 était celle qui correspondait le mieux.

T01-R2 — le meilleur morceau de synth-pop en boucle
Exemples de réalisations issues de l'espace « Broly Anywhere Tasks ».

Des paroles exactes : c'est possible, mais ce n'est pas déterministe

Le test des paroles personnalisées est la raison la plus évidente de générer plusieurs prises. La prise T02-R1 a omis la majeure partie de la dernière ligne du pont. La prise T02-R2 a ajouté des répétitions en écho après le refrain. La prise T02-R3 a suivi à la lettre le texte des paroles fourni dans la transcription « au mieux ».

Cette fonctionnalité est certes utile, mais elle modifie le déroulement du travail. Ne validez pas un morceau simplement parce que le premier couplet est correct. Comparez l'enregistrement vocal complet au texte source, y compris les refrains répétés et la dernière ligne, avant de passer au mixage ou à la diffusion.

T02-R1 — Exemple d'omission de paroles
Exemples de réalisations issues de l'espace « Broly Anywhere Tasks ».
T02-R3 — candidat « exact-lyrics »
Exemples de réalisations issues de l'espace « Broly Anywhere Tasks ».

Structure et sections chronométrées

Ces trois morceaux de musique électronique cinématographique d'une durée de 120 secondes ont été décrits comme respectant l'ordre général demandé : intro filtrée, premier couplet, refrain ample, pause avec violoncelle et effets granulaires, deuxième couplet plus intense, refrain final et conclusion à deux accords. Les fichiers réels duraient entre 115,148 et 117,029 secondes ; aucun n'a donc atteint l'objectif de 120 secondes.

Dans certains cas, l'évaluateur a également généré des horodatages impossibles, dépassant la durée réelle du fichier. La conclusion utile est donc limitée : Lyria 3 Pro a traité la séquence demandée, mais ce test ne permet pas de vérifier que le placement des sections est précis à l'image près. Utilisez un logiciel de production musicale (DAW) si un refrain doit être placé à un point de montage précis.

La fidélité des instruments et la plus grande défaillance en matière de reproductibilité

Le morceau T04-R1 a su créer l'ambiance de suspense de science-fiction recherchée grâce à un ostinato de violoncelle, un bourdon, une texture cristalline, un pic sonore maîtrisé et une fin en suspens. Le morceau T04-R2 a utilisé la même consigne, mais s'est orienté vers des sonorités classiques de cordes de chambre. Il ne comportait pas les pulsations de piano en sourdine, le bourdon analogique ni les harmoniques cristallines.

T04-R1 — candidat instrumental respectant fidèlement la consigne
Exemples de réalisations issues de l'espace « Broly Anywhere Tasks ».
T04-R2 — Exemple de dérive stylistique instrumentale
Exemples de réalisations issues de l'espace « Broly Anywhere Tasks ».

Cette paire est plus utile qu'une seule démo parfaite, car elle met en évidence le risque réel lié à la production. Une consigne détaillée augmente les chances de réussite, sans pour autant figer l'arrangement. Générez au moins deux prises lorsque l'identité des instruments est importante.

Cohérence des textes longs

Les deux morceaux de post-rock de trois minutes ont conservé leur cohérence tout au long de leur déroulement. Le morceau T05-R1 a duré 176,170 secondes et le morceau T05-R2, 177,006 secondes, avant de revenir au thème de guitare d'ouverture. Aucun des deux comptes-rendus d'écoute n'a signalé de changement brusque de genre ni de fin coupée.

T05-R1 — Exemple de morceau de post-rock de longue durée
Exemples de réalisations issues de l'espace « Broly Anywhere Tasks ».

C'est là que la version Pro fait honneur à son nom. Lyria 3 Clip est utile pour une boucle ou un court extrait ; Lyria 3 Pro permet quant à elle de maintenir un arrangement suffisamment longtemps pour créer un véritable brouillon de chanson, une bande-annonce ou une bande-son de vidéo.

Chants multilingues

Les extraits en espagnol et en japonais ont tous deux été jugés intelligibles et fidèles aux paroles fournies. Les transcriptions réalisées au mieux suggèrent que chaque interprétation a transformé la dernière phrase du refrain en un élément musical marquant supplémentaire. Il s’agit là d’une petite liberté créative, mais cela reste néanmoins une modification des paroles.

T07B-R1 — Candidat au poste de chanteur japonais
Exemples représentatifs issus de la plateforme « Broly Anywhere Tasks » ; il est recommandé de faire vérifier ces textes par un locuteur natif.

Google Cloud indique que les langues prises en charge sont l'anglais, l'allemand, l'espagnol, le français, l'hindi, le japonais, le coréen et le portugais. Un exemple en espagnol et un autre en japonais ne suffisent pas à garantir une qualité équivalente pour les huit langues ; la révision par des locuteurs natifs reste donc la condition préalable à la publication la plus judicieuse.

Les contraintes négatives peuvent échouer

T08 avait demandé qu'il n'y ait ni voix, ni paroles, ni chœur, ni « risers », ni effets cinématographiques. Le résultat final contenait néanmoins de courts extraits vocaux et un « riser » lors de l'évaluation à l'écoute, même si l'orientation principale minimal-techno à 124 BPM et la fin nette étaient bien présentes.

T08-R1 — Exemple d'échec lié à une contrainte négative
Exemples de réalisations issues de l'espace « Broly Anywhere Tasks ».

La page de présentation de Google Cloud indique clairement que les consignes négatives ne sont pas prises en charge. Vous pouvez tout de même rédiger des exclusions positives en langage naturel, mais le résultat doit être considéré comme une recommandation plutôt que comme un filtre strict.

Feuille de contact présentant les formes d'onde de onze résultats représentatifs obtenus avec le Lyria 3 Pro, comprenant des exemples de respect strict, variable et non respecté des consignes
Les résultats représentatifs comprennent des exécutions réussies et contradictoires ; les formes d'onde ne montrent que l'enveloppe d'amplitude et la longueur relative.

Conseils pour Lyria 3 Pro : la formule qui a donné les meilleurs résultats

Le guide de Google sur les prompts recommande de combiner le genre, l'ambiance, l'instrumentation, le tempo, les voix et les paroles. Nos prompts les plus efficaces ajoutaient deux éléments supplémentaires : un ordre clair des sections et une conclusion explicite.

Cadre officiel de prompts Google Cloud pour les modèles Lyria 3
Formule recommandée par Google pour les prompts Lyria : genre, ambiance, instrumentation, tempo, chant et paroles.

Voici une formule pratique pour les invites de Lyria 3 Pro :

  1. Longueur et format : “ Créez un morceau instrumental de 90 secondes. ”
  2. Genre et ambiance : Citez un style principal et une orientation émotionnelle.
  3. Tempo, tonalité et mesure : utilisez des valeurs exactes lorsque cela est important.
  4. Instrumentation : énumérez les sons qui caractérisent l'arrangement.
  5. Chant et paroles : Précisez le type de voix, la langue, la diction et le texte exact.
  6. Structure : Définir les notions d'intro, de couplets, de refrains, de pont, de solo et d'outro.
  7. Conclusion : demander un arrêt net, un accord résolu, un accord non résolu ou un fondu.

L'erreur la plus courante consiste à imposer trop de contraintes et à considérer celles-ci comme des garanties. Les échecs des tests T04 et T08 montrent pourquoi l'invite doit être suivie d'une étape de sélection, et non d'une publication à l'aveugle.

Consignes exactes utilisées lors de l'épreuve

Les instructions ci-dessous correspondent exactement au texte envoyé pour les exécutions évoquées dans cette analyse.

T01 — répétabilité de la synth-pop à thème identique

Prompt utilisé

PROMPT

Créez un morceau de synth-pop en anglais de 90 secondes, au son soigné, à 112 BPM en 4/4. Ambiance : optimiste après une nuit difficile. Instrumentation : basse synthé analogique chaleureuse, synthé arpégé lumineux, batterie électronique précise, accents de guitare électrique clairs et un court solo de synthé mélodique. Utilisez une voix principale féminine naturelle avec une diction claire. Écrivez des paroles originales comprenant une intro de 10 secondes, un couplet 1, un pré-refrain, un refrain marquant, un couplet 2, un refrain répété, un court solo de synthé et un outro net et bien résolu. Privilégiez un mixage aéré et adapté à la radio ; évitez les narrations parlées et les bruits de foule.

T02 — paroles personnalisées exactes

Prompt utilisé

PROMPT

Créez une chanson de pop alternative de 100 secondes à 96 BPM, avec un piano intimiste, une guitare électrique en sourdine, une basse douce, une batterie sobre et une voix masculine principale expressive. Chantez fidèlement les paroles originales suivantes, en conservant les intitulés des sections pour la structure, mais sans les prononcer. N’ajoutez pas, n’omettez pas, ne réorganisez pas et ne répétez pas de lignes de paroles au-delà du refrain répété tel qu’il est écrit.

[Couplet 1]
L’horloge du couloir avait cinq minutes de retard
Un matin bleu attendait sous la porte
J’ai rangé la carte que nous n’avons jamais utilisée
Et j’ai laissé une lumière allumée au deuxième étage

[Refrain]
Si la route oublie nos noms ce soir
Suis la rivière, suis la lumière
Je t’attendrai là où les ponts s’incurvent
En serrant la note que nous n’avons pas pu terminer

[Couplet 2]
Une lune de papier a traversé la vitre du tableau de bord
La ville s’est dissoute dans une pluie argentée
J’ai entendu ta voix dans le grésillement de la radio
Puis j’ai de nouveau syntonisé le silence

[Refrain]
Si la route oublie nos noms ce soir
Suis la rivière, suis la lumière
Je t’attendrai là où les ponts s’incurvent
En serrant contre moi la note que nous n’avons pas pu terminer

[Pont]
Pas de dernier mot, pas de signe de fin
Juste ta petite boussole à côté de la mienne

Terminer par une brève résolution instrumentale après le pont.

T03 — contrôle de la structure temporelle

Prompt utilisé

PROMPT

Créez un morceau électronique de style cinématographique de 120 secondes en mi mineur à 100 BPM et respectez autant que possible la structure suivante : 0:00-0:10 : intro avec un synthé filtré et une pulsation lointaine ; 0:10-0:35 couplet avec une voix féminine grave et une grosse caisse sporadique ; 0:35-0:55 refrain ample avec une batterie complète et des harmonies superposées ; 0:55-1:15 break instrumental mené par un violoncelle et un synthé granulaire ; 1:15-1:38 deuxième couplet avec une ligne de basse plus marquée ; 1:38-1:55 : refrain final ; 1:55-2:00 : fin percutante sur deux accords, sans fondu. Les paroles originales en anglais doivent décrire la traversée d’une ville avant le lever du soleil. N’incluez pas de paroles parlées ni de sons extérieurs à la musique.

T04 — fidélité instrumentale

Prompt utilisé

PROMPT

Créez un morceau instrumental cinématographique de 90 secondes, sans aucune voix, murmure, chant, parole ni chœur. Style : suspense de science-fiction sobre à 72 BPM. Instrumentation : ostinato de violoncelle grave, pulsations de piano en sourdine, bourdonnement analogique doux, tambour sur cadre joué aux balais et harmoniques de verre occasionnelles. Construisez le morceau à partir d’une ouverture épurée jusqu’à un point culminant maîtrisé à 1 min 05 s, puis terminez sur un accord clair et non résolu, sans fondu. Veillez à ce que la profondeur acoustique reste cohérente et que les graves soient nets.

T05 — cohérence des textes longs

Prompt utilisé

PROMPT

Créez un morceau instrumental de post-rock complet de 180 secondes, en ré mineur, à 6/8, à environ 84 BPM. Commencez par une guitare électrique jouée en fingerpicking accompagnée d'une ambiance de pièce, introduisez la basse et les toms après 30 secondes, ajoutez un quatuor à cordes discret après 70 secondes, atteignez le crescendo principal entre 2 min 05 s et 2 min 35 s, puis revenez au motif de guitare d'ouverture et terminez proprement à 3 min. Pas de chant, de chœur, de parole ni d'effets sonores. Conservez un motif reconnaissable de quatre notes tout au long du morceau et évitez les changements de genre brusques, les artefacts de boucle ou une fin coupée.

T06 — BPM, tonalité, mesure et synchronisation du solo

Prompt utilisé

PROMPT

Créez un morceau instrumental de néo-soul de 100 secondes, en fa dièse mineur, à exactement 92 BPM, en mesure 4/4. Utilisez un piano électrique Rhodes, une basse électrique jouée en fingerstyle, une batterie « dry rim-click », une guitare rythmique en sourdine et un solo de saxophone ténor entre environ 0:55 et 1:15. Gardez l'harmonie centrée sur le fa dièse mineur, utilisez des syncopes avec goût, excluez les voix et les chœurs, et terminez par un arrêt net de l'ensemble plutôt que par un fondu.

T07A — Chants en espagnol

Prompt utilisé

PROMPT

Créez une chanson pop acoustique en espagnol de 90 secondes, à 104 BPM, avec une guitare à cordes de nylon, une contrebasse, des percussions à main, un piano en sourdine et une voix principale féminine naturelle. Chantez clairement ces paroles originales sans les traduire : [Couplet] Entre les lumières de la ville, je garde une carte en papier. Chaque rue se remet à parler, chaque ombre sait qui. [Refrain] Suis la rivière jusqu’à la mer, laisse la peur à la gare. Si la nuit revient, j’allumerai une autre chanson. Répétez le refrain une fois, ajoutez un court interlude à la guitare et terminez proprement, sans narration parlée.

T07B — Chansons en japonais

Prompt utilisé

PROMPT

Créez une chanson de dream pop en japonais d'une durée de 90 secondes, à 108 BPM, avec une guitare électrique claire, des nappes de synthé chaleureuses, une ligne de basse mélodique, une batterie électronique légère et une voix principale féminine naturelle. Chantez clairement ces paroles originales sans les traduire : [Couplet] À la gare avant l’aube, j’attends une brise tranquille. Sur une carte oubliée, une lumière bleue vacille. [Refrain] Traversons la rivière, vers un lendemain sans nom. Une petite chanson dans les bras, je me remets en route. Répétez le refrain une fois, incluez un bref pont instrumental et terminez proprement, sans narration parlée.

T08 — Artefact API et test de contrainte négative

Prompt utilisé

PROMPT

Créez un morceau instrumental de minimal techno de 60 secondes, à 124 BPM, en la mineur, avec une grosse caisse « dry », un charleston fermé et précis, une ligne de basse mono arrondie, un motif de percussion métallique et un synthé filtré s’ouvrant progressivement. Pas de chant, de parole, de chœur, de « risers » ni d’effets sonores cinématographiques. Veillez à ce que l’arrangement reste délibérément simple et terminez par un arrêt net sur un temps, afin que la durée, le format, la fréquence d’échantillonnage, le débit binaire, le nombre de canaux, les blocs de métadonnées et le comportement de fin puissent être vérifiés.

Tarifs du Lyria 3 Pro

Google's Page des tarifs de l'API Gemini pour les développeurs présente un aperçu du Lyria 3 Pro à l'adresse $0,08 par demande de chanson complète et un aperçu de la bande-annonce de Lyria 3 sur $0,04 par morceau de 30 secondes. Aucun des deux modèles Lyria ne propose de forfait gratuit avec l'API Gemini. La tarification s'effectue à la requête, et non au jeton.

Tarifs de l'API Gemini pour Lyria 3 Clip et Lyria 3 Pro Preview
Tarifs officiels de l'API Gemini vérifiés le 10 août 2026.

ITINÉRAIRE

API pour développeurs Gemini

MODÈLE / PRODUIT

lyria-3-pro-aperçu

MODÈLE TESTÉ

PRIX AFFICHÉ

$0,08 par morceau complet

LIMITE IMPORTANTE

Pas de formule gratuite ; modèle d'accès anticipé

ITINÉRAIRE

API pour développeurs Gemini

MODÈLE / PRODUIT

lyria-3-extrait-aperçu

PRIX AFFICHÉ

$0,04 par morceau de 30 secondes

LIMITE IMPORTANTE

Rôle abrégé corrigé

ITINÉRAIRE

Google Cloud

MODÈLE / PRODUIT

Aperçu de Lyria 3 Pro

PRIX AFFICHÉ

Consultez les tarifs actuels de Lyria

LIMITE IMPORTANTE

Les conditions et les limites de la version d'essai s'appliquent

ITINÉRAIRE

Produit grand public Gemini

MODÈLE / PRODUIT

Lyria Music Generation

PRIX AFFICHÉ

Les conditions d'accès par abonnement varient selon la formule et la région

LIMITE IMPORTANTE

Le mode de facturation n'est pas le même que celui de l'API

ITINÉRAIRE

Itinéraire « Broly Anywhere » testé

MODÈLE / PRODUIT

lyria-3-pro

PRIX AFFICHÉ

La réponse de l'API a indiqué un coût en amont de $0,08

LIMITE IMPORTANTE

Une offre spécifique au lieu, et non une promesse commerciale

Pour le contexte de l'abonnement, commencez par le Avis sur Google AI Plus et ses limites cachées.

Le Comparaison entre les formules « AI Plus » et « Pro » de Google distingue les limites du forfait, qui peuvent facilement prêter à confusion avec l'accès à l'API.

Pour consulter uniquement les prix, consultez le Tarifs de l'abonnement à Google AI Plus.

L'accès régional peut varier ; le Google AI Plus : disponibilité aux États-Unis et analyse des prix explique pourquoi un abonnement grand public ne doit pas être assimilé à un accès universel à l'API.

Si le prix est le facteur déterminant, le calcul est simple et séduisant : 10 générations Pro coûtent $0,80 hors taxes et hors ajustements de plateforme. Le coût caché réside dans le temps consacré à la sélection. L’obtention de paroles ou d’une instrumentation exactes peut nécessiter plusieurs générations, même lorsque l’API elle-même est peu coûteuse.

API Lyria 3 Pro : identifiant du modèle, requête et résultat

Pour l'itinéraire officiel Gemini, utilisez le Flux de travail musical de l'API Interactions Gemini avec l'identifiant du modèle lyria-3-pro-aperçu. La réponse fournit des propriétés pratiques pour le fichier audio et le texte générés. Le fichier audio est encodé en base64 ; le texte peut contenir des paroles ou des informations structurelles.

Caractéristiques techniques et langues prises en charge par Vertex AI Lyria 3 Pro
Caractéristiques techniques de la version « Preview » du Lyria 3 Pro de Vertex AI, notamment une sortie MP3 de 184 secondes à 44,1 kHz.

Exemple en Python basé sur la documentation actuelle de Google

PYTHON

import base64
from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="lyria-3-pro-preview",
    input=(
 "Un morceau électronique cinématographique de 90 secondes en mi mineur. "
 "Commence par une pulsation filtrée, monte en puissance vers un refrain ample, "
 "ajoute un break instrumental mené par un violoncelle, et termine sans fondu."
    ),
)

generated_audio = interaction.output_audio
if generated_audio:
    with open("lyria-song.mp3", "wb") as file:
 file.write(base64.b64decode(generated_audio.data))

lyrics_or_structure = interaction.output_text
if lyrics_or_structure :
    print(lyrics_or_structure)

Le guide de Google indique que le format MP3 est le format par défaut. Il précise également que response_format={"type": "audio"} pour demander une sortie audio de qualité professionnelle dans le format pris en charge par ce flux de l’API Interactions, y compris son option WAV documentée. La page de spécifications actuelle de Google Cloud est plus restrictive : elle mentionne les formats MP3, 44,1 kHz et 192 kbps. Précisez le format utilisé lorsque vous décrivez les formats, plutôt que de présenter une spécification universelle.

L'itinéraire « Anywhere » testé était lui aussi asynchrone, mais son schéma de tâches est spécifique à chaque lieu. Il renvoyait des champs tels que l'identifiant de la tâche, son statut, sa progression, l'URL audio, les horodatages, le fournisseur et le coût. Ne collez pas ce schéma de réponse dans le code Gemini en supposant qu'il s'agit du schéma officiel de Google.

Lyria 3 Pro vs Lyria 3 Clip vs Lyria 3.5

ModèleUtilisation optimaleLongueurPoste à pourvoir en août 2026
Aperçu de l'extrait de « Lyria 3 »Boucles, extraits, courtes vidéos musicales30 secondesAperçu de l'API Gemini ; $ 0,04 par requête
Aperçu de Lyria 3 ProChansons complètes, couplets, refrains, pontsJusqu'à 184 secondes sur Google CloudGemini/Google Cloud (version préliminaire) ; $0,08/requête
Lyria 3.5Une qualité musicale de dernière génération et la création musicale avec Flow MusicJusqu'à trois minutes selon le système de positionnement actuel de DeepMindDiffusé via Flow Music ; il ne s'agit pas de l'identifiant de modèle utilisé dans ce test de l'API

Optez pour « Clip » lorsque la rapidité et un format court sont prioritaires. Optez pour « Pro » lorsque vous avez besoin d’une chanson complète via l’API documentée. Optez pour « Lyria 3.5 » lorsque l’expérience Flow Music la plus récente prime sur l’utilisation de l’identifiant de modèle de l’API Pro.

Lyria est également plus restreinte qu’un modèle audio polyvalent. Si le projet mélange des dialogues, des bruitages, des ambiances et de la musique au sein d’une même scène générée, le Critique de Seed Audio 1.0 : voix, effets sonores et musique couvre ce flux de travail différent.

Pour la production vidéo, découvrez comment faire La version Veo 3.1 gère le son et l'audio d'arrière-plan.

Lorsque la prestation orale et la synchronisation posent le plus de difficultés, optez pour la solution pratique Veo 3.1 : flux de travail pour les dialogues, l'audio et la synchronisation labiale.

Sécurité, SynthID, utilisation commerciale et restrictions

Selon Google, les fichiers de sortie de Lyria 3 intègrent un filigrane SynthID. Le spécifications actuelles de Google Cloud citent également les « Content Credentials » (C2PA), le filtrage des données d’entrée, le filtrage des données de sortie et le filtrage de la ressemblance vocale. Ces contrôles garantissent la traçabilité et la sécurité ; ils ne dispensent toutefois pas de vérifier les droits relatifs aux paroles, aux images de référence, aux échantillons, aux droits à l’image et aux droits de diffusion pour votre propre projet.

Limites officielles de l'API Gemini pour la génération musicale avec Lyria 3
Google aborde les filtres de sécurité, SynthID, la génération en un seul cycle, la variabilité de la durée et le non-déterminisme.

Google Cloud présente Lyria 3 Pro comme une offre « Generative AI Preview ». La page dédiée précise que les clients peuvent choisir d’utiliser cette version préliminaire à des fins de production ou commerciales et de divulguer les contenus générés à des tiers, sous réserve des conditions d’utilisation « Pre-GA » et du contrat régissant l’accès. Cela ne revient pas à une promesse inconditionnelle selon laquelle chaque morceau généré serait exempt de tout risque ou exclusif.

Les limites pratiques sont claires :

  • Les versions préliminaires peuvent faire l'objet de modifications avant la sortie de la version stable.
  • L'offre tarifaire de l'API Gemini ne propose pas de forfait gratuit pour Lyria 3.
  • Une requête permet d'obtenir un extrait audio sur la page du modèle Google Cloud actuel.
  • La saisie négative n'est pas prise en charge en tant que fonctionnalité officielle.
  • La génération musicale actuelle Gemini s'effectue en un seul passage, et non via un éditeur multipaisses intégré.
  • La durée et le respect rapide du traitement varient.
  • Les paroles exactes, le BPM, la tonalité et les repères temporels doivent encore faire l'objet d'un contrôle qualité au niveau de la sortie.

À qui s'adresse Lyria 3 Pro ?

Utilisez Lyria 3 Pro si vous êtes développeur, cinéaste, créateur de jeux vidéo, auteur-compositeur ou membre d’une équipe de création de contenu souhaitant obtenir des idées musicales complètes via une API et pouvoir évaluer plusieurs propositions. Cet outil est particulièrement convaincant pour les montages cinématographiques, les structures pop, les longs passages instrumentaux et les démos vocales multilingues.

Passez votre chemin — ou prévoyez un deuxième outil à portée de main — si vous avez besoin de stems déterministes, d’une édition précise après la génération, de contraintes négatives garanties ou d’une version finale masterisée à partir d’une seule demande. Lyria 3 Pro excelle davantage dans la génération d’une prise de son de qualité que dans le respect scrupuleux de chaque instruction, comme s’il s’agissait d’une piste d’automatisation d’une station de travail audio numérique (DAW).

GlobalGPT's outils audio accessibles via un navigateur Elle permet de gérer à la fois la reconnaissance vocale et la transcription au même endroit, mais cette page publique constitue une interface produit distincte de l’API Lyria testée ici. Cet avis ne prétend pas que cette page corresponde à une solution Lyria 3 Pro validée.

FAQ sur le Google Lyria 3 Pro

Le Lyria 3 Pro est-il le tout dernier modèle de Google dédié à la musique ?

Non. Depuis le 10 août 2026, Google DeepMind présente Lyria 3.5 comme son tout dernier modèle de génération musicale et en fait la promotion via Flow Music. Lyria 3 Pro reste le modèle officiel permettant de prévisualiser des morceaux complets pour les parcours de développement Gemini et Google Cloud dans le cadre de lyria-3-pro-aperçu.

Combien coûte le Lyria 3 Pro ?

L'API pour développeurs Gemini indique que l'aperçu de Lyria 3 Pro coûte $0,08 par requête pour une chanson complète. L'aperçu d'un extrait de Lyria 3 coûte $0,04 par extrait de 30 secondes. Aucun de ces deux modèles ne propose de forfait gratuit dans l’API Gemini, et les abonnements grand public sont soumis à des règles différentes selon les formules et les régions.

Quelle est la durée maximale d'un morceau sur le Lyria 3 Pro ?

Selon les informations officielles de Google, la durée maximale est de trois minutes. La page technique actuelle de Google Cloud indique une durée maximale de 184 secondes pour les extraits audio. Lors de nos deux tests de 180 secondes, les fichiers MP3 générés duraient respectivement 176,170 et 177,006 secondes.

Lyria 3 Pro est-il capable de chanter des paroles personnalisées à la lettre ?

Oui, mais pas de manière déterministe. L'une des trois versions répétées des paroles personnalisées correspondait exactement au texte fourni dans la transcription de l'enregistrement. Une autre omettait la majeure partie de la dernière ligne du pont, et la troisième ajoutait des répétitions en écho. Comparez toujours la version vocale complète aux paroles originales.

Lyria 3 Pro peut-il générer de la musique instrumentale sans chant ?

Oui, mais une exclusion écrite ne constitue pas une garantie absolue. Un test instrumental n’a généré aucune voix, tandis que le test avec la contrainte “ minimal-techno ” a ajouté des extraits vocaux malgré la mention « pas de voix ». Google Cloud indique également, sur la page du modèle actuel, que les invites négatives ne sont pas prises en charge.

Quel est l'identifiant du modèle API de Lyria 3 Pro ?

L'identifiant officiel du modèle Gemini et de Google Cloud est lyria-3-pro-aperçu. Dans le cadre de cette évaluation, le site de test utilisait l'identifiant de route fourni par un tiers lyria-3-pro; son schéma de tâches et sa nomenclature ne doivent pas se substituer à l'API Interactions officielle de Google.

Quel format de fichier Lyria 3 Pro génère-t-il ?

Le guide Gemini de Google indique que le format MP3 est le format par défaut et mentionne une option de format de sortie « Pro » dans l'API Interactions. Google Cloud indique un format MP3 à 44,1 kHz et 192 kbps. Les 18 fichiers issus de notre parcours de test correspondaient tous à cette spécification MP3 stéréo à 44,1 kHz et 192 kbps.

Lyria 3 Pro peut-il être utilisé à des fins commerciales ?

Google Cloud précise que les clients peuvent choisir d'utiliser cette offre en préversion à des fins de production ou commerciales et de diffuser les résultats générés, sous réserve des conditions d'utilisation et du contrat d'accès applicables avant la mise en production générale (Pre-GA). Veuillez prendre connaissance de ces conditions et vous assurer que les paroles, images, extraits ou médias de référence ne font l'objet d'aucun droit avant toute diffusion.

Puis-je utiliser Lyria 3 Pro sur un GlobalGPT ?

Cet article ne prétend pas présenter un itinéraire public vérifié pour GlobalGPT Lyria. Les 18 générations testées ont été exécutées via l'API Broly Anywhere Tasks, tandis que la page audio publique de GlobalGPT propose actuellement un espace de travail distinct pour la reconnaissance vocale et la transcription. Utilisez Gemini ou Google Cloud pour accéder à l'API officielle documentée.

Verdict final

Google Lyria 3 Pro est un modèle API fiable capable de générer des chansons complètes, qui se distingue par un faible coût par requête, des résultats cohérents sur de longs formats et des contrôles de prompt exceptionnellement détaillés. Le test réalisé sur 18 exécutions a également mis en évidence ce que les démos de lancement masquent : les détails structurels, les paroles exactes, les noms d’instruments et les contraintes négatives peuvent varier d’une requête à l’autre, même si celles-ci sont identiques.

Ce compromis est acceptable lorsqu'il est possible de générer deux ou trois propositions, de comparer la chanson dans son intégralité et de conserver la meilleure version. Pour ce type de workflow, Lyria 3 Pro est un choix facile à recommander. En revanche, pour obtenir des paroles déterministes ou une précision prête à l'édition à partir d'une seule requête, il faut encore recourir à une révision humaine et à un logiciel de production musicale (DAW).

Partager l'article :

Articles connexes