Lyria 3 è la famiglia di modelli di generazione di musica di Google, disponibile tramite l'API Gemini. Con Lyria 3, puoi generare audio stereo di alta qualità a 44, 1 kHz da prompt di testo o da immagini. Questi modelli offrono coerenza strutturale, incluse voci, testi sincronizzati e arrangiamenti strumentali completi.
La famiglia Lyria 3 include due modelli:
| Modello | ID modello | Ideale per | Durata | Output |
|---|---|---|---|---|
| Lyria 3 Clip | lyria-3-clip-preview |
Clip corti, loop, anteprime | 30 secondi | MP3 |
| Lyria 3 Pro | lyria-3-pro-preview |
Brani completi con strofe, ritornelli, ponti | Un paio di minuti (controllabile tramite prompt) | MP3 |
Entrambi i modelli possono essere utilizzati con la nuova API Interactions, supportano input multimodali input (testo e immagini) e producono audio stereo ad alta fedeltà a 44,1 kHz .
Generare un clip musicale
Il modello Lyria 3 Clip genera sempre un clip di 30 secondi. Per generare un clip, chiama il metodo interactions.create con un prompt testuale. La risposta include sempre i testi e la struttura del brano generati insieme all'audio nello schema steps.
Python
import base64
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="lyria-3-clip-preview",
input="A short instrumental acoustic guitar piece.",
)
generated_audio = interaction.output_audio
if generated_audio:
with open("music.mp3", "wb") as f:
f.write(base64.b64decode(generated_audio.data))
lyrics = interaction.output_text
if lyrics:
print(f"Lyrics:\n{lyrics}")
JavaScript
import { GoogleGenAI } from '@google/genai';
import * as