L'API Live permet des interactions vocales et visuelles en temps réel et à faible latence avec Gemini. Elle traite des flux continus d'audio, d'images et de texte pour fournir des réponses immédiates et semblables à celles d'un humain, créant ainsi une expérience de conversation naturelle pour vos utilisateurs.

Essayer l'API Live dans Google AI Studio
Cloner des exemples d'applications depuis GitHub
Utiliser les compétences de l'agent de codage
Cas d'utilisation
L'API Live peut être utilisée pour créer des agents vocaux en temps réel dans divers secteurs, y compris les suivants :
- E-commerce et vente au détail : assistants d'achat qui proposent des recommandations personnalisées et agents d'assistance qui résolvent les problèmes des clients.
- Jeux vidéo : personnages non jouables (PNJ) interactifs, assistants d'aide dans le jeu et traduction en temps réel du contenu du jeu.
- Interfaces de nouvelle génération : expériences vocales et vidéo dans la robotique, les lunettes connectées et les véhicules.
- Santé : compagnons de santé pour l'assistance et l'éducation des patients.
- Services financiers : conseillers IA pour la gestion de patrimoine et les conseils en investissement.
- Éducation : mentors IA et compagnons d'apprentissage qui fournissent des instructions et des commentaires personnalisés.
- Traduction et localisation : traduction en temps réel et à faible latence des conversations orales, permettant une communication multilingue fluide.
Principales fonctionnalités
L'API Live offre un ensemble complet de fonctionnalités pour créer des agents vocaux robustes :