ElevenAgents

Découvrez comment créer, lancer et faire évoluer des agents avec ElevenLabs.

Les agents accomplissent des tâches grâce au dialogue naturel, des demandes rapides aux workflows complexes et ouverts. ElevenLabs fournit des modèles vocaux riches et expressifs, des outils de développement pour créer des agents multimodaux, ainsi que des outils pour gérer et évaluer les performances des agents à grande échelle.

Capacités de la plateforme

De la conception au déploiement, puis à l’optimisation, ElevenLabs fournit tout ce dont vous avez besoin pour créer des agents à grande échelle.

Concevoir et configurer

ObjectifGuideDescription
Créer des workflows de conversationWorkflowsCréez des workflows en plusieurs étapes avec le générateur visuel de workflows
Rédiger des prompts systèmePrompt systèmeDécouvrez les bonnes pratiques pour créer des prompts d’agent efficaces
Sélectionner un modèle de langageModèlesChoisissez parmi les LLM pris en charge ou apportez votre propre modèle personnalisé
Contrôler le flux de conversationFlux de conversationConfigurez les tours de parole, les interruptions et les délais d’expiration
Configurer la voix et la langueVoix et langueChoisissez parmi plus de 5 000 voix dans 31 langues, avec des options de personnalisation
Ajouter des connaissances à l’agentBase de connaissancesImportez des documents et activez le RAG pour des réponses fondées sur vos données
Connecter des outilsOutilsPermettez aux agents d’appeler des clients et des API pour effectuer des actions
Personnaliser chaque conversationPersonnalisationUtilisez des variables dynamiques et des remplacements pour personnaliser chaque conversation
Sécuriser l’accès à l’agentAuthentificationImplémentez une authentification personnalisée pour protéger l’accès à l’agent

Connecter et déployer

ObjectifGuideDescription
Développer avec des composants ReactElevenLabs UIBibliothèque de composants prédéfinis pour les applications audio et d’agents (basée sur shadcn)
Intégrer un widget à un site webWidgetAjoutez un widget web personnalisable à n’importe quel site web
Créer des applications web ReactReact SDKHooks et composants React compatibles avec la voix
Créer des applications iOSSwift SDKSDK iOS natif pour les agents vocaux
Créer des applications AndroidKotlin SDKSDK Android natif pour les agents vocaux
Créer des applications React NativeReact Native SDKiOS et Android multiplateformes avec React Native
Se connecter via un trunk SIPTrunk SIPIntégrez votre infrastructure téléphonique existante
Effectuer des appels sortants par lotsAppels par lotsDéclenchez plusieurs appels par programmation
Utiliser l’intégration TwilioTwilioIntégration Twilio native pour les appels téléphoniques
Créer des intégrations personnaliséesAPI WebSocketProtocole WebSocket de bas niveau pour des implémentations personnalisées
Recevoir des événements en temps réelÉvénementsAbonnez-vous aux événements et mises à jour de conversation

Gérer et optimiser

ObjectifGuideDescription
Lister les utilisateurs par ID externeUtilisateursConsultez les utilisateurs finaux et ouvrez leurs conversations
Rechercher dans les transcriptionsRecherche de conversationsRecherche par mots-clés et sémantique dans l’historique des conversations
Exécuter des tests A/BExpériencesTestez les modifications de configuration des agents avec du trafic réel
Tester le comportement des agentsTestsCréez et exécutez des tests automatisés pour vos agents
Analyser la qualité des conversationsAnalyse des conversationsExtrayez des informations et évaluez les résultats des conversations
Suivre les métriques et analysesAnalysesGérez les métriques de performance et l’historique des conversations
Configurer la conservation des donnéesConfidentialitéDéfinissez des politiques de conservation pour les conversations et l’audio
Réduire les coûts de LLMOptimisation des coûtsGérez et optimisez les dépenses liées aux modèles de langage
Gérer les agents comme du codeCLIContrôlez les versions et déployez des agents depuis votre terminal
Gérer les agents depuis ClaudeMCP hébergéCréez et mettez à jour des agents depuis n’importe quel client MCP

Architecture

ElevenAgents coordonne 4 composants essentiels :

  1. Un modèle Speech to Text (ASR) affiné pour la reconnaissance vocale
  2. Le modèle de langage de votre choix ou un LLM personnalisé
  3. Un modèle Text to Speech (TTS) à faible latence, couvrant plus de 5 000 voix et plus de 70 langues
  4. Un modèle propriétaire de prise de parole qui gère le rythme de la conversation