Aller au contenu principal
Vantaige
Retell AI screenshot
Retell AI logo

Retell AI

Freemium

Retell AI est une plateforme d'infrastructure d'agents vocaux soutenue par Y Combinator (W24) permettant de créer des agents téléphoniques propulsés par l'IA. Les développeurs connectent leur propre LLM, configurent les flux d'appels et déploient des agents capables de gérer des appels réels avec une latence d'environ 600ms. Utilisée à grande échelle par des entreprises de la santé, de la logistique et du e-commerce.

Fonctionnalités :API

Retell AI est une plateforme d'infrastructure d'agents vocaux conçue pour les développeurs et les équipes d'ingénierie qui ont besoin d'automatiser des appels téléphoniques à grande échelle. Lancée en février 2024 dans le cadre de la promotion W24 de Y Combinator, l'entreprise est passée de zéro à plus de $40M d'ARR en environ deux ans, propulsant plus de 40 millions d'appels téléphoniques IA en temps réel par mois début 2026. La plateforme cible les opérations des centres de contact : support client entrant, prospection commerciale sortante, prise de rendez-vous, recouvrement de créances et qualification de leads, en connectant de grands modèles de langage à l'infrastructure téléphonique et en gérant les aspects techniques complexes de l'IA vocale, notamment la gestion de la latence, le traitement des interruptions et la prise de parole alternée.

La plateforme fonctionne comme un middleware entre la téléphonie, la reconnaissance vocale (speech-to-text), le raisonnement LLM et la synthèse vocale (text-to-speech). Les développeurs apportent leur propre LLM (GPT-4.1, Claude, Gemini, Llama ou autres) ou utilisent ceux par défaut de la plateforme, configurent les flux d'appels via un constructeur visuel en glisser-déposer ou une API brute, et déploient des agents qui répondent à de vrais appels téléphoniques. Les fonctionnalités clés incluent l'appel de fonctions en temps réel pour la réservation ou le traitement des paiements en pleine conversation, le RAG en streaming avec synchronisation automatique pour l'accès à la base de connaissances, les appels sortants en masse sans limite de simultanéité, les analyses post-appel et Retell Assure (lancé en janvier 2026), un système d'assurance qualité automatisé qui surveille 100% des appels au lieu du taux standard de l'industrie de 1-2% de vérifications humaines ponctuelles. La couverture de conformité inclut HIPAA, SOC2 Type II et GDPR, avec un déploiement sur site disponible pour les entreprises.

Ce que fait réellement Retell AI en mai 2026

Retell se situe à l'intersection de quatre composants : la reconnaissance vocale (transcription de l'appelant en temps réel), le raisonnement LLM (décider quoi dire), la synthèse vocale (convertir la réponse en voix) et la téléphonie (l'infrastructure téléphonique). La plateforme orchestre ces couches, avec une latence de réponse d'environ 600ms de bout en bout, ce qui compte parmi les plus rapides de cette catégorie de produits. Ce chiffre est important car tout ce qui dépasse 1.5-2 secondes commence à paraître peu naturel pour un appelant qui s'attend à parler à un humain.

Début 2026, la plateforme prend en charge plus de 50 langues, le fonctionnement multicanal (voix, chat, SMS via la même configuration d'agent) et l'appel de fonctions en temps réel. Cette dernière fonctionnalité signifie que l'agent peut réellement effectuer des actions pendant un appel : vérifier la disponibilité d'un rendez-vous, traiter un paiement, mettre à jour un enregistrement CRM ou transférer vers un agent humain, le tout sans mettre l'appelant en attente. La plateforme s'intègre avec HubSpot, Twilio, Vonage, Go High Level, n8n, Zapier, Salesforce et des plateformes de centres de contact d'entreprise comme Avaya, Genesys, Five9 et Amazon Connect.

En décembre 2025, Retell a lancé Retell Assure, son outil d'assurance qualité automatisé. Le système analyse chaque appel en fonction de critères personnalisables, notamment la latence, les interruptions, les hallucinations et le sentiment du client, puis ajuste automatiquement le comportement du modèle. L'assurance qualité traditionnelle des centres de contact implique que des humains examinent 1-2% des appels, avec des boucles de rétroaction prenant des semaines. Retell Assure ferme cette boucle en temps réel sur 100% du volume. Le PDG Bing Wu l'a décrit comme "la demande n°1 de nos clients d'entreprise - notre segment de clientèle à la croissance la plus rapide".

"J'ai eu des frissons en pensant au fait que je parlais à un ordinateur." - _fw, Hacker News, février 2024 (sur la démo Launch HN)

Où se situe Retell AI par rapport à Vapi et Bland AI

Trois plateformes dominent cette couche d'infrastructure : Retell AI, Vapi et Bland AI. Chacune fait un pari architectural différent.

Vapi est native API jusqu'à la granularité. Elle expose chaque composant du pipeline vocal individuellement : vous pouvez changer votre fournisseur STT, modifier votre moteur d'inférence LLM, configurer les seuils de détection d'activité vocale (VAD) à la milliseconde près et ajuster la gestion des interruptions selon l'état de la conversation. Cette puissance a un coût. Vapi nécessite des équipes d'ingénierie désireuses de maintenir cette configuration, et la tarification globale s'élève à $0.13-$0.31/min, ce qui est supérieur aux configurations comparables de Retell. Vapi est la plateforme que les équipes d'ingénierie pointues se recommandent lorsqu'elles ont besoin d'un contrôle maximal. Retell fait abstraction de ces couches avec des paramètres par défaut judicieux et des options de remplacement, ce qui rend le déploiement plus rapide mais signifie que vous perdez une partie de cet ajustement à la milliseconde.

Bland AI a pris un chemin différent : au lieu d'orchestrer des fournisseurs LLM et TTS externes comme le font Retell et Vapi, Bland a construit une pile de modèles interne propriétaire. Cela signifie que Bland contrôle la latence de bout en bout sans dépendre des temps de réponse d'API tierces. Le compromis est une moindre flexibilité dans le choix du modèle, mais la force de Bland réside dans les volumes d'appels sortants très élevés, où des millions de minutes par mois rendent cette prévisibilité constante de la latence précieuse. Bland dispose également d'une couche de mémoire inter-appels qui permet aux agents de faire référence à ce qui s'est passé lors d'appels précédents avec le même contact, ce que Retell ne fait pas nativement. Retell surpasse Bland sur la latence moyenne (~600ms contre ~800ms) et l'emporte sur les cas d'usage entrants/support client où la qualité vocale et la sensation de conversation naturelle comptent plus que le débit de volume brut.

Pour les équipes qui souhaitent associer leur pipeline vocal à une infrastructure open-source et éviter totalement les coûts fournisseurs à la minute, Pipecat mérite d'être examiné. Il s'agit d'un framework Python auto-hébergé pour les agents conversationnels multimodaux sans frais à la minute, bien qu'il nécessite beaucoup plus d'ingénierie pour fonctionner au niveau que Retell gère de manière native.

Concernant la qualité TTS spécifiquement, Retell prend en charge ElevenLabs comme option TTS (avec un surcoût : $0.040/min contre $0.015/min pour les autres fournisseurs), ce qui donne accès au clonage vocal de la plus haute qualité sur le marché pour les applications où le réalisme vocal est critique.

"L'assurance qualité automatisée était la demande n°1 de nos clients d'entreprise - notre segment de clientèle à la croissance la plus rapide." - Bing Wu, co-fondateur et PDG de Retell AI, décembre 2025

À quoi ressemble la réalité de la création et du déploiement d'agents vocaux

Mettre en ligne un agent de base prend quelques heures pour un développeur familier avec les API REST. Vous créez un agent dans le tableau de bord, configurez le prompt système et les paramètres LLM, connectez un numéro de téléphone (Retell fournit des numéros, ou vous apportez le vôtre via Twilio ou Vonage), et passez un appel de test. Le constructeur de flux visuel gère les chemins conditionnels simples ; la logique de ramification complexe passe par l'API. L'appel de fonctions en temps réel nécessite l'écriture de points de terminaison webhook que l'agent appelle en pleine conversation, ce qui représente la majeure partie du temps d'ingénierie consacré aux déploiements en production.

Le modèle de tarification s'additionne d'une manière que le prix d'appel de $0.07/min sous-estime. Une configuration réaliste utilisant GPT-4.1 comme LLM et le TTS par défaut de Retell se rapproche de $0.12-$0.15/min. Utilisez ElevenLabs pour la voix et Claude Sonnet pour le raisonnement et vous êtes à $0.19-$0.22/min avant les modules complémentaires. À 10 000 minutes par mois, c'est la différence entre environ $700 et $2,200. Les entreprises doivent construire des modèles de coûts en fonction de leurs choix réels de LLM et de TTS avant de s'engager, et non sur le tarif de base annoncé. Un agrégateur d'avis a noté que "des coûts globaux réels de $0.25-$0.33/min sont courants" pour les déploiements en production.

Le support client pour les clients en paiement à l'usage passe par Discord et par e-mail, ce qui fonctionne bien pour les développeurs résolvant des problèmes techniques mais crée des frictions pour les équipes commerciales s'attendant à des SLA plus rapides. Les clients d'entreprise bénéficient de portails de support dédiés et d'une couverture omnicanale 24/7. Plusieurs avis Trustpilot ont signalé des difficultés à annuler les comptes après la fin des essais et des réponses peu claires sur la conformité GDPR, des problèmes qui ne correspondent pas à la note G2 de 4.8/5 axée sur les développeurs.

La connexion LK LiveKit mérite d'être soulignée : la couche de transport en temps réel sous-jacente de Retell s'inspire des mêmes concepts d'infrastructure WebRTC que LiveKit, et certaines équipes utilisent LiveKit directement lorsqu'elles souhaitent un contrôle plus granulaire sur la couche de communication en temps réel sous leurs agents vocaux.

À qui s'adresse Retell AI

Le profil idéal pour Retell : une équipe d'ingénierie logicielle dans une entreprise basée aux États-Unis dans les secteurs de la santé, de la logistique, de l'immobilier, du recouvrement de créances ou du e-commerce, qui a besoin d'automatiser un volume important d'appels entrants et dispose de développeurs pour maintenir l'intégration. Medical Data Systems a déployé Retell pour gérer 100% des appels entrants avec seulement 30% de taux de transfert humain, recouvrant environ $280,000/mois grâce à des conversations automatisées sur les dettes. Pine Park Health a amélioré le NPS de planification de 38% et a rempli la capacité des prestataires qui restait auparavant inutilisée. SWTCH, une entreprise de recharge de VE, a réduit ses coûts de support de plus de 50%. Ce ne sont pas des cas isolés ; ils représentent ce pour quoi la plateforme est optimisée.

L'aspect conformité est véritablement solide. Les certifications HIPAA, SOC2 Type II et GDPR sont en place. La rédaction des informations personnelles, le contrôle d'accès basé sur les rôles (RBAC) et le SSO sont disponibles au niveau Entreprise. Pour les secteurs réglementés où l'absence d'un BAA chez un concurrent le disqualifierait, Retell est souvent le choix pratique.

Ce que Retell AI n'est pas

Retell n'est pas conçu pour les utilisateurs non techniques. Les propriétaires d'entreprise ou les équipes opérationnelles sans développeurs en interne trouveront la plateforme trop complexe pour un déploiement sans assistance. Il n'y a pas de constructeur de flux de travail visuel complet avec un mappage de secours en glisser-déposer pour chaque cas particulier. Il n'y a pas d'environnement de test bac à sable (sandbox) qui reflète parfaitement la production. Le contrôle d'accès basé sur les rôles et les journaux d'audit sont réservés au niveau Entreprise, ce qui crée des frictions pour les entreprises du marché intermédiaire qui ont besoin de ces contrôles mais ne sont pas encore à l'échelle de l'entreprise.

Ce n'est pas non plus le bon choix pour les ventes sortantes pures à très haut volume. Si le cas d'usage principal est de composer des millions de minutes par mois dans des campagnes sortantes séquentielles avec une mémoire par contact des appels passés, l'architecture de Bland AI est spécialement conçue pour ce flux de travail. La force de Retell réside dans le service client entrant et les opérations mixtes entrantes/sortantes où la qualité vocale et la fiabilité à une simultanéité modérée comptent plus que le débit brut.

Les entreprises européennes ayant des exigences strictes en matière de souveraineté des données, en particulier en Allemagne (où plus de 37 évaluateurs G2 ont spécifiquement signalé des lacunes en matière de qualité vocale et de conformité) et au Royaume-Uni, doivent vérifier la disponibilité régionale actuelle et les conditions de résidence des données avant de s'engager. La couverture GDPR existe, mais les garanties de résidence des données au niveau du paiement à l'usage sont moins claires qu'au niveau Entreprise.

Enfin : le prix d'appel de $0.07/min est un calcul marketing. Prévoyez un budget pour vos sélections réelles de LLM et de TTS. Pour les équipes évaluant le coût total de possession, la tarification modulaire est transparente une fois que vous lisez attentivement la page des tarifs, mais l'écart entre le tarif promotionnel et la réalité de la production a frustré suffisamment d'utilisateurs pour justifier une définition explicite des attentes avant l'inscription.

Avis des utilisateurs

Aucun avis pour l'instant. Soyez le premier à partager votre expérience !

Se connecter pour écrire un avis.

Articles associés

Guides et articles en lien avec Retell AI.