

Retell AI 是一个由 Y Combinator(W24)支持的语音代理基础设施平台,用于构建由 AI 驱动的电话代理。开发者可以连接自己的 LLM,配置通话流程,并部署能够以约 600ms 延迟处理真实通话的代理。已被医疗保健、物流和电子商务公司大规模使用。
Retell AI 是一个专为需要大规模自动化电话呼叫的开发者和工程团队构建的语音代理基础设施平台。作为 Y Combinator W24 批次的一部分于 2024 年 2 月推出,该公司在约两年内实现了从零到超过 $40M ARR 的增长,到 2026 年初每月驱动超过 4000 万次实时 AI 电话呼叫。该平台主要针对联络中心运营:入站客户支持、出站销售推广、预约安排、债务催收和潜在客户资格审查,将大型语言模型连接到电话基础设施,并处理语音 AI 的复杂工程部分,包括延迟管理、中断处理和轮流对话(turn-taking)。
该平台作为电话、语音转文本、LLM 推理和文本转语音之间的中间件运行。开发者可以自带 LLM(GPT-4.1、Claude、Gemini、Llama 等)或使用平台默认设置,通过可视化拖拽构建器或原生 API 配置通话流程,并部署接听真实电话的代理。主要功能包括用于在对话中途进行预订或支付处理的实时函数调用、带有自动同步功能以访问知识库的流式 RAG、无并发限制的批量出站呼叫、通话后分析,以及 Retell Assure(2026 年 1 月推出)——这是一个自动化 QA 系统,可监控 100% 的通话,而不是行业标准的 1-2% 人工抽查率。合规性覆盖包括 HIPAA、SOC2 Type II 和 GDPR,并提供企业级本地部署选项。
Retell AI 在 2026 年 5 月的实际功能
Retell 处于四个组件的交汇处:语音转文本(实时转录呼叫者的语音)、LLM 推理(决定说什么)、文本转语音(将响应转换为语音)和电话(电话基础设施)。该平台协调这些层级,端到端响应延迟约为 600ms,是该产品类别中最快的之一。这个数字至关重要,因为对于期望与真人交谈的呼叫者来说,任何超过 1.5-2 秒的延迟都会开始显得不自然。
截至 2026 年初,该平台支持 50 多种语言、多渠道操作(通过相同的代理配置实现语音、聊天、SMS)以及实时函数调用。最后一个功能意味着代理实际上可以在通话期间执行操作:检查预约可用性、处理付款、更新 CRM 记录或转接给人工代理,所有这些都无需让呼叫者等待。该平台集成了 HubSpot、Twilio、Vonage、Go High Level、n8n、Zapier、Salesforce,以及 Avaya、Genesys、Five9 和 Amazon Connect 等企业联络中心平台。
2025 年 12 月,Retell 推出了其自动化质量保证工具 Retell Assure。该系统根据可自定义的标准(包括延迟、中断、幻觉和客户情绪)分析每次通话,然后自动调整模型行为。传统的联络中心 QA 需要人工审查 1-2% 的通话,反馈周期长达数周。Retell Assure 在 100% 的通话量中实时闭环了这一过程。首席执行官 Bing Wu 将其描述为“我们企业客户(我们增长最快的客户群)的头号需求”。
“当我想到我正在和一台计算机说话时,我感到不寒而栗。” - _fw,Hacker News,2024 年 2 月(关于 Launch HN 演示)
Retell AI 与 Vapi 和 Bland AI 的对比定位
三个平台主导了这一基础设施层:Retell AI、Vapi 和 Bland AI。每个平台都做出了不同的架构选择。
Vapi 是 API 原生的,且粒度极细。它单独暴露了语音管道的每个组件:你可以更换 STT 提供商,更改 LLM 推理引擎,将语音活动检测(VAD)阈值配置到毫秒级,并根据对话状态调整中断处理。这种强大的功能是有代价的。Vapi 需要愿意维护该配置的工程团队,且总定价在 $0.13-$0.31/min 之间,高于 Retell 的同类配置。当需要最大控制权时,Vapi 是硬核工程团队互相推荐的平台。Retell 将这些层抽象为合理的默认设置并提供覆盖选项,这使得部署速度更快,但也意味着你失去了一些毫秒级的微调能力。
Bland AI 走了一条不同的路:与 Retell 和 Vapi 协调外部 LLM 和 TTS 提供商的方式不同,Bland 构建了专有的内部模型栈。这意味着 Bland 控制端到端延迟,而不依赖于第三方 API 的响应时间。代价是模型选择的灵活性较低,但 Bland 的优势在于极高的出站呼叫量,每月数百万分钟的通话使得这种一致的延迟可预测性变得非常有价值。Bland 还有一个跨通话记忆层,允许代理参考之前与同一联系人通话时发生的事情,这是 Retell 原生不支持的。Retell 在平均延迟方面优于 Bland(约 600ms 对比约 800ms),并在入站/客户支持用例中胜出,在这些用例中,语音质量和自然对话的感觉比原始吞吐量更重要。
对于希望将语音管道与开源基础设施结合并完全避免按分钟计费的供应商成本的团队来说,Pipecat 值得一试。它是一个用于多模态对话代理的自托管 Python 框架,没有按分钟计费的费用,尽管它需要更多的工程投入才能达到 Retell 开箱即用的水平。
特别是在 TTS 质量方面,Retell 支持将 ElevenLabs 作为 TTS 选项(需支付溢价:$0.040/min,而其他提供商为 $0.015/min),这为语音真实感至关重要的应用提供了市场上最高质量的语音克隆访问权限。
“自动化质量保证是我们企业客户(我们增长最快的客户群)的头号需求。” - Bing Wu,Retell AI 联合创始人兼首席执行官,2025 年 12 月
语音代理构建和部署的实际情况
对于熟悉 REST API 的开发者来说,让一个基础代理上线只需几个小时。你在仪表板中创建一个代理,配置系统提示词和 LLM 设置,连接一个电话号码(Retell 提供号码,或者你通过 Twilio 或 Vonage 自带号码),然后进行测试呼叫。可视化流程构建器处理简单的条件路径;复杂的分支逻辑则通过 API 实现。实时函数调用需要编写代理在对话中途调用的 webhook 端点,这也是生产部署中花费大部分工程时间的地方。
定价模型的累加方式使得 $0.07/min 的宣传价格显得有些轻描淡写。使用 GPT-4.1 作为 LLM 和 Retell 默认 TTS 的实际配置成本接近 $0.12-$0.15/min。如果使用 ElevenLabs 进行语音合成并使用 Claude Sonnet 进行推理,在添加附加组件之前,成本将达到 $0.19-$0.22/min。以每月 10,000 分钟计算,这大约是 $700 和 $2,200 之间的差异。企业在做出承诺之前,应根据其实际的 LLM 和 TTS 选择构建成本模型,而不是依赖宣传的基础费率。一家评论聚合网站指出,对于生产部署,“实际总成本在 $0.25-$0.33/min 之间是很常见的”。
按量付费客户的客户支持通过 Discord 和电子邮件进行,这对于解决技术问题的开发者来说效果很好,但对于期望更快 SLA 的业务团队来说会产生摩擦。企业客户可获得专属支持门户和 24/7 全渠道覆盖。多条 Trustpilot 评论指出,试用结束后取消账户存在困难,且 GDPR 合规性回复不明确,这些问题与 G2 上以开发者为中心的 4.8/5 评分不符。
LK LiveKit 的连接值得注意:Retell 底层的实时传输层借鉴了与 LiveKit 相同的 WebRTC 基础设施概念,一些团队在希望对其语音代理下方的实时通信层进行更细粒度控制时,会直接使用 LiveKit。
Retell AI 适合哪些用户
最适合 Retell 的场景:一家位于美国的医疗保健、物流、房地产、债务催收或电子商务公司的软件工程团队,需要自动化大量入站呼叫,并有开发者来维护集成。Medical Data Systems 部署了 Retell 来处理 100% 的入站呼叫,人工转接率仅为 30%,通过自动化的债务对话每月收回约 $280,000。Pine Park Health 将预约 NPS 提高了 38%,并填补了以前未使用的医疗服务提供者产能。电动汽车充电公司 SWTCH 将支持成本削减了 50% 以上。这些不是边缘案例;它们代表了该平台所优化的核心场景。
其合规性表现确实非常出色。已获得 HIPAA、SOC2 Type II 和 GDPR 认证。企业层级提供个人信息脱敏、基于角色的访问控制(RBAC)和 SSO。对于受监管的行业,如果竞争对手缺乏 BAA 会被取消资格,那么 Retell 通常是务实的选择。
Retell AI 不适合哪些场景
Retell 不是为非技术用户构建的。如果没有开发人员在职,企业主或运营团队会发现该平台过于复杂,无法在没有支持的情况下进行部署。它没有为每个边缘情况提供带有拖拽回退映射的完整可视化工作流构建器。也没有完全镜像生产环境的沙盒测试环境。基于角色的访问控制和审计日志仅限企业层级,这给需要这些控制但尚未达到企业规模的中端市场公司带来了摩擦。
它也不是极高呼叫量纯出站销售的正确选择。如果主要用例是在连续的出站活动中每月拨打数百万分钟,并且需要对每个联系人过去的通话有记忆功能,那么 Bland AI 的架构正是为该工作流量身定制的。Retell 的优势在于入站客户服务以及混合的入站/出站操作,在这些操作中,中等并发下的语音质量和可靠性比原始吞吐量更重要。
具有严格数据主权要求的欧洲企业,特别是德国(超过 37 位 G2 评论者特别指出了语音质量和合规性差距)和英国的企业,在做出承诺之前应验证当前的区域可用性和数据驻留条款。虽然涵盖了 GDPR,但按量付费层级的数据驻留保证不如企业层级明确。
最后:$0.07/min 的宣传价格是营销算术。请为实际的 LLM 和 TTS 选择做好预算。对于评估总拥有成本的团队来说,只要仔细阅读定价页面,模块化定价是透明的,但促销费率与生产实际之间的差距已经让足够多的用户感到沮丧,因此在注册之前有必要明确设定预期。
用户评价
暂无评价,快来分享你的第一条体验吧!
登录 后即可撰写评价。
相关文章
与 Retell AI 相关的指南和文章。

Voice Agent for Missed Calls: Every Service Business Is Bleeding Leads After Hours (2026)

OpenAI GPT-Realtime-2 (May 2026): Pricing, Latency & 30-Min Voice Agent

AI Receptionist for Solo Professionals: Replace the Answering Service (2026)
Build a 70-Language Live Voice Agent With GPT-Realtime-Translate (2026)

How to Sell AI Chatbots to Local Businesses ($1K-$5K Retainers, 2026)
