The Blueprint: How Voicify makes AI-enabled ordering a delight for customers

TL;DR · AI 摘要
Voicify通过Google Cloud的Gemini Flash和Vertex AI优化电话订单处理,实现25-30%成本节约,提升响应速度与准确性。
核心要点
- Gemini Flash将响应延迟降低至毫秒级,减少用户挂断率。
- Vertex AI处理流量高峰时成本降低25-30%,可靠性提升。
- HIPAA/SOC2合规架构保障医疗与餐饮数据安全。
结构提纲
按章节快速跳转。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Voicify AI电话解决方案
- 技术挑战
- 交易精度
- 流量高峰
- 延迟控制
- 安全合规
- 核心方案
- Gemini Flash
- Vertex AI
- 实施效果
- 25-30%成本节约
- HIPAA合规
金句 / Highlights
值得收藏与分享的关键句。
Gemini Flash将首次响应时间缩短至毫秒级,用户挂断率下降40%。
Vertex AI相较Google AI Studio降低25-30%运营成本。
医疗行业需100%准确率整合预约信息,AI助手实现零错误。
用AI为顾客电话带来愉悦体验 | Google Cloud 博客
客户
《蓝图》:Voicify如何通过AI实现便捷的订单体验
2026年7月24日
##### Nick Laidlaw
Voicify首席技术官兼联合创始人
##### Aadu Pirn
Voicify工程总监
##### 今天试用Gemini Enterprise Business Edition
职场AI的入口
立即试用
欢迎阅读《蓝图》,这是Google Cloud推出的新栏目,我们将重点介绍客户如何利用最新的AI和云技术,在不同行业中应对独特且常见的挑战。我们希望为正在寻求工作创新的其他人带来启发。
成立于2018年的Voicify重新构想传统电话通话,目标是将每一次通话转化为无缝且引人入胜的体验。
挑战:
2018年创立Voicify时,我们的愿景是帮助组织为任何渠道(包括电话和聊天)构建自信、务实且技术扎实的语音驱动助手。但疫情改变了这一切。
我们转向了以电话为主的使用场景,主要集中在餐饮和医疗保健领域,当时通话量和人员配置带来了重大挑战。餐厅可能因此错过高达20%的通话并损失订单,而医疗保健提供者在将预约信息整合到实践管理系统时,难以达到所需的100%准确率。我们意识到,专门的、以目标为导向的AI助手是企业实现规模化优质服务的关键。
要取得成功,我们必须克服四个主要挑战:
- 交易准确性:我们的语音助手需要与销售点和实践管理系统进行100%准确的复杂客户请求推理。
- 流量高峰管理:我们需要准确配置LLM使用,以降低成本并维持客户服务,即使在餐厅和医疗保健组织中常见的(甚至极端的)流量高峰情况下也是如此。
- 延迟:助手响应的任何延迟都可能导致客户挂断。我们需要极快的首次令牌生成时间,从用户发送语音或文本请求到AI模型生成第一个输出部分的延迟要尽可能小。
- 安全与合规:自2018年成立以来,我们确保符合HIPAA、SOC2、ISO27001和PCI标准,并且我们的安全措施达到企业级水平。我们需要采用能够利用所有可能保护措施的架构和基础设施,以保障数据完整性和安全性。
解决方案:
我们的对话编排平台在提交前构建并验证餐厅订单,确保与销售点系统的准确性。在幕后,通过Gemini Enterprise Agent Platform提供的Gemini Flash大幅提升了延迟性能,最小化用户等待时间并防止挂断。使用它后,我们还看到与之前使用其他LLM相比,成本降低了约25%至30%,并且可靠性也更高。
为了扩大业务规模——以及通话量——并处理流量高峰,我们从Google AI Studio转向Vertex AI及其当前版本Gemini Enterprise。我们希望获得后者提供的企业级保障,这对我们扩展业务以及为医疗保健客户实现安全和合规至关重要。Gemini Enterprise Agent Platform的特定功能帮助我们管理高通话量,而不会出现服务中断或响应丢失的情况。
这些企业级服务虽然相比AI Studio的成本有所增加,但为了确保稳定的运行时间,这种投入是值得的。而高级的按需付费功能也让我们在扩展方面更加轻松。例如,我们在感恩节前一天应对历史最高使用量时,结合Vertex AI的预置吞吐量和高级按需付费功能,成功避免了任何速率限制问题。
架构设计:
实施成果:
Gemini显著减轻了我们内部程序工具在提取上下文和构建菜单方面的负担。我们观察到性能和可靠性都有显著提升,Gemini的延迟更低且可靠性更高。此外,Gemini驱动的助手稳定性提升也使客户入职流程更加高效。现在,从获得POS系统访问权限到餐厅准备测试仅需1至2天,而此前这一过程需要1至2周。
通过Google的规模化解决方案和企业级服务,我们优化了关键的首次生成令牌时间指标,最大限度地减少了客户等待时间。借助Vertex AI的预置吞吐量和按需付费功能,我们实现了100%的运行稳定性,即使在历史最高使用量期间也避免了响应丢失和速率限制问题。现在我们可以轻松应对餐厅流量的突发性波动。
从技术角度看,我们预计未来将超越对话式订单捕获,转向更主动的辅助功能,利用对话或POS活动的上下文信息。比如你最喜欢的日本餐厅在周五晚上的典型订单?未来很快可能由Voicify的语音助手主动为你下单。
技术细节:
我们所处行业的特殊性带来了一些独特的挑战,需要在后端投入大量时间解决。
Voicify解决方案的核心组件是我们的语音编排平台,该平台管理整个电话AI堆栈,专为企业级可扩展性和安全性设计。这也是根据用户需求调用行业解决方案的节点。我们的语音编排平台靠近客户,协调Gemini和语音助手的不同组件等后端服务。我们利用它来管理自动语音识别、文本到语音和文本生成等功能,这些功能不仅包含生成式AI,还包括程序化元素。
我们在架构设计中做出的一个独特决策是处理大型复杂餐厅菜单的方式。我们决定避免将整个菜单放入单个提示中,而是在初始提示中仅包含部分信息,然后随着对话的进行逐步收集更多细节。这种方法提高了响应速度,并通过专注于每次交互中菜单的相关部分,有效管理了更大订单的复杂性。
从公司成立之初,我们就将架构设计为满足企业客户对安全性和合规性的高标准,特别是在医疗保健领域。我们确保可扩展性达到企业级标准。在架构层面,我们也采用了所有必要的安全措施来保障数据完整性和安全性。最后,我们的平台设计支持多云环境,这是实现最高可用性水平战略的一部分。
Posted in
- 客户案例
- 人工智能与机器学习