Skip to main content
QUICK REVIEW

[论文解读] Implementation of Google Assistant & Amazon Alexa on Raspberry Pi.

Shailesh Arya, Samir Patel|arXiv (Cornell University)|Jun 15, 2020
IoT-based Smart Home Systems参考文献 1被引用 4
一句话总结

本文提出了一款基于单个树莓派3的低成本双虚拟助手智能音箱原型,通过语音激活热词实现谷歌助手与亚马逊Alexa的并发使用。通过利用两个助手的云端自然语言处理服务,系统能够处理语音输入、解析意图,并通过USB扬声器输出语音响应,展示了在单一嵌入入式平台上无缝集成两大主流语音生态系统,用于家庭自动化和通用交互。

ABSTRACT

This paper investigates the implementation of voice-enabled Google Assistant and Amazon Alexa on Raspberry Pi. Virtual Assistants are being a new trend in how we interact or do computations with physical devices. A voice-enabled system essentially means a system that processes voice as an input, decodes, or understands the meaning of that input and generates an appropriate voice output. In this paper, we are developing a smart speaker prototype that has the functionalities of both in the same Raspberry Pi. Users can invoke a virtual assistant by saying the hot words and can leverage the best services of both eco-systems. This paper also explains the complex architecture of Google Assistant and Amazon Alexa and the working of both assistants as well. Later, this system can be used to control the smart home IoT devices.

研究动机与目标

  • 开发一款低成本、基于单一硬件的智能音箱原型,支持谷歌助手与亚马逊Alexa。
  • 使用户能够通过不同的热词(例如“嘿谷歌”、“Alexa”)在同一个设备上唤起任一助手。
  • 将两个助手集成到共享的树莓派3平台上,以实现对物联网设备的语音控制。
  • 证明在资源受限的嵌入式硬件上同时运行两个依赖云端的虚拟助手的可行性。
  • 提供一种DIY、开源的解决方案,利用广泛可用的组件实现家庭自动化。

提出的方法

  • 使用谷歌助手库和通过客户端密钥JSON文件进行OAuth2认证,在树莓派3上部署谷歌助手SDK。
  • 使用AVS设备SDK在树莓派上配置Alexa语音服务(AVS)SDK,并通过设备专用配置设置安全配置文件。
  • 使用USB麦克风进行语音输入,通过3.5mm AUX连接的扬声器进行音频输出,两个助手均通过远程云端自然语言处理与意图识别处理语音命令。
  • 在同一个树莓派上并行运行两个助手服务,分别监听不同的热词(“嘿谷歌”和“Alexa”)。
  • 通过基于网页的授权流程获取设备专用的OAuth2凭证和刷新令牌,对两个助手进行认证。
  • 通过谷歌助手和亚马逊Alexa生态系统中的原生支持,将系统与物联网设备(如智能插座、灯泡)集成。

实验结果

研究问题

  • RQ1能否在单个树莓派3上同时运行谷歌助手与亚马逊Alexa而不会导致性能下降?
  • RQ2如何在共享音频输入与输出的单一嵌入式平台上集成两个不同的云端虚拟助手?
  • RQ3在树莓派上为DIY智能音箱启用两个助手所需的关键配置与认证步骤是什么?
  • RQ4低成本单板计算机如树莓派3在多大程度上能够处理实时语音处理与双助手交互?
  • RQ5此类系统如何扩展以使用标准物联网设备实现实际的家庭自动化?

主要发现

  • 系统成功在单个树莓派3上并行运行谷歌助手与亚马逊Alexa,每个助手均可独立响应其对应的热词。
  • 通过使用谷歌与亚马逊的官方SDK实现集成,无需自定义语音识别模型,而是依赖云端自然语言处理与意图解析。
  • 使用标准开发工具与配置文件,成功完成了包括OAuth2认证与设备注册在内的设置流程。
  • 原型展示了可靠的语音交互,两个助手均能正确理解命令并通过USB扬声器生成语音响应。
  • 该系统可通过任一助手的原生生态系统集成,实现对标准物联网设备(如智能插座、灯泡)的语音控制。
  • 整个解决方案的构建成本远低于商用智能音箱,使其成为家庭自动化与语音交互的可行DIY替代方案。

更好的研究,从现在开始

从阅读论文到最终审阅,大幅缩短您的研究时间。

无需绑定信用卡

本解读由 AI 生成,并经人工编辑审核。