联网与 AI 整合

为玩具与小家电加入 App 连接设置与控制,以及 AI 语音互动。

整合方向分为两种,可以各自评估,也可以在同一产品中组合。本页为方案介绍,实际功能依各项目与您一起确认。

A

App 连接设置与控制

手机 App 通过 BLE 或 Wi-Fi 为玩具或整合模块配网(BLE Provisioning 或 SoftAP),完成云端注册后,即可经由 MQTT/HTTPS 在本地或远程操作产品支持的功能。

运作流程

  1. 1设备探索(BLE 扫描)
  2. 2Wi-Fi 配网
  3. 3云端注册与连接状态
  4. 4App 远程控制
  • 连接方式(BLE、Wi-Fi 或其他协议)与支持的手机平台,依实际实现而定。
  • 可规划 OTA 固件更新,以及设备状态同步(Device Shadow/数字孪生)。
  • 并非每台设备或浏览器都支持所有连接方式。
在桌前使用智能手机
B

AI 语音互动与控制

玩具或小家电通过整合模块将语音串流至云端:先由语音识别(ASR)转成文字,再由 LLM 理解需求并产生回复,最后以语音合成(TTS)说出来;支持的设备动作可通过 Function Calling 触发。

运作流程

  1. 1唤醒词与语音输入
  2. 2ASR 语音识别
  3. 3LLM 理解与回复
  4. 4TTS 语音回应/设备动作
  • 采用的 AI 服务、支持语言、回应时间与可控制的功能,依各项目选定并测试。
  • 角色设置(Persona)、Prompt 设计与内容安全过滤依产品调整,儿童产品尤其重要。
  • 此功能需要连网,并非离线功能。
麦克风与音频设备

云端与 AI 服务选项

云端平台与 AI 服务依目标市场、成本、数据存放地区与法规,与您一起选定。可评估的选项例如:

IoT 云端平台

设备连接、设备管理与 OTA 更新。

  • AWS IoT Core
  • Microsoft Azure IoT Hub
  • 阿里云 IoT 平台
  • 涂鸦 Tuya IoT(SaaS)
  • 自建 MQTT Broker

LLM 大型语言模型

对话、意图理解与内容生成。

  • OpenAI GPT
  • Anthropic Claude
  • Google Gemini
  • Azure OpenAI
  • 通义千问/DeepSeek(中国市场)

语音技术

从收音到说话的语音处理流程。

  • 云端 ASR 语音识别
  • TTS 语音合成
  • 唤醒词检测
  • VAD 语音活动检测

部署方式

依上市时程与数据掌控需求选择。

  • SaaS 平台:较快上市
  • 自有云端账号:数据自主掌控
  • 混合架构

以上服务商为可评估的选项,并非合作或代理关系;实际采用依项目需求、各服务条款与地区供应情况决定。

可分开,也可组合

App 控制与 AI 语音互动可以各自评估,也可以整合在同一产品中。

需要评估的硬件

加入联网或 AI 功能,通常需要评估额外的连接模块、麦克风与音频硬件;原本的语音 IC 或 MCU 本身并不具备网络与 LLM 能力。

我们可以协助的整合工作

  • 硬件评估:Wi-Fi/BLE 模块、麦克风、音频 Codec 与放大器
  • 设备与整合模块固件,包含配网与 OTA 更新
  • App 连接流程与控制界面
  • 以 MQTT/HTTPS 串接云端,处理设备管理与数据
  • 语音流程整合:ASR、LLM、TTS 与 Prompt/角色设计
  • 以 LLM Function Calling 对应设备控制指令

正在规划联网或 AI 产品吗?

告诉我们您的产品与想要的功能,我们会评估合适的做法。

洽谈整合需求