
端侧实现多语种识别、实时翻译与自然语音合成。可在桌面设备、会议终端、导览机等形态上落地双向对话与跨语种交流。
核心优势




在仓储、车间、机房等现场,端侧语音可替代复杂界面与扫码工具,让一线工人通过自然语言完成出入库登记、设备点检、巡检表单填报、危险事件播报。本地 ASR 输出结构化文字,可对接 WMS / MES / IoT 平台。
核心优势




XIAO ESP32S3 做低功耗唤醒前端,触发 AI 盒子启动 ASR-TTS 流水线;声纹识别区分不同成员的偏好;对接 Matter / HomeAssistant / 米家等本地协议执行控制。指令本地处理,断网不影响日常使用。
核心优势




语音方案的算力放在哪,决定整机能力上限与单台 BOM。常见落地拆成 3 类:
核心优势
| 产品图 | 设备 | 纯语音并发 | 语音能力 | 本地大模型 |
|---|---|---|---|---|
![]() | reRouter CM4 系列 | 单路 | 机器音 | 不支持(可选云端) |
![]() | reComputer RK3576 系列 | 单路 | 模拟音 | 4B–7B(需 1282 加速卡) |
![]() | reComputer RK3588 系列 | 单路 | 模拟音 | 4B–7B(需 1282 加速卡) |
![]() | reComputer J30 系列 | 单路 | 真人音 | ~2B |
![]() | reComputer J40 系列 | 2–3 路 | 真人音 | 4B–7B |
![]() | reComputer J50 系列 | 3 路以上 | 真人音 | 7B–14B |
![]() | NVIDIA Jetson AGX Thor Developer Kit | 6 路以上 | 真人音 | 14B–32B |
AI 算力盒按“能跑哪些语音能力”分档。下表为本场景可用的设备清单(族级):各设备族的纯语音并发、语音能力与可部署的本地大模型规模;具体型号、配置与配件组合在下方配单器里选择(麦克风与扬声器选型见下个 Tab)。注:本地大模型与语音链路同机运行时性能会有折损、响应延迟会增加;高并发 + 大模型建议选更高算力档位。
核心优势
| 产品 | 类型 | 芯片 | 拾音 距离 | 识音 角度 | 内置 功放 | 核心算法 |
|---|---|---|---|---|---|---|
reSpeaker Lite | 线形 双麦 | XMOS XU316 | 3m | 180° | 5W | AEC · DoA |
reSpeaker XVF3800 | 圆形 四麦 | XMOS XVF3800 | 5m | 360° | 5W | AEC · DoA · Multi-beamforming |
reSpeaker Flex Circular-4 | 圆形 四麦 | XMOS XVF3800 | 5m | 360° | 10W | AEC · DoA · Multi-beamforming |
reSpeaker Flex Linear-4 | 线形 四麦 | XMOS XVF3800 | 5m | 180° | 10W | AEC · DoA · Multi-beamforming |
核心优势