soundKIT bg desktopsoundKIT upd kv desktop scaled

适用于边缘AI音频和语音处理的soundKIT

AI声音人工智能实验室

soundKIT kv mobile

Ambiq soundKIT™ 是一款开源音频 AI 开发工具包(SDK),用于在 Ambiq 的超低功耗 SoC 上训练、评估和部署实时设备端音频模型。 它支持语音增强、关键词检测和说话人验证功能,适用于始终在线的边缘 AI 应用,包括智能家居设备、可穿戴设备、智能眼镜、工业传感器和医疗设备。

soundKIT 的主要特点

01

Audio Edge AI AI

在边缘设备上开发始终在线的关键AI音频功能,包括语音增强(降噪和去混响)、关键词定位、语音活动检测以及说话人/语音认证。

02

任务级模式

在整个音频 AI 工作流中使用统一的命令行界面(CLI):包括数据集设置、模型训练、基准测试、验证、部署,以及在 PC 或 Ambiq EVB 上的实时推理演示。

03

灵活迭代

使用 YAML 配置、CLI 命令或 Python API 交换数据集、模型、任务和训练配方,而无需更改核心工作流程。

04

动力与性能

基于 heliaRT™ 技术,可在 Apollo SoC 上实现生产级部署,通过向量加速的 AI Kernels,推理解决速度比 TFLM 快达 3 倍,并采用增强的 int16x8 量化技术,以实现高保真音频和语音处理

任务和能力

语音增强 (SE)

  • 利用去噪和消除混响的设备语音增强技术,提高嘈杂现实环境中的语音清晰度。

关键词 SPOT(KWS)

  • 利用与 TensorFlow Lite 和 TensorFlow Lite Micro(TFLite/TFLM)兼容的轻量级模型,实现快速、低内存占用的唤醒词检测。

语音活动检测 (VAD)

  • 实时、低功耗检测语音是否存在,减少误触发,延长始终在线音频系统的电池寿命。

扬声器验证(ID)

  • 用于语音验证的安全、保护隐私的设备上扬声器验证-无需云连接。

设计资源

其他文档

  • 设置收藏夹
  • 获取更新通知
  • 使用搜索过滤器

视频库

hqdefault
hqdefault
hqdefault
hqdefault

常见问题解答(FAQ)

  • soundKIT 是 Ambiq的 专为超低功耗设备设计的边缘AI音频和语音处理平台。它使开发者能够构建具备实时设备端推理能力的智能音频应用程序。

  • soundKIT 支持语音增强、关键词检测、语音活动检测(VAD)以及边缘AI应用中的说话人验证功能。

  • soundKIT 是 专为 ,适用于智能音箱、可穿戴设备、物联网设备、工业系统、智能家居产品以及其他电池供电的边缘AI设备。

  • 关键词识别使设备能够本地检测特定的唤醒词或语音命令 在设备上 ,且功耗极低。

  • 是的。 soundKIT 具备语音增强功能,可在复杂环境中提高语音清晰度并降低背景噪音。

  • 语音活动检测 可识别 人类语音出现的时间,从而帮助 优化 音频处理效率并降低功耗。

  • 是的。 soundKIT 专为设备端的边缘AI推理而设计,无需依赖云端处理。

  • 通过在设备本地处理音频 在设备上, soundKIT 减少了对将敏感语音数据发送至外部云服务器的需求。

  • soundKIT 是 针对 针对 Ambiq 基于SPOT的SoC ,并持续更新以支持未来版本。

  • 智能家居、医疗保健、工业物联网、可穿戴设备、消费电子产品以及支持语音功能的设备制造商都 受益 受益于 soundKIT的 边缘AI音频功能中获益。

  • soundKIT 利用 Ambiq的 超低功耗架构和优化的边缘AI工作流,以极低的能耗实现始终在线的音频处理。

  • 是的。 soundKIT 支持设备端扬声器验证和语音身份识别,以提供安全且个性化的体验。

  • 边缘AI通过直接在设备上处理音频, 在设备端。

  • 编号。 soundKIT 支持在设备上进行离线音频AI推理,无需持续连接云端。

  • 否. soundKIT 专为 Ambiq SPOT架构的SoC而设计,正是这种专注使其功能强大。紧密的软硬件集成实现了实时音频处理、始终在线的语音增强以及超低功耗,这是任何通用平台都无法比拟的。

准备下载