soundKIT bg desktopsoundKIT upd kv desktop scaled

適用於邊緣 AI 音訊與語音處理的 soundKIT

聲音人工智慧實驗場

soundKIT kv mobile

Ambiq soundKIT™ 是一款開源音訊 AI 開發套件(SDK),用於在 Ambiq 的超低功耗 SoC 上訓練、評估及部署即時、裝置端音訊模型。 它支援語音增強、關鍵字偵測及說話人驗證功能,適用於「始終開啟」的邊緣 AI 應用,包括智慧家庭裝置、穿戴式裝置、智慧眼鏡、工業感測器及醫療設備。

soundKIT 的主要功能

01

Audio Edge AI

在邊緣裝置上開發始終處於運作狀態的關鍵 AI 音訊功能,包括語音增強(降噪與去混響)、關鍵字定位、語音活動偵測,以及說話者/語音驗證。

02

任務層級模式

在整個音訊 AI 工作流程中,採用一致的命令列介面(CLI):包含資料集設定、模型訓練、效能測試、驗證、部署,以及在個人電腦或 Ambiq EVB 上進行的即時推論示範。

03

彈性迭代

使用 YAML 設定、CLI 指令或 Python API 交換資料集、模型、任務與訓練配方,且不改變核心工作流程。

04

動力與性能

由 heliaRT™ 驅動,適用於 Apollo SoC 的量產級部署,透過向量加速的 AI 核心,提供比 TFLM 快達 3 倍的推論速度,並採用增強的 int16x8 量化技術,以實現高保真音訊與語音處理

任務與能力

語音增強(SE)

  • 具備去噪與去雜音的裝置語音增強,以提升嘈雜真實環境中的語音清晰度。

關鍵字偵測(KWS)

  • 利用相容於 TensorFlow Lite 和 TensorFlow Lite Micro(TFLite/TFLM)的輕量級模型,實現快速且低記憶體佔用的喚醒詞偵測。

語音活動偵測(VAD)

  • 即時、低功耗偵測語音存在,減少誤觸發並延長常開音響系統的電池續航力。

講者驗證(ID)

  • 安全且保護隱私的裝置內建語音驗證喇叭驗證——無需雲端連線。

設計資源

其他文檔

  • 設置收藏夾
  • 取得更新通知
  • 使用搜尋過濾器

影片庫

hqdefault
hqdefault
hqdefault
hqdefault

常見問題 (FAQ)

  • soundKIT 是 Ambiq 的 專為超低功耗裝置設計的邊緣 AI 音訊與語音處理平台。它讓開發者能夠透過裝置端的即時推論,打造智慧音訊應用程式。

  • soundKIT 支援語音增強、關鍵字偵測、語音活動偵測(VAD)以及發言人驗證,適用於邊緣 AI 應用。

  • soundKIT 是 專為 智慧音箱、穿戴式裝置、物聯網裝置、工業系統、智慧家庭產品,以及其他由電池供電的邊緣 AI 裝置。

  • 關鍵字偵測功能可讓裝置在裝置端偵測特定的喚醒詞或語音指令 在裝置上 ,且功耗極低。

  • 是的。 soundKIT 具備語音增強功能,能在艱困的環境中提升語音清晰度並降低背景噪音。

  • 語音活動偵測 可識別 人類語音出現的時機,協助 優化 音訊處理效率與功耗。

  • 是的。 soundKIT 專為裝置端的邊緣 AI 推論而設計,無需仰賴雲端處理。

  • 透過在裝置上進行音訊處理 在裝置上, soundKIT 減少了將敏感語音資料傳送至外部雲端伺服器的需求。

  • soundKIT 是 針對 針對 Ambiq 基於 SPOT 的系統單晶片 (SoC) ,並持續更新以支援未來版本。

  • 智慧家庭、醫療保健、工業物聯網、穿戴式裝置、消費性電子產品以及語音控制裝置的製造商皆 受益 受益於 soundKIT 的 邊緣 AI 音訊功能中獲益。

  • soundKIT 善用 Ambiq 的 超低功耗架構與最佳化的邊緣 AI 工作流程,實現以最低能耗維持持續運作的音訊處理。

  • 是的。 soundKIT 支援裝置內建的揚聲器驗證與語音身分識別功能,提供安全且個人化的使用體驗。

  • 邊緣 AI 透過直接在裝置上處理音訊, 於裝置端。

  • 沒有。 soundKIT 支援離線的裝置端音訊 AI 推論,無需持續連線至雲端。

  • 不。 soundKIT 是專為 Ambiq SPOT 架構的 SoC 所設計,而這種專注正是其強大之處。緊密的軟硬體整合,實現了即時音訊處理、持續運作的語音增強功能,以及極低的功耗效率,這是任何通用平台都無法比擬的。

準備下載