JP2020502593A5

JP2020502593A5 - 音声コマンドを検出及びキャプチャするシステムと方法

Info

Publication number: JP2020502593A5
Application number: JP2019555430A
Authority: JP
Filing date: 2017-12-20
Publication date: 2021-02-04
Anticipated expiration: 2037-12-20

Claims

音声コマンドを検出及びキャプチャするシステムであって、
オーディオ信号を受信するべく構成された入力部と、
前記オーディオ信号をデジタルオーディオ信号に変換するべく構成されたアナログデジタル変換器と、
前記デジタルオーディオ信号の振幅を決定する振幅検出器と、
制御器と
を含み、
前記制御器は、
前記デジタルオーディオ信号の振幅を第１しきい値と及び第２しきい値と比較することと、
前記デジタルオーディオ信号の振幅が前記第１しきい値又は前記第２しきい値を超えない場合に割り込み信号を差し控えることと、
前記デジタルオーディオ信号の振幅が前記第１しきい値及び前記第２しきい値を超える場合に前記割り込み信号を生成することと、
前記デジタルオーディオ信号の振幅が前記第１しきい値と前記第２しきい値との間にある場合に前記デジタルオーディオ信号のスペクトル分析をトリガーすることと
を行うべく構成される、システム。
前記アナログデジタル変換器は、
前記オーディオ信号がオーディオアクティビティの開始レベルを有するか否かを決定することと、
前記オーディオ信号が前記オーディオアクティビティの開始レベルを有しない場合に前記アナログデジタル変換器を、前記アナログデジタル変換器の変換器部分が前記デジタルオーディオ信号を生成しないスリープモードに置くことと、
前記オーディオ信号が前記オーディオアクティビティの開始レベルを有する場合に前記アナログデジタル変換器を、前記アナログデジタル変換器の変換器部分が前記デジタルオーディオ信号を生成するアクティブモードに置くことと
を行うべく構成されたウェイクアップ回路を含む、請求項１のシステム。
前記オーディオ信号がオーディオアクティビティの開始レベルを有するか否かを決定するべく、前記ウェイクアップ回路は、前記オーディオ信号をウェイクアップ開始しきい値と比較するべく構成される、請求項２のシステム。
前記ウェイクアップ回路は、
前記オーディオ信号をブーストするべく構成されたオーディオプリアンプ利得段と、
ブーストされた前記オーディオ信号を、前記オーディオアクティビティの開始レベルを示すウェイクアップ開始しきい値と比較するべく構成された比較器段と
を含む、請求項２のシステム。
前記アナログデジタル変換器の変換器部分は、前記アナログデジタル変換器が前記スリープモードにある場合に電力供給なしとなり、
前記アナログデジタル変換器の変換器部分は、前記アナログデジタル変換器が前記アクティブモードにある場合に電力供給される、請求項２のシステム。
前記アナログデジタル変換器と前記振幅検出器との間にデシメーションフィルタをさらに含み、
前記デシメーションフィルタは、前記デジタルオーディオ信号を受信して前記デジタルオーディオ信号を処理し、前記アナログデジタル変換器のサンプリングレートよりも低い低減サンプリングレートを有する低減デジタルオーディオサンプルを生成するべく構成される、請求項１のシステム。
サンプリングレートを有するデジタルオーディオ信号を入力として受信して前記デジタルオーディオ信号を、振幅を有するとともに前記デジタルオーディオ信号の前記サンプリングレートよりも低いサンプリングレートを有する結合デジタルオーディオ信号を生成するように処理するべく構成されたサンプル結合ブロックをさらに含む、請求項１のシステム。
前記割り込み信号を受信してトリガーフレーズのために前記デジタルオーディオ信号を分析するべく構成されたデジタル信号プロセッサをさらに含む、請求項１のシステム。
前記デジタルオーディオ信号を受信して先入れ先出しフォーマットで格納するべく構成された音声ランダムアクセスメモリをさらに含み、
前記音声ランダムアクセスメモリはデジタル信号プロセッサによりアクセスされるように構成される、請求項８のシステム。
複数の非同期クロック生成メカニズムを含むクロックシステムをさらに含み、
前記非同期クロック生成メカニズムはそれぞれが異なる電流消費を有し、
前記クロックシステムは、前記非同期クロック生成メカニズム間でスイッチングするべく構成される、請求項８のシステム。
音声コマンドを検出及びキャプチャする方法であって、
音声アクティビティ検出器がデジタルオーディオ信号を受信することと、
前記音声アクティビティ検出器が前記デジタルオーディオ信号の振幅を決定することと、
前記音声アクティビティ検出器が前記デジタルオーディオ信号の振幅を第１しきい値と及び第２しきい値と比較することと、
前記デジタルオーディオ信号の振幅が前記第１しきい値又は前記第２しきい値を超えない場合に前記音声アクティビティ検出器が割り込み信号を差し控えることと、
前記デジタルオーディオ信号の振幅が前記第１しきい値及び前記第２しきい値を超える場合に前記音声アクティビティ検出器が前記割り込み信号を生成することと、
前記デジタルオーディオ信号の振幅が前記第１しきい値と前記第２しきい値との間にある場合に前記音声アクティビティ検出器が前記デジタルオーディオ信号のスペクトル分析を行うことと
を含む、方法。
アナログデジタル変換器がオーディオ信号を受信することと、
前記オーディオ信号がオーディオアクティビティの開始レベルを有するか否かをウェイクアップ回路が決定することと、
前記オーディオ信号が前記オーディオアクティビティの開始レベルを有しない場合に前記アナログデジタル変換器を、前記アナログデジタル変換器の変換器部分がデジタルオーディオ信号を生成しないスリープモードに置くことと、
前記オーディオ信号が前記オーディオアクティビティの開始レベルを有する場合に前記アナログデジタル変換器を、前記アナログデジタル変換器の変換器部分が、デジタルオーディオ信号を前記オーディオ信号からアナログデジタル変換器サンプリングレートで生成するアクティブモードに置くことと
をさらに含む、請求項１１の方法。
前記オーディオ信号がオーディオアクティビティの開始レベルを有するか否かをウェイクアップ回路が決定することは、前記オーディオ信号をウェイクアップ開始しきい値と比較することを含む、請求項１２の方法。
前記アナログデジタル変換器が前記スリープモードにある場合に前記アナログデジタル変換器の変換器部分に電力供給をしないことと、
前記アナログデジタル変換器が前記アクティブモードにある場合に前記アナログデジタル変換器の変換器部分に電力供給をすることと
をさらに含む、請求項１２の方法。
デジタル信号プロセッサが前記割り込み信号を前記音声アクティビティ検出器から受信することと、
前記デジタル信号プロセッサが、トリガーフレーズを検出するべく、前記デジタルオーディオ信号を分析することと
をさらに含む、請求項１２の方法。
音声ランダムアクセスメモリが前記デジタルオーディオ信号を受信して先入れ先出しフォーマットで格納することと、
前記デジタル信号プロセッサが前記トリガーフレーズを検出する場合に前記トリガーフレーズのエンドポイント前の前記音声ランダムアクセスメモリにおけるすべてのデータを破棄することと
をさらに含む、請求項１５の方法。
前記デジタル信号プロセッサがトリガーフレーズを検出する場合に、前記トリガーフレーズの後の予め特定されたタイムアウトの間にユーザが話したか否かを決定することをさらに含む、請求項１５の方法。
音声アクティビティ検出器であって、
デジタルオーディオ信号を受信するべく構成された入力部と、
前記デジタルオーディオ信号の振幅を決定するべく構成された振幅検出器と、
コントローラと、
スペクトル分析器と
を含み、
前記コントローラは、
前記デジタルオーディオ信号の振幅が第１しきい値又は第２しきい値を超えない場合に割り込み信号を差し控えることと、
前記デジタルオーディオ信号の振幅が前記第１しきい値及び前記第２しきい値を超える場合に前記割り込み信号を生成することと、
前記デジタルオーディオ信号の振幅が前記第１しきい値と前記第２しきい値との間にある場合に前記デジタルオーディオ信号のスペクトル分析をトリガーすることと
を行うべく構成され、
前記スペクトル分析器は、前記コントローラに前記割り込み信号を生成するべきか否かを命令するべく前記デジタルオーディオ信号のスペクトル分析を行うべく構成される、音声アクティビティ検出器。
サンプリングレートを有するデジタルオーディオ信号を入力として受信して前記デジタルオーディオ信号を、振幅を有するとともに前記デジタルオーディオ信号の前記サンプリングレートよりも低いサンプリングレートを有する結合デジタルオーディオ信号を生成するように処理するべく構成されたサンプル結合器をさらに含む、請求項１８の音声アクティビティ検出器。
前記スペクトル分析器は、
前記サンプル結合器から前記結合デジタルオーディオ信号を受信して前記結合デジタルオーディオ信号を格納するべく構成された音声アクティビティ検出器ランダムアクセスメモリと、
前記音声アクティビティ検出器ランダムアクセスメモリに格納された前記結合デジタルオーディオ信号の高速フーリエ変換を行って高速フーリエ変換結果を出力するべく構成された高速フーリエ変換ブロックと、
前記高速フーリエ変換結果の平均振幅を決定するべく構成されたスペクトルローパスフィルタと、
前記スペクトルローパスフィルタの結果を評価し、前記スペクトルローパスフィルタの結果の評価に基づいて前記割り込み信号を生成するか又は引き続いて前記割り込み信号を差し控えるかするように前記コントローラに信号を送るべく構成されたスペクトルコントローラと
を含む、請求項１９の音声アクティビティ検出器。