KR102315053B1 - 활성 단어 검출 억제 - Google Patents
활성 단어 검출 억제 Download PDFInfo
- Publication number
- KR102315053B1 KR102315053B1 KR1020207006519A KR20207006519A KR102315053B1 KR 102315053 B1 KR102315053 B1 KR 102315053B1 KR 1020207006519 A KR1020207006519 A KR 1020207006519A KR 20207006519 A KR20207006519 A KR 20207006519A KR 102315053 B1 KR102315053 B1 KR 102315053B1
- Authority
- KR
- South Korea
- Prior art keywords
- audio content
- playback
- active
- playback device
- nmd
- Prior art date
Links
- 238000001514 detection method Methods 0.000 title claims description 73
- 230000004044 response Effects 0.000 claims abstract description 200
- 238000000034 method Methods 0.000 claims abstract description 121
- 230000004913 activation Effects 0.000 claims abstract description 42
- 239000003550 marker Substances 0.000 claims description 28
- 230000001360 synchronised effect Effects 0.000 claims description 18
- 238000012545 processing Methods 0.000 description 76
- 238000004891 communication Methods 0.000 description 35
- 238000010586 diagram Methods 0.000 description 11
- 230000006870 function Effects 0.000 description 10
- 230000005236 sound signal Effects 0.000 description 9
- 230000008569 process Effects 0.000 description 8
- 241000238558 Eucarida Species 0.000 description 5
- 238000004458 analytical method Methods 0.000 description 4
- 230000006855 networking Effects 0.000 description 4
- 230000008929 regeneration Effects 0.000 description 4
- 238000011069 regeneration method Methods 0.000 description 4
- 230000000694 effects Effects 0.000 description 3
- 238000005516 engineering process Methods 0.000 description 3
- 230000003993 interaction Effects 0.000 description 3
- 239000000203 mixture Substances 0.000 description 3
- 238000010295 mobile communication Methods 0.000 description 3
- 230000001960 triggered effect Effects 0.000 description 3
- 238000003491 array Methods 0.000 description 2
- 238000006243 chemical reaction Methods 0.000 description 2
- 230000007613 environmental effect Effects 0.000 description 2
- 239000011435 rock Substances 0.000 description 2
- 230000009471 action Effects 0.000 description 1
- 230000003321 amplification Effects 0.000 description 1
- 238000013459 approach Methods 0.000 description 1
- 230000009286 beneficial effect Effects 0.000 description 1
- 230000008901 benefit Effects 0.000 description 1
- 230000008859 change Effects 0.000 description 1
- 238000010276 construction Methods 0.000 description 1
- 125000004122 cyclic group Chemical group 0.000 description 1
- 229920005994 diacetyl cellulose Polymers 0.000 description 1
- 235000019800 disodium phosphate Nutrition 0.000 description 1
- 230000002708 enhancing effect Effects 0.000 description 1
- 230000002401 inhibitory effect Effects 0.000 description 1
- 230000010354 integration Effects 0.000 description 1
- 230000004048 modification Effects 0.000 description 1
- 238000012986 modification Methods 0.000 description 1
- 238000003032 molecular docking Methods 0.000 description 1
- 238000003199 nucleic acid amplification method Methods 0.000 description 1
- 230000003287 optical effect Effects 0.000 description 1
- 238000007781 pre-processing Methods 0.000 description 1
- 239000000126 substance Substances 0.000 description 1
- 230000000007 visual effect Effects 0.000 description 1
- 238000013316 zoning Methods 0.000 description 1
Images
Classifications
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
-
- G—PHYSICS
- G06—COMPUTING; CALCULATING OR COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F3/00—Input arrangements for transferring data to be processed into a form capable of being handled by the computer; Output arrangements for transferring data from processing unit to output unit, e.g. interface arrangements
- G06F3/16—Sound input; Sound output
- G06F3/165—Management of the audio stream, e.g. setting of volume, audio stream path
-
- G—PHYSICS
- G06—COMPUTING; CALCULATING OR COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F3/00—Input arrangements for transferring data to be processed into a form capable of being handled by the computer; Output arrangements for transferring data from processing unit to output unit, e.g. interface arrangements
- G06F3/16—Sound input; Sound output
- G06F3/167—Audio in a user interface, e.g. using voice commands for navigating, audio feedback
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/26—Speech to text systems
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N21/00—Selective content distribution, e.g. interactive television or video on demand [VOD]
- H04N21/40—Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
- H04N21/41—Structure of client; Structure of client peripherals
- H04N21/422—Input-only peripherals, i.e. input devices connected to specially adapted client devices, e.g. global positioning system [GPS]
- H04N21/42203—Input-only peripherals, i.e. input devices connected to specially adapted client devices, e.g. global positioning system [GPS] sound input device, e.g. microphone
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
- G10L2015/223—Execution procedure of a spoken command
Landscapes
- Engineering & Computer Science (AREA)
- Multimedia (AREA)
- Theoretical Computer Science (AREA)
- Health & Medical Sciences (AREA)
- Audiology, Speech & Language Pathology (AREA)
- Human Computer Interaction (AREA)
- Physics & Mathematics (AREA)
- General Health & Medical Sciences (AREA)
- General Engineering & Computer Science (AREA)
- General Physics & Mathematics (AREA)
- Acoustics & Sound (AREA)
- Computational Linguistics (AREA)
- Signal Processing (AREA)
- Circuit For Audible Band Transducer (AREA)
- Two-Way Televisions, Distribution Of Moving Picture Or The Like (AREA)
- Reverberation, Karaoke And Other Acoustics (AREA)
- Information Retrieval, Db Structures And Fs Structures Therefor (AREA)
- Signal Processing For Digital Recording And Reproducing (AREA)
- Oscillators With Electromechanical Resonators (AREA)
- Control Of Stepping Motors (AREA)
- Diaphragms For Electromechanical Transducers (AREA)
Abstract
예시적인 기법이 NMD의 방향을 결정하는 것을 수반한다. 예시적인 구현예는 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신하는 재생 장치를 포함한다. 재생 장치에 의해 오디오 컨텐츠가 재생되기 전에, 재생 장치는 오디오 컨텐츠에서 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출한다. 재생 장치는 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하고, 하나 이상의 스피커를 통하여 오디오 컨텐츠를 재생한다. 인에이블 되는 경우, 특정 활성 단어에 대한 소정의 네트워킹된 마이크로폰 장치의 활성 응답은 소정의 네트워킹된 마이크로폰 장치로 하여금 마이크로폰을 통하여 특정 활성 단어에 후속하는 음성 명령을 듣도록 한다.
Description
본 개시는 소비재, 특히, 미디어 재생 또는 그 일부 양상에 관한 방법, 시스템, 제품, 특징, 서비스 및 기타 요소에 관련된다.
2003년 소노스 사(SONOS, Inc.)가 그 최초 특허 출원 중 하나인 "다수의 네트워킹된 장치들 사이의 오디오 재생을 동기화하기 위한 방법(Method for Synchronizing Audio Playback between Multiple Networked Devices)"을 출원하고 2005년 미디어 재생 시스템을 판매 제공하기 시작하기까지 소리를 내는 환경(out-loud setting)에서 디지털 오디오를 액세스하고 듣기 위한 옵션은 제한적이었다. 소노스 무선 하이파이 시스템(Sonos Wireless HiFi System)은 사람들로 하여금 하나 이상의 네트워킹된 재생 장치를 통하여 많은 소스로부터 음악을 경험하는 것을 가능하게 한다. 스마트폰, 태블릿 또는 컴퓨터 상에 설치된 소프트웨어 제어 애플리케이션을 통하여, 네트워킹된 재생 장치를 가지는 임의의 공간에서 원하는 것을 재생할 수 있다. 또한, 컨트롤러를 사용하여, 예컨대 다양한 노래가 재생 장치를 가지는 각각의 공간에서 스트리밍될 수 있거나, 공간이 동기 재생을 위해 함께 그룹화될 수 있거나, 같은 노래가 모든 공간에서 동시에 들릴 수 있다.
계속 성장하는 디지털 미디어에 대한 관심을 고려하여 볼 때, 청취 경험을 더 향상시키기 위해 소비자 접근 가능 기술을 개발할 필요가 계속 있다.
여기에 개시된 기술의 특징, 태양 및 이점은 이하의 설명, 첨부된 청구범위 및 첨부 도면과 관련하여 더 잘 이해될 수 있다.
도 1은 일부 실시예가 실시될 수 있는 예시적인 미디어 재생 시스템 구성을 도시한다.
도 2는 예시적인 재생 장치의 기능적 블록도를 도시한다.
도 3은 예시적인 컨트롤 장치의 기능적 블록도를 도시한다.
도 4는 예시적인 컨트롤러 인터페이스를 도시한다.
도 5는 예시적인 프로세싱 시스템을 도시한다.
도 6은 여기에서 설명되는 양상에 따른 예시적인 복수의 네트워크 장치를 도시한다.
도 7은 여기에서 설명되는 양상에 따른 예시적인 네트워크 마이크로폰 장치의 기능적 블록도를 도시한다.
도 8은 하나 이상의 NMD의 활성 반응을 디세이블(disable)하기 위한 예시적인 흐름도를 도시한다.
도 9는 NMD로 하여금 활성단어를 무시하도록 하는 예시적인 메시지를 도시한다.
도 10(a) 내지 도 10(d)는 NMD로 하여금 활성 단어를 무시하도록 하는 예시적인 명령어를 예시한다.
도 11는 하나 이상의 NMD의 활성 응답을 디세이블하기 위한 예시적인 흐름도를 도시한다.
도 12는 하나 이상의 NMD의 활성 반응을 디세이블하기 위한 예시적인 흐름도를 도시한다.
도 13은 활성 응답을 억제하기 위한 예시적인 흐름도를 도시한다.
도면은 예시적인 실시예를 예시하기 위한 것이나, 도면에 도시된 배열 및 수단에 발명이 제한되지 않음이 이해될 것이다.
도 1은 일부 실시예가 실시될 수 있는 예시적인 미디어 재생 시스템 구성을 도시한다.
도 2는 예시적인 재생 장치의 기능적 블록도를 도시한다.
도 3은 예시적인 컨트롤 장치의 기능적 블록도를 도시한다.
도 4는 예시적인 컨트롤러 인터페이스를 도시한다.
도 5는 예시적인 프로세싱 시스템을 도시한다.
도 6은 여기에서 설명되는 양상에 따른 예시적인 복수의 네트워크 장치를 도시한다.
도 7은 여기에서 설명되는 양상에 따른 예시적인 네트워크 마이크로폰 장치의 기능적 블록도를 도시한다.
도 8은 하나 이상의 NMD의 활성 반응을 디세이블(disable)하기 위한 예시적인 흐름도를 도시한다.
도 9는 NMD로 하여금 활성단어를 무시하도록 하는 예시적인 메시지를 도시한다.
도 10(a) 내지 도 10(d)는 NMD로 하여금 활성 단어를 무시하도록 하는 예시적인 명령어를 예시한다.
도 11는 하나 이상의 NMD의 활성 응답을 디세이블하기 위한 예시적인 흐름도를 도시한다.
도 12는 하나 이상의 NMD의 활성 반응을 디세이블하기 위한 예시적인 흐름도를 도시한다.
도 13은 활성 응답을 억제하기 위한 예시적인 흐름도를 도시한다.
도면은 예시적인 실시예를 예시하기 위한 것이나, 도면에 도시된 배열 및 수단에 발명이 제한되지 않음이 이해될 것이다.
본 출원은 그 전체가 여기에서 참조로서 포함된 2018년 9월 28일에 출원된 미국 특허 출원 제15/670,361호에 대한 우선권을 주장한다.
I. 개요
네트워킹된 마이크로폰 장치(NMD)는 음성 컨트롤을 사용하여 집(household)을 컨트롤하도록 사용될 수 있다. NMD는 마이크로폰을 통해, 음성 입력을 수신할 수 있는, 예를 들어, SONOS® 재생 장치, 서버 또는 시스템이거나 그 일부일 수 있다. 일부 예시에서, 재생 장치는 SONOS®재생 장치이다. 추가적으로, NMD는 마이크로폰을 통해, 음성 입력을 수신할 수 있는 다른 장치, 서버 또는 시스템(예컨대, 다른 예시 중에서도 AMAZON®, ECHO®, APPLE®, IPHONE®)이거나 그 일부일 수 있다. 2017년 2월 21에 출원되고 제목이 "미디어 재생 시스템의 음성 제어(Voice Control of a Media Playback System)"인 미국 출원 제15/438,749호는 그 전체가 참조로서 여기에 포함되며, 음성-인에이블된 집 건축의 예시를 제공한다. 음성 컨트롤은 재생 장치, 무선 조명 장치, 온도 조절기, 도어락, 가정 자동화 및 다른 예시와 같이 "스마트" 홈이 있는 다양한 장치에 대하여 유익할 수 있다.
일부 구현예에서, NMD에 의해 검출된 음성 입력은 프로세싱을 위해 음성 서비스로 송신된다. 재생 장치와 함께 NMD는 음성 서비스에 대한 마이크로폰/스피커 인터페이스로서 동작할 수 있다. 음성 입력은 NMD의 마이크로폰에 의해 검출되고, 이후 프로세싱을 위해 특정한 음성 서비스로 전송된다. 음성 서비스는 이후, 명령 또는 음성 입력의 다른 결과를 반환할 수 있다.
활성 단어의 발화는 음성 서비스를 작동시킬 수 있다. 예를 들어 AMAZON® 음성 서비스를 쿼리함에서, 사용자는 활성 단어 "Alexa"에 후속하여 음성 입력을 말할 수 있다. 다른 예시는 GOOGLE® 음성 서비스를 쿼리하기 위한 "Ok, Google" 및 APPLE® 음성 서비스를 쿼리하기 위한 "Hey, Siri"를 포함한다. 활성 단어와 음성 서비스의 다른 예시가 존재한다. 활성 단어를 검출하면, NMD는 마이크로폰을 통해, 활성 단어에 후속하는 음성 명령을 들음으로써 응답할 수 있다. 이러한 응답은 여기에서 NMD의 "활성 응답"으로 지칭된다.
일부 상황에서, 활성 단어를 포함하는 오디오 컨텐츠의 재생은 NMD의 활성 응답을 잘못 트리거할 수 있다. 많은 음성 서비스에 대한 활성 단어는 기존 언어의 어휘로부터 선택된 기 존재하는 단어이다. 예를 들어, 여러 대중적인 음성 서비스는 소정의 이름(예컨대, "Alexa" 및 "Siri")을 활성 단어로서 사용한다. 따라서, 일부 상황에서, 다른 것들 중에서도 토크쇼, 영화, 텔레비전 쇼, 팟캐스트, 인터넷 스트리밍 비디오와 같은 녹음된 오디오 컨텐츠는 활성 단어 또는 그와 유사한 것을 포함할 수 있다. NMD의 범위에서의 그러한 오디오 컨텐츠의 재생은 NMD를 잘못 트리거할 수 있고, 이는 오디오 컨텐츠의 즐거움을 방해할 수 있다는 점을 포함하는 많은 이유로 바람직하지 않을 수 있다.
예를 들어, 텔레비전은 소정의 음성 서비스에 대한 광고를 재생할 수 있다. 광고 동안, 배우는 예컨대 어떻게 음성 서비스가 작동하는지를 보여주기 위해 음성 서비스에 대한 활성 단어를 말할 수 있다. 텔레비전과 동일한 공간 내 NMD는 텔레비전으로부터의 오디오 출력을 검출할 수 있고, NMD가 광고에서 활성 단어를 검출하는 경우, 음성 서비스를 작동시킬 수 있다. 이는 바람직하지 않을 수 있다. 또한, 광고가 많은 텔레비전 상에서 동시에 재생될 수 있기 때문에, 광고는 같은 시간에 많은 NMD를 트리거할 수 있으며, 이는 음성 서비스로의 요청에서 요구되지 않는 급증을 야기할 수 있다.
그 광고들이 잘못 트리거하는 것을 피하기 위해, 음성 서비스의 오퍼레이터(operator)는 활성 단어를 포함하는 그 광고의 부분을 마크할 수 있고 이러한 마크된 부분을 무시하도록 그들의 NMD를 프로그래밍할 수 있다. 예를 들어, 오퍼레이터는 음성 서비스에 대한 광고에 톤(tone) 또는 다른 오디오 마커를 혼합할 수 있고, 이러한 오디오 마커와 함께 검출되는 활성 단어를 무시하도록 그들의 NMD를 프로그래밍할 수 있다. 이러한 구현은 음성 서비스의 오퍼레이터가 오디오 컨텐츠로 이러한 마커를 임베딩할 수 있는 음성 서비스에 대한 광고와 같이 제한된 경우에서 유용할 수 있다. 그러나, 이러한 구현은 음성 서비스의 오퍼레이터가 컨트롤하지 않는, 대부분의 기타 오디오 컨텐츠에 대해서 유용하지 않다.
여기서 설명된 예시적인 기법은 오디오 컨텐츠가 재생 장치에 의해 들을 수 있게 재생되기 전에, 재생 장치에 의해 재생될 오디오 컨텐츠를 프로세싱하는 것, 오디오 컨텐츠가 하나 이상의 활성 단어를 포함하는지 여부를 결정하는 것 및 재생 장치에 의해 재생되는 경우, 활성 단어를 무시하도록 하나 이상의 NMD에 통지하는 것을 포함할 수 있다. 이러한 방식에서, 기법은 NMD의 잘못된 트리거를 방지하는 데 도움을 줄 수 있다. 특히, 그러한 기법은 재생 장치에 의해 재생될 임의의 녹음된 오디오 컨텐츠에 적용 가능할 수 있다.
예를 들어, 재생 장치는 재생을 위한 오디오 컨텐츠를 수신할 수 있다. 오디오 컨텐츠를 재생하기 전에, 재생 장치는 오디오 컨텐츠를 메모리(예컨대, 버퍼)에 저장하고, 오디오 컨텐츠 상에서 활성 단어 검출 알고리즘을 동작한다. 임의의 활성 단어가 오디오 컨텐츠에서 검출되는 경우, 재생 장치(NMD 자체일 수 있음)는 하나 이상의 NMD로 하여금, 재생 장치가 결국 오디오 컨텐츠를 재생할 때, 이러한 활성 단어를 무시하도록 한다.
다른 예시로서, NMD는 재생 장치에 의한 재생을 위해 지정된 오디오 컨텐츠를 수신할 수 있다. 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, NMD는 오디오 컨텐츠 상의 활성 단어 검출 알고리즘을 실행할 수 있다. 임의의 활성 단어가 오디오 컨텐츠에서 검출되는 경우, NMD는 그 자신(및 아마 부근에 있는 다른 NMD)이 그들이 결국 재생 장치에 의해 재생되는 경우 이러한 활성 단어를 무시하도록 한다.
NMD는 다양한 기법 중 임의의 것을 사용하여 활성 단어를 무시할 수 있다. 일부 예시에서, NMD는 가능하다면 다른 예시 중에서도, 활성 단어를 듣는 것을 멈추도록 NMD에 지시하거나, 기간동안 NMD의 마이크로폰 어레이를 디세이블하거나, 또는 재생 장치의 방향에 청취 무효(listening NULL)를 생성함으로써, 재생 장치에 의해 재생되는 동안 활성 단어를 검출하지 않도록 명령될 수 있다. 대안적으로, NMD는 처음에 활성 단어를 검출하도록 진행될 수 있지만, 예컨대 어떠한 기간 동안 활성 단어를 무시하거나 또는 어떠한 기간 동안 모든 녹음된 오디오를 무시함으로써 활성 단어를 검출하는 것에 응답하여 음성 서비스를 작동하기 위한 그 프로그래밍된 활성 응답을 억제하도록 지시될 수 있다.
재생 장치가 오디오 컨텐츠를 들리도록 재생하기 전에 오디오 컨텐츠를 프로세싱하는 경우, (재생 장치 또는 NMD와 같은) 프로세싱 장치는 녹음된 오디오 컨텐츠의 어떤 섹션이 활성 단어를 포함하는지를 결정할 수 있다. 이러한 섹션은 활성 단어에 대한 시작과 중단 시각(예컨대, 33:52.543에서 시작하고 33:54.013에서 종료하는 팟캐스트에서의 활성 단어)과 같은 오디오 컨텐츠 내의 기간에 의해 정의될 수 있다. 오디오 컨텐츠가 재생되는 경우, 부근에 있는 NMD는 이러한 기간동안 활성 단어를 무시하도록 지시될 수 있다.
다른 예시로서, 프로세싱 장치는 오디오 컨텐츠(또는 오디오 컨텐츠의 부분)에서 활성 단어의 수를 카운트할 수 있다. 예를 들어, 광고의 오디오 컨텐츠를 프로세싱을 하는 재생 장치는 그 광고에서 활성 단어의 네 개의 인스턴스를 검출할 수 있다. 이후, 재생 장치는 재생 장치의 부근에 있는 NMD에, 카운트와 동일한 수의 활성 단어를 검출할 때까지 활성 단어를 무시하도록(예컨대, 다음 네가지 활성 단어를 무시하도록) 지시할 수 있다.
다른 예시에서, 프로세싱 장치는 녹음된 오디오 컨텐츠에 오디오 톤 또는 다른 마커를 동적으로 삽입하여 오디오 컨텐츠에서 검출된 활성 단어를 지정할 수 있다. 이후, 오디오 컨텐츠가 재생 장치에 의해 재생되는 경우, 활성 단어와 함께 오디오 마커를 검출하는 NMD는 활성 단어의 그 인스턴스를 무시하도록 지시받을 수 있다. 재생 장치의 가청 범위에 있는 복수의 NMD는 활성 단어를 각각 검출할 수 있고 연관된 오디오 마커를 검출하는 것에 응답하여 활성 단어를 무시할 수 있다.
예시적인 기법은 하나 이상의 NMD의 활성 응답을 디세이블하는 것을 수반할 수 있다. 제1 구현예는 네트워크 인터페이스를 통하여, 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신하는 것과 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 것을 포함할 수 있다. 제1 구현예는 또한 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블 하는 것을 포함할 수 있고, 인에이블되는 경우, 특정 활성 단어에 대한 소정의 네트워킹된 마이크로폰 장치의 활성 응답은 소정의 네트워킹된 마이크로폰 장치로 하여금 마이크로폰을 통해, 특정 활성 단어에 후속하는 음성 명령을 듣도록 한다. 제1 구현예는 하나 이상의 스피커를 통하여 오디오 컨텐츠를 재생하는 것을 더 포함할 수 있다.
제2 구현예는 네트워크 인터페이스를 통하여, 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신하는 것을 포함할 수 있다. 제2 구현예는 또한 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서, 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 것을 포함할 수 있다. 제2 구현예는 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 검출된 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하는 것과 재생 장치가 오디오 컨텐츠를 재생하는 한편, 마이크로폰을 통하여 재생되는 오디오 컨텐츠를 검출하는 것을 더 포함할 수 있다.
제3 구현예는 컴퓨팅 시스템의 인터페이스를 통하여, 하나 이상의 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 수신하는 것을 포함할 수 있다. 제3 구현예는 또한 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서, 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 것을 포함할 수 있다. 제3 구현예는 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 것을 더 포함할 수 있다.
제4 구현예는 네트워크 인터페이스를 통하여, 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하기 위한 명령어를 수신하는 것을 포함할 수 있다. 제4 구현예는 또한 마이크로폰을 통해, 하나 이상의 재생 장치에 의해 재생되는 오디오 컨텐츠를 검출하는 것을 포함할 수 있다. 제4 구현예는 검출된 오디오 컨텐츠가 하나 이상의 활성 단어를 포함한다고 결정하는 것과 수신된 명령어에 응답하여, 검출된 오디오 컨텐츠에서 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하는 것을 더 포함할 수 있다.
이러한 예시적인 구현예 각각은 다른 예시 중에서도, 방법, 구현예를 수행하도록 구성되는 장치, 구현예를 수행하도록 구성되는 장치의 시스템 또는 구현예를 수행하도록 하나 이상의 프로세서에 의해 실행 가능한 명령어를 포함하는 유형의 비일시적인 컴퓨터 판독 가능 기록매체로서 실시될 수 있다. 본 개시는 여기에 설명되는 예시적인 특징의 조합을 포함하는 많은 다른 실시예를 포함한다는 것이 당업자에 의해 이해될 것이다. 또한, 기법을 예시하기 위한 소정의 장치에 의해 수행되는 것으로 설명되는 임의의 예시적인 동작은 여기에 설명된 장치를 포함하는 임의의 적절한 장치에 의해 수행될 수 있다. 또한, 임의의 장치는 다른 장치로 하여금 여기에 설명된 임의의 동작을 수행하도록 할 수 있다.
여기에서 설명되는 일부 예시가 "사용자" 및/또는 다른 엔티티(entity)와 같은 소정의 행위자에 의해 수행되는 기능을 참조할 수 있으나, 이러한 설명은 단지 설명을 위한 것임이 이해되어야 한다. 청구범위는 청구범위 자체의 언어에 의하여 명시적으로 요구되지 않는다면 임의의 그러한 예시적인 행위자에 의한 행위를 요구하는 것으로 해석되어서는 안된다.
II. 예시적인 동작 환경
도 1은 여기에서 개시되는 하나 이상의 실시예가 실시되거나 구현될 미디어 재생 시스템(100)의 예시적인 조합을 예시한다. 도시된 바와 같이, 미디어 재생 시스템(100)은 예를 들어, 주 침실, 사무실, 식당 및 거실과 같은 여러 공간과 장소를 가지는 예시적인 가정 환경과 연관되어 있다. 도 1의 예시에서 도시된 바와 같이, 미디어 재생 시스템(100)은 재생 장치(102, 104, 108, 110, 112, 114, 116, 118, 120, 122 및 124), 컨트롤 장치(126 및 128) 및 유선 또는 무선 네트워크 라우터(130)를 포함한다. 또한 도 1에 있는 것은 NMD(132 및 134)이다.
예시적인 미디어 재생 시스템(100)의 다양한 컴포넌트와 관련 있는 추가 논의 및 다양한 컴포넌트가 어떻게 미디어 경험을 사용자에게 제공하도록 상호작용할 수 있는지는 다음의 섹션에서 발견될 수 있다. 여기에서 논의가 일반적으로 예시적인 미디어 재생 시스템(100)을 나타내는 한편, 여기서 설명되는 기술은 그 중에서도 도 1에 도시된 바와 같이 집 환경 내에서의 응용에 제한되는 것이 아니다. 예를 들어, 여기서 설명된 기술은 예를 들어, 레스토랑, 몰 또는 공항과 같은 상업적 환경, 스포츠형 다목적 차량(SUV), 버스 또는 자동차, 선박 또는 배, 비행기 등과 같은 운송 수단과 같은 멀티-구역 오디오가 요구될 수 있는 환경에서 유용할 수 있다.
a. 예시적인 재생 장치
도 2는 도 1의 미디어 재생 시스템(100)의 재생 장치(102-124) 중 하나 이상으로 구성될 수 있는 예시적인 재생 장치(200)의 기능적 블록도를 도시한다. 재생 장치(200)는 프로세서(202), 소프트웨어 컴포넌트(204), 메모리(206), 오디오 프로세싱 컴포넌트(208), 오디오 증폭기(210), 스피커(212) 및 무선 인터페이스(216)와 유선 인터페이스(218)을 포함하는 네트워크 인터페이스(214)를 포함할 수 잇다. 일 예시에서, 재생 장치(200)는 스피커(212)를 포함하지 않을 수 있지만, 외부 스피커로 재생 장치(200)를 연결하기 위한 스피커 인터페이스를 포함할 수 있다. 다른 경우에서, 재생 장치(200)는 스피커(212)와 오디오 증폭기(210) 모두를 포함하지 않을 수 있지만, 외부 오디오 증폭기 또는 오디오 영상 수신기로 재생 장치를 연결하기 위한 오디오 인터페이스를 포함할 수 있다.
일 예시에서, 프로세서(202)는 메모리(206)에 저장된 명령어에 따라 입력 데이터를 프로세싱하도록 구성되는 클락 구동(clock-driven) 컴퓨팅 컴포넌트일 수 있다. 메모리(206)는 프로세서(202)에 의해 실행 가능한 명령어를 저장하도록 구성되는 유형의 컴퓨터 판독 가능 기록매체일 수 있다. 예를 들어, 메모리(206)는 일부 기능을 달성하기 위해 프로세서(202)에 의해 실행 가능한 소프트웨어 컴포넌트(204) 중 하나 이상으로 로딩될 수 있는 데이터 저장소일 수 있다. 일 예시에서, 기능은 재생 장치(200)가 다른 재생 장치 또는 오디오 소스로부터 오디오 데이터를 검색하는 것을 수반할 수 있다. 다른 예시에서, 기능은 재생 장치(200)가 오디오 데이터를 다른 장치 또는 네트워크 상의 재생 장치로 송신하는 것을 수반할 수 있다. 또 다른 예시에서, 기능은 재생 장치(200)가 하나 이상의 재생 장치와 페어링하여 멀티 채널 오디오 환경을 생성하는 것을 수반할 수 있다.
일부 기능은 재생 장치(200)가 오디오 컨텐츠의 재생을 하나 이상의 다른 재생 장치와 동기화하는 것을 포함할 수 있다. 동기화 재생하는 동안, 청취자는 바람직하게는, 재생 장치(200)과 하나 이상의 다른 재생 장치에 의한 오디오 컨텐츠의 재생 간의 시간 지연 차이를 감지할 수 없을 것이다. 제목이 "복수의 독립적으로 클락(clock)되는 디지털 데이터 처리 장치 사이에서 동작을 동기화하기 위한 시스템 및 방법(System and method for synchronizing operations among a plurality of independently clocked digital data processing devices)"인 미국 특허 제8,234,395호는 전체 내용이 여기에 참조로서 포함되며 재생 장치 중에서 오디오 재생 동기화에 대한 더 상세한 일부 예시를 제공한다.
메모리(206)는 재생 장치(200)가 그 일부인 하나 이상의 구역 및/또는 구역 그룹, 재생 장치(200)에 의해 접근 가능한 오디오 소스 또는 재생 장치(또는 다른 재생 장치)가 연관될 수 있는 재생 큐와 같은 재생 장치(200)와 연관된 데이터를 저장하도록 더 구성될 수 있다.데이터는 재생 장치(200)의 상태를 설명하도록 정기적으로 업데이트되고 사용되는 하나 이상의 상태 변수로서 저장될 수 있다. 메모리(206)는 또한 미디어 시스템의 다른 장치의 상태와 연관되고 장치 중 하나 이상이 시스템과 연관된 최신 데이터를 가지도록 장치 중에서 가끔 공유되는 데이터를 포함할 수 있다. 다른 실시예 또한 가능하다.
오디오 프로세싱 컴포넌트(208)는 하나 이상의 디지털-아날로그 변환기("DAC"), 오디오 전프로세싱 컴포넌트, 오디오 향상 컴포넌트, 디지털 신호 프로세서("DSP") 등을 포함할 수 있다. 일 실시예에서, 오디오 프로세싱 컴포넌트(208) 중 하나 이상은 프로세서(202)의 서브 컴포넌트일 수 있다. 일 예시에서, 오디오 컨텐츠는 오디오 프로세싱 컴포넌트(208)에 의해 프로세싱되고/거나 의도적으로 수정되어, 오디오 신호를 생산할 수 있다. 생산된 오디오 신호는 이후 스피커(212)를 통하여 증폭 및 재생을 위해 오디오 증폭기(210)로 제공될 수 있다. 특히, 오디오 증폭기(210)는 오디오 신호를, 스피커(212) 중 하나 이상을 구동하기 위한 레벨로 증폭하도록 구성된 장치를 포함할 수 있다. 스피커(212)는 개별의 변환기(transducer)(예컨대, "드라이버") 또는 하나 이상의 드라이버가 있는 엔클로저를 수반하는 완전한 스피커 시스템을 포함할 수 있다. 스피커(212)의 특정 드라이버는 예를 들면, (예컨대, 저주파수를 위한) 서브 우퍼, (예컨대, 중간 주파수를 위한) 중간 범위의 드라이버 및/또는 (예컨대, 고주파를 위한) 트위터를 포함할 수 있다. 일부 경우에서, 하나 이상의 스피커(212)에 있는 각 변환기는 오디오 증폭기(210)의 개별 대응 오디오 증폭기에 의해 구동될 수 있다. 재생 장치(200)에 의한 재생을 위한 아날로그 신호를 생성하는 것에 더하여, 오디오 프로세싱 컴포넌트(208)는 재생을 위해 하나 이상의 다른 재생 장치로 전송될 오디오 컨텐츠를 프로세싱하도록 구성될 수 있다.
재생 장치(200)에 의해 프로세싱되고/거나 재생될 오디오 컨텐츠는 오디오 라인 인(line in) 입력 연결(예컨대, 자동 검출 3.5mm 오디오 라인 인 연결) 또는 네트워크 인터페이스(214)를 통하는 것과 같이, 외부 소스로부터 수신될 수 있다.
네트워크 인터페이스(214)는 재생 장치(200)와 데이터 네트워크 상의 하나 이상의 다른 장치 간의 데이터 흐름을 용이하게 하도록 구성될 수 있다. 이와 같이, 재생 장치(200)는 재생 장치(200), 근거리 네트워크 내의 네트워크 장치 또는 인터넷과 같은 광역 네트워크 상에서 오디오 컨텐츠 소스와 통신하는 하나 이상의 다른 재생 장치로부터 데이터 네트워크에서 오디오 컨텐츠를 수신하도록 구성될 수 있다. 일 예시에서, 재생 장치(200)에 의해 전송되고 수신되는 오디오 컨텐츠 및 다른 신호는 인터넷 프로토콜(Internet Protocol)(IP) 기반 소스 주소 및 IP 기반 목적지 주소를 포함하는 디지털 패킷 데이터(digital packet data)의 형태로 전송될 수 있다. 그러한 경우, 네트워크 인터페이스(214)는 재생 장치(200)로 향하는 데이터가 재생 장치(200)에 의해 적절히 수신되고 프로세싱되도록 디지털 패킷 데이터를 파싱(parsing)하도록 구성될 수 있다.
도시된 바와 같이, 네트워크 인터페이스(214)는 무선 인터페이스(216) 및 유선 인터페이스(218)를 포함할 수 있다. 무선 인터페이스(216)는 재생 장치(200)가 통신 프로토콜(예컨대, IEEE 802.11a, 802.11b, 802.11g, 802.11n, 802.11ac, 802.15, 4G 모바일 통신 표준 등을 포함하는 임의의 무선 표준)에 따라 다른 장치(예컨대, 다른 재생 장치, 스피커, 수신기, 네트워크 장치, 재생 장치(200)가 연관된 데이터 네트워크 내의 컨트롤러 장치)와 무선으로 통신하도록 네트워크 인터페이스 기능을 제공할 수 있다. 유선 인터페이스(218)는 재생 장치(200)가 통신 프로토콜(예컨대, IEEE 802.3)에 따라 다른 장치와 유선 연결 통신하도록 네트워크 인터페이스 기능을 제공할 수 있다. 도 2에 도시되는 네트워크 인터페이스(214)가 무선 인터페이스(216) 및 유선 인터페이스(218) 둘 다를 포함하는 한편, 네트워크 인터페이스(214)는 일부 실시예에서 무선 인터페이스만을 또는 유선 인터페이스만을 포함할 수 있다.
일 예시에서, 재생 장치(200) 및 하나의 다른 재생 장치는 오디오 컨텐츠의 두 개의 독립된 오디오 컴포넌트를 재생하도록 페어링될 수 있다. 예를 들어, 재생 장치(200)가 왼쪽 채널 오디오 컴포넌트를 재생하도록 구성될 수 있는 한편, 다른 재생 장치는 오른쪽 채널 오디오 컴포넌트를 재생하도록 구성될 수 있고, 이로써 오디오 컨텐츠의 스테레오 효과를 생산 또는 향상할 수 있다. 페어링된 재생 장치(또한 "결합된 장치"로서 지칭됨)는 다른 재생 장치와 서로 동기로 오디오 컨텐츠를 더 재생할 수 있다.
다른 예시에서, 재생 장치(200)는 하나 이상의 다른 재생 장치와 음향적으로 통합되어 단일의, 통합된 재생 장치를 형성할 수 있다. 통합된 재생 장치가 오디오 컨텐츠가 렌더링 될 수 있는 추가적인 스피커 드라이버를 가질 수 있기 때문에, 통합된 재생 장치는 통합되지 않은 재생 장치 또는 페어링된 재생 장치와 상이하게 사운드를 프로세싱 및 재생산하도록 구성될 수 있다. 예를 들어, 재생 장치(200)가 저주파수 범위의 오디오 컨텐츠를 렌더링하도록 설계된 재생 장치(즉, 서브 우퍼)인 경우, 재생 장치(200)는 모든 주파수 범위의 오디오 컨텐츠를 렌더링하도록 설계된 재생 장치와 통합될 수 있다. 이러한 경우에서, 모든 주파수 범위의 재생 장치가, 저주파수 재생 장치(200)와 통합된 경우, 오직 오디오 컨텐츠의 중간 내지 고주파수 컴포넌트를 렌더링하도록 구성되는 한편, 저주파수 범위의 재생 장치(200)는 오디오 컨텐츠의 저주파수 컴포넌트를 렌더링할 수 있다. 통합된 재생 장치는 단일 재생 장치 또는 또 다른 통합된 재생 장치와 더 페어링될 수 있다.
예를 들어, 소노스 사(SONONS, Inc.)는 일부 재생 장치를 현재 판매하며 (또는 판매해왔고), 이는 "PLAY:1", "PLAY:3", "PLAY:5", "PLAYBAR", "CONNECT:AMP", "CONNECT" 및 "SUB"를 포함한다. 임의의 다른 과거, 현재 및/또는 미래의 재생 장치가 추가적으로 또는 대안적으로 여기에 개시되는 예시적인 실시예의 재생 장치를 구현하도록 사용될 수 있다. 또한, 재생 장치가 도 2에서 예시되는 예시 또는 소노스 제품 제안에 제한되지 않음이 이해된다. 예를 들어, 재생 장치는 유선 또는 무선 헤드폰을 포함할 수 있다. 다른 예시에서, 재생 장치는 개인 모바일 미디어 재생 장치를 위한 도킹 스테이션(docking station)을 포함하거나 이와 상호작용할 수 있다. 또 다른 예시에서, 재생 장치는 텔레비전, 조명 기구, 또는 내부 또는 외부 용도를 위한 일부 다른 장치와 같은 다른 장치 또는 컴포넌트에 통합될 수 있다.
b. 예시적인 재생 구역 구성
도 1의 미디어 재생 시스템(100)을 다시 참조하면, 환경은 각각 하나 이상의 재생 장치가 있는 하나 이상의 재생 구역을 가질 수 있다. 미디어 재생 시스템(100)은 하나 이상의 재생 구역으로 규정될 수 있고, 이후 하나 이상의 구역이 추가되거나 제거되어 도 1에서 도시된 예시적인 배치에 도달할 수 있다. 각각의 구역은 사무실, 화장실, 주침실, 침실, 주방, 식당, 거실 및/또는 발코니와 같은 상이한 공간과 장소에 따라 이름이 주어질 수 있다. 일 예시에서, 단일 재생 구역은 복수의 공간 또는 장소를 포함할 수 있다. 다른 경우에서, 단일 공간 또는 장소는 복수의 재생 구역을 포함할 수 있다.
도 1에 도시된 바와 같이, 발코니, 식당, 주방, 화장실, 사무실 및 침실 구역은 각각 하나의 재생 장치를 가지는 한편, 거실 및 주침실 구역은 복수의 재생 장치를 가진다. 거실 구역에서, 재생 장치(104, 106, 108 및 110)는 개별의 재생 장치로서, 하나 이상의 결합된 재생 장치로서, 하나 이상의 통합된 재생 장치로서 또는 이들의 임의의 조합으로서 동기로 오디오 컨텐츠를 재생하도록 구성될 수 있다. 유사하게, 주침실의 경우에서, 재생 장치(122 및 124)는 개별 재생 장치로서, 결합된 재생 장치로서 또는 통합된 재생 장치로서 동기로 오디오 컨텐츠를 재생하도록 구성될 수 있다.
일 예시에서, 도 1의 환경에서 하나 이상의 재생 구역은 각각 상이한 오디오 컨텐츠를 재생할 수 있다. 예를 들어, 사용자는 발코니 구역에서 그릴에 굽고 재생 장치(102)에 의해 재생되는 힙합 음악을 들을 수 있는 한편, 다른 사용자는 주방 구역에서 음식을 준비하고 재생 장치(114)에 의해 재생되는 클래식 음악을 들을 수 있다. 다른 예시에서, 재생 구역은 다른 재생 구역과 동기화로 동일한 오디오 컨텐츠를 재생할 수 있다. 예를 들어, 사용자는 재생 장치(118)가 발코니 구역에 있는 재생 장치(102)에 의해 재생하고 있는 동일한 락 음악을 재생하고 있는 사무실 구역에 있을 수 있다. 그러한 경우에, 재생 장치(102 및 118)는 사용자가 다른 재생 구역 사이를 이동하면서 소리 내어 재생되고 있는 오디오 컨텐츠를 끊김 없이 (또는 적어도 실질적으로 끊김 없이) 즐길 수 있도록 동기화로 락 음악을 재생할 수 있다. 재생 구역 사이의 동기화는 이전에 참조된 미국 특허 제 8,234,395호에서 설명되는 바와 같이, 재생 장치 중의 동기화와 비슷한 방식으로 달성될 수 있다.
위에서 제안되는 바와 같이, 미디어 재생 시스템(100)의 구역 구성은 동적으로 수정될 수 있고, 일부 실시예에서, 미디어 재생 시스템(100)은 다수의 구성을 지원한다. 예를 들어, 사용자가 하나 이상의 재생 장치를 구역으로부터 또는 구역으로 물리적으로 이동하는 경우, 미디어 재생 시스템(100)은 변화를 수용하도록 재구성될 수 있다. 예를 들어, 사용자가 재생 장치(102)를 발코니 구역으로부터 사무실 구역으로 물리적으로 이동하는 경우, 사무실 구역은 재생 장치(118 및 102) 둘 다를 포함할 수 있다. 재생 장치(102)는 컨트롤 장치(126 및 128)과 같은 컨트롤 장치를 통하여 원하는 경우, 재명칭되고/거나 사무실 구역과 페어링되거나 그룹화할 수 있다. 한편, 하나 이상의 재생 장치가 이미 재생 구역이 아닌 집 환경에서 특정 구역으로 이동되는 경우, 특정 구역에 대한 새로운 재생 구역이 생성될 수 있다.
또한, 미디어 재생 시스템(100)의 상이한 재생 구역은 동적으로 구역 그룹으로 조합되거나 개별 재생 구역으로 나뉘어질 수 있다. 예를 들어, 식당 구역과 주방 구역(114)은 저녁 파티를 위해 구역 그룹으로 조합되어 재생 장치(112 및 114)가 동기로 오디오 컨텐츠를 렌더링할 수 있다. 한편, 사용자가 거실 장소에서 음악을 듣기를 원하는 한편, 다른 사용자가 텔레비전을 보기를 원하는 경우, 거실 구역은 재생 장치(104)를 포함하는 텔레비전 구역과 재생 장치(106, 108 및 110)를 포함하는 청취 구역으로 나뉘어질 수 있다.
c. 예시적인 컨트롤 장치
도 3은 미디어 재생 시스템(100)의 컨트롤 장치(126 및 128) 중 하나 또는 둘 다로 구성될 수 있는 예시적인 컨트롤 장치의 기능적 블록도를 도시한다. 컨트롤 장치(300)는 또한 컨트롤러(300)으로서 지칭될 수 있다. 도시된 바와 같이, 컨트롤 장치(300)는 프로세서(302), 메모리(304), 네트워크 인터페이스(306) 및 사용자 인터페이스(308)를 포함할 수 있다. 일 예시에서, 컨트롤 장치(300)는 미디어 재생 시스템을 위한 전용 컨트롤러일 수 있다. 다른 예시에서, 컨트롤 장치(300)는 예컨대 아이폰(iPhone)™, 아이패드(iPad)™ 또는 임의의 다른 스마트폰, 타블렛 또는 네트워크 장치(예컨대, PC 또는 맥(Mac)™과 같은 네트워킹된 컴퓨터)와 같은, 미디어 재생 시스템 컨트롤러 어플리케이션 소프트웨어가 설치될 수 있는 네트워크 장치일 수 있다.
프로세서(302)는 사용자 접근, 컨트롤 및 미디어 재생 시스템의 구성을 용이하게 하는 것과 관련 있는 기능을 수행하도록 구성될 수 있다. 메모리(304)는 그러한 기능을 수행하도록 프로세서(302)에 의해 실행 가능한 명령어를 저장하도록 구성될 수 있다. 메모리(304)는 또한 미디어 재생 시스템 컨트롤러 어플리케이션 소프트웨어 및 사용자 및 미디어 재생 시스템(100)과 연관된 다른 데이터를 저장하도록 구성될 수 있다.
일 예시에서, 네트워크 인터페이스(306)는 산업 표준(예컨대, 적외선, 라디오, IEEE 802.3을 포함하는 유선 표준, IEEE 802.11a, 802.11b, 802.11g, 802.11n, 802.11ac, 802.15, 4G 모바일 통신 표준을 포함하는 무선 표준 등)에 기초할 수 있다. 네트워크 인터페이스(306)는 미디어 재생 시스템(100)에서 다른 장치와 통신하도록 컨트롤 장치(300)에 대한 수단을 제공할 수 있다. 일 예시에서, (예컨대, 상태 변수와 같은) 데이터 및 정보는 네트워크 인터페이스(306)를 통하여 컨트롤 장치(300)와 다른 장치 사이에서 통신될 수 있다. 예를 들어, 미디어 재생 시스템(100)에서 재생 구역 및 구역 그룹 구성은 컨트롤 장치(300)에 의해, 재생 장치 또는 다른 네트워크 장치로부터 수신될 수 있거나, 컨트롤 장치(300)에 의해, 네트워크 인터페이스(306)를 통하여 다른 재생 장치 또는 네트워크 장치로 전송될 수 있다. 일부 경우에서, 다른 네트워크 장치는 다른 컨트롤 장치일 수 있다.
음량 컨트롤 및 오디오 재생 컨트롤과 같은 재생 장치 컨트롤 명령은 또한 네트워크 인터페이스(306)를 통하여 컨트롤 장치(300)로부터 재생 장치로 통신할 수 있다. 위에서 제안된 바와 같이, 미디어 재생 시스템(100)의 구성으로의 변화는 또한 컨트롤러 장치(300)를 사용하여 사용자에 의해 수행될 수 있다. 구성 수정은 다른 것들 중에서도 구역으로/으로부터 하나 이상의 재생 장치를 추가/제거하는 것, 구역 그룹으로/으로부터 하나 이상의 구역을 추가/제거하는 것, 결합 또는 통합된 재생 장치를 형성, 결합 또는 통합된 재생 장치로부터 하나 이상의 재생 장치를 분리하는 것을 포함할 수 있다. 따라서, 컨트롤 장치(300)는, 컨트롤 장치(300)가 전용 컨트롤러이건 미디어 재생 시스템 컨트롤러 어플리케이션 소프트웨어가 설치된 네트워크 장치이건, 종종 컨트롤러로서 지칭될 수 있다.
컨트롤 장치(300)의 사용자 인터페이스(308)는 도 4에 도시된 컨트롤러 인터페이스(400)과 같은 컨트롤러 인터페이스를 제공함으로써 사용자 접근 및 미디어 재생 시스템(100)의 컨트롤을 용이하게 하도록 구성될 수 있다. 컨트롤러 인터페이스(400)는 재생 컨트롤 영역(410), 재생 구역 영역(420), 재생 상태 영역(430), 재생 큐 영역(440) 및 오디오 컨텐츠 소스 영역(450)을 포함한다. 도시된 바와 같은 사용자 인터페이스(400)는 단지 도 3의 컨트롤 장치(300)(및/또는 도 1의 컨트롤 장치(126 및 128))와 같은 네트워크 장치 상에서 제공되고 미디어 재생 시스템(100)과 같은, 미디어 재생 시스템을 제어하도록 사용자에 의해 접근될 수 있는 사용자 인터페이스의 일 예시이다. 포맷, 스타일 및 상호작용 순서를 변동하는 다른 사용자 인터페이스가 하나 이상의 네트워크 장치 상에서 대안적으로 구현되어 미디어 재생 시스템으로 비슷한 제어 접근을 제공할 수 있다.
재생 컨트롤 영역(410)은 선택된 재생 구역 또는 구역 그룹 내 재생 장치가 재생 또는 일시 정지, 빨리 감기, 뒤로 감기, 다음으로 스킵, 이전으로 스킵, 셔플(shuffle) 모드 시작/종료, 크로스 페이드 모드(cross fade mode) 시작/종료를 하도록 하는 (예컨대, 터치의 방식으로 또는 커서를 이용함으로써) 선택 가능한 아이콘을 포함할 수 있다. 재생 컨트롤 영역(410)은 또한 다른 가능성 중에서도, 이퀄라이제이션 설정(equalization setting) 및 재생 음량을 수정하도록 선택 가능한 아이콘을 포함할 수 있다.
재생 구역 영역(420)은 미디어 재생 시스템(100) 내에 있는 재생 구역의 표현(representation)을 포함할 수 있다. 일부 실시예에서, 재생 구역의 그래픽적 표현은, 다른 가능성 중에서도, 결합된 구역의 생성, 구역 그룹의 생성, 구역 그룹의 분리 및 구역 그룹의 재명칭과 같은 미디어 재생 시스템(100)에서의 재생 구역을 관리하거나 구성하기 위한 추가의 선택 가능한 아이콘을 띄우도록 선택 가능할 수 있다.
예를 들면, 도시된 바와 같이, "그룹" 아이콘이 재생 구역의 그래픽적 표현 각각 내에서 제공될 수 있다. 특정 구역의 그래픽적 표현 내에서 제공되는 "그룹" 아이콘은 특정 구역과 그룹화될 미디어 재생 시스템(100) 내 하나 이상의 다른 구역을 선택하기 위한 옵션을 띄우도록 선택 가능할 수 있다. 그룹화 되면, 특정 구역과 그룹화된 구역 내 재생 장치는 특정 구역 내 재생 장치와 동기화로 오디오 컨텐츠를 재생하도록 구성될 것이다. 비슷하게, "그룹" 아이콘이 구역 그룹의 그래픽적 표현 내에서 제공될 수 있다. 이러한 경우에, "그룹" 아이콘은 구역 그룹으로부터 제거될 구역 그룹 내 하나 이상의 구역을 선택 해제하기 위한 옵션을 띄우도록 선택 가능할 수 있다. 사용자 인터페이스(400)와 같은, 사용자 인터페이스를 통하여 구역을 그룹화 및 그룹화 해제하기 위한 다른 상호 작용 및 구현도 가능하다. 재생 구역 영역(420)에서 재생 구역의 표현은 재생 구역 또는 구역 그룹 구성이 수정됨에 따라 동적으로 갱신될 수 있다.
재생 상태 영역(430)은 선택된 재생 구역 또는 구역 그룹에서 현재 재생되거나, 이전에 재생되었거나 다음에 재생하도록 스케줄링되는 오디오 컨텐츠의 그래픽적 표현을 포함할 수 있다. 선택된 재생 구역 또는 구역 그룹은 재생 구역 영역(420) 및/또는 재생 상태 영역(430) 내에서와 같이 사용자 인터페이스 상에서 시각적으로 구분될 수 있다. 그래픽적 표현은 트랙 타이틀(track title), 아티스트 이름, 앨범 이름, 앨범 년도, 트랙 길이 및/또는 사용자 인터페이스(400)를 통하여 미디어 재생 시스템(100)을 제어하는 경우, 사용자가 알기에 유용할 수 있는 다른 관련 정보를 포함할 수 있다.
재생 큐 영역(440)은 선택된 재생 구역 또는 구역 그룹과 연관된 재생 큐 내의 오디오 컨텐츠의 그래픽적 표현을 포함할 수 있다. 일부 실시예에서, 각각의 재생 구역 또는 구역 그룹은 재생 구역 또는 구역 그룹에 의한 재생을 위한 0 개 이상의 오디오 항목에 대응하는 정보를 포함하는 재생 큐와 연관될 수 있다. 예를 들어, 재생 큐에 있는 각각의 오디오 항목은 가능한, 재생 장치에 의한 재생을 위한 로컬 오디오 컨텐츠 소스 또는 네트워킹된 오디오 컨텐츠 소스로부터 오디오 항목을 탐색 및/또는 검색하도록 재생 구역 또는 구역 그룹에서 재생 장치에 의해 사용될 수 있는 URI(uniform resource identifier), URL(uniform resource locator), 또는 일부 다른 식별자를 포함할 수 있다.
일 예시에서, 플레이리스트는 재생 큐에 추가될 수 있으며, 이러한 경우에 플레이리스트 내 각 오디오 항목에 대응하는 정보는 재생 큐에 추가될 수 있다. 다른 예시에서, 재생 큐에 있는 오디오 항목은 플레이리스트로서 저장될 수 있다. 추가적인 예시에서, 재생 구역 또는 구역 그룹이 재생 기간을 가지는 개별 오디오 항목 보다는 달리 멈출 때까지 지속적으로 재생할 수 있는 인터넷 라디오와 같은, 계속해서 스트리밍 오디오 컨텐츠를 재생하는 경우, 재생 큐는 비어 있거나 차 있더라도, "사용되지 않음"일 수 있다. 대안적인 실시예에서, 재생 큐는 재생 구역 또는 구역 그룹이 그러한 아이템을 재생하고 있는 경우, 인터넷 라디오 및/또는 다른 스트리밍 오디오 컨텐츠 항목을 포함할 수 있고, "사용 중"일 수 있다. 다른 예시도 또한 가능하다.
재생 구역 또는 구역 그룹이 "그룹화" 또는 "그룹화 해제"되는 경우, 영향을 받는 재생 구역 또는 구역 그룹과 연관되는 재생 큐는 정리되거나 재연관될 수 있다. 예를 들어, 제1 재생 큐를 포함하는 제1 재생 구역이 제2 재생 큐를 포함하는 제2 재생 구역과 그룹화되면, 규정된 구역 그룹은 처음에는 비어 있고, (제2 재생 구역이 제1 재생 구역으로 추가된 경우와 같이) 제1 재생 큐로부터의 오디오 항목을 포함하고, (제1 재생 구역이 제1 재생 구역으로 추가되는 경우와 같이) 제2 재생 큐로부터의 오디오 항목 또는 제1 및 제2 재생 큐 둘 다로부터의 오디오 항목의 조합을 포함하는 연관된 재생 큐를 가질 수 있다. 차후에, 규정된 구역 그룹이 그룹화 해제되는 경우, 결과적인 제1 재생 구역은 이전의 제1 재생 큐와 재연관될 수 있거나, 비어 있거나 규정된 구역 그룹이 그룹화 해제되기 이전에 규정된 구역 그룹과 연관된 재생 큐로부터 오디오 항목을 포함하는 새로운 재생 큐와 연관될 수 있다. 유사하게, 결과적인 제2 재생 구역은 이전의 제2 재생 큐와 재연관될 수 있거나, 비어 있거나 규정된 구역 그룹이 그룹화 해제되기 이전에 규정된 구역 그룹과 연관된 재생 큐로부터 오디오 항목을 포함하는 새로운 재생 큐와 연관될 수 있다. 다른 예시도 가능하다.
도 4의 사용자 인터페이스(400)를 다시 참조하면, 재생 큐 영역(440) 내 오디오 컨텐츠의 그래픽적 표현은 트랙 타이틀, 아티스트 이름, 트랙 길이 및 재생 큐에서 오디오 컨텐츠와 연관되는 다른 관련 정보를 포함할 수 있다. 일 예시에서, 오디오 컨텐츠의 그래픽적 표현은 재생 큐 및/또는 재생 큐에서 나타나는 오디오 컨텐츠를 관리 및/또는 조작하도록 추가의 선택 가능한 아이콘을 띄우도록 선택 가능할 수 있다. 예를 들어, 나타나는 오디오 컨텐츠는 다른 가능성 중에서도 재생 큐로부터 제거되거나, 재생 큐 내에서 다른 위치로 이동되거나 임의의 현재 오디오 컨텐츠 이후 또는 즉시 재생되도록 선택될 수 있다. 재생 구역 또는 구역 그룹과 연관된 재생 큐는 재생 구역 또는 구역 그룹 내 하나 이상의 재생 장치, 재생 구역 또는 구역 그룹에 있지 않은 재생 장치 및/또는 일부 다른 지정된 장치 상의 메모리에 저장될 수 있다. 그러한 재생 큐의 재생은 예컨대 순차적이거나 무작위 순서로 큐의 미디어 항목을 재생하는 하나 이상의 재생 장치를 수반할 수 있다.
오디오 컨텐츠 소스 영역(450)은 오디오 컨텐츠가, 선택된 재생 구역 또는 구역 그룹에 의해 검색되고 재생될 수 있는 오디오 컨텐츠 소스일 수 있는 선택 가능한 오디오 컨텐츠 소스의 그래픽적 표현을 포함할 수 있다. 오디오 컨텐츠 소스와 관련 있는 논의는 다음의 섹션에서 발견될 수 있다.
d. 예시적인 오디오 컨텐츠 소스
이전에 나타낸 바와 같이, 구역 또는 구역 그룹 내 하나 이상의 재생 장치는 다양한 이용 가능한 오디오 컨텐츠 소스로부터 (예컨대, 오디오 컨텐츠에 대하여 대응하는 URI 또는 URL에 따라) 재생 오디오 컨텐츠를 검색하도록 구성될 수 있다. 일 예시에서, 오디오 컨텐츠는 대응하는 오디오 컨텐츠 소스로부터 직접적으로 (예컨대, 라인인 연결을 통하여) 재생 장치에 의해 검색될 수 있다. 다른 예시에서, 오디오 컨텐츠는 하나 이상의 다른 재생 장치 또는 네트워크 장치를 통하여 네트워크 상에서 재생 장치로 제공될 수 있다.
예시적인 오디오 컨텐츠 소스는 다른 가능성 중에서도, 도 1의 미디어 재생시스템(100)과 같은 미디어 재생 시스템 내 하나 이상의 재생 장치의 메모리, (예컨대, 컨트롤 장치, 네트워크 가능한 개인 컴퓨터, 또는 네트워크 접속 기반 파일 서버(NAS)와 같은) 하나 이상의 네트워크 장치 상의 로컬 음악 라이브러리, 인터넷을 통하여 오디오 컨텐츠를 제공하는 스트리밍 오디오 서비스(예컨대, 클라우드) 또는 재생 장치 또는 네트워크 장치 상에서 라인인 입력 연결을 통하여 미디어 재생 시스템으로 연결되는 오디오 소스를 포함할 수 있다.
일부 실시예에서, 오디오 컨텐츠 소스는 도 1의 미디어 재생 시스템(100)과 같은 미디어 재생 시스템으로부터 정기적으로 추가 또는 제거될 수 있다. 일 예시에서, 하나 이상의 오디오 컨텐츠 소스가 추가, 제거 또는 갱신될 때마다 오디오 항목의 인덱싱(indexing)이 수행될 수 있다. 오디오 항목의 인덱싱은 미디어 재생 시스템 내 재생 장치에 의해 액세스 가능한 네트워크 상에서 공유되는 모든 폴더/디렉토리에서 식별 가능한 오디오 항목에 대하여 스캐닝하는 것 및 메타데이터(예컨대, 다른 것들 중에서도 타이틀, 아티스트, 앨범, 트랙 길이)와 탐색되는 각각의 식별 가능한 오디오 항목에 대한 URI 또는 URL과 같은 다른 연관되는 정보를 포함하는 오디오 컨텐츠 데이터베이스를 생성 또는 갱신하는 것을 수반할 수 있다. 오디오 컨텐츠 소스를 관리 및 유지하기 위한 다른 예시도 가능할 수 있다.
e. 예시적인 프로세싱 시스템
도 5는 오디오 입력/출력 컴포넌트(502), 활성 단어 검출 컴포넌트(504) 및 알림 컴포넌트(506)를 포함하는 예시적인 프로세싱 시스템(500)의 기능적 블록도를 도시한다. 동작에서, 프로세싱 시스템(500)은 녹음된 오디오 컨텐츠 내의 활성 단어를 검출하고, NMD로 알림을 제공하여 활성 단어를 검출하는 것에 대한 프로그래밍된 활성 응답을 무시하거나 억제한다. 다양한 실시예 내에서, 프로세싱 시스템(500)은 다른 예시 중에서도 재생 장치, NMD 또는 클라우드 서버와 같은 별개의 프로세싱 장치에서 구현될 수 있다. 일부 실시예에서, 프로세싱 시스템(및/또는 그 기능)의 다양한 컴포넌트는 복수의 장치에 분배된다.
동작에서, 오디오 입력/출력 컴포넌트(502)는 입력 인터페이스를 통하여, 재생 장치에 의한 재생을 위해 지정된 녹음된 오디오 컨텐츠를 수신한다. 예를 들어, (예컨대, 도 1의 컨트롤 장치(126 또는 128)와 같은) 컨트롤 장치는 재생 장치(예컨대, 도 1의 임의의 재생 장치)에 지시하여 예컨대 다른 예시 중에서도 재생 장치의 재생 큐에 위치될 컨텐츠로 하여금 재생 장치가 오디오 컨텐츠를 검색하도록 하거나, 오디오 컨텐츠 스트림을 재생 장치로 향하게 하거나, 또는 아날로그 또는 디지털 라인-인 인터페이스를 통하여 재생 장치로 오디오 컨텐츠를 향하게 함으로써, 일부 오디오 컨텐츠를 재생하도록 할 수 있다. 프로세싱 시스템(500)의 오디오 입력/출력 컴포넌트(502)는 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 녹음된 오디오 컨텐츠를 수신한다.
위에서 언급된 바와 같이, 일부 예시에서, 프로세싱 시스템(500)은 재생 장치 내에서 구현된다. 이러한 실시예에서, 재생 장치(500)는 이미 재생을 위해 필요한 오디오 컨텐츠로의 접근을 가진다. 예를 들어, 재생 장치는 다른 가능성 중에서도, 광역 네트워크(WAN), 근거리 네트워크(LAN) 및 개인 영역 네트워크(PAN)와 같은 하나 이상의 유형의 네트워크 상에서 네트워크 인터페이스를 통하여 네트워크 소스(예컨대, 스트리밍 미디어 서비스 또는 모바일 장치)로부터 오디오 컨텐츠를 수신할 수 있다. 대안적으로, 재생 장치는 아날로그(예컨대, RCA) 또는 디지털(예컨대, TosLink® 또는 HDMI®) 라인 인 인터페이스를 통하여 오디오 컨텐츠를 수신할 수 있다.
다른 예시에서, 프로세싱 시스템(500)은 NMD 또는 재생 장치로부터 분리되는 다른 프로세싱 장치 내에서 구현된다. 이러한 실시예에서, 프로세싱 시스템(500)은 다른 예시 중에서도, 재생 장치로부터 또는 오디오 컨텐츠의 소스로부터 네트워크 인터페이스를 통하여 오디오 컨텐츠를 수신할 수 있다. 다른 예시에서, 라인 인 인터페이스는 오디오 컨텐츠를 NMD로 직접 제공할 수 있거나 재생 장치는 라인 인 인터페이스를 통하여 오디오 컨텐츠를 수신할 수 있고, 하나 이상의 네트워크 상에서 프로세싱 시스템(500)으로 컨텐츠를 전달할 수 있다.
예를 들어, 프로세싱 시스템(500)은 재생 장치의 재생 큐로의 접근을 가질 수 있다. 위에서 언급된 바와 같이, 재생 큐에 있는 각각의 오디오 항목은 가능하다면 재생 장치에 의한 재생을 위한 로컬 오디오 컨텐츠 소스 또는 네트워킹된 오디오 컨텐츠 소스로부터 오디오 항목을 탐색 및/또는 검색하도록 재생 구역 또는 구역 그룹에서 재생 장치에 의해 사용될 수 있는 URI(uniform resource identifier), URL(uniform resource locator), 또는 일부 다른 식별자를 포함할 수 있다. 프로세싱 시스템(500)은 재생 장치에 의한 재생 이전에, 로컬 오디오 컨텐츠 소스 또는 네트워킹된 오디오 컨텐츠 소스로부터 오디오 컨텐츠를 검색하도록 이러한 식별자를 유사하게 사용할 수 있다.
일부 구현예에서, 재생 큐는 재생 장치의 데이터 저장소에 저장된다. 추가 구현예에서, 재생 큐는 클라우드 서버 상에 저장된다. 클라우드 서버(즉, 클라우드 큐) 상에 저장된 재생 큐는 재생 장치 상에 저장된 재생 큐의 표현 또는 인스턴스일 수 있다. 클라우드 큐는 재생 포인터 또는 재생 장치 상의 재생의 현재 상태를 나타내는 다른 상태 정보를 포함할 수 있다.
일부 경우에서, 프로세싱 시스템(500)은 활성 단어 검출을 위해 적합한 포맷으로 수신된 오디오 컨텐츠를 전환할 수 있다. 예를 들어, 오디오 컨텐츠가 아날로그 라인 인 인터페이스를 통하여 오디오 입력/출력 컴포넌트(502)로 제공되는 경우, 프로세싱 시스템(500)은 (예컨대, 소프트웨어 또는 하드웨어 기반 아날로그 디지털 변환기를 사용하여) 아날로그 오디오를 디지털화할 수 있다. 다른 예시로서, 수신된 오디오 컨텐츠가 분석을 위해 적합하지 않은 디지털 형태로 수신되는 경우, 프로세싱 시스템(500)은 녹음을 적합한 포맷으로 트랜스코딩(transcode)할 수 있다.
활성 검출 컴포넌트(504)는 수신된 오디오 컨텐츠를 분석하여 임의의 활성 단어가 녹음에 존재하는지를 결정한다. 활성 단어 검출 컴포넌트(504)는 활성 단어 검출 알고리즘을 사용하여, 수신된 오디오 컨텐츠를 분석할 수 있다. 예시적인 활성 단어 검출 알고리즘은 입력으로서, 오디오 녹음을 받아들이고, 출력으로서, 활성 단어가 녹음에 존재하는지 여부의 표시를 제공한다.
일부 구현예에서, 활성 단어 검출 컴포넌트(504)는 마이크로폰을 통하여 녹음된 오디오에서 활성 단어를 검출하기 위해 NMD에 의해 활용된 것처럼 녹음 상의 동일한 알고리즘을 사용할 수 있다. 보통의 동작 동안, 예시적인 NMD는 녹음된 오디오가 활성 단어를 포함하는지를 결정하기 위하여 지속적으로 오디오를 녹음하고, 녹음된 오디오 스트림을 활성 단어 알고리즘으로 제공한다. 여기서, NMD의 마이크로폰에 의해 녹음된 오디오를 활성 단어 검출 알고리즘으로 제공하는 대신, 활성 단어 검출 컴포넌트(504)는 재생을 위해 지정된 미리 녹음된 오디오 컨텐츠를 제공한다.
분석 동안, 활성 단어 검출 컴포넌트(504)는 추가적으로 각 활성 단어가 수신된 오디오 컨텐츠 내에서 발생하는 곳을 결정한다. 예를 들어, 활성 단어 검출 컴포넌트(504)는 수신된 오디오 컨텐츠를 알려진 길이의 세그먼트로 분할할 수 있다. 이후, 활성 단어 검출 컴포넌트(504) 검출된 세그먼트를 식별함으로써 활성 단어가 발생하는 녹음에서의 위치를 결정할 수 있다. 예를 들어, 각각의 세그먼트가 5초 길이이고, 활성 단어가 4번째 세그먼트에서 검출되는 경우, 활성 단어는 녹음에서 15 내지 20초 사이에 위치해야만 한다. 활성 단어 검출 컴포넌트(504)는 예컨대 하나 이상의 타임스탬프(예컨대, 활성 단어에 대한 시작 시간을 나타내는 타임스탬프 및 예컨대 활성 단어에 대한 중단 시간을 나타내는 다른 타임스탬프)를 사용하여, 활성 단어를 포함하는 오디오 컨텐츠의 부분을 녹음할 수 있다. 그러한 타임스탬프는 오디오 녹음의 시작으로부터, 또는 오디오 녹음에 있는 다른 특정한 위치로부터의 각 시간 오프셋을 규정할 수 있다. 일부 경우에서, 활성 단어 검출 컴포넌트(504)는 오디오 녹음을 오버랩핑 세그먼트로 분리하여, 활성 단어가 인지할 수 없는 부분으로 쪼개지는 것을 피할 수 있다. 오디오 녹음 내의 활성 단어의 위치를 결정하기 위한 다른 기법도 활용될 수 있다.
예시 내에서, 프로세싱 시스템(500)은 메모리에서 수신된 오디오 컨텐츠를 버퍼링할 수 있다. 예를 들어, 프로세싱 시스템(500)은 선입선출 버퍼(first-in-first-out buffer)(예컨대, 원형 버퍼)에서 수신된 오디오 컨텐츠를 저장할 수 있다. 이러한 구현예에서, 수신된 오디오의 부분은 그들이 수신되었을 때, 버퍼에 저장되고, 이들이 프로세싱되어 수신된 오디오 컨텐츠가 활성 단어를 포함하는지를 결정함에 따라 제거된다.
일부 경우에서, 활성 단어 검출 컴포넌트(504)는 수신된 오디오 컨텐츠 상의 복수의 활성 단어 검출 알고리즘을 동시에(또는 실질적으로 동시에) 실행한다. 위에서 언급된 바와 같이, 다양한 음성 서비스(예컨대, AMAXON의 ALEXA®, APPLE의 SIRI® 또는 MICROSOFT의 CORTANA®) 각각은 그들의 각 음성 서비스를 작동시키기 위한 다양한 활성 단어를 사용한다. 복수의 서비스를 지원하기 위해, 활성 단어 검출 컴포넌트(504)는 각각 병렬로 지원된 음성 서비스에 대한 활성 단어 검출 알고리즘을 통하여 수신된 오디오 컨텐츠를 실행할 수 있다.
하나 이상의 활성 단어가 오디오 컨텐츠에서 검출되는 경우, 알림 컴포넌트(506)는 하나 이상의 NMD(예컨대, 도 1의 NMD(132 및/또는 134))를 알린다. 이러한 알림은, NMD로 하여금, 재생 장치가 활성 단어가 포함된 오디오 컨텐츠를 재생하는 동안 재생될 때 검출된 활성 단어를 무시하도록 한다. 예를 들어, 알림 컴포넌트(506)은 네트워크 인터페이스를 지나 하나 이상의 NMD로 명령어를 송신하여 일부 활성 단어 또는 일정 수의 활성 단어를 무시할 수 있다.
일부 경우에서, 알림 컴포넌트(506)은 NMD가 재생 장치에 의해 재생됨에 따라 활성 단어를 검출하는 것을 방지할 수 있다. 예를 들어, 알림 컴포넌트(506)는 NMD에 지시하여 기간 동안 활성 단어를 듣는 것을 중단(예컨대, 녹음된 오디오를 프로세싱하는 것을 중단)하도록 할 수 있다. 대안적으로, 알림 컴포넌트(506)는 NMD에 지시하여, 마이크로폰 어레이를 일시적으로(예컨대, 활성 단어가 재생 장치에 의해 재생될 것으로 예상되는 때에 대응하는 기간 동안) 디세이블할 수 있다. 또 다른 예시에서, 알림 컴포넌트(506)는 NMD에 지시하여 마이크로폰 어레이를 사용하여 재생 장치의 방향으로 청취 무효(listening NULL)를 생성하여 NMD가 활성 단어를 검출하지 않을 수 있다. 다른 예시도 가능하다.
대안적으로, NMD는 활성 단어를 검출할 수 있지만, 알림 컴포넌트(506)는 NMD에 지시하여 활성 단어를 검출하는 것에 응답하여 음성 서비스를 작동하기 위한 그 프로그래밍된 활성 응답을 억제한다. 예를 들어, 알림 컴포넌트(506)는 NMD에 지시하여 일정 기간동안 모든 오디오를 무시하거나 일정 기간 동안 활성 단어를 무시하도록 할 수 있다. 다른 예시도 가능하다.
재생 장치가 오디오 컨텐츠를 들리도록 재생하기 전에, 오디오 컨텐츠를 프로세싱하는 경우, (재생 장치 또는 NMD와 같은) 프로세싱 장치는 또한 녹음된 오디오 컨텐츠의 어떤 섹션이 활성 단어를 포함하는지를 결정할 수 있다. 이러한 섹션은 활성 단어에 대한 시작과 중단 시각(예컨대, 33:52.543에서 시작하고 33:54.013에서 종료하는 팟캐스트에서의 활성 단어)과 같은 오디오 컨텐츠 내의 기간에 의해 정의될 수 있다. 오디오 컨텐츠가 재생되는 경우, 부근에 있는 NMD는 이러한 기간동안 활성 단어를 무시하도록 지시될 수 있다.
다른 예시로서, 프로세싱 시스템(500)은 오디오 컨텐츠 내의 (또는 오디오 컨텐츠의 부분 내의) 활성 단어의 수를 카운트할 수 있다. 예를 들어, 프로세싱 시스템(500)은 예시적인 오디오 컨텐츠(예컨대, 텔레비전 쇼) 내의 세 개의 활성 단어를 검출할 수 있다. 위에서 언급된 바와 같이, 이러한 경우는 다양한 음성 서비스를 위한 다양한 활성 단어를 포함하는 활성 단어의 임의의 조합을 포함할 수 있다. 이후, 프로세싱 시스템(500)은 부근에 있는 NMD에 지시하여, 그들이 카운트와 같은 활성 단어의 수를 검출할 때까지 활성 단어를 무시(예컨대, 다음 세 개의 활성 단어를 무시)할 수 있다.
다른 예시에서, 프로세싱 시스템(500)은 녹음된 오디오 컨텐츠에 다른 마커 또는 오디오 톤을 동적으로 삽입하여 오디오 컨텐츠에서 검출된 활성 단어를 지정할 수 있다. 이후, 오디오 컨텐츠가 재생 장치에 의해 재생되는 경우, 활성 단어와 함께 오디오 마커를 검출하는 NMD는 활성 단어의 그 인스턴스를 무시하도록 지시받을 수 있다. 복수의 NMD가 재생 장치의 가청 범위에 있는 경우, 활성 단어를 검출하는 각각의 NMD는 연관된 오디오 마커를 검출하는 것에 응답하여 이를 무시할 수 있다. 일부 경우에서, 오디오 마커는 사람의 청력 범위 밖에 있는 오디오 주파수(예컨대, 20kHZ 초과)로 구성되어 삽입된 톤은 인간 청취자에 의해 인식 가능하지 않다.
일부 구현예에서, 프로세싱 시스템(500)은 오디오 컨텐츠의 소스와 재생 장치 사이의 중재자로서 동작한다. 예를 들어, 프로세싱 시스템(500)이 오디오 마커를 사용하여 NMD에 알리는 구현예에서, 프로세싱 시스템은 재생 장치에 의한 재생을 위해 지정된 오디오 컨텐츠를 수정한다. 그러한 구현예에서, 프로세싱 시스템(500)은 (예컨대, 네트워크 또는 라인 인 인터페이스를 통하여) 오디오 소스로부터 오디오 컨텐츠를 수신하고, 오디오 컨텐츠를 분석하고, 수정된 오디오 컨텐츠를 예컨대 네트워크 인터페이스를 통하여, 재생을 위한 재생 장치로 제공할 수 있다.
대안적으로, 위에서 언급된 바와 같이, 프로세싱 시스템(500)은 재생 장치 자체에서 구현된다. 그러한 경우에서, 오디오 컨텐츠를 분석하는 것 이후, 재생 장치는 오디오 컨텐츠를 재생하도록 진행할 수 있다. 또한, 위에서 언급된 바와 같이, 일부 경우에서, 재생 장치는 (예컨대, 구역 그룹, 스테레오 쌍 또는 서라운드 사운드 구성에서) 하나 이상의 추가적인 재생 장치와 동시에 오디오 컨텐츠를 재생하도록 구성될 수 있다. 그러한 상황에서, 재생 장치는 (예컨대 수정된) 오디오 컨텐츠를 예컨대 네트워크 인터페이스를 통하여, 하나 이상의 추가적인 재생 장치로 제공할 수 있다.
추가적 예시에서, 프로세싱 시스템(500)은 NMD에서 구현된다. 이러한 경우에서, 프로세싱 시스템(500)은 NMD 자체로 하여금, 오디오 컨텐츠가 재생될 때 오디오 컨텐츠에 있는 활성 단어를 무시하도록 할 수 있다. 또한, NMD는 활성 단어를 무시하도록 다른 NMD에 지시할 수 있다. 예를 들어, NMD(132)는 활성 단어를 무시하도록 NMD(134)에 지시할 수 있다. 또한, NMD가 재생 장치(예컨대, 재생 장치(104))에서 구현되는 경우, NMD/재생 장치는 활성 단어를 무시하도록 다른 NMD(그들 자체가 재생 장치에서 구현될 수 있음)에 지시할 수 있다.
f. 예시적인 복수의 네트워킹된 장치
도 6은 음성 컨트롤에 기초하여 오디오 재생 경험을 제공하도록 구성될 수 있는 예시적인 복수의 장치(600)를 도시한다. 당업자는, 도 6에 도시된 장치가 단지 예시적인 목적을 위한 것이며, 상이하고/거나 추가적인 장치를 포함하는 변동이 가능함을 인정할 것이다. 도시된 바와 같이, 복수의 장치(600)는 컴퓨팅 장치(604, 606 및 608), 네트워크 마이크로폰 장치(NMD)(612, 614 및 616), 재생 장치(PBD)(632, 634, 636 및 638) 및 컨트롤러 장치(CR)(622)를 포함한다.
복수의 장치(600) 각각은, 예컨대, 다른 가능성 중에서도, 광역 네트워크(WAN), 근거리 네트워크(LAN) 및 개인 영역 네트워크(PAN)와 같은 하나 이상의 유형의 네트워크에서, 다른 예시 중에서도 NFC, 블루투스, 이더넷 및 IEEE 802.11과 같은 하나 이상의 네트워크 프로토콜에 따라 복수의 장치에서 하나 이상의 다른 장치와의 통신을 수립할 수 있는 네트워크-가능한 장치일 수 있다.
도시한 바와 같이, 컴퓨팅 장치(604, 606 및 608)는 클라우드 네트워크(602)의 일부일 수 있다. 클라우드 네트워크(602)는 추가적인 컴퓨팅 장치를 포함할 수 있다. 일 예시에서, 컴퓨팅 장치(604, 606 및 608)는 상이한 서버일 수 있다. 다른 예시에서, 컴퓨팅 장치(604, 606 및 608) 중 둘 이상은 단일 서버의 모듈일 수 있다. 비슷하게, 컴퓨팅 장치(604, 606 및 608) 각각은 하나 이상의 모듈 또는 서버를 포함할 수 있다. 여기서 예시 목적의 편의를 위해, 컴퓨팅 장치(604, 606 및 608) 각각은 클라우드 네트워크(602) 내에서 특정한 기능을 수행하도록 구성될 수 있다. 예를 들어, 컴퓨팅 장치(608) 스트리밍 음악 서비스를 위한 오디오 컨텐츠의 소스일 수 있다.
도시된 바와 같이, 컴퓨팅 장치(604)는 통신 경로(642)를 통하여 NMD(612, 614 및 616)와 인터페이싱 하도록 구성될 수 있다. NMD(612, 614 및 616)는 하나 이상의 “스마트 홈” 시스템의 컴포넌트일 수 있다. 일 예시에서, NMD(612, 614 및 616)는 도 1의 도시된 장치의 분배와 유사하게, 집 전반에 물리적으로 분배될 수 있다. 다른 경우에서, NMD(612, 614 및 616) 중 둘 이상은 서로 비교적 근접하게 물리적으로 위치될 수 있다. 통신 경로(642)는 다른 가능성 중에서도, 인터넷을 포함하는 WAN, LAN 및/또는 PAN과 같은 하나 이상의 유형의 네트워크를 포함할 수 있다.
일 예시에서, NMD(612, 614 및 616) 중 하나 이상은 주로 오디오 검출을 위해 구성되는 장치일 수 있다. 다른 예시에서, NMD(612, 614 및 616) 중 하나 이상은 다양한 주된 효용을 가지는 장치의 컴포넌트일 수 있다. 예를 들어, 도 2 및 도 3와 관련하여 위에서 논의된 바와 같이, NMD(612, 614 및 616) 중 하나 이상은 재생 장치(200)의 마이크로폰(220) 또는 네트워크 장치(300)의 마이크로폰(310)일 수 있다. 또한, 일부 경우에서, NMD(612, 614 및 616) 중 하나 이상은 재생 장치(200) 또는 네트워크 장치(300)일 수 있다. 일 예시에서, NMD(612, 614 및/또는 616) 중 하나 이상은 마이크로폰 어레이에서 배열된 복수의 마이크로폰을 포함할 수 있다.
도시된 바와 같이, 컴퓨팅 장치(606)는 통신 경로(644)를 통하여, CR(622) 및 PBD(632, 634, 636 및 638)와 인터페이싱 하도록 구성될 수 있다. 일 예시에서, CR(622)은 도 2의 네트워크 장치(200)와 같은 네트워크 장치일 수 있다. 따라서, CR(622)은 도 4의 컨트롤러 인터페이스(400)를 제공하도록 구성될 수 있다. 유사하게, PBD(632, 634, 636 및 638)는 도 3의 재생 장치(300)와 같은 재생 장치일 수 있다. 이와 같이, PBD(632, 634, 636 및 638)는 도 1에 도시된 바와 같이, 집 전반에 걸쳐 물리적으로 분배될 수 있다. 예시를 위해, PBD(636 및 638)는 결합된 구역(630)의 일부일 수 있는 한편, PBD(632 및 634)는 그들의 각 구역의 일부일 수 있다. 위에서 설명된 바와 같이, PBD(632, 634, 636 및 638)는 동적으로 결합되고, 그룹화되고, 결합해제 되고, 그룹화해제 될 수 있다. 통신 경로(644)는 다른 가능성 중에서도, 인터넷을 포함하는 WAN, LAN 및/또는 PAN과 같은 하나 이상의 유형의 네트워크를 포함할 수 있다.
일 예시에서, NMD(612, 614 및 616)와 같이, CR(622) 및 PBD(632, 634, 636 및 638)도 하나 이상의 "스마트 홈" 시스템의 컴포넌트일 수 있다. 일 예시에서, PBD(632, 634, 636 및 638)는 NMD(612, 614 및 616)처럼 동일한 집 전반에 분배될 수 있다. 또한, 위에서 제안된 바와 같이, PBD(632, 634, 636 및 638) 중 하나 이상은 NMD(612, 614 및 616) 중 하나 이상일 수 있다.
NMD(612, 614 및 616)는 근거리 네트워크의 일부일 수 있고, 통신 경로(642)는 NMD(612, 614 및 616)의 근거리 네트워크를 WAN(통신 경로 도시되지 않음)을 통해 컴퓨팅 장치(604)로 연결하는 액세스 포인트를 포함할 수 있다. 마찬가지로, NMD(612, 614 및 616) 각각은 그러한 액세스 포인트를 통하여 서로 통신할 수 있다.
유사하게, CR(622) 및 PBD(632, 634, 636 및 638)는 근거리 네트워크 및/또는 이전 섹션에서 논의된 바와 같은, 로컬 재생 네트워크의 일부일 수 있고, 통신 경로(644)는 근거리 네트워크 및/또는 CR(622) 및 PBD(632, 634, 636 및 638)의 로컬 재생 네트워크를 WAN을 통해 컴퓨팅 장치(606)로 연결하는 액세스 포인트를 포함할 수 있다. 이와 같이, CR(622) 및 PBD(632, 634, 636 및 638) 각각은 또한 이러한 액세스 포인트를 통해 서로와 통신할 수 있다.
일 예시에서, 통신 경로(642 및 644)는 동일한 액세스 포인트를 포함할 수 있다. 일 예시에서, NMD(612, 614 및 616), CR(622) 및 PBD(632, 634, 636 및 638) 각각은 집에 대한 동일한 액세스 포인트를 통하여 클라우드 네트워크(602)에 접근할 수 있다.
도 6에서 도시된 바와 같이, NMD(612, 614 및 616), CR(622) 및 PBD(632, 634, 636 및 638) 각각은 또한 통신 수단(646)을 통하여 다른 장치 중 하나 이상과 직접적으로 통신할 수 있다. 여기서 설명된 바와 같이, 통신 수단(646)은 하나 이상의 유형의 네트워크를 통해 하나 이상의 네트워크 프로토콜에 따라, 장치 간의 하나 이상의 형태의 통신을 수반할 수 있고/거나 하나 이상의 다른 네트워크 장치를 통하여 통신을 수반할 수 있다. 예를 들어, 통신 수단(646)은 다른 가능성 중에서도, 예컨대, 블루투스TM(IEEE 802.15), NFC, 무선 직통 및/또는 등록된 무선 중 하나 이상을 포함할 수 있다.
일 예시에서, CR(622)은 블루투스TM를 통해 NMD(612)와 통신할 수 있고, 다른 근거리 네트워크를 통해 PBD(634)와 통신할 수 있다. 다른 예시에서, NMD(614)는 다른 근거리 네트워크를 통해 CR(622)과 통신할 수 있고, 블루투스를 통해 PBD(636)와 통신할 수 있다. 추가 예시에서, PBD(632, 634, 636 및 638) 각각이 로컬 재생 네트워크를 통해 스패닝 트리 프로토콜을 따라(spanning tree protocol) 서로와 통신하는 한편, 각각은 로컬 재생 네트워크와 상이한 근거리 네트워크를 통해 CR(622)과 통신할 수 있다. 다른 예시도 가능하다.
일부 경우에서, NMD(612, 614 및 616), CR(622) 및 PBD(632, 634, 636 및 638) 간의 통신 수단은 장치, 네트워크 상태 및/또는 지연 요구 간의 통신의 유형에 따라 변화할 수 있다. 예를 들어, 통신 수단(646)은, NMD(616)가 PBD(632, 634, 636 및 638)가 있는 집에 처음 도입되는 경우, 사용될 수 있다. 일 예시에서, NMD(616)는 NFC를 통하여 NMD(616)에 대응하는 식별 정보를 PBD(638)로 전송할 수 있고, PBD(638)는 이에 응답하여, NFC(또는 통신의 다른 형태)를 통하여 근거리 네트워크 정보를 NMD(616)로 전송할 수 있다. 그러나, NMD(616)가 집 내에서 구성되면, NMD(616)와 PBD(638) 간의 통신 수단은 바꿀 수 있다. 예를 들어, NMD(616)는 차후에 통신 경로(642), 클라우드 네트워크(602) 및 통신 경로(644)를 통하여, PBD(638)와 통신할 수 있다. 다른 예시에서, NMD 및 PBD는 로컬 통신 수단(646)을 통하여 전혀 통신하지 않을 수 있다. 추가 예시에서, NMD 및 PBD는 주로 로컬 통신 수단(646)을 통하여 통신할 수 있다. 다른 예시도 가능하다.
예시적인 예시에서, NMD(612, 614 및 616)는 음성 입력을 수신하여 PBD(632, 634, 636 및 638)를 컨트롤하도록 구성될 수 있다. 이용 가능한 컨트롤 명령은 다른 가능성 중에서도, 재생 음량 컨트롤, 재생 운송 컨트롤, 음악 소스 선택 및 그룹화와 같은 이전에 논의된 임의의 미디어 재생 시스템 컨트롤을 포함할 수 있다. 일 예시에서, NMD(612)는 PBD(632, 634, 636 및 638) 중 하나 이상을 컨트롤하도록 음성 입력을 수신할 수 있다. 음성 입력을 수신하는 것에 응답하여, NMD(612)는 통신 경로(642)를 통하여 음성 입력을 프로세싱을 위한 컴퓨팅 장치(604)로 전송할 수 있다. 일 예시에서, 컴퓨팅 장치(604)는 음성 입력을 동등한 텍스트 명령으로 전환할 수 있고, 텍스트 명령을 파싱하여 명령을 식별할 수 있다. 컴퓨팅 장치(604)는 이후, 텍스트 명령을 컴퓨팅 장치(606)로 차후에 전송할 수 있다. 다른 예시에서, 컴퓨팅 장치(604)는 음성 입력을 동등한 텍스트 명령으로 전환할 수 있고, 이후 텍스트 명령을 컴퓨팅 장치(606)로 차후에 전송할 수 있다. 컴퓨팅 장치(606)는 이후, 텍스트 명령을 파싱하여 하나 이상의 재생 명령을 식별할 수 있다.
예를 들어, 텍스트 명령이 "'구역 1'에서 '스트리밍 서비스 1'로부터 '아티스트 1'의 '트랙 1'을 재생해"인 경우, 컴퓨팅 장치(606)는 (i) "스트리밍 서비스 1"로부터 이용 가능한 "아티스트 1"의 "트랙 1"에 대한 URL 및 (ii) "구역 1"에 있는 적어도 하나의 재생 장치를 식별할 수 있다. 이러한 예시에서, "스트리밍 서비스 1"로부터 "아티스트 1"의 "트랙 1"에 대한 URL은 컴퓨팅 장치(608)를 지시하는 URL일 수 있고, "구역 1"은 결합된 구역(630)일 수 있다. 이와 같이, URL 및 PBD(636 및 638) 중 하나 또는 둘 다를 식별하면, 컴퓨팅 장치(606)는 통신 경로(644)를 통하여, PBD(636 및 638) 중 하나 또는 둘 다로 재생을 위한 식별된 URL을 전송할 수 있다. PBD(636 및 638) 중 하나 또는 둘 다는 수신된 URL에 따라, 컴퓨팅 장치(608)로부터 오디오 컨텐츠를 응답으로 검색할 수 있고, "스트리밍 서비스 1"로부터 "아티스트 1"의 "트랙 1" 재생을 시작할 수 있다.
또 다른 예시에서, 컴퓨팅 장치(604)는 일부 프로세싱을 수행하여 관련된 명령 또는 사용자의 의도를 식별할 수 있고 컴퓨팅 장치(606)로 음성 입력에 관련된 미디어 컨텐츠에 관한 정보를 제공할 수 있다. 예를 들어, 컴퓨팅 장치(604)는 음성 입력의 스피치 투 텍스트 변환(speech-to-text conversion)을 수행하고 명령을 어떻게 실행하는지에 대한 다른 정보를 따라 명령 또는 의도(예컨대, 재생, 정지, 중단, 음량 높임, 음량 낮춤, 스킵, 다음, 그룹, 그룹해제)에 대하여 음성 입력을 분석할 수 있다. 컴퓨팅 장치(604) 또는 컴퓨팅 장치(606)는 어떤 PBD 명령이 컴퓨팅 장치(604)에 의해 결정된 명령 또는 의도에 대응하는 지를 결정할 수 있다. 명령을 실행하는 것과 관련된 다른 정보 및/또는 음성 입력으로부터 결정된 명령 또는 의도는 컴퓨팅 장치(604)로부터 컴퓨팅 장치(606)로 전송될 수 있다. 컴퓨팅 장치(604) 상의 프로세싱은 어플리케이션, 모듈, 애드온(add-on) 소프트웨어, 네이티브 네트워킹된 마이크로폰 시스템 소프트웨어 플랫폼과의 통합 및/또는 네이티브 네트워킹된 마이크로폰 시스템 소프트웨어 플랫폼에 의해 수행될 수 있다.
당업자는 위 내용이 단순히 일 예시이고, 다른 구현예 또한 가능함을 인정할 것이다. 일 예시에서, 위에서 설명된 바와 같이 복수의 장치(600) 중 하나 이상에 의해 수행되는 동작은 복수의 장치(600)에서 하나 이상의 다른 장치에 의해 수행될 수 있다. 예를 들어, 음성 입력으로부터 텍스트 명령으로의 전환은 NMD(612), 컴퓨팅 장치(606), PBD(636) 및/또는 PBD(638)와 같은 다른 장치에 의해 대안적, 부분적 또는 전체적으로 수행될 수 있다. 유사하게, URL의 식별은 NMD(612), 컴퓨팅 장치(604), PBD(636) 및/또는 PBD(638)과 같은 다른 장치에 의해 대안적, 부분적 또는 전체적으로 수행될 수 있다.
g. 예시적인 네트워크 마이크로폰 장치
도 7은 도 7의 NMD(712, 714 및 716) 중 하나 이상으로 구성될 수 있는 예시적인 네트워킹 마이크로폰 장치(700)의 기능적 블록도를 도시한다. 도시된 바와 같이, 네트워크 마이크로폰 장치(700)는 프로세서(702), 메모리(704), 마이크로폰 어레이(706), 네트워크 인터페이스(708), 사용자 인터페이스(710), 소프트웨어 컴포넌트(712) 및 스피커(714)를 포함한다. 당업자는 다른 네트워크 마이크로폰 장치 구성 및 배열 또한 가능함을 인정할 것이다. 예를 들어, 네트워크 마이크로폰 장치는 대안적으로 스피커(714)를 배제하거나, 마이크로폰 어레이(706) 대신 단일 마이크로폰을 가질 수 있다.
프로세서(702)는 하나 이상의 프로세서 및/또는 컨트롤러를 포함할 수 있으며, 이는 일반적 또는 특수 목적의 프로세서 또는 컨트롤러의 형태를 취할 수 있다. 예를 들어, 프로세싱 유닛(702)은 마이크로프로세서, 마이크로컨트롤러, 어플리케이션-특정 집적 회로, 디지털 신호 프로세서 등을 포함할 수 있다. 메모리(704)는 그러한 기능을 수행하도록 프로세서(702)에 의해 실행 가능한 소프트웨어 컴포넌트 중 하나 이상과 로딩될 수 있는 데이터 저장소일 수 있다. 따라서, 메모리(704)는 하나 이상의 비일시적 컴퓨터 판독 가능 기록매체를 포함할 수 있고, 그 예는 다른 가능성 중에서도, RAM(random access memory), 레지스터, 캐시 등과 같은 휘발성 저장 매체와 ROM(read-only memory), 하드디스크 드라이브, SSD(solid-state drive), 플래시 메모리 및/또는 광학 저장 장치와 같은 비휘발성 저장 매체를 포함할 수 있다.
마이크로폰 어레이(706)는 네트워크 마이크로폰 장치(700)의 환경에서 사운드를 검출하도록 배열된 복수의 마이크로폰일 수 있다. 마이크로폰 어레이(706)는 다른 가능성 중에서도, 콘덴서 마이크로폰(condenser microphone), 일렉트레트 콘덴서 마이크로폰(electret condenser microphone) 또는 다이내믹 마이크로폰(dynamic microphone)과 같이, 현재 알려지거나 추후에 개발되는 임의의 유형의 마이크로폰일 수 있다. 일 예시에서, 마이크로폰 어레이는 네트워크 마이크로폰에 관하여 하나 이상의 방향으로부터 오디오를 검출하도록 배열될 수 있다. 마이크로폰 어레이(706)는 주파수 범위의 일부에 민감할 수 있다. 일 예시에서, 마이크로폰 어레이(706)의 제1 서브세트는 제1 주파수 범위에 민감할 수 있는 한편, 마이크로폰 어레이의 제2 서브 세트는 제2 주파수 범위에 민감할 수 있다. 마이크로폰 어레이(706)는 오디오 소스(예컨대, 음성, 가청 사운드)의 위치 정보를 캡쳐하고/거나 배경 잡음을 필터링하는 것을 돕도록 더 배열될 수 있다. 특히, 일부 실시예에서, 마이크로폰 어레이는 복수의 마이크로폰 보다도 단일 마이크로폰만으로 구성될 수 있다.
네트워크 인터페이스(708)는 도 6을 참조하면, 다른 가능성 중에서도, CR(622), PBD(632-638), 클라우드 네트워크(602)에 있는 컴퓨팅 장치(604-608) 및 다른 네트워크 마이크로폰 장치와 같은, 다양한 네트워크 장치 간의 무선 및/또는 유선 통신을 용이하게 하도록 구성될 수 있다. 이와 같이, 네트워크 인터페이스(708)는 이러한 기능을 수행하기 위해 임의의 적합한 형태를 취할 수 있고, 그 예는 이더넷 인터페이스, 시리얼 버스 인터페이스(예컨대, FireWire, USB 2.0 등), 무선 통신을 용이하게 하도록 구성된 안테나와 칩셋 및/또는 유선 및/또는 무선 통신을 제공하는 임의의 다른 인터페이스를 포함할 수 있다. 일 예시에서, 네트워크 인터페이스(708)는 산업 표준(예컨대, 적외선, 라디오, IEEE 802.3을 포함하는 유선 표준, IEEE 802.11a, 802.11b, 802.11g, 802.11n, 802.11ac, 802.15, 4G 모바일 통신 표준을 포함하는 무선 표준 등)에 기초할 수 있다.
네트워크 마이크로폰 장치(700)의 사용자 인터페이스(710)는 네트워크 마이크로폰 장치로 사용자 상호작용을 용이하게 하도록 구성될 수 있다. 일 예시에서, 사용자 인터페이스(708)는 사용자가 네트워크 마이크로폰 장치(700)로 직접 입력을 제공하도록, 다른 가능성 중에서도 물리적 버튼, 터치 센스 스크린 및/또는 표면 상에 제공되는 그래픽 인터페이스 중 하나 이상을 포함할 수 있다. 사용자 인터페이스(710)는 사용자에게 시각적 및/또는 오디오 피드백을 제공하도록 조명 및 스피커(714) 중 하나 이상을 더 포함할 수 있다. 일 예시에서, 네트워크 마이크로폰 장치(700)는 스피커(714)를 통하여 오디오 컨텐츠를 재생하도록 더 구성될 수 있다.
III. 활성 단어를 디세이블하기 위한 재생 장치에 대한 예시적인 기법
위에서 논의된 바와 같이, 여기서 설명된 실시예는 활성 응답을 디세이블하는 것을 수반할 수 있다. 도 8은 재생 장치가 하나 이상의 NMD의 활성 응답을 디세이블하는, 예시적인 구현예(800)를 예시한다.
a. 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신
블록(802)에서, 구현예(800)는 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신하는 것을 수반한다. 예를 들어, 재생 장치는 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 수신할 수 있다. 예시적인 재생 장치는 도 1에 도시된 재생 장치(102, 104, 106, 108, 110, 112, 114, 116, 118, 120, 122 및 124)중 임의의 것을 포함하며, 이는 예를 들어, 도 2의 재생 장치(200)에 의해 나타나는 바와 같이 구현될 수 있다. 일부 구현예에서, 재생 장치는 프로세싱 시스템(예컨대, 프로세싱 시스템(500))을 포함하고 (도 5의 오디오 입력/출력 컴포넌트(502)와 같은) 오디오 입력/출력 컴포넌트를 사용하여 오디오 컨텐츠를 나타내는 데이터를 수신할 수 있다.
예시적인 오디오 컨텐츠는 오디오 컨텐츠의 많은 다른 형태 중에서도, 하나 이상의 오디오 트랙, 토크 쇼, 영화, 텔레비전 쇼, 팟캐스트, 인터넷 스트리밍 비디오를 포함할 수 있다. 오디오 컨텐츠는 비디오(예컨대, 비디오의 오디오 트랙)에 의해 동반되는 오디오 컨텐츠 또는 비디오에 의해 동반되지 않은 오디오를 포함할 수 있다.
재생 장치는 다른 예시 중에서도, 유선 또는 무선 네트워크 인터페이스 또는 아날로그 또는 디지털 라인 인 인터페이스일 수 있는, 입력 인터페이스를 통하여 오디오 컨텐츠를 수신할 수 있다. 예를 들어, 재생 장치는 다른 가능성 중에서도, 광역 네트워크(WAN), 근거리 네트워크(LAN) 및 개인 영역 네트워크(PAN)와 같은 하나 이상의 유형의 네트워크에서 네트워크 인터페이스를 통하여 네트워크 소스로부터 오디오 컨텐츠를 수신할 수 있다.
재생 장치는 로컬 또는 원격 오디오 소스로부터 오디오 컨텐츠를 나타내는 데이터를 수신할 수 있다. 예를 들어, 재생 장치는 로컬 미디어 서버 또는 근거리 네트워크 상의 다른 장치로부터, (예컨대, 네트워크 인터페이스를 통하여 근거리 네트워크에서) 재생 장치와 통신하는 다른 장치 또는 재생 장치에 의해 판독되는 (CD, DVD, Blu-Ray, 플래시 메모리 또는 하드드라이브와 같은) 매체로부터, 또는 재생 장치 자체 상의 데이터 저장소로부터 오디오 컨텐츠를 수신할 수 있다. 재생 장치는 예컨대, 하나 이상의 클라우드 서버로부터 오디오 컨텐츠 스트림과 같은 오디오 컨텐츠를 수신할 수 있다. 예를 들어, 재생 장치는 네트워크 인터페이스를 통하여, URL로부터 오디오 컨텐츠 스트림을 검색할 수 있다. 대안적으로, 재생 장치는 (예컨대, 네트워크 인터페이스를 통하여, 근거리 네트워크에서) 재생 장치 또는 재생 장치와 통신하는 다른 장치 상의 라인 인 인터페이스로부터 오디오 컨텐츠를 수신할 수 있다.
일부 경우에서, 재생 장치는 예컨대, 아날로그 라인 인 인터페이스를 통하여, 오디오 컨텐츠를 아날로그 포맷으로 수신할 수 있다. 이러한 경우에서, 재생 장치는 (예컨대, 소프트웨어 또는 하드웨어 기반 아날로그-디지털 변환기를 사용하여) 아날로그 오디오를 프로세싱에 적합한 포맷으로 디지털화한다. 대안적으로, 재생 장치와 통신하는 장치는 아날로그 포맷으로 오디오 컨텐츠를 수신하고, 오디오 컨텐츠를 디지털화하고, 재생 장치로 오디오 컨텐츠를 나타내는 데이터를 전송할 수 있다.
위에서 언급된 바와 같이, 수신된 오디오 컨텐츠는 재생 장치에 의한 재생을 위해 설계된다. 예를 들어, (도 1의 컨트롤 장치(126 또는 128)와 같은) 컨트롤 장치는 예컨대, 일부 오디오 컨텐츠로 하여금 재생 장치의 재생 큐에 위치되도록 함으로써, 일부 오디오 컨텐츠를 재생하도록 재생 장치에 지시할 수 있다. 오디오 트랙 또는 다른 오디오 컨텐츠를 그러한 큐 안으로 위치시키는 것은, 재생 장치로 하여금, 예컨대 재생이 컨트롤 장치 또는 재생 장치 자체에 있는 컨트롤(예컨대, 재생/정지 버튼)을 통하여 개시된 이후, 오디오 컨텐츠를 검색하도록 한다. 재생 장치는 다른 예시 중에서도, 오디오 컨텐츠를 아날로그 또는 디지털 라인 인 인터페이스를 통하여 재생 장치로 향하게 하거나 오디오 컨텐츠 스트림을 네트워크 인터페이스를 통하여 재생 장치로 향하게 함으로써, 로컬 또는 원격 오디오 소스로부터 오디오 컨텐츠를 검색할 수 있다.
예시 내에서, 재생 장치는 수신된 오디오 컨텐츠의 적어도 일부를 메모리에 저장할 수 있다. 예를 들어, 재생 장치는 선입선출 버퍼(예컨대, 원형의 버퍼)에서 수신된 오디오 컨텐츠를 버퍼링할 수 있다. 이러한 구현예에서, 수신된 오디오의 부분은, 수신될 때, 버퍼에 저장되고, 수신된 오디오 컨텐츠가 활성 단어를 포함하는지를 결정하도록 재생 장치를 인에이블하도록 프로세싱됨에 따라 제거된다.
b. 오디오 컨텐츠에서 하나 이상의 활성 단어 검출
도 8을 다시 참조하면, 블록(804)에서, 구현예(800)는 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서 하나 이상의 활성 단어를 검출하는 것을 수반한다. 예를 들어, 재생 장치는 오디오 컨텐츠를 나타내는 수신된 데이터를 분석하여 임의의 음성 서비스에 대한 활성 단어 오디오 컨텐츠에 나타나는지를 결정할 수 있고, 오디오 컨텐츠가 재생되는 경우, 활성 단어가 들을 수 있게 재생될 것이다. 위에서 언급된 바와 같이, 일부 구현예에서, 재생 장치는 프로세싱 시스템(예컨대, 프로세싱 시스템(500))을 포함하고, (도 5의 활성 단어 검출 컴포넌트(504)와 같은) 활성 단어 검출 컴포넌트를 사용하여 오디오 컨텐츠 내에서 활성 단어를 검출할 수 있다.
재생 장치는 하나 이상의 활성 단어 검출 알고리즘을 사용하여 수신된 오디오 컨텐츠를 분석할 수 있다. 예시적인 활성 단어 검출 알고리즘은 입력으로서 오디오 녹음을 받아들이고, 출력으로서 활성 단어가 녹음 내에 존재하는지의 지표를 제공한다. 많은 당사자 및 제3자 활성 단어 검출 알고리즘이 알려져 있고 상업적으로 이용 가능하다. 예를 들어, 음성 서비스의 오퍼레이터는 제3자 장치에서 사용 가능한 그들의 알고리즘을 만들 수 있다. 대안적으로, 알고리즘은 일부 활성 단어를 검출하도록 트레이닝될 수 있다.
일부 구현예에서, 재생 장치는 마이크로폰을 통하여 녹음된 오디오에서 활성 단어를 검출하기 위해 NMD에 의해 활용되는 바와 같이, 오디오 컨텐츠를 나타내는 수신된 데이터 상에 동일하거나 유사한 알고리즘을 사용할 수 있다. 그러한 방식에서, 재생 장치는 오디오 컨텐츠가 NMD의 가청 범위에서 재생되는지를 NMD가 검출할 것임에 따라, 오디오 컨텐츠에서 동일하거나 유사한 활성 단어를 검출할 수 있다. 그러나, NMD가 다양한 환경 조건(예컨대, 시끄러운 집)에서 매우 다양한 사람의 음성에 의해 말해진 마이크로폰으로 녹음된 오디오 상에 활성 단어 검출 알고리즘을 실행하는 경우, 이러한 변동성 없이 수신된 오디오 컨텐츠 상에서 동작하는 활성 단어 알고리즘은 활성 단어를 검출하는 것에서 보다 더 효과적일 수 있다.
분석 동안, 재생 장치는 각 활성 단어가 수신된 오디오 컨텐츠에서 발생하는 곳이 어디인지를 결정할 수 있다. 활성 단어를 포함하도록 결정되는 오디오 컨텐츠의 부분을 식별하는 것 이후에, 재생 장치는 하나 이상의 타임스탬프(예컨대, 활성 단어에 대한 시작 시간을 나타내는 타임스탬프와 혹은 활성 단어에 대한 중단 시간을 나타내는 다른 타임스탬프)를 사용하여 오디오 컨텐츠의 이러한 부분을 주목할 수 있다. 궁극적으로, 이러한 타임 스탬프는 각 타임 스탬프에 대응하는 활성 단어에 대한 하나 이상의 NMD의 활성 응답을 디세이블하는 데 사용될 수 있다.
일 예시에서, 재생 장치는 수신된 오디오 컨텐츠를 알려진 길이의 세그먼트로 분할할 수 있다. 이후, 재생 장치는 활성 단어가 검출된 세그먼트를 식별함으로써 의해 활성 단어를 포함하는 오디오 컨텐츠의 부분-즉, 세그먼트-을 식별한다. 예를 들어, 각 세그먼트가 3초이고, 활성 단어가 제4 세그먼트에서 검출되는 경우, 활성 단어는 녹음에서 9 내지 12초 사이에 위치된다. 일부 경우에서, 재생 장치는 오디오 녹음을 오버랩핑 세그먼트로 분리하여, 인지할 수 없는 부분(예컨대, "Hey"를 나타내는 일 섹션과 "Siri"를 나타내는 다른 세그먼트)으로 활성 단어가 쪼개지는 것을 피할 수 있다. 오디오 녹음 내에서 활성 단어의 위치를 결정하기 위한 다른 기법도 활용될 수 있다.
일부 경우에서, 재생 장치는 수신된 오디오 컨텐츠 상에 복수의 활성 단어 검출 알고리즘을 동시에(또는 실질적으로 동시에) 실행한다. 위에서 언급된 바와 같이, 다양한 음성 서비스(예컨대, AMAZON의 ALEXA®, APPLE의 SIRI® 또는 MICROSOFT의 CORTANA®)는 그들의 각 음성 서비스를 작동시키기 위한 다양한 활성 단어를 각각 사용할 수 있다. 또한, 일부 음성 서비스는 선호된 활성 단어 또는 맞춤 활성 단어를 구성하도록 사용자 선택을 허용할 수 있다. 복수의 서비스(및/또는 다양한 활성 단어)를 지원하기 위해, 재생 장치는 각 지원되는 음성 서비스에 대한 활성 단어 검출 알고리즘을 통하여 수신된 오디오 컨텐츠를 병렬로 실행할 수 있다. 예를 들어, 재생 장치는 오디오 컨텐츠가 재생 장치에 의한 재생되기 전에, 오디오 컨텐츠로 제1 음성 서비스에 대한 제1 오디오 검출 알고리즘을 적용하여 제1 음성 서비스에 대한 적어도 하나의 제1 활성 단어를 검출하고, 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠로 제2 음성 서비스에 대한 제2 오디오 검출 알고리즘을 적용하여 제2 음성 서비스에 대한 적어도 하나의 제2 활성 단어를 검출할 수 있다. 재생 장치는 예컨대 각 음성 서비스에 대하여 또한, 추가적 오디오 검출 알고리즘을 오디오 컨텐츠에 적용할 수 있다.
c. 오디오 컨텐츠의 재생 동안, 하나 이상의 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블
도 8의 블록(806)에서, 구현예(800)는 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 것을 수반한다. 예를 들어, 재생 장치는 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 재생 장치의 가청 범위에 있는 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 할 수 있다. 위에서 언급된 바와 같이, 재생 장치는 알림 컴포넌트(예컨대, 도 5의 알림 컴포넌트(506))를 포함하는 프로세싱 시스템(500)을 구현할 수 있고, 알림 컴포넌트를 사용하여 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 할 수 있다.
위에서 언급된 바와 같이, NMD의 활성 응답은 활성 단어를 검출하는 프로그래밍된 응답을 지칭한다. 활성 응답이 인에이블되는 경우, 활성 단어를 검출하는 것에 응답하여, NMD의 활성 응답은 NMD로 하여금 마이크로폰을 통하여 특정한 활성 단어에 후속하는 음성 명령을 듣도록 한다. NMD는 음성 명령을 수행하기 위한 음성 서비스를 작동시킨다. 그러나 활성 응답이 디세이블되는 경우, NMD는 음성 명령을 듣지 않을 수 있고, 음성 명령을 수행하기 위한 음성 서비스를 작동하지 않을 것이다.
일부 구현예에서, 재생 장치 자체는 NMD를 포함한다(예컨대, NMD(700)은 재생 장치 내에 구현됨). 그러한 구현예에서, 재생 장치는, 재생 장치가 오디오 컨텐츠를 재생하는 한편, 검출된 하나 이상의 활성 단어에 대한 NMD의 활성 응답을 디세이블한다. 예를 들어, 재생 장치에서 구현되는 프로세싱 시스템(500)의 인스턴스는 하나 이상의 활성 단어 및 그 재생 시간을 NMD에 알려 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 NMD의 활성 응답을 디세이블하도록 할 수 있다. 예를 들어, 프로세싱 시스템은 다른 예시 중에서도, RAM 내 플래그를 수정하여 활성 응답을 디세이블하거나 내부 통신 버스를 사용하여 NMD에 메시징함으로써, NMD에 알릴 수 있다. 이후, 오디오 컨텐츠를 재생하는 동안, 재생 장치의 NMD는 마이크로폰을 통하여, 재생 장치에 의해 재생되는 오디오 컨텐츠를 녹음하고, 녹음된 오디오 컨텐츠 내의 하나 이상의 활성 단어에 대한 NMD의 활성 응답을 디세이블할 수 있다.
예시적인 구현예 내에서, 재생 장치는 집 내의 모든 네트워킹된 마이크로폰 장치로 하여금 각 활성 응답을 디세이블할 수 있다. 예를 들어, 도 1에 도시된 재생 장치(104)는, 재생 장치(104)가 하나 이상의 활성 단어를 포함하는 오디오 컨텐츠를 재생하면, NMD(132 및 134)로 하여금 그 각 활성 응답을 디세이블하도록 할 수 있다. 또한, 재생 장치(102 또는 106-124) 중 임의의 것이 NMD를 구현하는 경우, 재생 장치(104)는, 재생 장치(104)가 하나 이상의 활성 단어를 포함하는 오디오 컨텐츠를 재생하면, 이러한 장치로 하여금 그 각 활성 응답을 디세이블하도록 할 수 있다. 더 추가적으로, 재생 장치(104) 자체가 NMD를 구현하는 경우 또는 컨트롤 장치(126 또는 128)가 NMD를 구현하는 경우, 재생 장치(104)는, 재생 장치(104)가 오디오 컨텐츠를 재생하면, 이러한 장치로 하여금 그 각 활성 응답을 디세이블하도록 할 수 있다.
대안적으로, 재생 장치는 집 내의 NMD의 서브세트로 하여금 그들의 각 활성 응답을 디세이블하도록 할 수 있다. 예를 들어, 재생 장치는 재생 장치의 가청 범위 내의 NMD로 하여금 활성 응답을 디세이블하도록 할 수 있다. 대안적으로 재생 장치는 재생 장치와 연관되어 온 NMD로 하여금 그 각 활성 응답을 디세이블하도록 할 수 있다.
가청 범위는 임의의 적합한 기법을 사용하여 결정될 수 있다. 일부 구현예에서, 가청 범위는 재생 장치의 재생 구성에 기초하여 규정된다. 예를 들어, 재생 장치가 하나 이상의 재생 장치와 동기 재생 구성으로 있는 경우, 이러한 재생 장치는 재생 장치의 가청 범위에 있는 것으로 추정될 수 있다. 따라서, 이러한 재생 장치 중 임의의 것이 NMD를 구현하는 경우, 이러한 재생 장치의 각 활성 응답은 디세이블된다. 재생 장치는, 집에 있는 재생 장치 전반에 걸쳐 동기화되는 하나 이상의 상태 변수에 저장될 수 있는 재생 장치의 구성을 참조함으로써, 그러한 NMD가 재생 장치의 가청범위에 있다고 결정할 수 있다.
다른 예시에서, 가청 범위는 셋업 절차(예컨대, 교정 절차) 동안 규정된다. 이러한 셋업 절차 동안, 집 내의 NMD는 집에 있는 재생 장치에 의해 재생되는 오디오 신호(예컨대, 톤)를 듣도록 지시될 수 있다. NMD가 그 마이크로폰을 통하여 오디오 신호를 검출할 수 있는 경우, 그 NMD는 가청 범위 내에 있다고 추정될 수 있다. 집 내의 재생 장치는 다양한 음량에서 오디오 신호의 재생을 통해 순환하도록 지시되어, 임의의 소정의 음량 레벨에서 각 재생 장치의 가청 범위에 있는 NMD의 세트를 결정할 수 있다. 예시적인 교정 절차는 교정 사운드의 출력을 수반할 수 있으며, 이는 집 내에서 NMD에 의해 검출될 오디오 신호로서 역할할 수 있다.
예컨대, 예시적인 셋업 절차 동안, 도 1의 컨트롤 장치(126)는 주 침실 구역에 있는 재생 장치(즉, 재생 장치(122 및 124))에 지시하여 오디오 신호를 출력하도록 할 수 있다. 대부분 음량 레벨에서, 이러한 출력은 NMD(134)에 의해 검출된다. 그러나 음량 레벨이 증가됨에 따라, 다른 NMD도 출력을 검출하기 시작한다. 예를 들어, 재생 장치(118) 및 컨트롤 장치(128)는 NMD를 각각 구현하고 비교적 높은 음량 레벨에서 오디오 신호 출력을 검출할 수 있다. 이와 같이, 예시적인 셋업 절차를 통하여, NMD(134)는 일부 음량 범위(예컨대, 5% -100%)에서 재생 장치(122 및 124)의 가청 범위에 있는 것으로 규정되는 한편, 재생 장치(118) 및 컨트롤 장치(128)가 고려되는 동안, 일부 높은 음량 범위(예컨대, 음량 레벨>80%)에서 재생 장치(122 및 124)의 가청 범위에 있는 것으로 규정된다. 이러한 절차는 집 내의 NMD와 다른 재생 장치에 대하여 반복될 수 있다.
다른 예시에서, NMD는, 알려진 물리적 근접성에 기초하여 하나 이상의 재생 장치와 페어링될 수 있다. 예를 들어, 도 1을 다시 참조하면, NMD(134)는 주 침실 구역에 대한 NMD로서 재생 장치(122 및/또는 124)와 페어링될 수 있다. 그러한 페어링은 사용자 인터페이스를 통하여, 컨트롤 장치(126 또는 128)와 같은 컨트롤 장치 상에서 구성될 수 있다. 다른 예시로서, NMD(132)는, NMD가 주방 구역과 페어링되고 주방 구역이 식당/및 거실 구역에 물리적 근접성이 있는 것으로 알려진 근거 또는 주방 구역이 식당 또는 거실 구역과 구역 그룹으로 형성되는 근거로, 재생 장치(104, 106, 108, 110, 112 및 114)와 페어링 될 수 있다. NMD가 하나 이상 재생 장치와 페어링되는 경우, NMD는 이러한 재생 장치의 가청 범위 내에 있다고 추정될 수 있다.
미디어 재생 시스템의 재생 장치에 근접성에 있는 NMD의 존재를 검출하기 위한 다른 예시는 2016.4.14에 출원되고 제목이 “디폴트 재생 장치 지정”인 미국 출원 제15/098,867호; 2016.4.14에 출원되고 제목이 “디폴트 재생 장치”인 미국 출원 제15/098,892호; 제목이 “오디오 응답 재생”인 미국 출원 제15/237,133호; 및 2016.8.5에 출원되고 제목이 “오디오 재생 장치에 관하여 네트워킹된 마이크로폰 장치의 방향을 검출”인 미국 출원 제15/229,855호에서 설명된다. 이러한 출원 각각은 그 전체가 참조로서 포함된다.
위에서 제안된 바와 같이, 일부 경우에서, 재생 장치는 예컨대 구역 그룹, 스테레오 쌍 또는 서라운드 사운드 구성에서 하나 이상의 추가적인 재생 장치와 동시에 오디오를 재생하도록 구성될 수 있다. 그러한 구성은, 재생 장치의 가청 범위에 있는 임의의 NMD 또는 하나 이상의 추가적 재생 장치 중 임의의 것이 동기로 이러한 재생 장치에 의해 재생된 오디오 컨텐츠 내 활성 단어에 응답하여 잘못 트리거할 수 있음에 따라, 재생 장치의 가청 범위를 연장할 수 있다. 이와 같이, 재생 장치가 하나 이상의 추가적 재생 장치와 현재 동기화 재생 구성으로 있는 경우, 재생 장치는 가청 범위에 있거나 이러한 추가적 재생 장치와 연관된 NMD의 각 활성 응답을 디세이블할 수 있다.
일부 구현예에서, 재생 장치는 수신된 오디오 컨텐츠의 재생 동안, 하나 이상의 NMD에 대한 네트워크 인터페이스를 통하여 하나 이상의 NMD로 하여금 각 활성 응답을 디세이블하도록 하는 명령어를 네트워크 인터페이스를 통하여 하나 이상의 NMD로 송신함으로써, 하나 이상의 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 그 각 활성 응답을 디세이블하도록 한다. 위에서 언급된 바와 같이, 미디어 재생 시스템(예컨대, 컨트롤 장치, 재생 장치 및 NMD)의 다양한 장치는 근거리 네트워크를 통하여(예컨대, 도 1의 유선 또는 무선 네트워크 라우터(130)에 의해 형성된 근거리 네트워크를 통하여) 서로 연결되어 집 내의 장치 간의 다른 메시징과 명령어의 교환을 허용할 수 있다. 미디어 재생 시스템의 이러한 장치는 시스템에서 다른 장치로부터의 일부 명령에 응답하여 각각 프로그래밍될 수 있다.
일부 예시에서, 그러한 명령어는 하나 이상의 NMD가 활성 단어를, 재생 장치에 의해 재생됨에 따라 검출하는 것으로부터 방지할 수 있다. 예를 들어, 재생 장치는 하나 이상의 NMD에 지시하여, 하나 이상의 기간(즉, 예컨대 타임 스탬프에 의해 기록되는, 활성 단어가 재생 장치에 의해 재생될 때와 대응하는 기간)동안 활성 단어를 듣는 것을 멈출 수 있다(예컨대, 녹음된 오디오 프로세싱을 멈출 수 있음). 대안적으로, 재생 장치는 하나 이상의 NMD에 지시하여 그 각 마이크로폰을 일시적으로(예컨대, 위에서 언급된 기간 동안) 디세이블할 수 있다. 또 다른 예시에서, 재생 장치는 하나 이상의 NMD에 지시하여 그 마이크로폰 어레이를 사용하여, 재생 장치의 방향으로 청취 무효(listening NULL)를 생성하여 NMD가 활성 단어를 검출하지 않을 수 있다. 다른 예시도 가능하다. 예를 들어, 재생 장치가 활성 단어를 포함하는 오디오 컨텐츠의 부분을 재생하기 직전에, 재생 장치는 하나 이상의 NMD에 지시하여 활성 단어 검출을 디세이블하는 제1 메시지를 송신할 수 있다. 이후, 재생 장치가 활성 단어를 포함하는 오디오 컨텐츠의 부분을 재생한 직후에, 재생 장치는 하나 이상의 NMD에 지시하여 활성 단어 검출을 인에이블하는 제2 메시지를 송신할 수 있다.
예컨대, 도 9는 예시적인 메시지(900)를 도시하며, 이는 재생 장치가 하나 이상의 NMD로 송신하여 하나 이상의 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 할 수 있다. 메시지(900)는 (이더넷 패킷과 프레임의 구조를 명시하는) IEEE 802.3 사양과 같은, 사양과 일치할 수 있다. 도시된 바와 같이, 메시지(900)는 프리앰블(902)을 포함하며, 이는 네트워크 상의 장치(다른 것들 중에서도, 예컨대, NMD, 재생 장치 및/또는 컨트롤 장치)가 그들의 수신자 클락을 동기화 할 수 있는 교호하는 비트의 패턴을 포함한다. 메시지(900)는 또한 프리앰블(이더넷 패킷의 제1 필드)의 끝을 마크하는 프레임 구분의 시작(start of frame delimiter; SFD)(904)과 메시지의 이더넷 프레임 부분의 시작을 포함한다. 메시지(900)는 또한 목적지(예컨대, NMD) 및 소스(예컨대, 재생 장치)를 나타내는 목적지 주소(906) 및 소스 주소(908)를 포함한다. 메시지(900)는 페이로드(910)를 더 포함한다. 페이로드(910)는 NMD(즉, 목적지 주소(906)에 의해 나타나는 NMD)로 하여금 하나 이상의 활성 단어에 대한 활성 응답을 디세이블하도록 하는 명령어를 포함한다. 메시지(900)는 프레임 검사 순서(frame check sequence; FCS)(912)를 더 포함하며, 이는 수신됨에 따라 프레임 내에 손상된 데이터의 검출을 허용하는 순환 중복 검사 값이다.
명령어는 둘 이상의 이더넷 패킷(예컨대, 메시지(900) 중 둘 이상)을 사용하여 전송될 수 있다. 예를 들어, 하나의 NMD로의 명령어는 메시지(900) 중 둘 이상의 인스턴스의 페이로드 전체에 걸쳐 분할될 수 있다. 또한, 복수의 NMD로의 명령어는 메시지(900) 중 하나 이상의 각 인스턴스에서 각각 송신될 수 있다. 다른 예시도 가능하다.
예를 들어, 도 10(a), 10(b), 10(c) 및 10(d)는 하나 이상의 메시지의 페이로드(예컨대, 메시지(900)의 페이로드(910))에 있어 NMD로 전송될 수 있는 예시적인 명령어(1000A, 1000B, 1000C 및 1000D)를 예시한다. 도 10(a)에 도시된 바와 같이, 명령어(1000A)는 타임 스탬프(1004A, 1006A, 1008A 및 1010A)에 의해 정의되는 일부 기간 동안 NMD로 하여금 활성 응답을 디세이블하도록 하는 명령(1002A)을 포함한다. 일부 예시에서, 타임 스탬프(1004A 및 1006A)는, 재생 장치가 제1 활성 단어를 포함하는 오디오 컨텐츠의 부분을 재생할 기간의 시작과 끝을 각각 지정한다. 유사하게, 타임 스탬프(1008A 및 1010A)는, 재생 장치가 제2 활성 단어를 포함하는 오디오 컨텐츠의 부분을 재생할 기간의 시작과 끝을 각각 지정한다. 명령어(1000A)는 추가적인 기간을 정의하는 타임 스탬프를 더 포함할 수 있다. 대안적으로 스탬프(1004A, 1006A, 1008A 및 1010A)는 다른 예시 중에서도, 오디오의 특정한 프레임에 대한 재생 시간; 송신하거나 수신하는 장치 상의 시스템 클락에 대응하는 시간; 또는 NMD 및 재생 장치 둘 다에 대해 알려진 글로벌 클락에 대응하는 시간에 대응할 수 있다.
도 10(b)는 명령어(1000B)를 도시하며, 이는 NMD로 하여금 좌표(1004B 및 1006B)에 의해 정의되는 일부 방향에서 청취 무효를 생성하도록 하기 위한 명령(1002B)을 포함한다. 좌표(1004B 및 1006B)는 NMD에 대한 각 재생 장치의 방향을 나타낸다. 예를 들어, 도 1을 다시 참조하면, 명령어(1000B)의 예시적인 인스턴스는 NMD(134)에 대한 재생 장치(122 및 124)의 방향을 나타내기 위한 좌표(1004B 및 1006B)를 포함할 수 있다. 이러한 예시에서, 좌표(1004B 및 1006B)는 재생 장치(122)가 NMD(134)에 관하여 O°(즉, NMD(134)의 바로 정면)인 한편 재생 장치(124)는 NMD(134)에 관하여 왼쪽으로 45°에 있다는 점을 NMD에 대해서 나타낼 수 있다. 서로에 관하여 집 내에 있는 장치의 각 위치는 셋업 또는 구성 절차에 의해 미리 규정될 수 있다.
도 10(c) 및 10(d)는 명령어(1000C 및 1000D)를 각각 도시한다. 명령어(1000C)는 수신하는 NMD로 하여금 활성 단어 검출을 디세이블하도록 하기 위한 명령(1002C)을 포함한다. 재생 장치는 활성 단어를 포함하는 오디오 컨텐츠의 부분을 재생하기 직전에, 그러한 명령어를 송신할 수 있다. 명령어(1000D)는 수신하는 NMD로 하여금 활성 단어 검출을 인에이블하도록 하기 위한 명령(1002D)을 포함한다. 재생 장치는 활성 단어를 포함하는 오디오 컨텐츠의 부분을 재생한 직후, 그러한 명령어를 송신할 수 있다.
추가 예시에서, 하나 이상의 NMD는 활성 단어를 검출할 수 있지만, 재생 장치는 하나 이상의 NMD에 지시하여 활성 응답을 억제한다. 예를 들어, 재생 장치는 하나 이상의 NMD에 지시하여, 일부 기간 동안 활성 단어를 무시하거나, 일부 기간 동안 모든 오디오를 무시할 수 있다. 다른 예시도 가능하다.
다른 예시와 같이, 재생 장치는 오디오 컨텐츠에서 (또는 오디오 컨텐츠의 부분에서) 활성 단어의 수를 카운트할 수 있다. 예를 들어, 재생 장치는 예시적인 오디오 컨텐츠에서 세 개의 활성 단어를 검출할 수 있다. 위에서 언급된 바와 같이, 다양한 음성 서비스에 대한 다양한 활성 단어를 포함하는 활성 단어의 임의의 조합을 포함할 수 있다. 이후, 재생 장치는 부근에 있는 하나 이상의 NMD에 지시하여, 그들이 카운트와 같은 수의 활성 단어를 검출할 때까지 활성 단어를 무시(예컨대, 다음 세 개의 활성 단어를 무시)할 수 있다.
대안적으로, 재생 장치는 오디오 컨텐츠의 세그먼트에서 음향 마커를 포함하도록 오디오 컨텐츠를 동적으로 수정함으로써, 하나 이상의 NMD로 하여금 검출된 활성 단어에 대한 각 활성 응답을 디세이블하도록 한다. 예를 들어, 재생 장치는 녹음된 오디오 컨텐츠에서 다른 마커 또는 오디오 톤을 삽입(예컨대, 혼합)하여, 오디오 컨텐츠에서 검출된 활성 단어를 지정할 수 있다. 이후, NMD는 활성 단어와 관련하여 음향 마커를 검출하는 경우(예컨대, 활성 단어 직전 또는 활성 단어와 동시에), 활성 단어의 인스턴스를 무시하도록 지시되거나 미리 프로그래밍될 수 있다. 그러한 기법을 사용하여, 재생 장치의 가청 범위에 있는 NMD는 미리 결정되거나 추정될 필요가 없다. 그보다는, 음향 마커가 오디오 컨텐츠와 재생되므로, 오디오 컨텐츠를 검출하도록 가청 범위에 있는 (그리고 이와 같이, 이러한 컨텐츠에 의해 잘못 트리거될 수 있는) NMD는 또한 음향 마커를 검출하고 응답하여 그 활성 응답을 디세이블하기 위한 범위에 있다. 복수의 NMD가 재생 장치의 가청 범위에 있는 경우, 응답으로 활성 단어를 검출하는 각각의 NMD는 연관된 음향 마커를 검출하는 것에 응답하여 활성 단어에 대한 활성 응답을 디세이블한다.
d. 오디오 컨텐츠를 재생
도 8의 블록(808)에서, 구현예(800)는 하나 이상의 스피커를 통하여 오디오 컨텐츠를 재생하는 것을 수반한다. 재생 장치는 하나 이상의 오디오 변환기(예컨대, 스피커)를 통하여 오디오 컨텐츠를 재생한다. 일부 경우에서, 스피커는 동일한 하우징에서 재생 장치와 함께 위치된다. 대안적으로, 하나 이상의 별개의 패시브 스피커로 스피커 잭을 통하여 증폭된 오디오를 제공할 수 있다. 다른 예시로서, 재생 장치는 증폭기로 회선 레벨 오디오를 제공함으로써 오디오 컨텐츠를 재생할 수 있으며, 이는 이후 결국 스피커 잭을 통하여 하나 이상의 패시브 스피커로 증폭된 오디오를 제공한다.
위에서 언급된 바와 같이, 일부 경우에서, 재생 장치는 하나 이상의 추가적 재생 장치와 동기화 재생 구성으로 구성된다. 그러한 경우에서, 오디오 컨텐츠를 재생하는 것은 하나 이상의 추가적인 재생 장치와 동기로 오디오 컨텐츠를 재생하는 것을 수반한다. 일부 재생 구성(예컨대, 스테레오 쌍 또는 서라운드)에서, 재생 구성에 있는 각 재생 장치는 재생 구성에 있는 다른 재생 장치와 동기로 오디오 컨텐츠의 부분을 재생한다.
일부 구현예에서, 재생 장치는 재생을 위해 하나 이상의 추가적 재생 장치로 오디오 컨텐츠를 제공하여 재생 장치와 오디오 컨텐츠의 동기 재생을 용이하게 한다. 그러한 구현예에서, 재생 장치는 재생 장치와 하나 이상의 추가적인 재생 장치를 포함하는 동기화 그룹에 대하여 그룹 조정자(group coordinator)로서 동작할 수 있다. 그룹 조정자로서, 재생 장치는 또한 타이밍 정보를 하나 이상의 추가적인 재생 장치로 제공하여, 동기화 그룹이 동기 재생을 스케줄링하는 것을 용이하게 할 수 있다. 재생 장치는 네트워크 인터페이스를 통하여 오디오 컨텐츠 및/또는 타이밍 정보를 제공한다.
위에서 언급된 바와 같이, 일부 경우에서, 재생 장치는 음향 마커를 포함하도록 오디오 컨텐츠를 수정한다. 그러한 실시예에서, 재생 장치가 동기화 그룹에 있는 경우, 재생 장치는 수정된 오디오 컨텐츠를 동기화 그룹 내 다른 장치로 제공할 수 있다. 동기화 그룹 내 각 재생 장치는 이후 그룹에서 다른 재생 장치와 수정된 오디오 컨텐츠를 동기로 재생할 수 있다.
예컨대, 일 예시에서, 재생 장치(114 및 122 및 124)는 동기로 오디오 컨텐츠를 재생하도록 구성되는 구역 그룹(즉, 주방 + 주 침실 구역 그룹)에 있다. 구역 그룹에 의한 재생을 위해 지정된 오디오 컨텐츠에서 활성 단어를 검출하는 것 이후에, 재생 장치(114)는 음향 마커를 포함하여 오디오 컨텐츠에 활성 단어를 지정하도록 오디오 컨텐츠를 수정할 수 있다. 재생 장치(114)는 이후 수정된 오디오 컨텐츠를 재생 장치(122)로 제공하여 수정된 오디오 컨텐츠의 동기 재생을 용이하게 할 수 있다.
IV. 활성 응답을 디세이블하기 위한 NMD에 대한 예시적인 기법
위에서 논의된 바와 같이, 여기서 설명된 실시예는 활성 응답을 디세이블하는 것을 수반할 수 있다. 도 11은 NMD가 하나 이상의 검출된 활성 단어에 대한 활성 응답을 디세이블하는 예시적인 구현예(1100)를 예시한다.
a. 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신
블록(1102)에서, 구현예(1100)는 녹음된 오디오 컨텐츠를 나타내는 데이터를 수신하는 것을 수반한다. 예를 들어, NMD는 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 수신할 수 있다. 예시적인 NMD는 도 1에 도시된 NMD(132 및 134)중 임의의 것을 포함할 수 있으며, 이는 예를 들어, 도 7의 NMD(700)로서 구현될 수 있다. 예시적인 재생 장치는 도 1에 도시된 재생 장치(102, 104, 106, 108, 110, 112, 114, 116, 118, 120, 122 및 124) 중 임의의 것을 포함할 수 있으며, 이는, 예를 들어, 도 2의 재생 장치(200)에 의해 나타난 바와 같이 구현될 수 있다. 추가 예시적인 NMD는 그러한 장치가 재생 또는 컨트롤 장치로서 그들의 기능성에 더하여 NMD를 구현할 수 있음에 따라 이러한 재생 장치 및/또는 컨트롤 장치(126 및/또는 128) 중 임의의 것을 포함할 수 있다. NMD는 프로세싱 시스템(예컨대, 프로세싱 시스템(500))을 포함하고 (도 5의 오디오 입력/출력 컴포넌트(502)와 같은) 오디오 입력/출력 컴포넌트를 사용하여 오디오 컨텐츠를 나타내는 데이터를 수신할 수 있다.
NMD는 다른 예시 중에서도, 유선 또는 무선 네트워크 또는 아날로그 또는 디지털 라인 인 인터페이스일 수 있는 입력 인터페이스를 통하여 오디오 컨텐츠를 수신할 수 있다. 예를 들어, NMD는 다른 가능성 중에서도, WAN, LAN 및 PAN과 같은 하나 이상의 유형의 네트워크에서 네트워크 인터페이스를 통하여 네트워크 소스로부터 오디오 컨텐츠를 수신할 수 있다.
NMD는 로컬 또는 원격 오디오 소스로부터 오디오 컨텐츠를 나타내는 데이터를 수신할 수 있다. 예를 들어, NMD는 근거리 네트워크 상의 다른 장치 또는 로컬 미디어 서버로부터, NMD와 통신하는 다른 장치(예컨대, 네트워크 인터페이스를 통하여 근거리 네트워크에서 NMD로 연결되는 재생 장치)에 의해 또는 NMD에 의해 판독되는 (CD, DVD, Blu-Ray, 플래시 메모리 또는 하드 드라이브와 같은) 매체로부터 또는 NMD 자체 상의 데이터 저장소로부터 오디오 컨텐츠를 수신할 수 있다.
NMD는 오디오 컨텐츠 스트림처럼 예컨대, 하나 이상의 클라우드 서버로부터 오디오 컨텐츠를 수신할 수 있다. 예를 들어, NMD는 네트워크 인터페이스를 통하여 URL로부터 오디오 컨텐츠 스트림을 검색할 수 있다. 대안적으로, NMD는 NMD 상의 라인 인 인터페이스 또는 NMD와 통신하는 다른 장치(예컨대, 네트워크 인터페이스 통하여 근거리 네트워크에서 NMD로 연결되는 재생 장치)로부터 오디오 컨텐츠를 수신할 수 있다.
일부 경우에서, NMD는 예컨대 아날로그 라인 인 인터페이스를 통하여, 아날로그 포맷에서 오디오 컨텐츠를 수신할 수 있다. 이러한 경우에서, NMD는 프로세싱을 위해 적합한 포맷으로 (예컨대, 소프트웨어 또는 하드웨어 기반 아날로그 디지털 변환기를 사용하여) 아날로그 오디오를 디지털화한다. 대안적으로, NMD(예컨대, 재생 장치)와 통신하는 장치는 아날로그 포맷에서 오디오 컨텐츠를 수신하고, 오디오 컨텐츠를 디지털화하고, 재생 장치로 오디오 컨텐츠를 나타내는 데이터를 전송할 수 있다.
위에서 언급된 바와 같이, 수신된 오디오 컨텐츠는 재생 장치에 의한 재생을 위해 설계된다. 예를 들어, (도 1의 컨트롤 장치(126 또는 128)과 같은) 컨트롤 장치는 예컨대, 일부 오디오 컨텐츠로 하여금 재생 장치의 재생 큐에 위치되도록 함으로써 일부 오디오 컨텐츠를 재생하도록 재생 장치에 지시할 수 있다. 오디오 트랙 또는 다른 오디오 컨텐츠를 그러한 큐에 위치시키는 것은, 예컨대 재생이 컨트롤 장치 또는 재생 장치 자체 상의 컨트롤(예컨대, 재생/정지 버튼)을 통하여 개시된 이후, 재생 장치로 하여금 오디오 컨텐츠를 검색하도록 한다. NMD는 이러한 큐로 접근할 수 있다(예컨대, 큐의 컨텐츠는 LAN 또는 다른 네트워크를 통하여, NMD와 공유될 수 있음). 그러한 접근을 고려하여 볼 때, NMD는 다른 예시 중에서도, 아날로그 또는 디지털 라인 인 인터페이스를 통하여 재생 장치로 오디오 컨텐츠를 향하게 함으로써 또는 네트워크 인터페이스를 통하여 재생 장치로 오디오 컨텐츠 스트림을 향하게 함으로써, 로컬 또는 원격 오디오 소스로부터 오디오 컨텐츠를 검색할 수 있다.
일부 경우에서, 수신된 오디오 컨텐츠는 둘 이상의 재생 장치에 의한 재생을 위해 설계될 수 있다. 예를 들어, 둘 이상의 재생 장치는 동기화 그룹(예컨대, 구역 그룹, 스테레오 쌍 또는 서라운드 사운드 구성)으로 구성될 수 있다. 특정한 오디오 컨텐츠는 이러한 동기화 그룹에 의한 재생을 위해 지정될 수 있다.
예시 내에서, 프로세싱 시스템(500)은 메모리에서 수신된 오디오 컨텐츠의 적어도 일부를 저장할 수 있다. 예를 들어, 프로세싱 시스템(500)은 선입선출 버퍼(예컨대, 원형의 버퍼)에서 수신된 오디오 컨텐츠를 버퍼링할 수 있다. 이러한 구현예에서, 수신된 오디오의 부분은, 수신될 때, 버퍼에 저장되고, 수신된 오디오 컨텐츠가 활성 단어를 포함하는지를 결정하도록 재생 장치를 인에이블하도록 프로세싱됨에 따라 제거된다.
b. 오디오 컨텐츠에서 하나 이상의 활성 단어를 검출
도 11의 블록(1104)에서, 구현예(1100)는 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서 하나 이상의 활성 단어를 검출하는 것을 수반한다. 예를 들어, NMD는 오디오 컨텐츠를 나타내는 수신된 데이터를 분석하여 임의의 음성 서비스에 대한 활성 단어가 오디오 컨텐츠에서 나타나는지를 결정할 수 있고, 오디오 컨텐츠가 재생되는 경우, 활성 단어는 들을 수 있게 재생될 것이다. 위에서 언급된 바와 같이, 일부 구현예에서, NMD는 프로세싱 시스템(예컨대, 프로세싱 시스템(500))을 포함하고, (예컨대, 도 5의 활성 단어 검출 컴포넌트(504)와 같은) 활성 단어 검출 컴포넌트를 사용하여 오디오 컨텐츠 내에서 활성 단어를 검출할 수 있다.
NMD는 하나 이상의 활성 단어 검출 알고리즘을 사용하여 수신된 오디오 컨텐츠를 분석할 수 있다. 예시적인 활성 단어 검출 알고리즘은 입력으로서 오디오 녹음을 받아들이고, 출력으로서 활성 단어가 녹음에 존재하는지 여부의 지표를 제공한다. 많은 당사자 및 제3자 활성 단어 검출 알고리즘이 알려져 있고, 상업적으로 이용 가능하다. 예를 들어, 음성 서비스의 오퍼레이터는 제3자 장치에서 사용 가능한 그들의 알고리즘을 만들 수 있다. 대안적으로, 알고리즘은 일부 활성 단어를 검출하도록 트레이닝될 수 있다.
보통의 동작에서, NMD는 마이크로폰을 통하여 집 또는 다른 환경에서 사운드(예컨대, 사람 음성)를 듣고, 그 사운드가 활성 단어를 포함하는지를 검출하도록 활성 단어 검출 알고리즘을 통하여, 그 사운드의 오디오 녹음을 실행할 것이다. 이러한 프로세스에서, NMD는 사람 음성에 의해 말해진 활성 단어를 검출하기 위해 NMD에 의해 사용되는 바와 동일하거나 유사한 알고리즘을 사용할 수 있다. 그러나, 알고리즘으로의 입력이 마이크로폰을 통하여 녹음된 오디오인 대신, 입력은 재생 장치에 의한 재생을 위한 오디오 컨텐츠이다. 이러한 방식에서, NMD는, 오디오 컨텐츠가 NMD의 가청 범위에서 재생되었는지를 NMD가 검출할 것임에 따라, 오디오 컨텐츠에서 동일하거나 비슷한 활성 단어를 검출할 수 있다. 그러나, NMD가 보통 다양한 환경 조건(예컨대, 시끄러운 집)에서 매우 다양한 사람의 음성에 의해 말해진 마이크로폰으로 녹음된 오디오 상에 활성 단어 검출 알고리즘을 실행하는 경우, 이러한 변동성 없이 수신된 오디오 컨텐츠 상에서 동작하는 활성 단어 알고리즘은 활성 단어를 검출하는 것에서 보다 더 효과적일 수 있다.
분석 동안, NMD는 각 활성 단어가 수신된 오디오 컨텐츠 발생하는 곳이 어디인지를 결정할 수 있다. 활성 단어를 포함하도록 결정되는 오디오 컨텐츠의 부분을 식별하는 것 이후에, NMD는 하나 이상의 타임스탬프(예컨대, 활성 단어에 대한 시작 시간을 나타내는 타임스탬프 및 활성 단어에 대한 중단 시간을 나타내는 예컨대, 다른 타임 스탬프)를 사용하여 오디오 컨텐츠의 이러한 부분을 주목할 수 있다. 궁극적으로, 이러한 타임 스탬프는 각 타임 스탬프에 대응하는 활성 단어에 대한 NMD의 활성 응답을 디세이블하는 데 사용될 수 있다.
일 예시에서, NMD는 수신된 오디오 컨텐츠를 알려진 길이의 세그먼트로 분할할 수 있다. 이후, NMD는, 활성 단어가 검출된 세그먼트를 식별함으로써 활성 단어를 포함하는 오디오 컨텐츠의 부분-즉, 세그먼트-을 식별할 수 있다. 예를 들어, 각 세그먼트가 4초이고, 활성 단어가 제6 세그먼트에서 검출되는 경우, 활성 단어는 녹음에서 20 내지 24초 사이에 위치된다. 일부 경우에서, NMD는 오디오 녹음을 오디오 녹음을 오버랩핑 세그먼트로 분리하여, 인지할 수 없는 부분(예컨대, "Hey"를 나타내는 일 섹션 및 "Alexa"를 나타내는 다른 세그먼트)으로 활성 단어가 쪼개지는 것을 피할 수 있다. 오디오 녹음 내에서 활성 단어의 위치를 결정하기 위한 다른 기법 또한 활용될 수 있다.
일부 경우에서, NMD는 수신된 오디오 컨텐츠 상에서 동시에 복수의 활성 단어 검출 알고리즘을 실행한다. 위에서 언급된 바와 같이, 다양한 음성 서비스(예컨대, AMAZON의 ALEXA®, APPLE의 SIRI® 또는 MICROSOFT의 CORTANA®)는 그들의 각 음성 서비스를 작동시키기 위한 다양한 활성 단어를 각각 사용할 수 있다. 또한, 각 음성 서비스는 복수의 활성 단어 및/또는 맞춤 활성 단어를 지원할 수 있다. 복수의 음성 서비스를 지원하기 위해, NMD는 각 지원된 음성 서비스에 대한 활성 단어 검출 알고리즘을 통하여 수신된 오디오 컨텐츠를 병렬로 실행하여, 오디오 컨텐츠에서 나타날 수 있는 다양한 활성 단어를 검출할 수 있다. 예를 들어, NMD는 제1 음성 서비스에 대한 제1 오디오 검출 알고리즘을 적용하여 제1 음성 서비스에 대한 적어도 하나의 제1 활성 단어를 검출하고, 제2 음성 서비스에 대한 제2 오디오 검출 알고리즘을 적용하여 제2 음성 서비스에 대한 적어도 하나의 제2 활성 단어를 검출할 수 있다. 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, NMD는 예컨대 각 음성 서비스에 대하여, 오디오 컨텐츠에 대한 추가적인 오디오 검출 알고리즘도 적용할 수 있다.
c. 오디오 컨텐츠의 재생 동안, 검출된 하나 이상의 활성 단어에 대한 활성 응답을 디세이블함
도 11의 블록(1106)에서, 구현예(1100)는 오디오 컨텐츠의 재생 동안, 검출된 하나 이상의 활성 단어에 대한 활성 응답을 디세이블하는 것을 수반한다. 예를 들어, NMD는 오디오 컨텐츠가 재생 장치에 의해 들릴 수 있게 재생되는 경우, 오디오 컨텐츠에서 검출된 하나 이상의 활성 단어에 대한 활성 응답을 디세이블할 수 있다.
위에서 언급된 바와 같이, NMD의 활성 응답은 활성 단어 검출에 대한 프로그래밍된 응답을 지칭한다. 활성 응답이 인에이블되는 경우, 활성 단어를 검출하는 것에 응답하여, NMD의 활성 응답은 NMD로 하여금 마이크로폰을 통하여, 특정 활성 단어에 후속하는 음성 명령을 듣도록 한다. NMD는 음성 명령을 수행하기 위한 음성 서비스를 작동시킬 수 있다. 그러나 활성 응답이 디세이블되는 경우, NMD는 음성 명령을 듣지 않을 수 있고, 음성 명령을 수행하기 위한 음성 서비스를 작동시키지 않을 것이다.
일부 구현예에서, NMD는 NMD가 활성 단어를, 재생 장치에 의해 재생됨에 따라 검출하는 것으로부터 방지함으로써 그 활성 응답을 디세이블한다. 예를 들어, NMD는 하나 이상의 기간 (즉, 예컨대 타임 스탬프에 의해 기록되는, 활성 단어가 재생 장치에 의해 재생될 때와 대응하는 기간)동안 활성 단어를 듣는 것을 중단(예컨대, 녹음된 오디오 프로세싱을 중단)할 수 있다. 대안적으로, NMD는 그것의 마이크로폰을 일시적으로(예컨대, 위에서 언급된 기간 동안) 디세이블할 수 있다. 또 다른 예시에서, NMD는 그 마이크로폰 어레이를 사용하여 재생 장치의 방향으로 청취 무효를 생성하여 NMD가 활성 단어를 검출하지 않을 수 있다. 다른 예시도 가능하다.
추가 예시에서, NMD는 활성 단어를, 재생 장치에 의해 재생됨에 따라 검출하지만, 검출된 활성 단어에 대한 활성 응답을 억제한다. 예를 들어, NMD는 일부 기간 동안 활성 단어를 무시하거나, 일부 기간 동안 모든 오디오를 무시할 수 있다. 다른 예시도 가능하다.
다른 예시에서, NMD는 오디오 컨텐츠에서 (또는 오디오 컨텐츠의 부분에서) 활성 단어의 수를 카운트할 수 있다. 예를 들어, NMD는 예시적인 오디오 컨텐츠에서 세 개의 활성 단어를 검출할 수 있다. 위에서 언급된 바와 같이, 이러한 인스턴스는 다양한 음성 서비스에 대한 다양한 활성 단어를 포함하는, 활성 단어의 임의의 조합을 포함할 수 있다. 이후, NMD는 카운트와 같은 수의 활성 단어를 검출할 때까지 (예컨대, 다음 세 개의 활성 단어를 무시함으로써) 활성 응답을 디세이블할 수 있다.
대안적으로, NMD는 오디오 컨텐츠의 세그먼트에 음향 마커를 포함하도록 오디오 컨텐츠를 수정함으로써, 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블한다. 예를 들어, NMD는 녹음된 오디오 컨텐츠에서 다른 마커 또는 오디오 톤을 삽입(예컨대, 혼합)하여, 오디오 컨텐츠에서 검출된 활성 단어를 지정할 수 있다. 이후, NMD가 그러한 오디오 마커를 검출하는 것에 응답하여 활성 응답을 디세이블하도록 프로그래밍되는 경우, NMD는, 재생 장치에 의해 재생되는 오디오 컨텐츠에서 활성 단어를 검출하면, 활성 응답을 자동적으로 억제할 것이다.
일부 예시에서, NMD는 활성 단어가 재생 장치에 의해 재생되는 경우, 하나 이상의 추가적인 네트워킹된 마이크로폰 장치로 하여금 검출된 활성 단어에 대한 각 활성 응답을 디세이블할 수 있다. 예를 들어, 도 1을 참조하면, NMD(132)는 NMD(134)로 하여금 활성 응답을 디세이블하도록 할 수 있다. 또한, 집 내의 재생 장치 및/또는 컨트롤 장치 중 임의의 것은 NMD를 구현할 수 있고, NMD(132)는 또한 이러한 재생 장치 중 임의의 것의 활성 응답을 디세이블할 수 있다.
NMD는 집 내의 NMD의 특정한 세트를 디세이블할 수 있다. 일부 경우에서, 디세이블된 활성 응답을 가지는 NMD의 세트는 구역 또는 미디어 재생 시스템의 구역 그룹 구성에 기초한다. 예를 들어, NMD가 특정한 구역과 연관되는 경우 (예컨대, NMD(132)가 주방 구역과 연관되는 경우), NMD는 동일한 구역과도 연관되는 임의의 NMD의 각 활성 응답이 디세이블되도록 할 수 있다. 이러한 NMD는 NMD(예컨대, 재생 장치) 및 전용 NMD를 구현하는 다양한 장치를 포함할 수 있다. 또한, NMD가 연관되는 특정한 구역이 구역 그룹 내 하나 이상의 추가적 구역과 연결되는 경우, NMD는 하나 이상의 추가적 구역과도 연관되는 임의의 NMD의 각 활성 응답이 또한 디세이블되도록 할 수 있다. 위에서 나타난 바와 같이, 연관성이 미디어 재생 시스템의 구역과 NMD 사이에 생성되어, 예컨대 집의 특별 공간(예컨대, 주방 구역)에서 협력을 용이하게 할 수 있다.
대안적으로, 디세이블된 활성 응답을 가지는, 특정한 추가적인 NMD는 활성 단어를 포함하는 오디오 컨텐츠를 재생하는 재생 장치의 가청 범위에 기초한다. 가청 범위는 임의의 적합한 기법을 사용하여 결정될 수 있다. 일부 구현예에서, 가청 범위는 위에서 나타난 바와 같이, 하나 이상의 구역과 NMD의 연관성에 기초하여 규정된다. 다른 예시에서, 가청 범위는 위의 섹션 III에서 설명된 바와 같이, 셋업 절차(예컨대, 교정 절차) 동안 규정된다. 구역 구성 및/또는 셋업 절차에 의해 규정된 가청 범위는 하나 이상의 상태 변수로서 저장되고 네트워크(예컨대, 도 1에 도시된 집 내의 라우터(130)에 의해 규정되는 LAN) 내의 장치 중에서 공유될 수 있다. 그러한 정보에 접근함으로써, NMD는, 오디오 컨텐츠를 재생할 재생 장치의 가청 범위에 있을 NMD의 세트를 결정하고, NMD의 이러한 세트의 각 활성 응답으로 하여금 디세이블되도록 한다.
예컨대, 일 예시에서, 도 1 내 NMD(132)는 주방 구역에 있는 재생 장치(114)에 의한 재생을 위해 설계된 소정의 오디오 컨텐츠에 있는 하나 이상의 활성 단어를 검출한다. 따라서, NMD(132)는 이러한 활성 단어에 대한 활성 응답을 디세이블한다. 재생 장치(114) 또한 NMD이므로, NMD(132)는 재생 장치(114)의 활성 응답을 디세이블 한다. 또한, 주방 구역이 식당 구역이 있는 구역 그룹에 있으므로, NMD(132)는 또한 NMD인 재생 장치(112)의 활성 응답을 또한 디세이블하여, 오디오 컨텐츠가 주방 구역에서 식당 구역과 동기로 재생되면, 재생 장치의 NMD(112)는 잘못 트리거하지 않는다.
다른 예시에서, 도 1에서 NMD(134)는 주 침실 구역 내 재생 장치(122 및 124)에 의한 재생을 위해 설계된 소정의 오디오 컨텐츠에 있는 하나 이상의 활성 단어를 검출한다. 따라서, NMD는 이러한 활성 단어에 대한 활성 응답을 디세이블한다. 재생 장치(116)가 NMD를 구현하고 현재 음량 레벨에서 재생 장치(122 및 124)의 가청 범위에 있도록 미리 규정되었으므로, NMD(134)는 또한 재생 장치(116)의 활성 응답을 디세이블한다. NMD(134)는 라우터(130)에 의해 생성된 LAN을 통하여 NMD(134)와 공유된 하나 이상의 상태 변수로부터 현재 음량 레벨에서 재생 장치(122 및 124)의 가청 범위에 있는 것을 인식한다. 그러한 상태 변수는 재생 장치(122 및 124)(예컨대, 스테레오 쌍)의 현재 재생 구성과 같은 미디어 재생 시스템(100)의 다양한 양상의 상태와 어떤 NMD가 재생 구성 및 음량 레벨에서 이러한 재생 장치의 가청 범위 내에 있는지 결정되었는지 NMD(134)에 나타낸다.
NMD는 임의의 적합한 기법을 사용하여 하나 이상의 추가적 NMD로 하여금 각 활성 응답을 디세이블할 수 있다. NMD는 알림 컴포넌트(예컨대, 도 5의 알림 컴포넌트(506))를 포함하는 프로세싱 시스템(500)을 구현하고, 알림 컴포넌트를 사용하여 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 NMD의 세트로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 할 수 있다.
일부 구현예에서, NMD는 네트워크 인터페이스를 통하여, 하나 이상의 NMD로 명령어를 송신함으로써, 수신된 오디오 컨텐츠의 재생 동안, 하나 이상의 추가적 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는데, 명령어는 하나 이상의 NMD로 하여금 각 활성 응답을 디세이블하도록 한다. 위에서 언급된 바와 같이, 미디어 재생 시스템(예컨대, 컨트롤 장치, 재생 장치 및 NMD)의 다양한 장치는 근거리 네트워크를 통하여(예컨대, 도 1의 유선 또는 무선 네트워크 라우터(130)에 의해 형성된 근거리 네트워크를 통하여) 서로 연결되어 집 내의 장치 간의 명령어와 다른 메시징의 교환을 허용할 수 있다. 이러한 미디어 재생 시스템의 장치는 시스템에 있는 다른 장치로부터 일부 명령어에 응답하도록 각각 프로그래밍될 수 있다. 예시적인 메시지 및 명령어는 도 9 및 도 10(a), 10(b), 10(c) 및 10(d)와 관련하여 위에서 설명된다.
대안적으로, NMD는, 오디오 컨텐츠의 세그먼트에 음향 마커를 포함하도록 오디오 컨텐츠를 수정함으로써, 하나 이상의 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 한다. 이러한 기법을 사용하여, 재생 장치의 가청 범위에 있는 NMD는 미리 결정되거나 추정될 필요가 없다. 그보다는, 음향 마커가 오디오 컨텐츠와 재생되므로, 오디오 컨텐츠를 검출하도록 가청 범위 내에 있는(및 이와 같이, 이러한 컨텐츠에 의해 잘못 트리거될 수 있는) NMD는 또한 음향 마커를 검출하고 그 활성 응답을 응답하여 디세이블기 위한 범위 내에 있다. 복수의 NMD가 NMD의 가청 범위에 있는 경우, 응답하여 각 활성 단어를 검출하는 각각의 NMD는 연관된 음향 마커를 검출하는 것에 응답하여 활성 단어에 대한 활성 응답을 디세이블한다.
일부 구현예에서, NMD가 오디오 컨텐츠를 수정하는 바와 같이, NMD는 오디오 컨텐츠를 재생 장치에 제공한다. 이러한 경우에서, NMD는 오디오 컨텐츠의 소스와 재생 장치 사이의 중재자로서 동작할 수 있다. 오디오 컨텐츠를 재생 장치로 전송하는 것은 재생 장치가 수신된 오디오 컨텐츠를 재생하도록 구성될 수 있음에 따라, 재생 장치로 하여금 오디오 컨텐츠를 재생하도록 할 수 있다. NMD는 네트워크 인터페이스와 같은, 임의의 적합한 통신 인터페이스를 통하여 오디오 컨텐츠를 재생 장치로 제공할 수 있다. 복수의 재생 장치가 오디오 컨텐츠를 재생하도록 구성되는 경우, NMD는 오디오 컨텐츠를 재생 장치 모두에 제공할 수 있거나, NMD는 오디오 컨텐츠를 예컨대, 동기 재생을 스케줄링하기 위한 타이밍 정보에 따라 오디오 컨텐츠를 그룹 내 다른 재생 장치로 분배하는 재생 장치의 서브 세트(예컨대, 그룹 조정자)로 전송할 수 있다.
예컨대, 일 예시에서, 재생 장치(112 및 114)는 동기로 오디오 컨텐츠를 재생하도록 구성되는 구역 그룹(즉, 주방 + 식당 구역 그룹)에 있다. 구역 그룹에 의한 재생을 위해 지정된 오디오 컨텐츠에서 활성 단어를 검출하는 것 이후, NMD(132)는 오디오 컨텐츠를 수정하여 오디오 컨텐츠에 있는 활성 단어를 지정하도록 음향 마커를 포함할 수 있다. 재생 장치(132)는 이후 수정된 오디오 컨텐츠를 재생 장치(112 및/또는 114)에 제공하여 수정된 오디오 컨텐츠의 동기 재생을 용이하도록 할 수 있다.
d. 재생되는 오디오 컨텐츠 검출
블록(1108)에서, 구현예(1100)는 마이크로폰을 통하여 재생되는 오디오 컨텐츠를 검출하는 것을 포함한다. 예를 들어, 재생 장치가 하나 이상의 검출된 활성 단어를 포함하는 오디오 컨텐츠를 재생하는 한편, NMD는 마이크로폰을 통하여 재생되는 오디오 컨텐츠를 검출할 수 있다. NMD의 활성 응답이 인에이블되는 구성에서, 활성 단어를 포함하는 재생되는 오디오 컨텐츠의 부분을 검출하는 것은 NMD의 활성 응답을 트리거할 것이다. 그러나, NMD가 오디오 컨텐츠에서 하나 이상의 활성 단어에 대한 활성 응답을 디세이블했으므로, 활성 응답은 트리거되지 않는다.
일부 구현예에서, 재생 장치는 NMD를 구현한다. 이러한 예시에서, 재생 장치는 하나 이상의 스피커를 통하여 수신된 오디오 컨텐츠를 재생할 수 있다. 일부 경우에서, 스피커는 동일한 하우징에 NND와 함께 위치된다. 대안적으로, 재생 장치는 증폭된 오디오를 스피커 잭을 통하여 하나 이상의 별개의 패시브 스피커로 제공할 수 있다. 다른 예시로서, 재생 장치는 라인 레벨 오디오를 증폭기로 제공하고, 이는 이후 차례로, 증폭된 오디오를 스피커 잭을 통하여 하나 이상의 패시브 스피커로 제공함으로써, 오디오 컨텐츠를 재생할 수 있다.
일부 경우에서, NMD는 하나 이상의 추가적인 재생 장치가 있는 동기화 재생 구성으로 구성될 수 있다. 그러한 경우에서, 오디오 컨텐츠를 재생하는 것은 하나 이상의 추가적인 재생 장치와 동기로 오디오 컨텐츠를 재생하는 것을 수반한다. 일부 재생 구성(예컨대, 스테레오 쌍 또는 서라운드)에서, 재생 구성에 있는 각각의 재생 장치는 재생 구성에 있는 다른 재생 장치와 동기로 오디오 컨텐츠의 부분을 재생한다.
위에서 언급된 바와 같이, 일부 구현예에서, NMD는 재생을 위한 하나 이상의 재생 장치로 오디오 컨텐츠를 제공한다. 일부 예시에서, NMD는 하나 이상의 재생 장치로 오디오 컨텐츠를 제공하여 NMD와 그 오디오 컨텐츠의 동기 재생을 용이하게 하도록 한다. 이러한 구현예에서, NMD는 NMD 및 하나 이상의 추가적인 재생 장치를 포함하는 동기 그룹을 위한 그룹 중재자로서 동작할 수 있다. 그룹 중재자로서, NMD는 추가적으로 하나 이상의 추가 재생 장치로 타이밍 정보를 제공하여 동기 그룹이 동기 재생을 스케줄링하는 것을 용이하게 할 수 있다. 재생 장치는 네트워크 인터페이스를 통하여 오디오 컨텐츠 및/또는 타이밍 정보를 제공한다.
V. 활성 응답을 디세이블하기 위한 컴퓨팅 시스템에 대한 예시적인 기법
위에서 논의된 바와 같이, 여기서 설명된 실시예는 활성 응답을 디세이블하는 것을 수반할 수 있다. 도 12는 컴퓨팅 시스템이 오디오 컨텐츠 내 하나 이상의 활성 단어에 대한 하나 이상의 NMD의 활성 응답을 디세이블하는 예시적인 구현예(1200)를 예시한다. 다양한 실시예에서, 컴퓨팅 시스템은 클라우드 서버일 수 있다. 대안적으로, 컴퓨팅 시스템은 로컬 프로세싱 장치(예컨대, 미디어 재생 시스템처럼 동일한 LAN으로 연결되는 장치)일 수 있다. 컴퓨팅 시스템은 재생 장치 또는 NMD를 구현할 수 있다.
a. 녹음된 오디오 컨텐츠를 나타내는 데이터를 수신
블록(1202)에서, 구현예(1200)는 녹음된 오디오 컨텐츠를 나타내는 데이터를 수신하는 것을 수반한다. 예를 들어, 컴퓨팅 시스템은 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 수신할 수 있다. 예시적인 재생 장치는 도 1에 도시된 재생 장치(102, 104, 106, 108, 110, 112, 114, 116, 118, 120, 122 및 124) 중 임의의 것을 포함하며, 이는 예를 들어, 도 2의 재생 장치(200)에 의해 나타나는 바와 같이 구현될 수 있다. 프로세싱 시스템은 프로세싱 시스템(예컨대, 프로세싱 시스템(500))을 포함할 수 있고 (도 5의 오디오 입력/출력 컴포넌트(502)와 같은) 오디오 입력/출력 컴포넌트를 사용하여 오디오 컨텐츠를 나타내는 데이터를 수신할 수 있다. 컴퓨팅 시스템은 위의 섹션 II, III 및 IV에서 논의된 기법과 같이 임의의 적합한 기법을 사용하여 오디오 컨텐츠를 수신할 수 있다.
b. 오디오 컨텐츠에서 하나 이상의 활성 단어 검출
도 12의 블록(1204)에서, 구현예(1200)는 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서 하나 이상의 활성 단어를 검출하는 것을 수반한다. 예를 들어, 컴퓨팅 시스템은 오디오 컨텐츠를 나타내는 수신된 데이터를 분석하여 임의의 음성 서비스에 대한 활성 단어가 오디오 컨텐츠에서 나타나는지를 결정할 수 있어, 오디오 컨텐츠가 재생될 때, 활성 단어는 들릴 수 있게 재생될 것이다. 위에서 언급된 바와 같이, 일부 구현예에서, 컴퓨팅 시스템은 프로세싱 시스템(예컨대, 프로세싱 시스템(500))을 포함하고, (도 5의 활성 단어 검출 컴포넌트(504)와 같은) 활성 단어 검출 컴포넌트를 사용하여 오디오 컨텐츠 내의 활성 단어를 검출할 수 있다. 컴퓨팅 시스템은 위의 섹션 II, III 및 IV에서 논의된 기법과 같이 임의의 적합한 기법을 사용하여 활성 단어를 검출할 수 있다.
c. 오디오 컨텐츠의 재생 동안, 하나 이상의 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블함
도 12의 블록(1206)에서, 구현예(1200)는 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는 것을 수반한다. 예를 들어, 컴퓨팅 시스템은 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 재생 장치의 가청 범위에 있는 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 할 수 있다. 위에서 언급된 바와 같이, 컴퓨팅 시스템은 알림 컴포넌트(예컨대, 도 5의 알림 컴포넌트(506))를 포함하는 프로세싱 시스템(500)을 구현할 수 있고, 알림 컴포넌트를 사용하여 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 할 수 있다. 컴퓨팅 시스템은 위의 섹션 II, III 및 IV에서 논의된 기법과 같이 임의의 적합한 기법을 사용하여 오디오 컨텐츠의 재생 동안, 하나 이상의 NMD로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 할 수 있다.
VI. 활성 응답을 억제하기 위한 예시적인 기법
위에서 논의된 바와 같이, 여기서 설명된 실시예는 활성 응답을 억제하는 것을 수반할 수 있다. 도 13은 NMD가 활성 응답을 디세이블하는 예시적인 구현예(1300)를 예시한다.
a. 하나 이상의 활성 단어에 대한 NMD의 활성 응답을 디세이블하도록 하는 명령어를 수신
블록(1302)에서, 구현예(1300)는 하나 이상의 활성 단어에 대한 NMD의 활성 응답을 디세이블하도록 하는 명령어를 수신하는 것을 수반한다. 예를 들어, NMD(예컨대, NMD(132))는 다른 NMD, 재생 장치, 컴퓨팅 시스템 또는 임의의 다른 장치로부터 명령어를 수신할 수 있다. 명령어는 NMD로 하여금, 하나 이상의 재생 장치에 의한 재생을 위해 지정된 일부 오디오 컨텐츠에서 나타나는 하나 이상의 활성 단어에 대한 활성 응답을 디세이블하도록 한다.
일부 구현예에서, 하나 이상의 활성 단어에 대한 NMD의 활성 응답을 디세이블하기 위한 수신된 명령어가 내포된다. 예를 들어, NMD는, 다른 예시 중에서도, 예컨대 활성 단어를 듣는 것을 멈추도록 NMD에 지시함으로써, 기간 동안 NMD의 마이크로폰 어레이를 디세이블함으로써, 또는 재생 장치의 방향에서 청취 무효(listening NULL)를 생성함으로써, 활성 단어를 재생 장치에 의해 재생됨에 따라 검출하지 않도록 지시될 수 있다. 대안적으로, NMD는 활성 단어를 검출할 수 있지만, 예컨대 일부 기간 동안 활성 단어를 무시함으로써 또는 일부 기간 동안 모든 오디오를 무시함으로써, 활성 단어를 검출하는 것에 응답하여 음성 서비스를 작동시키기 위한 프로그래밍된 활성 응답을 억제하도록 지시될 수 있다. NMD는 위의 섹션 II, III 및 IV에서 논의된 바와 같이, 임의의 적합한 명령어를 사용하여 지시될 수 있다.
대안적으로, 수신된 명령어가 내포된다. 예를 들어, 위에서 설명된 바와 같이, 오디오 컨텐츠는 활성 단어를 지정하는 음향 마커를 포함하도록 수정될 수 있다. 이러한 구현예에서, 수신된 명령어는 음향 마커의 형태로 있을 수 있다. 일부 경우에서, 수신된 명령어는 음향 마커가 검출되는 경우, NMD의 활성 응답을 디세이블하기 위한 명령어일 수 있다.
b. 하나 이상의 재생 장치에 의해 재생되는 오디오 컨텐츠 검출
도 13의 블록(1304)에서, 구현예(1300)는 하나 이상의 재생 장치에 의해 재생되는 오디오 컨텐츠를 검출하는 것을 수반한다. 예를 들어, NMD는 마이크로폰을 통하여 단일 재생 장치에 의해 재생되는 오디오 컨텐츠를 검출할 수 있다. 대안적으로 NMD는 (예컨대, 동시에) 둘 이상의 장치에 의해 재생되는 오디오 컨텐츠를 검출할 수 있다.
c. 검출된 오디오 컨텐츠가 하나 이상의 활성 단어를 포함한다고 결정
도 13의 블록(1306)에서, 구현예(1300)는 검출된 오디오 컨텐츠가 하나 이상의 활성 단어를 포함한다고 결정하는 것을 수반한다. 예를 들어, NMD는 하나 이상의 활성 단어 검출 알고리즘을 통해 검출된 오디오 컨텐츠를 실행함으로써, 검출된 오디오 컨텐츠가 하나 이상의 활성 단어를 포함한다고 결정할 수 있다. 일부 경우에서, NMD는 복수의 활성 단어 검출 알고리즘(예컨대, 예컨대, 다양한 음성 서비스를 위한 다양한 활성 단어에 대한 활성 단어 알고리즘)을 통해 검출된 오디오 컨텐츠를 실행할 수 있다. 예시적인 활성 단어 검출 알고리즘은 본 개시의 전반에 걸쳐 설명된다.
d. 검출된 오디오 컨텐츠에서 하나 이상의 활성 단어에 대한 NMD의 활성 응답을 디세이블
도 13의 블록(1308)에서, 구현예(1300)는 검출된 오디오 컨텐츠에 있는 하나 이상의 활성 단어에 대한 NMD의 활성 응답을 디세이블하는 것을 수반한다. 위에서 언급된 바와 같이, NMD의 활성 응답은 활성 단어를 검출하는 것에 대한 프로그래밍된 응답을 지칭한다. 활성 응답이 인에이블되는 경우, 활성 단어를 검출하는 것에 응답하여, NMD의 활성 응답은 NMD로 하여금, 마이크로폰을 통하여, 특정 활성 단어에 후속하는 음성 명령을 듣도록 한다. NMD는 음성 서비스를 작동시켜 음성 명령을 수행한다. 그러나 활성 응답이 디세이블되는 경우, NMD는 음성 명령을 듣지 않을 수 있고, 음성 명령을 수행하기 위한 음성 서비스를 작동시키지 않을 것이다.
VII. 결론
위 설명은 다른 컴포넌트 중에서도 하드웨어 상에서 실행되는 펌웨어 및/또는 소프트웨어를 포함하는, 다른 것들 중에서도, 다양한 예시적인 시스템, 방법, 장비 및 제품을 개시한다. 이러한 예시는 단지 예시적이며, 제한하는 것으로 간주되어서는 안된다고 이해된다. 예를 들어, 펌웨어, 하드웨어 및/또는 소프트웨어 태양 또는 컴포넌트 중 임의의 것 또는 모두가 하드웨어로만, 소프트웨어로만, 펌웨어로만 또는 하드웨어, 소프트웨어 및/또는 펌웨어의 임의의 조합으로 구현될 수 있음이 고려된다. 따라서, 제공되는 예시는 그러한 시스템, 방법, 장비 및/또는 제품을 구현하기 위한 유일한 방식이 아니다.
(특징 1) 재생 장치를 통하여, 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신하는 단계; 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서, 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 단계; 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계 - 인에이블(enable)되는 경우, 특정 활성 단어에 대한 소정의 네트워킹된 마이크로폰 장치의 활성 응답은 소정의 네트워킹된 마이크로폰 장치로 하여금 마이크로폰을 통해, 특정 활성 단어에 후속하는 음성 명령을 듣도록 함-; 및 하나 이상의 스피커를 통하여 오디오 컨텐츠를 재생하는 단계를 포함하는 방법.
(특징 2) 특징 1의 방법에 있어서, 재생 장치는 소정의 네트워킹된 마이크로폰 장치를 포함하고, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계는, 오디오 컨텐츠를 재생하는 동안, 마이크로폰을 통하여, 재생되는 오디오 컨텐츠를 녹음하는 단계; 및 녹음된 오디오 컨텐츠 내에서의 하나 이상의 활성 단어에 대한 소정의 네트워킹된 마이크로폰 장치의 각 활성 응답을 디세이블하는 단계를 포함하는, 방법.
(특징 3) 특징 1의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계는 네트워크 인터페이스를 통해 하나 이상의 네트워킹된 마이크로폰 장치로, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는 명령어를 송신하는 단계를 포함하는, 방법.
(특징 4) 특징 2의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치는 집(household) 내 네트워킹된 마이크로폰 장치의 서브 세트(subset)이고, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근(audible vicinity)에 있다고 결정하는 단계 및 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 것에 응답하여, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 단어를 디세이블하도록 하는 명령어를 송신하는 단계를 포함하는 방법.
(특징 5) 특징 4의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치는 각각의 재생 장치를 포함하고, 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 재생 장치와 동기화 재생 구성으로 있다고 결정하는 단계를 포함하는, 방법.
(특징 6) 특징 4의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 재생 장치의 가청 부근에 있다고 결정하는 단계를 포함하는, 방법.
(특징 7) 특징 1의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는 오디오 컨텐츠를 재생하기 전에, 오디오 컨텐츠를 수정하여 각 활성 단어를 나타내는 오디오 컨텐츠의 세그먼트에 음향 마커(acoustic marker)를 포함시키는 단계를 포함하고, 음향 마커를 검출하는 것은 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는 것인, 방법.
(특징 8) 특징 1의 방법에 있어서, 하나 이상의 활성 단어를 검출하는 단계는 복수의 활성 단어 검출 알고리즘을 오디오 컨텐츠에 적용하는 단계를 포함하고, 복수의 활성 단어 검출 알고리즘은 제1 음성 서비스에 대한 제1 활성 단어 검출 알고리즘과 제2 음성 서비스에 대한 제2 활성 단어 검출 알고리즘을 포함하고, 오디오 컨텐츠가 재생 장치에 의해서 재생되기 전에, 복수의 활성 단어 검출 알고리즘을 오디오 컨텐츠에 적용하는 단계는, 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에 제1 음성 서비스에 대한 제1 오디오 검출 알고리즘을 적용하여 제1 음성 서비스에 대한 적어도 하나의 제1 활성 단어를 검출하는 단계; 및 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에 제2 음성 서비스에 대한 제2 오디오 검출 알고리즘을 적용하여 제2 음성 서비스에 대한 적어도 하나의 제2 활성 단어를 검출하는 단계를 포함하고, 제2 활성 단어는 제1 활성 단어와 상이한 단어인, 방법.
(특징 9) 특징 1의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치는 제1 네트워킹된 마이크로폰 장치 및 제2 네트워킹된 마이크로폰 장치를 포함하고, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는, 제1 네트워킹된 마이크로폰 장치로 하여금 검출된 적어도 하나의 제1 활성 단어에 대한 각 활성 응답을 디세이블하는 단계; 및 제2 네트워킹된 마이크로폰 장치로 하여금 검출된 적어도 하나의 제2 활성 단어에 대한 각 활성 응답을 디세이블하는 단계를 포함하는, 방법.
(특징 10) 특징 1의 방법에 있어서, 오디오 컨텐츠에서, 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 단계는 오디오 컨텐츠에서 특정 활성 단어의 복수 인스턴스를 검출하는 단계를 포함하고, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치로 하여금, 각 네트워킹된 마이크로폰 장치가 오디오 컨텐츠 내 특정 활성 단어의 복수 인스턴스의 수와 동일한 수의 활성 단어를 검출할 때까지 각 활성 응답을 디세이블하는 단계를 포함하는, 방법.
(특징 11) 장치로 하여금 특징 1 내지 10 중 어느 하나의 방법을 수행하도록 하는 하나 이상의 프로세서에 의해 실행 가능한 명령어를 저장하는 유형의 비일시적인 컴퓨터 판독 가능 기록매체.
(특징 12) 특징 1 내지 10 중 어느 하나의 방법을 수행하도록 구성되는 장치.
(특징 13) 특징 1 내지 10 중 어느 하나의 방법을 수행하도록 구성되는 미디어 재생 시스템.
(특징 14) 네트워킹된 마이크로폰 장치를 통하여, 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신하는 단계;오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서, 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 단계; 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 검출된 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하는 단계 -인에이블(enable)되는 경우, 특정 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답은 네트워킹된 마이크로폰 장치로 하여금 마이크로폰을 통해, 특정 활성 단어에 후속하는 음성 명령을 듣도록 함-; 및 재생 장치가 오디오 컨텐츠를 재생하는 한편, 마이크로폰을 통하여 재생되는 오디오 컨텐츠를 검출하는 단계를 포함하는 방법.
(특징 15) 특징 14의 방법에 있어서, 재생 장치로 하여금 오디오 컨텐츠를 재생하기 위한 오디오 컨텐츠를 나타내는 데이터를 네트워크 인터페이스를 통하여, 재생 장치로 전송하는 단계를 더 포함하는 방법.
(특징 16) 특징 15의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 검출된 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하는 단계는; 재생 장치에 대한 오디오 컨텐츠를 나타내는 데이터를 전송하기 전에, 오디오 컨텐츠를 수정하여 각 활성 단어를 나타내는 오디오 컨텐츠의 세그먼트에 음향 마커를 포함시키는 단계를 포함하고, 여기서 음향 마커를 검출하는 단계는 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는, 방법.
(특징 17) 특징 14의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 추가적인 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계를 더 포함하는 방법.
(특징 18) 특징 17의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 추가적인 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는 네트워크 인터페이스를 통해 하나 이상의 추가적인 네트워킹된 마이크로폰 장치로, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는 명령어를 송신하는 단계를 포함하는, 방법.
(특징 19) 특징 17의 방법에 있어서, 하나 이상의 추가적인 네트워킹된 마이크로폰 장치는 집(household) 내 네트워킹된 마이크로폰 장치의 서브 세트(subset)이고, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 추가적인 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근(audible vicinity)에 있다고 결정하는 단계 및 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 것에 응답하여, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 단어를 디세이블하도록 하는 명령어를 송신하는 단계를 포함하는 방법.
(특징 20) 특징 19의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치는 각각의 재생 장치를 포함하고, 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 재생 장치와 동기화 재생 구성에 있다고 결정하는 단계를 포함하는, 방법.
(특징 21) 특징 14의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 재생 장치의 가청 부근에 있다고 결정하는 단계를 포함하는, 방법.
(특징 22) 특징 14의 방법에 있어서, 하나 이상의 활성 단어를 검출하는 단계는 복수의 활성 단어 검출 알고리즘을 오디오 컨텐츠에 적용하는 단계를 포함하고, 복수의 활성 단어 검출 알고리즘은 제1 음성 서비스에 대한 제1 활성 단어 검출 알고리즘과 제2 음성 서비스에 대한 제2 활성 단어 검출 알고리즘을 포함하고, 오디오 컨텐츠가 재생 장치에 의해서 재생되기 전에, 복수의 활성 단어 검출 알고리즘을 오디오 컨텐츠에 적용하는 단계는, 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에 제1 음성 서비스에 대한 제1 오디오 검출 알고리즘을 적용하여 제1 음성 서비스에 대한 적어도 하나의 제1 활성 단어를 검출하는 단계; 및 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에 제2 음성 서비스에 대한 제2 오디오 검출 알고리즘을 적용하여 제2 음성 서비스에 대한 적어도 하나의 제2 활성 단어를 검출하는 단계를 포함하고, 제2 활성 단어는 제1 활성 단어와 상이한 단어인, 방법.
(특징 23) 특징 14의 방법에 있어서, 네트워킹된 마이크로폰 장치는 재생 장치를 포함하고, 방법은 하나 이상의 스피커를 통하여 오디오 컨텐츠를 재생하는 단계를 더 포함하는 방법.
(특징 24) 장치로 하여금 특징 14 내지 23 중 어느 하나의 방법을 수행하도록 하는 하나 이상의 프로세서에 의해 실행 가능한 명령어를 저장하는 유형의 비일시적인 컴퓨터 판독 가능 기록매체.
(특징 25) 특징 14 내지 23 중 어느 하나의 방법을 수행하도록 구성되는 장치.
(특징 26) 특징 14 내지 23 중 어느 하나의 방법을 수행하도록 구성되는 미디어 재생 시스템.
(특징 27) 컴퓨팅 시스템의 인터페이스를 통해, 수신되는 컴퓨팅 시스템을 통하여, 하나 이상의 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 수신하는 단계; 오디오 컨텐츠가 재생 장치에 의해 재생되기 전에, 오디오 컨텐츠에서, 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 단계; 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 재생 장치에 의한 오디오 컨텐츠의 재생 동안 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계 - 인에이블(enable)되는 경우, 특정 활성 단어에 대한 소정의 네트워킹된 마이크로폰 장치의 활성 응답은 소정의 네트워킹된 마이크로폰 장치로 하여금 마이크로폰을 통해, 특정 활성 단어에 후속하는 음성 명령을 듣도록 함-;를 포함하는 방법.
(특징 28) 특징 27의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계는, 네트워크 인터페이스를 통해 하나 이상의 네트워킹된 마이크로폰 장치로, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는 명령어를 송신하는 단계를 포함하는, 방법.
(특징 29) 특징 28의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블 하도록 하는 명령어를 송신하는 단계는; 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 재생 장치가 각 활성 단어를 나타내는 오디오 컨텐츠의 세그먼트를 재생 할 때에 대응하는 하나 이상의 기간 동안 각 활성 응답을 디세이블 하도록 하는 명령어를 송신하는 단계를 포함하는 방법.
(특징 30) 특징 28의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블 하도록 하는 명령어를 송신하는 단계는; 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 재생 장치가 각 활성 단어를 나타내는 오디오 컨텐츠의 세그먼트를 재생 할 때에 대응하는 하나 이상의 기간 동안 각 마이크로폰을 디세이블 하도록 하는 명령어를 송신하는 단계를 포함하는 방법.
(특징 31) 특징 28의 방법에 있어서, 컴퓨팅 시스템은 오디오 컨텐츠에 있는 활성 단어의 특정한 수를 검출하고, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블 하도록 하는 명령어를 송신하는 단계는; 하나 이상의 네트워킹된 마이크로폰 장치가 검출된 오디오 컨텐츠에서 활성 단어의 특정한 수와 같은 수의 활성 단어를 검출할 때까지, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 재생 장치가 각 활성 응답을 디세이블 하도록 하는 명령어를 송신하는 단계를 포함하는 방법.
(특징 32) 특징 28의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치는 집(household) 내 네트워킹된 마이크로폰 장치의 서브 세트(subset)이고, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근(audible vicinity)에 있다고 결정하는 단계 및 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 것에 응답하여, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 단어를 디세이블하도록 하는 명령어를 송신하는 단계를 포함하는 방법.
(특징 33) 특징 32의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치는 각각의 재생 장치를 포함하고, 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 재생 장치와 동기화 재생 구성에 있다고 결정하는 단계를 포함하는, 방법.
(특징 34) 특징 32의 방법에 있어서, 하나 이상의 네트워킹된 마이크로폰 장치가 오디오 컨텐츠의 가청 부근에 있다고 결정하는 단계는 하나 이상의 네트워킹된 마이크로폰 장치가 재생 장치의 가청 부근에 있다고 결정하는 단계를 포함하는, 방법.
(특징 35) 특징 27의 방법에 있어서, 재생 장치에 의한 오디오 컨텐츠의 재생 동안, 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계는 하나 이상의 재생 장치가 오디오 컨텐츠를 재생하기 전에, 오디오 컨텐츠를 수정하여 각 활성 단어를 나타내는 오디오 컨텐츠의 세그먼트에서 음향 마커를 포함시키는 단계; 재생 장치에 의한 오디오 컨텐츠의 재생 동안,하나 이상의 네트워킹된 마이크로폰 장치로 하여금 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는 음향 마커를 검출하는 단계; 및 하나 이상의 재생 장치에 의해 수정된 오디오 컨텐츠를 재생을 위한 하나 이상의 재생 장치 중 적어도 하나로 전송하는 단계를 포함하는 방법.
(특징 36) 특징 35의 방법에 있어서, 하나 이상의 재생 장치에 의한 재생의 위한 오디오 컨텐츠를 수신하는 단계는; (a) 인터페이스의 네트워크 인터페이스를 통하여, 오디오 컨텐츠를 나타내는 데이터를 수신하는 단계 또는 (b) 인터페이스의 아날로그 인터페이스를 통하여, 오디오 컨텐츠를 나타내는 아날로그 신호를 수신하는 단계 중 하나를 포함하는 방법.
(특징 37) 특징 27의 방법에 있어서, 컴퓨팅 시스템은 하나 이상의 재생 장치 중 특정한 재생 장치를 포함하고, 동작은 오디오 컨텐츠 재생을 더 포함하는 방법.
(특징 38) 특징 27의 방법에 있어서, 컴퓨팅 시스템은 하나 이상의 네트워킹된 마이크로폰 장치 중 특정한 네트워킹된 마이크로폰 장치를 포함하고, 동작은 마이크로폰을 통하여, 하나 이상의 재생 장치에 의해 재생되는 오디오 컨텐츠를 검출하는 동작을 더 포함하는 방법.
(특징 39) 장치로 하여금 특징 27 내지 38 중 어느 하나의 방법을 수행하도록 하는 하나 이상의 프로세서에 의해 실행 가능한 명령어를 저장하는 유형의 비일시적인 컴퓨터 판독 가능 기록매체.
(특징 40) 특징 27 내지 38 중 어느 하나의 방법을 수행하도록 구성되는 장치.
(특징 41) 특징 27 내지 38 중 어느 하나의 방법을 수행하도록 구성되는 미디어 재생 시스템.
(특징 42) 네트워킹된 마이크로폰 장치를 통해, 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하도록 하는 명령어를 수신하는 단계 -인에이블(enable)되는 경우, 소정의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답은 네트워킹된 마이크로폰 장치로 하여금 마이크로폰을 통해, 소정의 활성 단어에 후속하는 음성 명령을 듣도록 함-; 마이크로폰을 통해, 하나 이상의 재생 장치에 의해 재생되는 오디오 컨텐츠를 검출하는 단계; 검출된 오디오 컨텐츠가 하나 이상의 활성 단어를 포함한다고 결정하는 단계; 수신된 명령어에 응답하여, 검출된 오디오 컨텐츠에서 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하는 단계를 포함하는 방법.
(특징 43) 특징 42의 방법에 있어서, 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하도록 하는 명령어를 수신하는 단계는; 하나 이상의 재생 장치가 각 검출된 활성 단어에 대응하는 오디오 컨텐츠의 세그먼트를 재생할 때에 대응하는 하나 이상의 기간 동안 활성 단어를 디세이블하도록 하는 명령어를 수신하는 것을 포함하는 방법.
(특징 44) 특징 42의 방법에 있어서, 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하도록 하는 명령어를 수신하는 단계는; 하나 이상의 재생 장치가 각 검출된 활성 단어에 대응하는 오디오 컨텐츠의 세그먼트를 재생할 때에 대응하는 하나 이상의 기간 동안 마이크로폰을 디세이블하도록 하는 명령어를 수신하는 것을 포함하는 방법.
(특징 45) 특징 42의 방법에 있어서, 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하도록 하는 명령어를 수신하는 단계는; 네트워킹된 마이크로폰 장치가 활성 단어의 특정한 수와 같은 수의 활성 단어를 검출할 때까지, 연속적으로 활성 단어가 검출되는 경우, 활성 단어를 디세이블하도록 하는 명령어를 수신하는 단계를 포함하는 방법.
(특징 46) 특징 42의 방법에 있어서, 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하도록 하는 명령어를 수신하는 단계는; 음향 마커가 검출되는 경우, 활성 응답을 디세이블하도록 하는 명령어를 수신하는 단계를 포함하고, 검출된 오디오 컨텐츠에서 하나 이상의 활성 단어에 대한 네트워킹된 마이크로폰 장치의 활성 응답을 디세이블하는 단계는 각 검출된 활성 단어에 대응하는 검출된 오디오 컨텐츠에서 음향 마커를 검출하는 단계 및 각 음향 마커를 검출하는 단계에 응답하여 활성 응답을 디세이블하는 단계를 포함하는 방법.
(특징 47) 특징 42의 방법에 있어서, 검출된 오디오 컨텐츠가 하나 이상의 활성 단어를 포함한다고 결정하는 단계는 검출된 오디오 컨텐츠에 하나 이상의 활성 단어 검출 알고리즘을 적용하는 단계를 포함하는 방법.
(특징 48) 장치로 하여금 특징 42 내지 47 중 어느 하나의 방법을 수행하도록 하는 하나 이상의 프로세서에 의해 실행 가능한 명령어를 저장하는 유형의 비일시적인 컴퓨터 판독 가능 기록매체.
(특징 49) 특징 42 내지 47 중 어느 하나의 방법을 수행하도록 구성되는 장치.
(특징 50) 특징 42 내지 47 중 어느 하나의 방법을 수행하도록 구성되는 미디어 재생 시스템.
명세서는 주로 예시적인 환경, 시스템, 절차, 단계, 논리 블록, 처리 및 네트워크로 결합된 데이터 처리 장치의 동작에 직접 또는 간접적으로 유사한 다른 심볼 표현의 관점에서 제공된다. 이러한 프로세스 설명 및 표현은 일반적으로 당업자에 의해 가장 효과적으로 자신의 연구의 본질을 다른 분야에 전달하기 위해 사용된다. 본 개시의 완전한 이해를 제공하기 위해 다수의 구체적인 세부 사항이 개시된다. 그러나 본 개시의 일부 실시예는 일부 구체적인 세부 사항 없이 수행될 수 있음이 당업자에게 이해된다. 다른 경우에, 잘 알려진 방법, 절차, 컴포넌트 및 회로는 실시예의 태양을 불필요하게 흐리는 것을 피하기 위해 상세히 설명되지 않았다. 따라서, 본 개시의 범위는 앞의 실시예의 설명이 아니라 첨부된 청구범위에 의해 정의된다.
첨부된 청구범위 중에서 임의의 것이 순전히 소프트웨어 및/또는 펌웨어 구현을 커버하는 것으로 읽히는 경우, 적어도 하나의 예시에서의 구성 요소 중 적어도 하나는 여기에서 명시적으로 메모리, DVD, CD, 블루레이 등과 같이 소프트웨어 및/또는 펌웨어를 저장하는 유형의 비일시적인 매체를 포함하는 것으로 정의된다.
Claims (20)
- 재생 장치에 의해 수행되는 방법으로서,
상기 재생 장치의 네트워크 인터페이스를 통하여, 상기 재생 장치에 의한 재생을 위한 오디오 컨텐츠를 나타내는 데이터를 수신하는 단계; 및
상기 오디오 컨텐츠가 상기 재생 장치에 의해 재생되기 전에, 상기 오디오 컨텐츠에서, 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 단계;
를 포함하고, 상기 방법은
하나 이상의 네트워킹된 마이크로폰 장치가 상기 재생 장치의 가청 범위 내에 있다고 결정하는 단계;
상기 하나 이상의 네트워킹된 마이크로폰 장치가 상기 재생 장치의 상기 가청 범위 내에 있다고 결정하는 단계에 응답하여, 상기 재생 장치에 의한 상기 오디오 컨텐츠의 재생 동안, 상기 재생 장치의 상기 가청 범위 내에 있는 것으로 결정된 상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 상기 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블(disable)하는 단계 - 인에이블(enable)되는 경우, 특정 활성 단어에 대한 소정의 네트워킹된 마이크로폰 장치의 상기 활성 응답은 상기 소정의 네트워킹된 마이크로폰 장치로 하여금 마이크로폰을 통해, 상기 특정 활성 단어에 후속하는 음성 명령을 듣도록 함-; 및
상기 재생 장치의 하나 이상의 스피커를 통하여 상기 오디오 컨텐츠를 재생하는 단계를 더 포함하는 방법. - 제1항에 있어서,
상기 재생 장치는 상기 소정의 네트워킹된 마이크로폰 장치를 포함하는, 방법. - 제1항 또는 제2항에 있어서,
상기 재생 장치에 의한 상기 오디오 컨텐츠의 재생 동안, 상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 상기 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는,
상기 오디오 컨텐츠를 재생하는 동안, 상기 하나 이상의 네트워킹된 마이크로폰 장치를 통하여, 재생되는 상기 오디오 컨텐츠를 녹음하는 단계; 및
상기 녹음된 오디오 컨텐츠 내에서의 상기 하나 이상의 활성 단어에 대한 상기 소정의 네트워킹된 마이크로폰 장치의 각 활성 응답을 디세이블하는 단계를 포함하는, 방법. - 제1항 또는 제2항에 있어서,
상기 재생 장치에 의한 상기 오디오 컨텐츠의 재생 동안, 상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 상기 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는,
상기 재생 장치에 의한 상기 오디오 컨텐츠의 재생 동안, 상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 상기 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는 명령어를 상기 재생 장치의 상기 네트워크 인터페이스를 통해 상기 하나 이상의 네트워킹된 마이크로폰 장치로 송신하는 단계를 포함하는, 방법. - 제1항 또는 제2항에 있어서,
상기 재생 장치의 상기 가청 범위 내에 있는 것으로 결정된 상기 하나 이상의 네트워킹된 마이크로폰 장치는 집(household) 내 네트워킹된 마이크로폰 장치의 서브 세트(subset)인, 방법. - 제1항 또는 제2항에 있어서,
특정한 네트워킹된 마이크로폰 장치가 상기 재생 장치의 가청 범위에 있다고 결정하는 것은 상기 특정한 네트워킹된 마이크로폰 장치가 상기 재생 장치와 동기화 재생 구성으로 되어 있다고 결정하는 것을 포함하고,
상기 특정한 네트워킹된 마이크로폰 장치는 재생 장치를 포함하는, 방법. - 제1항 또는 제2항에 있어서,
상기 하나 이상의 네트워킹된 마이크로폰 장치가 상기 재생 장치의 가청 범위에 있다고 결정하는 단계는 상기 하나 이상의 네트워킹된 마이크로폰 장치가 상기 재생 장치의 가청 범위에 있다고 결정하는 단계를 포함하는, 방법. - 제1항 또는 제2항에 있어서,
상기 재생 장치에 의한 상기 오디오 컨텐츠의 재생 동안, 상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 상기 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는,
상기 오디오 컨텐츠를 재생하기 전에, 상기 오디오 컨텐츠를 수정하여 각 활성 단어를 나타내는 상기 오디오 컨텐츠의 세그먼트에 음향 마커(acoustic markers)를 포함시키는 단계를 포함하고,
상기 음향 마커를 검출하는 것은 상기 재생 장치에 의한 상기 오디오 컨텐츠의 재생 동안, 상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 상기 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하도록 하는 것인, 방법. - 제1항 또는 제2항에 있어서,
상기 하나 이상의 활성 단어를 검출하는 단계는 각 음성 서비스에 연관되는 각 활성 단어에 대한 복수의 활성 단어 검출 알고리즘을 상기 오디오 컨텐츠에 적용하는 단계를 포함하는, 방법. - 제9항에 있어서,
상기 하나 이상의 활성 단어를 검출하는 단계는 복수의 활성 단어를 검출하는 단계를 포함하고,
상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 상기 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는,
제1 네트워킹된 마이크로폰 장치로 하여금 상기 검출된 적어도 하나의 제1 활성 단어에 대한 각 활성 응답을 디세이블하는 단계; 및
제2 네트워킹된 마이크로폰 장치로 하여금 상기 검출된 적어도 하나의 제2 활성 단어에 대한 각 활성 응답을 디세이블하는 단계를 포함하는, 방법. - 제1항에 있어서,
상기 오디오 컨텐츠에서, 하나 이상의 음성 서비스에 대한 하나 이상의 활성 단어를 검출하는 단계는 상기 오디오 컨텐츠에서 특정 활성 단어의 복수 인스턴스를 검출하는 단계를 포함하는, 방법. - 제11항에 있어서,
상기 재생 장치에 의한 상기 오디오 컨텐츠의 재생 동안, 상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금 상기 검출된 하나 이상의 활성 단어에 대한 각 활성 응답을 디세이블하는 단계는,
상기 하나 이상의 네트워킹된 마이크로폰 장치로 하여금, 각 네트워킹된 마이크로폰 장치가 상기 오디오 컨텐츠 내 상기 특정 활성 단어의 상기 복수 인스턴스의 수와 동일한 수의 활성 단어를 검출할 때까지 각 활성 응답을 디세이블하는 단계를 포함하는, 방법. - 재생 장치로 하여금 제1항 또는 제2항의 방법을 수행하도록 하는 하나 이상의 프로세서에 의해 실행 가능한 명령어를 저장하는, 유형의 비일시적인 컴퓨터 판독 가능 기록매체.
- 재생 장치로서,
네트워크 인터페이스;
하나 이상의 프로세서; 및
제13항에 따른 유형의 비일시적인 컴퓨터 판독 가능 기록매체를 포함하는, 재생장치. - 삭제
- 삭제
- 삭제
- 삭제
- 삭제
- 삭제
Applications Claiming Priority (3)
Application Number | Priority Date | Filing Date | Title |
---|---|---|---|
US15/670,361 US10475449B2 (en) | 2017-08-07 | 2017-08-07 | Wake-word detection suppression |
US15/670,361 | 2017-08-07 | ||
PCT/US2018/045397 WO2019032462A1 (en) | 2017-08-07 | 2018-08-06 | REMOVAL OF AWAKENING WORD DETECTION |
Publications (2)
Publication Number | Publication Date |
---|---|
KR20200035118A KR20200035118A (ko) | 2020-04-01 |
KR102315053B1 true KR102315053B1 (ko) | 2021-10-20 |
Family
ID=63405364
Family Applications (1)
Application Number | Title | Priority Date | Filing Date |
---|---|---|---|
KR1020207006519A KR102315053B1 (ko) | 2017-08-07 | 2018-08-06 | 활성 단어 검출 억제 |
Country Status (8)
Country | Link |
---|---|
US (3) | US10475449B2 (ko) |
EP (2) | EP4040285A1 (ko) |
JP (1) | JP6963673B2 (ko) |
KR (1) | KR102315053B1 (ko) |
CN (2) | CN116954545A (ko) |
AU (2) | AU2018312989B2 (ko) |
CA (2) | CA3140979C (ko) |
WO (1) | WO2019032462A1 (ko) |
Families Citing this family (95)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
US9691378B1 (en) * | 2015-11-05 | 2017-06-27 | Amazon Technologies, Inc. | Methods and devices for selectively ignoring captured audio data |
US10095470B2 (en) | 2016-02-22 | 2018-10-09 | Sonos, Inc. | Audio response playback |
US9947316B2 (en) | 2016-02-22 | 2018-04-17 | Sonos, Inc. | Voice control of a media playback system |
US9772817B2 (en) | 2016-02-22 | 2017-09-26 | Sonos, Inc. | Room-corrected voice detection |
US9811314B2 (en) | 2016-02-22 | 2017-11-07 | Sonos, Inc. | Metadata exchange involving a networked playback system and a networked microphone system |
US10264030B2 (en) | 2016-02-22 | 2019-04-16 | Sonos, Inc. | Networked microphone device control |
US9965247B2 (en) | 2016-02-22 | 2018-05-08 | Sonos, Inc. | Voice controlled media playback system based on user profile |
US9978390B2 (en) | 2016-06-09 | 2018-05-22 | Sonos, Inc. | Dynamic player selection for audio signal processing |
US10152969B2 (en) | 2016-07-15 | 2018-12-11 | Sonos, Inc. | Voice detection by multiple devices |
US10134399B2 (en) | 2016-07-15 | 2018-11-20 | Sonos, Inc. | Contextualization of voice inputs |
US10115400B2 (en) | 2016-08-05 | 2018-10-30 | Sonos, Inc. | Multiple voice services |
US9942678B1 (en) | 2016-09-27 | 2018-04-10 | Sonos, Inc. | Audio playback settings for voice interaction |
US9743204B1 (en) | 2016-09-30 | 2017-08-22 | Sonos, Inc. | Multi-orientation playback device microphones |
US10181323B2 (en) | 2016-10-19 | 2019-01-15 | Sonos, Inc. | Arbitration-based voice recognition |
US11183181B2 (en) | 2017-03-27 | 2021-11-23 | Sonos, Inc. | Systems and methods of multiple voice services |
US10475449B2 (en) | 2017-08-07 | 2019-11-12 | Sonos, Inc. | Wake-word detection suppression |
CN107591151B (zh) * | 2017-08-22 | 2021-03-16 | 百度在线网络技术(北京)有限公司 | 远场语音唤醒方法、装置和终端设备 |
US10048930B1 (en) | 2017-09-08 | 2018-08-14 | Sonos, Inc. | Dynamic computation of system response volume |
US10446165B2 (en) | 2017-09-27 | 2019-10-15 | Sonos, Inc. | Robust short-time fourier transform acoustic echo cancellation during audio playback |
US10051366B1 (en) | 2017-09-28 | 2018-08-14 | Sonos, Inc. | Three-dimensional beam forming with a microphone array |
US10621981B2 (en) | 2017-09-28 | 2020-04-14 | Sonos, Inc. | Tone interference cancellation |
US10482868B2 (en) | 2017-09-28 | 2019-11-19 | Sonos, Inc. | Multi-channel acoustic echo cancellation |
US10466962B2 (en) | 2017-09-29 | 2019-11-05 | Sonos, Inc. | Media playback system with voice assistance |
US10733990B2 (en) * | 2017-10-18 | 2020-08-04 | Motorola Mobility Llc | Preventing initiation of a voice recognition session |
US10152966B1 (en) * | 2017-10-31 | 2018-12-11 | Comcast Cable Communications, Llc | Preventing unwanted activation of a hands free device |
US20190130898A1 (en) * | 2017-11-02 | 2019-05-02 | GM Global Technology Operations LLC | Wake-up-word detection |
US10880650B2 (en) | 2017-12-10 | 2020-12-29 | Sonos, Inc. | Network microphone devices with automatic do not disturb actuation capabilities |
US10818290B2 (en) | 2017-12-11 | 2020-10-27 | Sonos, Inc. | Home graph |
FR3075442B1 (fr) * | 2017-12-19 | 2019-11-22 | Sagemcom Broadband Sas | Dispositif et procede d'assistance vocale |
CN108039175B (zh) * | 2018-01-29 | 2021-03-26 | 北京百度网讯科技有限公司 | 语音识别方法、装置及服务器 |
WO2019152722A1 (en) | 2018-01-31 | 2019-08-08 | Sonos, Inc. | Device designation of playback and network microphone device arrangements |
US10877637B1 (en) | 2018-03-14 | 2020-12-29 | Amazon Technologies, Inc. | Voice-based device operation mode management |
US10885910B1 (en) | 2018-03-14 | 2021-01-05 | Amazon Technologies, Inc. | Voice-forward graphical user interface mode management |
US11127405B1 (en) * | 2018-03-14 | 2021-09-21 | Amazon Technologies, Inc. | Selective requests for authentication for voice-based launching of applications |
US10685666B2 (en) * | 2018-04-06 | 2020-06-16 | Intel Corporation | Automatic gain adjustment for improved wake word recognition in audio systems |
US11175880B2 (en) | 2018-05-10 | 2021-11-16 | Sonos, Inc. | Systems and methods for voice-assisted media content selection |
US10649727B1 (en) * | 2018-05-14 | 2020-05-12 | Amazon Technologies, Inc. | Wake word detection configuration |
US10847178B2 (en) | 2018-05-18 | 2020-11-24 | Sonos, Inc. | Linear filtering for noise-suppressed speech detection |
US10959029B2 (en) | 2018-05-25 | 2021-03-23 | Sonos, Inc. | Determining and adapting to changes in microphone performance of playback devices |
KR102318340B1 (ko) * | 2018-06-25 | 2021-10-28 | 구글 엘엘씨 | 핫 워드-인식 음성 합성 |
US10929097B2 (en) * | 2018-06-26 | 2021-02-23 | ROVl GUIDES, INC. | Systems and methods for switching operational modes based on audio triggers |
US10681460B2 (en) | 2018-06-28 | 2020-06-09 | Sonos, Inc. | Systems and methods for associating playback devices with voice assistant services |
KR102580521B1 (ko) * | 2018-07-13 | 2023-09-21 | 삼성전자주식회사 | 전자 장치 및 전자 장치의 음량 조절 방법 |
US10461710B1 (en) | 2018-08-28 | 2019-10-29 | Sonos, Inc. | Media playback system with maximum volume setting |
US11076035B2 (en) | 2018-08-28 | 2021-07-27 | Sonos, Inc. | Do not disturb feature for audio notifications |
US10878811B2 (en) | 2018-09-14 | 2020-12-29 | Sonos, Inc. | Networked devices, systems, and methods for intelligently deactivating wake-word engines |
US10587430B1 (en) | 2018-09-14 | 2020-03-10 | Sonos, Inc. | Networked devices, systems, and methods for associating playback devices based on sound codes |
US11024331B2 (en) | 2018-09-21 | 2021-06-01 | Sonos, Inc. | Voice detection optimization using sound metadata |
US10811015B2 (en) | 2018-09-25 | 2020-10-20 | Sonos, Inc. | Voice detection optimization based on selected voice assistant service |
US11100923B2 (en) | 2018-09-28 | 2021-08-24 | Sonos, Inc. | Systems and methods for selective wake word detection using neural network models |
US10692518B2 (en) | 2018-09-29 | 2020-06-23 | Sonos, Inc. | Linear filtering for noise-suppressed speech detection via multiple network microphone devices |
US11899519B2 (en) | 2018-10-23 | 2024-02-13 | Sonos, Inc. | Multiple stage network microphone device with reduced power consumption and processing load |
EP3654249A1 (en) | 2018-11-15 | 2020-05-20 | Snips | Dilated convolutions and gating for efficient keyword spotting |
US11183183B2 (en) | 2018-12-07 | 2021-11-23 | Sonos, Inc. | Systems and methods of operating media playback systems having multiple voice assistant services |
US11132989B2 (en) | 2018-12-13 | 2021-09-28 | Sonos, Inc. | Networked microphone devices, systems, and methods of localized arbitration |
US10602268B1 (en) | 2018-12-20 | 2020-03-24 | Sonos, Inc. | Optimization of network microphone devices using noise classification |
US11151994B2 (en) * | 2019-01-04 | 2021-10-19 | International Business Machines Corporation | Methods and systems for managing voice commands and the execution thereof |
US10867604B2 (en) | 2019-02-08 | 2020-12-15 | Sonos, Inc. | Devices, systems, and methods for distributed voice processing |
US11315556B2 (en) | 2019-02-08 | 2022-04-26 | Sonos, Inc. | Devices, systems, and methods for distributed voice processing by transmitting sound data associated with a wake word to an appropriate device for identification |
US11024290B2 (en) * | 2019-02-11 | 2021-06-01 | Amazon Technologies, Inc. | Wakeword detection using a secondary microphone |
CN110109645A (zh) * | 2019-04-30 | 2019-08-09 | 百度在线网络技术(北京)有限公司 | 一种交互式音乐试听方法、装置和终端 |
US11120794B2 (en) | 2019-05-03 | 2021-09-14 | Sonos, Inc. | Voice assistant persistence across multiple network microphone devices |
JPWO2020235141A1 (ko) * | 2019-05-17 | 2020-11-26 | ||
US10586540B1 (en) | 2019-06-12 | 2020-03-10 | Sonos, Inc. | Network microphone device with command keyword conditioning |
US11361756B2 (en) | 2019-06-12 | 2022-06-14 | Sonos, Inc. | Conditional wake word eventing based on environment |
US11200894B2 (en) | 2019-06-12 | 2021-12-14 | Sonos, Inc. | Network microphone device with command keyword eventing |
CN112712803B (zh) * | 2019-07-15 | 2022-02-25 | 华为技术有限公司 | 一种语音唤醒的方法和电子设备 |
US11138969B2 (en) | 2019-07-31 | 2021-10-05 | Sonos, Inc. | Locally distributed keyword detection |
US11138975B2 (en) | 2019-07-31 | 2021-10-05 | Sonos, Inc. | Locally distributed keyword detection |
US10871943B1 (en) | 2019-07-31 | 2020-12-22 | Sonos, Inc. | Noise classification for event detection |
US11189286B2 (en) | 2019-10-22 | 2021-11-30 | Sonos, Inc. | VAS toggle based on device orientation |
US11200900B2 (en) | 2019-12-20 | 2021-12-14 | Sonos, Inc. | Offline voice control |
US11562740B2 (en) | 2020-01-07 | 2023-01-24 | Sonos, Inc. | Voice verification for media playback |
US11556307B2 (en) | 2020-01-31 | 2023-01-17 | Sonos, Inc. | Local voice data processing |
US11308958B2 (en) | 2020-02-07 | 2022-04-19 | Sonos, Inc. | Localized wakeword verification |
JP7483421B2 (ja) | 2020-03-12 | 2024-05-15 | キヤノン株式会社 | 撮像装置、制御方法、及びプログラム |
CN111429917B (zh) * | 2020-03-18 | 2023-09-22 | 北京声智科技有限公司 | 一种设备唤醒方法及终端设备 |
KR20210123633A (ko) * | 2020-04-03 | 2021-10-14 | 삼성전자주식회사 | 음성 명령에 대응하는 태스크를 수행하는 전자 장치 및 그 동작 방법 |
CN111554298B (zh) * | 2020-05-18 | 2023-03-28 | 阿波罗智联(北京)科技有限公司 | 语音交互方法、语音交互设备和电子设备 |
US11482224B2 (en) | 2020-05-20 | 2022-10-25 | Sonos, Inc. | Command keywords with input detection windowing |
US11308962B2 (en) | 2020-05-20 | 2022-04-19 | Sonos, Inc. | Input detection windowing |
US11727919B2 (en) | 2020-05-20 | 2023-08-15 | Sonos, Inc. | Memory allocation for keyword spotting engines |
CN111640426A (zh) * | 2020-06-10 | 2020-09-08 | 北京百度网讯科技有限公司 | 用于输出信息的方法和装置 |
US11698771B2 (en) | 2020-08-25 | 2023-07-11 | Sonos, Inc. | Vocal guidance engines for playback devices |
JP7491147B2 (ja) | 2020-08-31 | 2024-05-28 | セイコーエプソン株式会社 | 表示システムの制御方法、表示システム、及び、表示装置の制御方法 |
US11657814B2 (en) * | 2020-10-08 | 2023-05-23 | Harman International Industries, Incorporated | Techniques for dynamic auditory phrase completion |
US11984123B2 (en) | 2020-11-12 | 2024-05-14 | Sonos, Inc. | Network device interaction by range |
US11562748B2 (en) * | 2020-12-01 | 2023-01-24 | Google Llc | Detecting and suppressing commands in media that may trigger another automated assistant |
US12001260B1 (en) * | 2020-12-11 | 2024-06-04 | Amazon Technologies, Inc. | Preventing inadvertent wake in a speech-controlled device |
US20220215835A1 (en) * | 2021-01-06 | 2022-07-07 | Comcast Cable Communications, Llc | Evaluating user device activations |
US11551700B2 (en) | 2021-01-25 | 2023-01-10 | Sonos, Inc. | Systems and methods for power-efficient keyword detection |
US20220246144A1 (en) * | 2021-01-29 | 2022-08-04 | Salesforce.Com, Inc. | Intent disambiguation within a virtual agent platform |
US11557293B2 (en) * | 2021-05-17 | 2023-01-17 | Google Llc | Contextual suppression of assistant command(s) |
WO2023056258A1 (en) * | 2021-09-30 | 2023-04-06 | Sonos, Inc. | Conflict management for wake-word detection processes |
US11769506B1 (en) * | 2022-05-09 | 2023-09-26 | Amazon Technologies, Inc. | Response orchestrator for natural language interface |
Citations (1)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
US20170084277A1 (en) | 2014-10-09 | 2017-03-23 | Google Inc. | Hotword detection on multiple devices |
Family Cites Families (1203)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
US186265A (en) * | 1877-01-16 | Improvement in odorless receptacles | ||
US4941187A (en) | 1984-02-03 | 1990-07-10 | Slater Robert W | Intercom apparatus for integrating disparate audio sources for use in light aircraft or similar high noise environments |
US4741038A (en) | 1986-09-26 | 1988-04-26 | American Telephone And Telegraph Company, At&T Bell Laboratories | Sound location arrangement |
JPS63301998A (ja) | 1987-06-02 | 1988-12-08 | 日本電気株式会社 | 音声認識応答装置 |
US4974213A (en) | 1988-12-16 | 1990-11-27 | Siwecki Thomas L | Passive active underwater sound detection apparatus |
US5036538A (en) | 1989-11-22 | 1991-07-30 | Telephonics Corporation | Multi-station voice recognition and processing system |
US5440644A (en) | 1991-01-09 | 1995-08-08 | Square D Company | Audio distribution system having programmable zoning features |
EP0548836B1 (en) | 1991-12-20 | 1997-06-11 | Matsushita Electric Industrial Co., Ltd. | A bass reproduction speaker apparatus |
US6311157B1 (en) | 1992-12-31 | 2001-10-30 | Apple Computer, Inc. | Assigning meanings to utterances in a speech recognition system |
JPH0883091A (ja) | 1994-09-09 | 1996-03-26 | Matsushita Electric Ind Co Ltd | 音声認識装置 |
US5740260A (en) | 1995-05-22 | 1998-04-14 | Presonus L.L.P. | Midi to analog sound processor interface |
US6070140A (en) | 1995-06-05 | 2000-05-30 | Tran; Bao Q. | Speech recognizer |
US5857172A (en) | 1995-07-31 | 1999-01-05 | Microsoft Corporation | Activation control of a speech recognizer through use of a pointing device |
US7174299B2 (en) | 1995-08-18 | 2007-02-06 | Canon Kabushiki Kaisha | Speech recognition system, speech recognition apparatus, and speech recognition method |
FR2739736B1 (fr) | 1995-10-05 | 1997-12-05 | Jean Laroche | Procede de reduction des pre-echos ou post-echos affectant des enregistrements audio |
JP3094900B2 (ja) | 1996-02-20 | 2000-10-03 | ヤマハ株式会社 | ネットワーク機器およびデータ送受信方法 |
US6404811B1 (en) | 1996-05-13 | 2002-06-11 | Tektronix, Inc. | Interactive multimedia system |
JP3679526B2 (ja) | 1996-10-31 | 2005-08-03 | キヤノン株式会社 | 画像共有装置、画面制御方法及びコンピュータ可読メモリ |
US6469633B1 (en) | 1997-01-06 | 2002-10-22 | Openglobe Inc. | Remote control of electronic devices |
US6078886A (en) | 1997-04-14 | 2000-06-20 | At&T Corporation | System and method for providing remote automatic speech recognition services via a packet network |
US6611537B1 (en) | 1997-05-30 | 2003-08-26 | Centillium Communications, Inc. | Synchronous network for digital media streams |
US6408078B1 (en) | 1997-10-30 | 2002-06-18 | Maximilian Hobelsberger | Active reactive acoustical elements |
US6088459A (en) | 1997-10-30 | 2000-07-11 | Hobelsberger; Maximilian Hans | Loudspeaker system with simulated baffle for improved base reproduction |
US6032202A (en) | 1998-01-06 | 2000-02-29 | Sony Corporation Of Japan | Home audio/video network with two level device control |
US20020002039A1 (en) | 1998-06-12 | 2002-01-03 | Safi Qureshey | Network-enabled audio device |
US6301603B1 (en) | 1998-02-17 | 2001-10-09 | Euphonics Incorporated | Scalable audio processing on a heterogeneous processor array |
US6953886B1 (en) | 1998-06-17 | 2005-10-11 | Looney Productions, Llc | Media organizer and entertainment center |
IL127569A0 (en) | 1998-09-16 | 1999-10-28 | Comsense Technologies Ltd | Interactive toys |
US6839410B2 (en) | 1998-09-01 | 2005-01-04 | At&T Corp. | Method and apparatus for setting user communication parameters based on voice identification of users |
CN1151488C (zh) | 1998-10-02 | 2004-05-26 | 国际商业机器公司 | 通过一般分层对象进行有效语音导航的结构框架 |
US20020116196A1 (en) | 1998-11-12 | 2002-08-22 | Tran Bao Q. | Speech recognizer |
US6243676B1 (en) | 1998-12-23 | 2001-06-05 | Openwave Systems Inc. | Searching and retrieving multimedia information |
US7130616B2 (en) | 2000-04-25 | 2006-10-31 | Simple Devices | System and method for providing content, management, and interactivity for client devices |
US6256554B1 (en) | 1999-04-14 | 2001-07-03 | Dilorenzo Mark | Multi-room entertainment system with in-room media player/dispenser |
US6414251B1 (en) | 1999-04-19 | 2002-07-02 | Breck Colquett | Weighing apparatus and method having automatic tolerance analysis and calibration |
US7657910B1 (en) | 1999-07-26 | 2010-02-02 | E-Cast Inc. | Distributed electronic entertainment method and apparatus |
GB2352933A (en) | 1999-07-31 | 2001-02-07 | Ibm | Speech encoding in a client server system |
US6542868B1 (en) | 1999-09-23 | 2003-04-01 | International Business Machines Corporation | Audio notification management system |
US6937977B2 (en) | 1999-10-05 | 2005-08-30 | Fastmobile, Inc. | Method and apparatus for processing an input speech signal during presentation of an output audio signal |
US6611604B1 (en) | 1999-10-22 | 2003-08-26 | Stillwater Designs & Audio, Inc. | Ultra low frequency transducer and loud speaker comprising same |
US7725307B2 (en) | 1999-11-12 | 2010-05-25 | Phoenix Solutions, Inc. | Query engine for processing voice based queries including semantic decoding |
US6594630B1 (en) | 1999-11-19 | 2003-07-15 | Voice Signal Technologies, Inc. | Voice-activated control for electrical device |
US6522886B1 (en) | 1999-11-22 | 2003-02-18 | Qwest Communications International Inc. | Method and system for simultaneously sharing wireless communications among multiple wireless handsets |
US6219645B1 (en) | 1999-12-02 | 2001-04-17 | Lucent Technologies, Inc. | Enhanced automatic speech recognition using multiple directional microphones |
ES2277419T3 (es) | 1999-12-03 | 2007-07-01 | Telefonaktiebolaget Lm Ericsson (Publ) | Un metodo para producir simultaneamente ficheros de audio en dos telefonos. |
KR20010054622A (ko) | 1999-12-07 | 2001-07-02 | 서평원 | 음성 인식 시스템의 음성 인식률 향상 방법 |
US20010042107A1 (en) | 2000-01-06 | 2001-11-15 | Palm Stephen R. | Networked audio player transport protocol and architecture |
US7661107B1 (en) | 2000-01-18 | 2010-02-09 | Advanced Micro Devices, Inc. | Method and apparatus for dynamic allocation of processing resources |
WO2001053994A2 (en) | 2000-01-24 | 2001-07-26 | Friskit, Inc. | Streaming media search and playback system |
US20020026442A1 (en) | 2000-01-24 | 2002-02-28 | Lipscomb Kenneth O. | System and method for the distribution and sharing of media assets between media players devices |
WO2001061939A2 (en) | 2000-02-18 | 2001-08-23 | Bridgeco Ag | Multi-portal bridge for providing network connectivity |
JP2001236093A (ja) | 2000-02-24 | 2001-08-31 | Omron Corp | 電子機器制御装置および電子機器 |
US8645137B2 (en) | 2000-03-16 | 2014-02-04 | Apple Inc. | Fast, language-independent method for user authentication by voice |
US6631410B1 (en) | 2000-03-16 | 2003-10-07 | Sharp Laboratories Of America, Inc. | Multimedia wired/wireless content synchronization system and method |
US20020022453A1 (en) | 2000-03-31 | 2002-02-21 | Horia Balog | Dynamic protocol selection and routing of content to mobile devices |
GB2363036B (en) | 2000-05-31 | 2004-05-12 | Nokia Mobile Phones Ltd | Conference call method and apparatus therefor |
US20050164664A1 (en) | 2000-07-21 | 2005-07-28 | Difonzo Daniel F. | Dynamically reconfigurable wireless networks (DRWiN) and methods for operating such networks |
US20040105566A1 (en) | 2000-07-27 | 2004-06-03 | International Business Machines Corporation | Body set type speaker unit |
US8165867B1 (en) | 2000-09-15 | 2012-04-24 | Fish Robert D | Methods for translating a device command |
US6934756B2 (en) | 2000-11-01 | 2005-08-23 | International Business Machines Corporation | Conversational networking via transport, coding and control conversational protocols |
US20020054685A1 (en) | 2000-11-09 | 2002-05-09 | Carlos Avendano | System for suppressing acoustic echoes and interferences in multi-channel audio systems |
US20020072816A1 (en) | 2000-12-07 | 2002-06-13 | Yoav Shdema | Audio system |
US7016847B1 (en) | 2000-12-08 | 2006-03-21 | Ben Franklin Patent Holdings L.L.C. | Open architecture for a voice user interface |
US6778869B2 (en) | 2000-12-11 | 2004-08-17 | Sony Corporation | System and method for request, delivery and use of multimedia files for audiovisual entertainment in the home environment |
US7143939B2 (en) | 2000-12-19 | 2006-12-05 | Intel Corporation | Wireless music device and method therefor |
US20020124097A1 (en) | 2000-12-29 | 2002-09-05 | Isely Larson J. | Methods, systems and computer program products for zone based distribution of audio signals |
US7617099B2 (en) | 2001-02-12 | 2009-11-10 | FortMedia Inc. | Noise suppression by two-channel tandem spectrum modification for speech signal in an automobile |
GB2372864B (en) | 2001-02-28 | 2005-09-07 | Vox Generation Ltd | Spoken language interface |
US6885989B2 (en) | 2001-04-02 | 2005-04-26 | International Business Machines Corporation | Method and system for collaborative speech recognition for small-area network |
US6757517B2 (en) | 2001-05-10 | 2004-06-29 | Chin-Chi Chang | Apparatus and method for coordinated music playback in wireless ad-hoc networks |
US7136934B2 (en) | 2001-06-19 | 2006-11-14 | Request, Inc. | Multimedia synchronization method and device |
KR100420069B1 (ko) | 2001-08-23 | 2004-02-25 | 한국과학기술원 | 인지 특성을 반영한 메뉴 설계 및 아이템 제시방법 |
US6892083B2 (en) | 2001-09-05 | 2005-05-10 | Vocera Communications Inc. | Voice-controlled wireless communications system and method |
US7536704B2 (en) | 2001-10-05 | 2009-05-19 | Opentv, Inc. | Method and apparatus automatic pause and resume of playback for a popup on interactive TV |
CA2408045A1 (en) | 2001-10-16 | 2003-04-16 | Audio Products International Corp. | Loudspeaker with large displacement motional feedback |
CA2407123C (en) | 2001-10-16 | 2007-12-18 | Audio Products International Corp. | Low distortion loudspeaker cone suspension |
US7006639B2 (en) | 2001-11-20 | 2006-02-28 | Maximilian Hans Hobelsberger | Active noise-attenuating duct element |
US7103542B2 (en) | 2001-12-14 | 2006-09-05 | Ben Franklin Patent Holding Llc | Automatically improving a voice recognition system |
US7391791B2 (en) | 2001-12-17 | 2008-06-24 | Implicit Networks, Inc. | Method and system for synchronization of content rendering |
DE10163213A1 (de) | 2001-12-21 | 2003-07-10 | Philips Intellectual Property | Verfahren zum Betrieb eines Spracherkennungssystems |
US8103009B2 (en) | 2002-01-25 | 2012-01-24 | Ksc Industries, Inc. | Wired, wireless, infrared, and powerline audio entertainment systems |
US7853341B2 (en) | 2002-01-25 | 2010-12-14 | Ksc Industries, Inc. | Wired, wireless, infrared, and powerline audio entertainment systems |
JP4086280B2 (ja) | 2002-01-29 | 2008-05-14 | 株式会社東芝 | 音声入力システム、音声入力方法及び音声入力プログラム |
US20030157951A1 (en) | 2002-02-20 | 2003-08-21 | Hasty William V. | System and method for routing 802.11 data traffic across channels to increase ad-hoc network capacity |
JP3715584B2 (ja) | 2002-03-28 | 2005-11-09 | 富士通株式会社 | 機器制御装置および機器制御方法 |
WO2003093950A2 (en) | 2002-05-06 | 2003-11-13 | David Goldberg | Localized audio networks and associated digital accessories |
US7643894B2 (en) | 2002-05-09 | 2010-01-05 | Netstreams Llc | Audio network distribution system |
US6961423B2 (en) | 2002-06-24 | 2005-11-01 | Freescale Semiconductor, Inc. | Method and apparatus for performing adaptive filtering |
JP3815388B2 (ja) | 2002-06-25 | 2006-08-30 | 株式会社デンソー | 音声認識システムおよび端末 |
US8060225B2 (en) | 2002-07-31 | 2011-11-15 | Hewlett-Packard Development Company, L. P. | Digital audio device |
EP1389853B1 (en) | 2002-08-14 | 2006-03-29 | Sony Deutschland GmbH | Bandwidth oriented reconfiguration of wireless ad hoc networks |
JP3910898B2 (ja) | 2002-09-17 | 2007-04-25 | 株式会社東芝 | 指向性設定装置、指向性設定方法及び指向性設定プログラム |
US7228275B1 (en) | 2002-10-21 | 2007-06-05 | Toyota Infotechnology Center Co., Ltd. | Speech recognition system having multiple speech recognizers |
JP2004163590A (ja) | 2002-11-12 | 2004-06-10 | Denso Corp | 再生装置及びプログラム |
KR20040042242A (ko) | 2002-11-13 | 2004-05-20 | 삼성전자주식회사 | 홈서버를 이용하는 홈로봇 및 이를 포함하는 홈네트워크시스템 |
US7295548B2 (en) | 2002-11-27 | 2007-11-13 | Microsoft Corporation | Method and system for disaggregating audio/visual components |
CN100392723C (zh) | 2002-12-11 | 2008-06-04 | 索夫塔马克斯公司 | 在稳定性约束下使用独立分量分析的语音处理系统和方法 |
US7076428B2 (en) | 2002-12-30 | 2006-07-11 | Motorola, Inc. | Method and apparatus for selective distributed speech recognition |
KR100668297B1 (ko) | 2002-12-31 | 2007-01-12 | 삼성전자주식회사 | 음성인식방법 및 장치 |
US6823050B2 (en) | 2003-02-13 | 2004-11-23 | International Business Machines Corporation | System and method for interfacing with a personal telephony recorder |
KR100749456B1 (ko) | 2003-03-03 | 2007-08-14 | 에이오엘 엘엘씨 | 디지털 통신용 소스 오디오 식별자 |
JP2004347943A (ja) | 2003-05-23 | 2004-12-09 | Clarion Co Ltd | データ処理装置、楽曲再生装置、データ処理装置の制御プログラムおよび楽曲再生装置の制御プログラム |
JP2004354721A (ja) | 2003-05-29 | 2004-12-16 | Shimizu Corp | 音声制御装置、音声制御方法および音声制御プログラム |
US7961892B2 (en) | 2003-07-28 | 2011-06-14 | Texas Instruments Incorporated | Apparatus and method for monitoring speaker cone displacement in an audio speaker |
US8234395B2 (en) | 2003-07-28 | 2012-07-31 | Sonos, Inc. | System and method for synchronizing operations among a plurality of independently clocked digital data processing devices |
US8290603B1 (en) | 2004-06-05 | 2012-10-16 | Sonos, Inc. | User interfaces for controlling and manipulating groupings in a multi-zone media system |
US10613817B2 (en) | 2003-07-28 | 2020-04-07 | Sonos, Inc. | Method and apparatus for displaying a list of tracks scheduled for playback by a synchrony group |
US7571014B1 (en) | 2004-04-01 | 2009-08-04 | Sonos, Inc. | Method and apparatus for controlling multimedia players in a multi-zone system |
US20050031139A1 (en) | 2003-08-07 | 2005-02-10 | Tymphany Corporation | Position detection of an actuator using impedance |
US20050031134A1 (en) | 2003-08-07 | 2005-02-10 | Tymphany Corporation | Position detection of an actuator using infrared light |
US20060104451A1 (en) | 2003-08-07 | 2006-05-18 | Tymphany Corporation | Audio reproduction system |
US20050031132A1 (en) | 2003-08-07 | 2005-02-10 | Tymphany Corporation | Control system |
US20050031131A1 (en) | 2003-08-07 | 2005-02-10 | Tymphany Corporation | Method of modifying dynamics of a system |
US20050031140A1 (en) | 2003-08-07 | 2005-02-10 | Tymphany Corporation | Position detection of an actuator using a capacitance measurement |
US20050031133A1 (en) | 2003-08-07 | 2005-02-10 | Tymphany Corporation | Process for position indication |
US20050031138A1 (en) | 2003-08-07 | 2005-02-10 | Tymphany Corporation | Method of measuring a cant of an actuator |
US20050031137A1 (en) | 2003-08-07 | 2005-02-10 | Tymphany Corporation | Calibration of an actuator |
KR20050023841A (ko) | 2003-09-03 | 2005-03-10 | 삼성전자주식회사 | 비선형 왜곡 저감 방법 및 장치 |
US7099821B2 (en) | 2003-09-12 | 2006-08-29 | Softmax, Inc. | Separation of target acoustic signals in a multi-transducer arrangement |
US20050077843A1 (en) | 2003-10-11 | 2005-04-14 | Ronnie Benditt | Method and apparatus for controlling a performing arts show by an onstage performer |
CN1871874A (zh) | 2003-10-24 | 2006-11-29 | 皇家飞利浦电子股份有限公司 | 自适应声音再现 |
WO2005048239A1 (ja) | 2003-11-12 | 2005-05-26 | Honda Motor Co., Ltd. | 音声認識装置 |
US7705565B2 (en) | 2003-12-31 | 2010-04-27 | Motorola, Inc. | Method and system for wireless charging |
US7707039B2 (en) | 2004-02-15 | 2010-04-27 | Exbiblio B.V. | Automatic modification of web pages |
JP4269973B2 (ja) | 2004-02-27 | 2009-05-27 | 株式会社デンソー | カーオーディオシステム |
US7483538B2 (en) | 2004-03-02 | 2009-01-27 | Ksc Industries, Inc. | Wireless and wired speaker hub for a home theater system |
US7415117B2 (en) | 2004-03-02 | 2008-08-19 | Microsoft Corporation | System and method for beamforming using a microphone array |
JP4059214B2 (ja) | 2004-03-04 | 2008-03-12 | ソニー株式会社 | 情報再生システムの制御方法、情報再生システム、情報提供装置、および情報提供プログラム |
US10200504B2 (en) | 2007-06-12 | 2019-02-05 | Icontrol Networks, Inc. | Communication protocols over internet protocol (IP) networks |
US7372966B2 (en) | 2004-03-19 | 2008-05-13 | Nokia Corporation | System for limiting loudspeaker displacement |
JP2005284492A (ja) | 2004-03-29 | 2005-10-13 | Mitsubishi Electric Corp | 音声利用操作装置 |
US7630501B2 (en) | 2004-05-14 | 2009-12-08 | Microsoft Corporation | System and method for calibration of an acoustic system |
US7792311B1 (en) | 2004-05-15 | 2010-09-07 | Sonos, Inc., | Method and apparatus for automatically enabling subwoofer channel audio based on detection of subwoofer device |
US7346846B2 (en) | 2004-05-28 | 2008-03-18 | Microsoft Corporation | Strategies for providing just-in-time user assistance |
US7006938B2 (en) | 2004-06-16 | 2006-02-28 | Ami Semiconductor, Inc. | Reactive sensor modules using Pade' Approximant based compensation and providing module-sourced excitation |
US7672845B2 (en) | 2004-06-22 | 2010-03-02 | International Business Machines Corporation | Method and system for keyword detection using voice-recognition |
US20060004834A1 (en) | 2004-06-30 | 2006-01-05 | Nokia Corporation | Dynamic shortcuts |
JP2006092482A (ja) | 2004-09-27 | 2006-04-06 | Yamaha Corp | 音声認識通報装置 |
US7720232B2 (en) | 2004-10-15 | 2010-05-18 | Lifesize Communications, Inc. | Speakerphone |
US8386523B2 (en) | 2004-12-30 | 2013-02-26 | Texas Instruments Incorporated | Random access audio decoder |
TWI272860B (en) | 2005-01-03 | 2007-02-01 | Lite On Technology Corp | Audio receiver and volume reminder method |
US20070189544A1 (en) | 2005-01-15 | 2007-08-16 | Outland Research, Llc | Ambient sound responsive media player |
CA2594670C (en) | 2005-01-21 | 2014-12-23 | Certicom Corp. | Elliptic curve random number generation |
US20060190968A1 (en) | 2005-01-31 | 2006-08-24 | Searete Llc, A Limited Corporation Of The State Of The State Of Delaware | Sharing between shared audio devices |
US8594320B2 (en) | 2005-04-19 | 2013-11-26 | (Epfl) Ecole Polytechnique Federale De Lausanne | Hybrid echo and noise suppression method and device in a multi-channel audio signal |
EP1715669A1 (en) | 2005-04-19 | 2006-10-25 | Ecole Polytechnique Federale De Lausanne (Epfl) | A method for removing echo in an audio signal |
US7991167B2 (en) | 2005-04-29 | 2011-08-02 | Lifesize Communications, Inc. | Forming beams with nulls directed at noise sources |
US7720684B2 (en) | 2005-04-29 | 2010-05-18 | Nuance Communications, Inc. | Method, apparatus, and computer program product for one-step correction of voice interaction |
US9300790B2 (en) | 2005-06-24 | 2016-03-29 | Securus Technologies, Inc. | Multi-party conversation analyzer and logger |
JP4760160B2 (ja) | 2005-06-29 | 2011-08-31 | ヤマハ株式会社 | 集音装置 |
JP4804052B2 (ja) | 2005-07-08 | 2011-10-26 | アルパイン株式会社 | 音声認識装置、音声認識装置を備えたナビゲーション装置及び音声認識装置の音声認識方法 |
US20070018844A1 (en) | 2005-07-19 | 2007-01-25 | Sehat Sutardja | Two way remote control |
JP4285457B2 (ja) | 2005-07-20 | 2009-06-24 | ソニー株式会社 | 音場測定装置及び音場測定方法 |
US8073149B2 (en) | 2005-07-29 | 2011-12-06 | Panasonic Corporation | Loudspeaker device |
CN1909625A (zh) | 2005-08-05 | 2007-02-07 | 鸿富锦精密工业(深圳)有限公司 | 一种自动调整音量的电视装置及控制方法 |
EP1934828A4 (en) | 2005-08-19 | 2008-10-08 | Gracenote Inc | METHOD AND SYSTEM FOR MANAGING THE OPERATION OF A REPRODUCTION DEVICE |
US20070060054A1 (en) | 2005-09-15 | 2007-03-15 | Sony Ericsson Mobile Communications Ab | Wireless home communication system method and apparatus |
JP4519041B2 (ja) | 2005-09-20 | 2010-08-04 | ローランド株式会社 | 楽器用スピーカ装置 |
KR20080046199A (ko) | 2005-09-21 | 2008-05-26 | 코닌클리케 필립스 일렉트로닉스 엔.브이. | 원거리에 위치한 마이크로폰을 사용한 음성 작동 제어를가진 초음파 이미징 시스템 |
EP1952619B1 (en) | 2005-11-07 | 2018-02-28 | Telecom Italia S.p.A. | Method for managing a conference call in a telephone network |
US8135143B2 (en) | 2005-11-15 | 2012-03-13 | Yamaha Corporation | Remote conference apparatus and sound emitting/collecting apparatus |
JP4929685B2 (ja) | 2005-11-15 | 2012-05-09 | ヤマハ株式会社 | 遠隔会議装置 |
US20070140058A1 (en) | 2005-11-21 | 2007-06-21 | Motorola, Inc. | Method and system for correcting transducer non-linearities |
US7600194B2 (en) | 2005-12-02 | 2009-10-06 | Microsoft Corporation | Start menu operation for computer user interface |
JP2007174233A (ja) | 2005-12-21 | 2007-07-05 | Pioneer Electronic Corp | スピーカー装置及び携帯電話機 |
JP4677341B2 (ja) | 2005-12-21 | 2011-04-27 | パイオニア株式会社 | スピーカー装置及び携帯電話機 |
US20160066087A1 (en) | 2006-01-30 | 2016-03-03 | Ludger Solbach | Joint noise suppression and acoustic echo cancellation |
KR100762636B1 (ko) | 2006-02-14 | 2007-10-01 | 삼성전자주식회사 | 네트워크 단말의 음성 검출 제어 시스템 및 방법 |
JP4422692B2 (ja) | 2006-03-03 | 2010-02-24 | 日本電信電話株式会社 | 伝達経路推定方法、残響除去方法、音源分離方法、これらの装置、プログラム、記録媒体 |
US8284982B2 (en) | 2006-03-06 | 2012-10-09 | Induction Speaker Technology, Llc | Positionally sequenced loudspeaker system |
WO2007123797A1 (en) | 2006-04-04 | 2007-11-01 | Johnson Controls Technology Company | System and method for extraction of meta data from a digital media storage device for media selection in a vehicle |
ATE423433T1 (de) | 2006-04-18 | 2009-03-15 | Harman Becker Automotive Sys | System und verfahren zur mehrkanal- echokompensation |
KR100786108B1 (ko) | 2006-05-01 | 2007-12-18 | 김준식 | 음파통신 네트워크 |
EP1855457B1 (en) | 2006-05-10 | 2009-07-08 | Harman Becker Automotive Systems GmbH | Multi channel echo compensation using a decorrelation stage |
US9208785B2 (en) | 2006-05-10 | 2015-12-08 | Nuance Communications, Inc. | Synchronizing distributed speech recognition |
US8041057B2 (en) | 2006-06-07 | 2011-10-18 | Qualcomm Incorporated | Mixing techniques for mixing audio |
JP4984683B2 (ja) | 2006-06-29 | 2012-07-25 | ヤマハ株式会社 | 放収音装置 |
US8207936B2 (en) | 2006-06-30 | 2012-06-26 | Sony Ericsson Mobile Communications Ab | Voice remote control |
US8189765B2 (en) | 2006-07-06 | 2012-05-29 | Panasonic Corporation | Multichannel echo canceller |
US20080037814A1 (en) | 2006-08-09 | 2008-02-14 | Jeng-Jye Shau | Precision audio speakers |
US8428278B2 (en) | 2006-08-10 | 2013-04-23 | Claudio Lastrucci | Improvements to systems for acoustic diffusion |
US10013381B2 (en) | 2006-08-31 | 2018-07-03 | Bose Corporation | Media playing from a docked handheld media device |
US8483853B1 (en) | 2006-09-12 | 2013-07-09 | Sonos, Inc. | Controlling and manipulating groupings in a multi-zone media system |
US8473618B2 (en) | 2006-09-19 | 2013-06-25 | Motorola Solutions, Inc. | Method and system for processing multiple communication sessions in a communication network |
JP2008079256A (ja) | 2006-09-25 | 2008-04-03 | Toshiba Corp | 音響信号処理装置、音響信号処理方法及びプログラム |
US8073681B2 (en) | 2006-10-16 | 2011-12-06 | Voicebox Technologies, Inc. | System and method for a cooperative conversational voice user interface |
TWI435591B (zh) | 2006-10-17 | 2014-04-21 | Marvell World Trade Ltd | 用於蜂巢電話之顯示控制 |
US7747293B2 (en) | 2006-10-17 | 2010-06-29 | Marvell Worl Trade Ltd. | Display control for cellular phone |
US7987294B2 (en) | 2006-10-17 | 2011-07-26 | Altec Lansing Australia Pty Limited | Unification of multimedia devices |
US9124650B2 (en) | 2006-12-13 | 2015-09-01 | Quickplay Media Inc. | Digital rights management in a mobile environment |
US8391501B2 (en) | 2006-12-13 | 2013-03-05 | Motorola Mobility Llc | Method and apparatus for mixing priority and non-priority audio signals |
US20080146289A1 (en) | 2006-12-14 | 2008-06-19 | Motorola, Inc. | Automatic audio transducer adjustments based upon orientation of a mobile communication device |
JP2008158868A (ja) | 2006-12-25 | 2008-07-10 | Toyota Motor Corp | 移動体、及びその制御方法 |
US7973857B2 (en) | 2006-12-27 | 2011-07-05 | Nokia Corporation | Teleconference group formation using context information |
US20090013255A1 (en) | 2006-12-30 | 2009-01-08 | Matthew John Yuschik | Method and System for Supporting Graphical User Interfaces |
KR101316750B1 (ko) | 2007-01-23 | 2013-10-08 | 삼성전자주식회사 | 수신된 위치 정보에 따라 오디오 파일을 재생하는 장치 및그 방법 |
TW200833152A (en) | 2007-01-31 | 2008-08-01 | Bluepacket Comm Co Ltd | Multimedia switching system |
JPWO2008096414A1 (ja) | 2007-02-06 | 2010-05-20 | パイオニア株式会社 | コンテンツ取得装置、コンテンツ取得方法、コンテンツ取得プログラムおよび記録媒体 |
US20090228919A1 (en) | 2007-11-16 | 2009-09-10 | Zott Joseph A | Media playlist management and viewing remote control |
US20080208594A1 (en) | 2007-02-27 | 2008-08-28 | Cross Charles W | Effecting Functions On A Multimodal Telephony Device |
JP4728982B2 (ja) | 2007-03-05 | 2011-07-20 | 株式会社東芝 | 利用者と対話する装置、方法およびプログラム |
US8635243B2 (en) | 2007-03-07 | 2014-01-21 | Research In Motion Limited | Sending a communications header with voice recording to send metadata for use in speech recognition, formatting, and search mobile search application |
US8996379B2 (en) | 2007-03-07 | 2015-03-31 | Vlingo Corporation | Speech recognition text entry for software applications |
US8886545B2 (en) | 2007-03-07 | 2014-11-11 | Vlingo Corporation | Dealing with switch latency in speech recognition |
US8019076B1 (en) | 2007-03-14 | 2011-09-13 | Clearone Communications, Inc. | Portable speakerphone device and subsystem utilizing false doubletalk detection |
GB0706074D0 (en) | 2007-03-28 | 2007-05-09 | Skype Ltd | Detection of communication states |
US8977255B2 (en) | 2007-04-03 | 2015-03-10 | Apple Inc. | Method and system for operating a multi-function portable electronic device using voice-activation |
US8983051B2 (en) | 2007-04-03 | 2015-03-17 | William F. Barton | Outgoing call classification and disposition |
US8406439B1 (en) | 2007-04-04 | 2013-03-26 | At&T Intellectual Property I, L.P. | Methods and systems for synthetic audio placement |
US8848879B1 (en) | 2007-05-03 | 2014-09-30 | Avaya Inc. | Customizable notification based on recent communication history |
US8041565B1 (en) | 2007-05-04 | 2011-10-18 | Foneweb, Inc. | Precision speech to text conversion |
KR100827613B1 (ko) | 2007-05-04 | 2008-05-07 | 삼성전자주식회사 | 휴대용 단말기의 마이크 제어 장치 및 방법 |
US8032383B1 (en) | 2007-05-04 | 2011-10-04 | Foneweb, Inc. | Speech controlled services and devices using internet |
US8136040B2 (en) | 2007-05-16 | 2012-03-13 | Apple Inc. | Audio variance for multiple windows |
BRPI0810285A2 (pt) | 2007-05-18 | 2014-12-30 | Shorthand Mobile Inc | "sistema e processo para comunicações aperfeiçoadas via sistemas de comunicação de pequena taxa de dados" |
US20080291916A1 (en) | 2007-05-22 | 2008-11-27 | Bo Xiong | Systems and methods for dynamic quality of service |
EP1998446A1 (en) | 2007-05-31 | 2008-12-03 | Alcatel Lucent | Remote control for devices with connectivity to a service delivery platform |
US8068925B2 (en) | 2007-06-28 | 2011-11-29 | Apple Inc. | Dynamic routing of audio among multiple audio devices |
JP4985151B2 (ja) | 2007-06-29 | 2012-07-25 | ヤマハ株式会社 | コンテンツ配信システム及びセンタ装置 |
JP4916394B2 (ja) | 2007-07-03 | 2012-04-11 | 富士通株式会社 | エコー抑圧装置、エコー抑圧方法及びコンピュータプログラム |
WO2009020617A1 (en) | 2007-08-06 | 2009-02-12 | Orison Corporation | System and method for three-dimensional ultrasound imaging |
US20090046866A1 (en) | 2007-08-15 | 2009-02-19 | Fortemedia, Inc. | Apparatus capable of performing acoustic echo cancellation and a method thereof |
US8073125B2 (en) | 2007-09-25 | 2011-12-06 | Microsoft Corporation | Spatial audio conferencing |
US7844724B2 (en) | 2007-10-24 | 2010-11-30 | Social Communications Company | Automated real-time data stream switching in a shared virtual area communication environment |
US8639214B1 (en) | 2007-10-26 | 2014-01-28 | Iwao Fujisaki | Communication device |
US8013720B2 (en) | 2007-11-02 | 2011-09-06 | Reverse Control, Inc. | Signal apparatus for facilitating safe backup of vehicles |
CN103648071B (zh) | 2007-11-20 | 2018-11-02 | 松下知识产权经营株式会社 | 扬声器、视频设备、以及便携式信息处理装置 |
US9247346B2 (en) | 2007-12-07 | 2016-01-26 | Northern Illinois Research Foundation | Apparatus, system and method for noise cancellation and communication for incubators and related devices |
US20090153289A1 (en) | 2007-12-12 | 2009-06-18 | Eric James Hope | Handheld electronic devices with bimodal remote control functionality |
US9386154B2 (en) | 2007-12-21 | 2016-07-05 | Nuance Communications, Inc. | System, method and software program for enabling communications between customer service agents and users of communication devices |
US8473081B2 (en) | 2007-12-25 | 2013-06-25 | Personics Holdings, Inc. | Method and system for event reminder using an earpiece |
US8423893B2 (en) | 2008-01-07 | 2013-04-16 | Altec Lansing Australia Pty Limited | User interface for managing the operation of networked media playback devices |
US9992314B2 (en) | 2008-01-24 | 2018-06-05 | Garmin Switzerland Gmbh | Automatic device mode switching |
DE102008039329A1 (de) | 2008-01-25 | 2009-07-30 | Fraunhofer-Gesellschaft zur Förderung der angewandten Forschung e.V. | Vorrichtung und Verfahren zur Berechnung von Steuerinformationen für ein Echounterdrückungsfilter und Vorrichtung und Verfahren zur Berechnung eines Verzögerungswerts |
DE102008039330A1 (de) | 2008-01-31 | 2009-08-13 | Fraunhofer-Gesellschaft zur Förderung der angewandten Forschung e.V. | Vorrichtung und Verfahren zum Berechnen von Filterkoeffizienten zur Echounterdrückung |
US8072905B2 (en) | 2008-02-04 | 2011-12-06 | Sony Ericsson Mobile Communications Ab | Intelligent interaction between devices in a local network |
US8213598B2 (en) | 2008-02-26 | 2012-07-03 | Microsoft Corporation | Harmonic distortion residual echo suppression |
US8638908B2 (en) | 2008-02-28 | 2014-01-28 | Computer Products Introductions, Corp | Contextual conversation processing in telecommunication applications |
US8194882B2 (en) | 2008-02-29 | 2012-06-05 | Audience, Inc. | System and method for providing single microphone noise suppression fallback |
US8255224B2 (en) | 2008-03-07 | 2012-08-28 | Google Inc. | Voice recognition grammar selection based on context |
US9113240B2 (en) | 2008-03-18 | 2015-08-18 | Qualcomm Incorporated | Speech enhancement using multiple microphones on multiple devices |
US20090248397A1 (en) | 2008-03-25 | 2009-10-01 | Microsoft Corporation | Service Initiation Techniques |
WO2009120301A2 (en) | 2008-03-25 | 2009-10-01 | Square Products Corporation | System and method for simultaneous media presentation |
US7516068B1 (en) | 2008-04-07 | 2009-04-07 | International Business Machines Corporation | Optimized collection of audio for speech recognition |
CN101562671A (zh) | 2008-04-18 | 2009-10-21 | 鸿富锦精密工业(深圳)有限公司 | 音频设备的音量控制方法及通信装置 |
US8751227B2 (en) | 2008-04-30 | 2014-06-10 | Nec Corporation | Acoustic model learning device and speech recognition device |
US8589161B2 (en) | 2008-05-27 | 2013-11-19 | Voicebox Technologies, Inc. | System and method for an integrated, multi-modal, multi-device natural language voice services environment |
US8831948B2 (en) | 2008-06-06 | 2014-09-09 | At&T Intellectual Property I, L.P. | System and method for synthetically generated speech describing media content |
US8385557B2 (en) | 2008-06-19 | 2013-02-26 | Microsoft Corporation | Multichannel acoustic echo reduction |
US8325909B2 (en) | 2008-06-25 | 2012-12-04 | Microsoft Corporation | Acoustic echo suppression |
US8693663B2 (en) | 2008-06-27 | 2014-04-08 | Centurylink Intellectual Property Llc | System and method for implementing do-not-disturb during playback of media content |
US8364481B2 (en) | 2008-07-02 | 2013-01-29 | Google Inc. | Speech recognition with parallel recognition tasks |
US8505056B2 (en) | 2008-07-10 | 2013-08-06 | Apple Inc. | Updating properties of remote A/V performance nodes |
EP2146519B1 (en) | 2008-07-16 | 2012-06-06 | Nuance Communications, Inc. | Beamforming pre-processing for speaker localization |
US8781833B2 (en) | 2008-07-17 | 2014-07-15 | Nuance Communications, Inc. | Speech recognition semantic classification training |
US8639830B2 (en) | 2008-07-22 | 2014-01-28 | Control4 Corporation | System and method for streaming audio |
US8325938B2 (en) | 2008-08-12 | 2012-12-04 | Sony Corporation | Handsfree call apparatus, acoustic reproducing apparatus with handsfree call function, and handsfree call method |
JP5206234B2 (ja) | 2008-08-27 | 2013-06-12 | 富士通株式会社 | 雑音抑圧装置、携帯電話機、雑音抑圧方法及びコンピュータプログラム |
US8676586B2 (en) | 2008-09-16 | 2014-03-18 | Nice Systems Ltd | Method and apparatus for interaction or discourse analytics |
KR20100034229A (ko) | 2008-09-23 | 2010-04-01 | 삼성전자주식회사 | 이어폰 회로를 포함하는 휴대 단말기 및 이의 운용방법 |
US8676904B2 (en) | 2008-10-02 | 2014-03-18 | Apple Inc. | Electronic devices with voice command and contextual data processing capabilities |
KR101829865B1 (ko) | 2008-11-10 | 2018-02-20 | 구글 엘엘씨 | 멀티센서 음성 검출 |
US8386261B2 (en) | 2008-11-14 | 2013-02-26 | Vocollect Healthcare Systems, Inc. | Training/coaching system for a voice-enabled work environment |
JP5347472B2 (ja) | 2008-12-12 | 2013-11-20 | ヤマハ株式会社 | 遠隔制御装置および遠隔制御システム |
US8548812B2 (en) | 2008-12-22 | 2013-10-01 | Avaya Inc. | Method and system for detecting a relevant utterance in a voice session |
KR101467796B1 (ko) | 2009-01-12 | 2014-12-10 | 엘지전자 주식회사 | 이동단말기 및 그 제어 방법 |
US20100179874A1 (en) | 2009-01-13 | 2010-07-15 | Yahoo! Inc. | Media object metadata engine configured to determine relationships between persons and brands |
US8351617B2 (en) | 2009-01-13 | 2013-01-08 | Fortemedia, Inc. | Method for phase mismatch calibration for an array microphone and phase calibration module for the same |
US20130283169A1 (en) | 2012-04-24 | 2013-10-24 | Social Communications Company | Voice-based virtual area navigation |
US8428758B2 (en) | 2009-02-16 | 2013-04-23 | Apple Inc. | Dynamic audio ducking |
FR2943875A1 (fr) | 2009-03-31 | 2010-10-01 | France Telecom | Procede et dispositif de classification du bruit de fond contenu dans un signal audio. |
KR101064976B1 (ko) | 2009-04-06 | 2011-09-15 | 한국과학기술원 | 음원위치추정시스템 및 이를 구비한 음원에 반응하는 로봇 |
US8243949B2 (en) | 2009-04-14 | 2012-08-14 | Plantronics, Inc. | Network addressible loudspeaker and audio play |
WO2010118763A1 (en) | 2009-04-15 | 2010-10-21 | Fraunhofer-Gesellschaft zur Förderung der angewandten Forschung e.V. | Multichannel echo canceller |
US8483398B2 (en) | 2009-04-30 | 2013-07-09 | Hewlett-Packard Development Company, L.P. | Methods and systems for reducing acoustic echoes in multichannel communication systems by reducing the dimensionality of the space of impulse responses |
JP5550456B2 (ja) | 2009-06-04 | 2014-07-16 | 本田技研工業株式会社 | 残響抑圧装置、及び残響抑圧方法 |
US9858925B2 (en) | 2009-06-05 | 2018-01-02 | Apple Inc. | Using context information to facilitate processing of commands in a virtual assistant |
JP4820434B2 (ja) | 2009-06-08 | 2011-11-24 | レノボ・シンガポール・プライベート・リミテッド | マイクロフォンのミュート・コントロール |
US20100332236A1 (en) | 2009-06-25 | 2010-12-30 | Blueant Wireless Pty Limited | Voice-triggered operation of electronic devices |
US8478982B2 (en) | 2009-08-06 | 2013-07-02 | Broadcom Corporation | Media access control security management in physical layer |
US8625775B2 (en) | 2009-08-06 | 2014-01-07 | Hti Ip, L.L.C. | Method and system for reducing echo and noise in a vehicle passenger compartment environment |
JP5440053B2 (ja) | 2009-09-14 | 2014-03-12 | ソニー株式会社 | 情報処理装置及び情報処理方法、並びにコンピューター・プログラム |
US8753279B2 (en) | 2009-09-17 | 2014-06-17 | Hitachi Medical Corporation | Ultrasound probe and ultrasound imaging device |
US20110091055A1 (en) | 2009-10-19 | 2011-04-21 | Broadcom Corporation | Loudspeaker localization techniques |
US8600073B2 (en) | 2009-11-04 | 2013-12-03 | Cambridge Silicon Radio Limited | Wind noise suppression |
KR101301535B1 (ko) | 2009-12-02 | 2013-09-04 | 한국전자통신연구원 | 하이브리드 번역 장치 및 그 방법 |
US20110145581A1 (en) | 2009-12-14 | 2011-06-16 | Verizon Patent And Licensing, Inc. | Media playback across devices |
JP5641186B2 (ja) | 2010-01-13 | 2014-12-17 | ヤマハ株式会社 | 雑音抑圧装置およびプログラム |
NO332437B1 (no) | 2010-01-18 | 2012-09-17 | Cisco Systems Int Sarl | Apparat og fremgangsmate for a supprimere et akustisk ekko |
US10553209B2 (en) | 2010-01-18 | 2020-02-04 | Apple Inc. | Systems and methods for hands-free notification summaries |
WO2011091402A1 (en) | 2010-01-25 | 2011-07-28 | Justin Mason | Voice electronic listening assistant |
US8718290B2 (en) | 2010-01-26 | 2014-05-06 | Audience, Inc. | Adaptive noise reduction using level cues |
US8713571B2 (en) | 2010-02-17 | 2014-04-29 | Microsoft Corporation | Asynchronous task execution |
US8682667B2 (en) | 2010-02-25 | 2014-03-25 | Apple Inc. | User profiling for selecting user specific voice input processing information |
US9209987B2 (en) | 2010-03-02 | 2015-12-08 | Microsoft Technology Licensing, Llc | Social media playback |
EP2375779A3 (en) | 2010-03-31 | 2012-01-18 | Fraunhofer-Gesellschaft zur Förderung der Angewandten Forschung e.V. | Apparatus and method for measuring a plurality of loudspeakers and microphone array |
US9112989B2 (en) | 2010-04-08 | 2015-08-18 | Qualcomm Incorporated | System and method of smart audio logging for mobile devices |
US9514476B2 (en) | 2010-04-14 | 2016-12-06 | Viacom International Inc. | Systems and methods for discovering artists |
US8538035B2 (en) | 2010-04-29 | 2013-09-17 | Audience, Inc. | Multi-microphone robust noise suppression |
US8437339B2 (en) | 2010-04-28 | 2013-05-07 | Hewlett-Packard Development Company, L.P. | Techniques to provide integrated voice service management |
JP5572445B2 (ja) | 2010-04-30 | 2014-08-13 | 本田技研工業株式会社 | 残響抑圧装置、及び残響抑圧方法 |
KR101582436B1 (ko) | 2010-05-04 | 2016-01-04 | 샤잠 엔터테인먼트 리미티드 | 미디어의 동기화 방법 및 시스템 |
US9307340B2 (en) | 2010-05-06 | 2016-04-05 | Dolby Laboratories Licensing Corporation | Audio system equalization for portable media playback devices |
JP2013530420A (ja) | 2010-05-06 | 2013-07-25 | ドルビー ラボラトリーズ ライセンシング コーポレイション | 可搬型メディア再生装置に関するオーディオ・システム等化処理 |
US9736600B2 (en) | 2010-05-17 | 2017-08-15 | Iii Holdings 4, Llc | Devices and methods for collecting acoustic data |
US8395653B2 (en) | 2010-05-18 | 2013-03-12 | Polycom, Inc. | Videoconferencing endpoint having multiple voice-tracking cameras |
US20110289506A1 (en) | 2010-05-18 | 2011-11-24 | Google Inc. | Management of computing resources for applications |
US9558755B1 (en) | 2010-05-20 | 2017-01-31 | Knowles Electronics, Llc | Noise suppression assisted automatic speech recognition |
US8831761B2 (en) | 2010-06-02 | 2014-09-09 | Sony Corporation | Method for determining a processed audio signal and a handheld device |
JP2011259097A (ja) | 2010-06-07 | 2011-12-22 | Sony Corp | 音声信号処理装置及び音声信号処理方法 |
US8588849B2 (en) | 2010-07-09 | 2013-11-19 | Blackberry Limited | System and method for resuming media |
US8699723B2 (en) | 2010-07-20 | 2014-04-15 | International Business Machines Corporation | Audio device volume manager using measured volume perceived at a first audio device to control volume generation by a second audio device |
US8762144B2 (en) | 2010-07-21 | 2014-06-24 | Samsung Electronics Co., Ltd. | Method and apparatus for voice activity detection |
US9025782B2 (en) | 2010-07-26 | 2015-05-05 | Qualcomm Incorporated | Systems, methods, apparatus, and computer-readable media for multi-microphone location-selective processing |
US9349368B1 (en) | 2010-08-05 | 2016-05-24 | Google Inc. | Generating an audio notification based on detection of a triggering event |
US8731939B1 (en) | 2010-08-06 | 2014-05-20 | Google Inc. | Routing queries based on carrier phrase registration |
US8359020B2 (en) | 2010-08-06 | 2013-01-22 | Google Inc. | Automatically monitoring for voice input based on context |
JP2013538522A (ja) | 2010-08-27 | 2013-10-10 | インテル コーポレイション | オブジェクトに基づく動作のための技術 |
US20120078635A1 (en) | 2010-09-24 | 2012-03-29 | Apple Inc. | Voice control system |
US8861756B2 (en) | 2010-09-24 | 2014-10-14 | LI Creative Technologies, Inc. | Microphone array system |
JP5259020B2 (ja) | 2010-10-01 | 2013-08-07 | 三菱電機株式会社 | 音声認識装置 |
US9240111B2 (en) | 2010-10-06 | 2016-01-19 | Microsoft Technology Licensing, Llc | Inferring building metadata from distributed sensors |
WO2012046582A1 (ja) | 2010-10-08 | 2012-04-12 | 日本電気株式会社 | 信号処理装置、信号処理方法、及び信号処理プログラム |
WO2012054872A2 (en) | 2010-10-22 | 2012-04-26 | Phorus Llc | Media distribution architecture |
EP2444967A1 (en) | 2010-10-25 | 2012-04-25 | Fraunhofer-Gesellschaft zur Förderung der Angewandten Forschung e.V. | Echo suppression comprising modeling of late reverberation components |
US9552840B2 (en) | 2010-10-25 | 2017-01-24 | Qualcomm Incorporated | Three-dimensional sound capturing and reproducing with multi-microphones |
US9226069B2 (en) | 2010-10-29 | 2015-12-29 | Qualcomm Incorporated | Transitioning multiple microphones from a first mode to a second mode |
US8799395B2 (en) | 2010-11-22 | 2014-08-05 | Deluxe Media Inc. | Methods and systems of dynamically managing content for use by a media playback device |
US20120148075A1 (en) | 2010-12-08 | 2012-06-14 | Creative Technology Ltd | Method for optimizing reproduction of audio signals from an apparatus for audio reproduction |
CN103238182B (zh) | 2010-12-15 | 2015-07-22 | 皇家飞利浦电子股份有限公司 | 具有远程噪声检测器的降噪系统 |
JP5771002B2 (ja) | 2010-12-22 | 2015-08-26 | 株式会社東芝 | 音声認識装置、音声認識方法および音声認識装置を搭載したテレビ受像機 |
US9241227B2 (en) | 2011-01-06 | 2016-01-19 | Bose Corporation | Transducer with integrated sensor |
JP2012150237A (ja) | 2011-01-18 | 2012-08-09 | Sony Corp | 音信号処理装置、および音信号処理方法、並びにプログラム |
CN102123188A (zh) | 2011-03-03 | 2011-07-13 | 曾超宁 | 移动电话耳麦装置 |
US8929564B2 (en) | 2011-03-03 | 2015-01-06 | Microsoft Corporation | Noise adaptive beamforming for microphone arrays |
KR20120100514A (ko) | 2011-03-04 | 2012-09-12 | 삼성전자주식회사 | 디바이스 그룹핑 방법 및 이를 적용한 서버 |
US8804977B2 (en) | 2011-03-18 | 2014-08-12 | Dolby Laboratories Licensing Corporation | Nonlinear reference signal processing for echo suppression |
US9262612B2 (en) | 2011-03-21 | 2016-02-16 | Apple Inc. | Device access using voice authentication |
US8938312B2 (en) | 2011-04-18 | 2015-01-20 | Sonos, Inc. | Smart line-in processing |
US9493130B2 (en) | 2011-04-22 | 2016-11-15 | Angel A. Penilla | Methods and systems for communicating content to connected vehicle users based detected tone/mood in voice input |
KR20120128542A (ko) | 2011-05-11 | 2012-11-27 | 삼성전자주식회사 | 멀티 채널 에코 제거를 위한 멀티 채널 비-상관 처리 방법 및 장치 |
US9342516B2 (en) | 2011-05-18 | 2016-05-17 | Microsoft Technology Licensing, Llc | Media presentation playback annotation |
US8320577B1 (en) | 2011-05-20 | 2012-11-27 | Google Inc. | Method and apparatus for multi-channel audio processing using single-channel components |
CN103703719B (zh) | 2011-05-31 | 2018-06-05 | 谷歌有限责任公司 | 使通信会话中的参与者静音的方法及设备 |
US8897465B2 (en) | 2011-06-01 | 2014-11-25 | Robert Bosch Gmbh | Class D micro-speaker |
US8958571B2 (en) | 2011-06-03 | 2015-02-17 | Cirrus Logic, Inc. | MIC covering detection in personal audio devices |
US8738925B1 (en) | 2013-01-07 | 2014-05-27 | Fitbit, Inc. | Wireless portable biometric device syncing |
US9307321B1 (en) | 2011-06-09 | 2016-04-05 | Audience, Inc. | Speaker distortion reduction |
US9264553B2 (en) | 2011-06-11 | 2016-02-16 | Clearone Communications, Inc. | Methods and apparatuses for echo cancelation with beamforming microphone arrays |
WO2012174301A1 (en) | 2011-06-14 | 2012-12-20 | Related Content Database, Inc. | System and method for presenting content with time based metadata |
US8731765B2 (en) | 2011-06-28 | 2014-05-20 | GM Global Technology Operations LLC | Method and apparatus for fault detection in a torque machine of a powertrain system |
US20130018659A1 (en) | 2011-07-12 | 2013-01-17 | Google Inc. | Systems and Methods for Speech Command Processing |
US9042556B2 (en) | 2011-07-19 | 2015-05-26 | Sonos, Inc | Shaping sound responsive to speaker orientation |
US20130024018A1 (en) | 2011-07-22 | 2013-01-24 | Htc Corporation | Multimedia control method and multimedia control system |
JP5289517B2 (ja) | 2011-07-28 | 2013-09-11 | 株式会社半導体理工学研究センター | センサネットワークシステムとその通信方法 |
US9148742B1 (en) | 2011-07-29 | 2015-09-29 | Google Inc. | Proximity detection via audio |
JP5640918B2 (ja) | 2011-08-05 | 2014-12-17 | ブラザー工業株式会社 | サーバ装置、対応付け方法、及び携帯機器用プログラム |
EP2555598A1 (en) | 2011-08-05 | 2013-02-06 | Fraunhofer-Gesellschaft zur Förderung der angewandten Forschung e.V. | Method and device for generating optical radiation by means of electrically operated pulsed discharges |
EP2557813A2 (en) | 2011-08-08 | 2013-02-13 | Bang & Olufsen A/S | A modular, configurable speaker system and a method of operating it |
KR101252167B1 (ko) | 2011-08-18 | 2013-04-05 | 엘지전자 주식회사 | 가전기기 진단장치 및 그 진단방법 |
US20130211826A1 (en) | 2011-08-22 | 2013-08-15 | Claes-Fredrik Urban Mannby | Audio Signals as Buffered Streams of Audio Signals and Metadata |
US8750677B2 (en) | 2011-08-23 | 2014-06-10 | Microsoft Corporation | Method for transferring media playback from a different device |
US20130073293A1 (en) | 2011-09-20 | 2013-03-21 | Lg Electronics Inc. | Electronic device and method for controlling the same |
US9094539B1 (en) | 2011-09-22 | 2015-07-28 | Amazon Technologies, Inc. | Dynamic device adjustments based on determined user sleep state |
US8996381B2 (en) | 2011-09-27 | 2015-03-31 | Sensory, Incorporated | Background speech recognition assistant |
US8768707B2 (en) | 2011-09-27 | 2014-07-01 | Sensory Incorporated | Background speech recognition assistant using speaker verification |
US8762156B2 (en) | 2011-09-28 | 2014-06-24 | Apple Inc. | Speech recognition repair using contextual information |
US9729631B2 (en) | 2011-09-30 | 2017-08-08 | Apple Inc. | Asynchronous data manipulation |
US8340975B1 (en) | 2011-10-04 | 2012-12-25 | Theodore Alfred Rosenberger | Interactive speech recognition device and system for hands-free building control |
US8971546B2 (en) | 2011-10-14 | 2015-03-03 | Sonos, Inc. | Systems, methods, apparatus, and articles of manufacture to control audio playback devices |
CN103052001B (zh) | 2011-10-17 | 2015-06-24 | 联想(北京)有限公司 | 智能设备及其控制方法 |
GB201118784D0 (en) | 2011-10-31 | 2011-12-14 | Omnifone Ltd | Djml |
GB2496660B (en) | 2011-11-18 | 2014-06-04 | Skype | Processing audio signals |
US8983089B1 (en) | 2011-11-28 | 2015-03-17 | Rawles Llc | Sound source localization using multiple microphone arrays |
CN102567468B (zh) | 2011-12-06 | 2014-06-04 | 上海聚力传媒技术有限公司 | 一种用于对媒体文件的播放音量进行调节的方法与设备 |
GB2497343B (en) | 2011-12-08 | 2014-11-26 | Skype | Processing audio signals |
KR101649499B1 (ko) | 2011-12-13 | 2016-08-19 | 인텔 코포레이션 | 연결된 미디어 장치들에서의 키워드 선택을 통한 채널 네비게이션 |
US9084058B2 (en) | 2011-12-29 | 2015-07-14 | Sonos, Inc. | Sound field calibration using listener localization |
KR102022318B1 (ko) | 2012-01-11 | 2019-09-18 | 삼성전자 주식회사 | 음성 인식을 사용하여 사용자 기능을 수행하는 방법 및 장치 |
US8825020B2 (en) | 2012-01-12 | 2014-09-02 | Sensory, Incorporated | Information access and device control using mobile phones and audio in the home environment |
US9654817B2 (en) | 2012-01-27 | 2017-05-16 | Avaya Inc. | System and method to synchronize video playback on mobile devices |
US9401058B2 (en) | 2012-01-30 | 2016-07-26 | International Business Machines Corporation | Zone based presence determination via voiceprint location awareness |
US9431980B2 (en) | 2012-01-30 | 2016-08-30 | Echostar Ukraine Llc | Apparatus, systems and methods for adjusting output audio volume based on user location |
US9418658B1 (en) | 2012-02-08 | 2016-08-16 | Amazon Technologies, Inc. | Configuration of voice controlled assistant |
US9173025B2 (en) | 2012-02-08 | 2015-10-27 | Dolby Laboratories Licensing Corporation | Combined suppression of noise, echo, and out-of-location signals |
US9947333B1 (en) | 2012-02-10 | 2018-04-17 | Amazon Technologies, Inc. | Voice interaction architecture with intelligent background noise cancellation |
US8453058B1 (en) | 2012-02-20 | 2013-05-28 | Google Inc. | Crowd-sourced audio shortcuts |
EP2632141B1 (en) | 2012-02-22 | 2014-10-15 | Dialog Semiconductor B.V. | Postfilter for Spectral Domain Echo Cancellers to handle Non-linear Echo Components |
US9065895B2 (en) | 2012-02-22 | 2015-06-23 | Broadcom Corporation | Non-linear echo cancellation |
US9838810B2 (en) | 2012-02-27 | 2017-12-05 | Qualcomm Technologies International, Ltd. | Low power audio detection |
US20130238326A1 (en) | 2012-03-08 | 2013-09-12 | Lg Electronics Inc. | Apparatus and method for multiple device voice control |
US20130263237A1 (en) * | 2012-03-30 | 2013-10-03 | Ebay Inc. | User authentication and authorization using personas |
US9361878B2 (en) | 2012-03-30 | 2016-06-07 | Michael Boukadakis | Computer-readable medium, system and method of providing domain-specific information |
US9198204B2 (en) | 2012-04-11 | 2015-11-24 | Google Inc. | Apparatus and method for seamless commissioning of wireless devices |
WO2013155619A1 (en) | 2012-04-20 | 2013-10-24 | Sam Pasupalak | Conversational agent |
US9633186B2 (en) | 2012-04-23 | 2017-04-25 | Apple Inc. | Systems and methods for controlling output of content based on human recognition data detection |
US9117449B2 (en) | 2012-04-26 | 2015-08-25 | Nuance Communications, Inc. | Embedded system for construction of small footprint speech recognition with user-definable constraints |
EP2845189B1 (en) | 2012-04-30 | 2018-09-05 | Creative Technology Ltd. | A universal reconfigurable echo cancellation system |
US11452153B2 (en) | 2012-05-01 | 2022-09-20 | Lisnr, Inc. | Pairing and gateway connection using sonic tones |
US8886524B1 (en) | 2012-05-01 | 2014-11-11 | Amazon Technologies, Inc. | Signal processing based on audio context |
US20130294611A1 (en) | 2012-05-04 | 2013-11-07 | Sony Computer Entertainment Inc. | Source separation by independent component analysis in conjuction with optimization of acoustic echo cancellation |
US9584909B2 (en) | 2012-05-10 | 2017-02-28 | Google Inc. | Distributed beamforming based on message passing |
US9768829B2 (en) | 2012-05-11 | 2017-09-19 | Intel Deutschland Gmbh | Methods for processing audio signals and circuit arrangements therefor |
US8908879B2 (en) | 2012-05-23 | 2014-12-09 | Sonos, Inc. | Audio content auditioning |
US9633368B2 (en) | 2012-05-25 | 2017-04-25 | Apple Inc. | Content ranking and serving on a multi-user device or interface |
CN103456332A (zh) | 2012-05-28 | 2013-12-18 | 富泰华工业(深圳)有限公司 | 音频播放装置及音量调节方法 |
US20130324031A1 (en) | 2012-05-31 | 2013-12-05 | Nokia Corporation | Dynamic allocation of audio channel for surround sound systems |
US9060224B1 (en) | 2012-06-01 | 2015-06-16 | Rawles Llc | Voice controlled assistant with coaxial speaker and microphone arrangement |
JP6362277B2 (ja) | 2012-06-01 | 2018-07-25 | ブラックベリー リミテッドBlackBerry Limited | マルチフォーマットオーディオシステムにおけるロック保証のための確率的方法に基づく汎用同期エンジン |
US9997069B2 (en) | 2012-06-05 | 2018-06-12 | Apple Inc. | Context-aware voice guidance |
US8903526B2 (en) | 2012-06-06 | 2014-12-02 | Sonos, Inc. | Device playback failure recovery and redistribution |
US9881616B2 (en) | 2012-06-06 | 2018-01-30 | Qualcomm Incorporated | Method and systems having improved speech recognition |
US9301073B2 (en) | 2012-06-08 | 2016-03-29 | Apple Inc. | Systems and methods for determining the condition of multiple microphones |
US9142215B2 (en) | 2012-06-15 | 2015-09-22 | Cypress Semiconductor Corporation | Power-efficient voice activation |
US9031255B2 (en) | 2012-06-15 | 2015-05-12 | Sonos, Inc. | Systems, methods, apparatus, and articles of manufacture to provide low-latency audio |
US9674587B2 (en) | 2012-06-26 | 2017-06-06 | Sonos, Inc. | Systems and methods for networked music playback including remote add to queue |
US10354650B2 (en) | 2012-06-26 | 2019-07-16 | Google Llc | Recognizing speech with mixed speech recognition models to generate transcriptions |
US9706323B2 (en) | 2014-09-09 | 2017-07-11 | Sonos, Inc. | Playback device calibration |
US9137564B2 (en) | 2012-06-28 | 2015-09-15 | Sonos, Inc. | Shift to corresponding media in a playback queue |
US9106192B2 (en) | 2012-06-28 | 2015-08-11 | Sonos, Inc. | System and method for device playback calibration |
US9384737B2 (en) | 2012-06-29 | 2016-07-05 | Microsoft Technology Licensing, Llc | Method and device for adjusting sound levels of sources based on sound source priority |
US20140006825A1 (en) | 2012-06-30 | 2014-01-02 | David Shenhav | Systems and methods to wake up a device from a power conservation state |
US9497544B2 (en) | 2012-07-02 | 2016-11-15 | Qualcomm Incorporated | Systems and methods for surround sound echo reduction |
US20140003635A1 (en) | 2012-07-02 | 2014-01-02 | Qualcomm Incorporated | Audio signal processing device calibration |
US9615171B1 (en) | 2012-07-02 | 2017-04-04 | Amazon Technologies, Inc. | Transformation inversion to reduce the effect of room acoustics |
KR101972955B1 (ko) | 2012-07-03 | 2019-04-26 | 삼성전자 주식회사 | 음성을 이용한 사용자 디바이스들 간 서비스 연결 방법 및 장치 |
US9536528B2 (en) | 2012-07-03 | 2017-01-03 | Google Inc. | Determining hotword suitability |
US8972762B2 (en) | 2012-07-11 | 2015-03-03 | Blackberry Limited | Computing devices and methods for resetting inactivity timers on computing devices |
US8983844B1 (en) | 2012-07-31 | 2015-03-17 | Amazon Technologies, Inc. | Transmission of noise parameters for improving automatic speech recognition |
US8831957B2 (en) | 2012-08-01 | 2014-09-09 | Google Inc. | Speech recognition models based on location indicia |
DE112013007830B4 (de) | 2012-08-03 | 2024-07-04 | Semiconductor Energy Laboratory Co., Ltd. | Lichtemittierendes Element, lichtemittierende Vorrichtung und Beleuchtungsvorrichtung |
US8930005B2 (en) | 2012-08-07 | 2015-01-06 | Sonos, Inc. | Acoustic signatures in a playback system |
DK3190587T3 (en) | 2012-08-24 | 2019-01-21 | Oticon As | Noise estimation for noise reduction and echo suppression in personal communication |
US9532153B2 (en) | 2012-08-29 | 2016-12-27 | Bang & Olufsen A/S | Method and a system of providing information to a user |
US9088336B2 (en) | 2012-09-06 | 2015-07-21 | Imagination Technologies Limited | Systems and methods of echo and noise cancellation in voice communication |
US20140075311A1 (en) | 2012-09-11 | 2014-03-13 | Jesse William Boettcher | Methods and apparatus for controlling audio volume on an electronic device |
US20140075306A1 (en) | 2012-09-12 | 2014-03-13 | Randy Rega | Music search and retrieval system |
US8798598B2 (en) | 2012-09-13 | 2014-08-05 | Alain Rossmann | Method and system for screencasting Smartphone video game software to online social networks |
US9532139B1 (en) | 2012-09-14 | 2016-12-27 | Cirrus Logic, Inc. | Dual-microphone frequency amplitude response self-calibration |
US8983383B1 (en) | 2012-09-25 | 2015-03-17 | Rawles Llc | Providing hands-free service to multiple devices |
US9319816B1 (en) | 2012-09-26 | 2016-04-19 | Amazon Technologies, Inc. | Characterizing environment using ultrasound pilot tones |
JP2014071138A (ja) | 2012-09-27 | 2014-04-21 | Xing Inc | カラオケ装置 |
US8725125B2 (en) | 2012-09-28 | 2014-05-13 | United Video Properties, Inc. | Systems and methods for controlling audio playback on portable devices with vehicle equipment |
KR102091236B1 (ko) | 2012-09-28 | 2020-03-18 | 삼성전자 주식회사 | 전자기기 및 그 제어방법 |
WO2014055312A1 (en) | 2012-10-02 | 2014-04-10 | Mh Acoustics, Llc | Earphones having configurable microphone arrays |
US9640194B1 (en) | 2012-10-04 | 2017-05-02 | Knowles Electronics, Llc | Noise suppression for speech processing based on machine-learning mask estimation |
US8484025B1 (en) | 2012-10-04 | 2013-07-09 | Google Inc. | Mapping an audio utterance to an action using a classifier |
CN102902253B (zh) | 2012-10-09 | 2015-07-15 | 鸿富锦精密工业(深圳)有限公司 | 具有语音控制功能的智能开关及智能控制系统 |
US20140108010A1 (en) | 2012-10-11 | 2014-04-17 | Intermec Ip Corp. | Voice-enabled documents for facilitating operational procedures |
US9232310B2 (en) | 2012-10-15 | 2016-01-05 | Nokia Technologies Oy | Methods, apparatuses and computer program products for facilitating directional audio capture with multiple microphones |
ES2886325T3 (es) | 2012-10-15 | 2021-12-17 | Msi Dfat Llc | Pruebas acústicas de campo directo en un recinto semirreverberante |
DE102012020271A1 (de) | 2012-10-17 | 2014-04-17 | Wolfgang Klippel | Anordnung und Verfahren zur Steuerung von Wandlern |
WO2014064531A1 (en) | 2012-10-22 | 2014-05-01 | Spotify Ab | Systems and methods for pre-fetching media content |
KR101978688B1 (ko) | 2012-10-22 | 2019-05-15 | 삼성전자주식회사 | 마이크로폰 장치를 갖는 전자 장치 및 그 운용 방법 |
US20150228274A1 (en) | 2012-10-26 | 2015-08-13 | Nokia Technologies Oy | Multi-Device Speech Recognition |
KR20140054643A (ko) | 2012-10-29 | 2014-05-09 | 삼성전자주식회사 | 음성인식장치 및 음성인식방법 |
US9584642B2 (en) | 2013-03-12 | 2017-02-28 | Google Technology Holdings LLC | Apparatus with adaptive acoustic echo control for speakerphone mode |
US10381002B2 (en) | 2012-10-30 | 2019-08-13 | Google Technology Holdings LLC | Voice control user interface during low-power mode |
US8761349B2 (en) | 2012-10-31 | 2014-06-24 | Citrix Systems, Inc. | Systems and methods of monitoring performance of acoustic echo cancellation |
US9275637B1 (en) | 2012-11-06 | 2016-03-01 | Amazon Technologies, Inc. | Wake word evaluation |
KR20140060040A (ko) | 2012-11-09 | 2014-05-19 | 삼성전자주식회사 | 디스플레이장치, 음성취득장치 및 그 음성인식방법 |
US9275642B2 (en) | 2012-11-13 | 2016-03-01 | Unified Computer Intelligence Corporation | Voice-operated internet-ready ubiquitous computing device and method thereof |
CN102999161B (zh) | 2012-11-13 | 2016-03-02 | 科大讯飞股份有限公司 | 一种语音唤醒模块的实现方法及应用 |
US9685171B1 (en) | 2012-11-20 | 2017-06-20 | Amazon Technologies, Inc. | Multiple-stage adaptive filtering of audio signals |
US9070367B1 (en) | 2012-11-26 | 2015-06-30 | Amazon Technologies, Inc. | Local speech recognition of frequent utterances |
US9154877B2 (en) | 2012-11-28 | 2015-10-06 | Qualcomm Incorporated | Collaborative sound system |
US9875741B2 (en) | 2013-03-15 | 2018-01-23 | Google Llc | Selective speech recognition for chat and digital personal assistant systems |
US20140149118A1 (en) | 2012-11-28 | 2014-05-29 | Lg Electronics Inc. | Apparatus and method for driving electric device using speech recognition |
US9203045B2 (en) | 2012-11-29 | 2015-12-01 | Semiconductor Energy Laboratory Co., Ltd. | Light-emitting element, light-emitting device, electronic device, and lighting device |
US9171092B2 (en) | 2012-12-07 | 2015-10-27 | Empire Technology Development Llc | Personal assistant context building |
US20140161263A1 (en) | 2012-12-10 | 2014-06-12 | Microsoft Corporation | Facilitating recognition of real-time content |
US9704486B2 (en) | 2012-12-11 | 2017-07-11 | Amazon Technologies, Inc. | Speech recognition power management |
US9226071B2 (en) | 2012-12-13 | 2015-12-29 | Maxim Integrated Products, Inc. | Direct measurement of an input signal to a loudspeaker to determine and limit a temperature of a voice coil of the loudspeaker |
US9271111B2 (en) | 2012-12-14 | 2016-02-23 | Amazon Technologies, Inc. | Response endpoint selection |
US9300910B2 (en) | 2012-12-14 | 2016-03-29 | Biscotti Inc. | Video mail capture, processing and distribution |
US9607046B2 (en) | 2012-12-14 | 2017-03-28 | Microsoft Technology Licensing, Llc | Probability-based state modification for query dialogues |
US9978260B2 (en) | 2012-12-18 | 2018-05-22 | Samsung Electronics Co., Ltd. | Method and apparatus for controlling a home device remotely in a home network system |
US9098467B1 (en) | 2012-12-19 | 2015-08-04 | Rawles Llc | Accepting voice commands based on user identity |
US9047857B1 (en) | 2012-12-19 | 2015-06-02 | Rawles Llc | Voice commands for transitioning between device states |
US20150338917A1 (en) | 2012-12-26 | 2015-11-26 | Sia Technology Ltd. | Device, system, and method of controlling electronic devices via thought |
US9620115B2 (en) | 2013-01-03 | 2017-04-11 | Telenav, Inc. | Content delivery system with barge-in mechanism and method of operation thereof |
KR102051588B1 (ko) | 2013-01-07 | 2019-12-03 | 삼성전자주식회사 | 휴대 단말기의 오디오 컨텐츠 재생 방법 및 그 장치 |
US9318125B2 (en) | 2013-01-15 | 2016-04-19 | Intel Deutschland Gmbh | Noise reduction devices and noise reduction methods |
JP2014137590A (ja) | 2013-01-18 | 2014-07-28 | Yoji Fukinuki | 音楽コンテンツ配信方法 |
US9646605B2 (en) | 2013-01-22 | 2017-05-09 | Interactive Intelligence Group, Inc. | False alarm reduction in speech recognition systems using contextual information |
DE102013001219B4 (de) | 2013-01-25 | 2019-08-29 | Inodyn Newmedia Gmbh | Verfahren und System zur Sprachaktivierung eines Software-Agenten aus einem Standby-Modus |
US20140215332A1 (en) | 2013-01-31 | 2014-07-31 | Hewlett-Packard Development Company, Lp | Virtual microphone selection corresponding to a set of audio source devices |
US9818407B1 (en) | 2013-02-07 | 2017-11-14 | Amazon Technologies, Inc. | Distributed endpointing for speech recognition |
KR20150104615A (ko) | 2013-02-07 | 2015-09-15 | 애플 인크. | 디지털 어시스턴트를 위한 음성 트리거 |
TWI593294B (zh) | 2013-02-07 | 2017-07-21 | 晨星半導體股份有限公司 | 收音系統與相關方法 |
US9300266B2 (en) | 2013-02-12 | 2016-03-29 | Qualcomm Incorporated | Speaker equalization for mobile devices |
US9842489B2 (en) | 2013-02-14 | 2017-12-12 | Google Llc | Waking other devices for additional data |
US9237384B2 (en) | 2013-02-14 | 2016-01-12 | Sonos, Inc. | Automatic configuration of household playback devices |
US9172747B2 (en) | 2013-02-25 | 2015-10-27 | Artificial Solutions Iberia SL | System and methods for virtual assistant networks |
US9195432B2 (en) | 2013-02-26 | 2015-11-24 | Sonos, Inc. | Pre-caching of audio content |
EP2962300B1 (en) | 2013-02-26 | 2017-01-25 | Koninklijke Philips N.V. | Method and apparatus for generating a speech signal |
CN104010251B (zh) | 2013-02-27 | 2018-06-19 | 晨星半导体股份有限公司 | 收音系统与相关方法 |
US10395651B2 (en) | 2013-02-28 | 2019-08-27 | Sony Corporation | Device and method for activating with voice input |
US9460715B2 (en) | 2013-03-04 | 2016-10-04 | Amazon Technologies, Inc. | Identification using audio signatures and additional characteristics |
US20140258292A1 (en) | 2013-03-05 | 2014-09-11 | Clip Interactive, Inc. | Apparatus, system, and method for integrating content and content services |
US9275625B2 (en) * | 2013-03-06 | 2016-03-01 | Qualcomm Incorporated | Content based noise suppression |
JP6429465B2 (ja) | 2013-03-07 | 2018-11-28 | 株式会社半導体エネルギー研究所 | 装置及びその作製方法 |
KR101887983B1 (ko) | 2013-03-07 | 2018-08-14 | 애플 인크. | 룸 및 프로그램 응답 확성기 시스템 |
US9349386B2 (en) | 2013-03-07 | 2016-05-24 | Analog Device Global | System and method for processor wake-up based on sensor data |
US9161126B2 (en) | 2013-03-08 | 2015-10-13 | Cirrus Logic, Inc. | Systems and methods for protecting a speaker |
TWI533686B (zh) | 2013-03-11 | 2016-05-11 | 緯創資通股份有限公司 | 虛擬頻道之管理方法、具有虛擬頻道之網路多媒體重現系統和電腦可讀取記錄媒體 |
CN104053088A (zh) | 2013-03-11 | 2014-09-17 | 联想(北京)有限公司 | 一种麦克风阵列调整方法、麦克风阵列及电子设备 |
KR101787224B1 (ko) | 2013-03-11 | 2017-10-18 | 애플 인크. | 다양한 지향에 걸친 라우드스피커의 음색 항상성 |
KR20140111859A (ko) | 2013-03-12 | 2014-09-22 | 삼성전자주식회사 | 콘텐트 공유 방법 및 이를 위한 디바이스 |
US11393461B2 (en) * | 2013-03-12 | 2022-07-19 | Cerence Operating Company | Methods and apparatus for detecting a voice command |
US9443529B2 (en) | 2013-03-12 | 2016-09-13 | Aawtend, Inc. | Integrated sensor-array processor |
US9173021B2 (en) | 2013-03-12 | 2015-10-27 | Google Technology Holdings LLC | Method and device for adjusting an audio beam orientation based on device location |
EP3709293A1 (en) | 2013-03-12 | 2020-09-16 | Nuance Communications, Inc. | Methods and apparatus for detecting a voice command |
US9357306B2 (en) | 2013-03-12 | 2016-05-31 | Nokia Technologies Oy | Multichannel audio calibration method and apparatus |
US9361885B2 (en) | 2013-03-12 | 2016-06-07 | Nuance Communications, Inc. | Methods and apparatus for detecting a voice command |
KR101571338B1 (ko) | 2013-03-13 | 2015-11-24 | 삼성전자주식회사 | 복수의 재생 장치들이 스트리밍 컨텐트를 동기화하여 재생하는 방법 및 이를 위한 장치 |
US9060052B2 (en) | 2013-03-13 | 2015-06-16 | Accusonus S.A. | Single channel, binaural and multi-channel dereverberation |
JP6013951B2 (ja) | 2013-03-14 | 2016-10-25 | 本田技研工業株式会社 | 環境音検索装置、環境音検索方法 |
US20140274185A1 (en) | 2013-03-14 | 2014-09-18 | Aliphcom | Intelligence device connection for wireless media ecosystem |
KR102152754B1 (ko) | 2013-03-14 | 2020-09-07 | 삼성전자주식회사 | 블루루스 디바이스에서 통신 연결 방법 및 그 장치 |
WO2014160419A1 (en) | 2013-03-14 | 2014-10-02 | Tiskerling Dynamics Llc | Adaptive room equalization using a speaker and a handheld listening device |
WO2014144773A2 (en) | 2013-03-15 | 2014-09-18 | The Echo Nest Corporation | Systems, methods, and computer readable medium for generating playlists |
US20140278933A1 (en) | 2013-03-15 | 2014-09-18 | F. Gavin McMillan | Methods and apparatus to measure audience engagement with media |
US9854081B2 (en) | 2013-03-15 | 2017-12-26 | Apple Inc. | Volume control for mobile device using a wireless device |
EP2976897B8 (en) | 2013-03-21 | 2020-07-01 | Cerence Operating Company | System and method for identifying suboptimal microphone performance |
WO2014157433A1 (en) | 2013-03-26 | 2014-10-02 | Semiconductor Energy Laboratory Co., Ltd. | Light-emitting element, light-emitting device, electronic device, and lighting device |
JP6300589B2 (ja) | 2013-04-04 | 2018-03-28 | 株式会社半導体エネルギー研究所 | 半導体装置の作製方法 |
US9462115B2 (en) | 2013-04-04 | 2016-10-04 | James S. Rand | Unified communications system and method |
JP6198432B2 (ja) | 2013-04-09 | 2017-09-20 | 小島プレス工業株式会社 | 音声認識制御装置 |
WO2014172299A1 (en) | 2013-04-15 | 2014-10-23 | Chacha Search, Inc. | Method and system of increasing user interaction |
US9501533B2 (en) | 2013-04-16 | 2016-11-22 | Sonos, Inc. | Private queue for a media playback system |
US9875494B2 (en) | 2013-04-16 | 2018-01-23 | Sri International | Using intents to analyze and personalize a user's dialog experience with a virtual personal assistant |
US9304736B1 (en) | 2013-04-18 | 2016-04-05 | Amazon Technologies, Inc. | Voice controlled assistant with non-verbal code entry |
US9390716B2 (en) | 2013-04-19 | 2016-07-12 | Panasonic Intellectual Property Corporation Of America | Control method for household electrical appliance, household electrical appliance control system, and gateway |
US9936290B2 (en) | 2013-05-03 | 2018-04-03 | Qualcomm Incorporated | Multi-channel echo cancellation and noise suppression |
US9892729B2 (en) | 2013-05-07 | 2018-02-13 | Qualcomm Incorporated | Method and apparatus for controlling voice activation |
KR102230139B1 (ko) | 2013-05-17 | 2021-03-18 | 가부시키가이샤 한도오따이 에네루기 켄큐쇼 | 발광 소자, 조명 장치, 발광 장치, 및 전자 기기 |
CN109584868B (zh) | 2013-05-20 | 2022-12-13 | 英特尔公司 | 用于虚拟个人助理系统的自然人-计算机交互 |
US9472201B1 (en) | 2013-05-22 | 2016-10-18 | Google Inc. | Speaker localization by means of tactile input |
US20140358535A1 (en) | 2013-05-28 | 2014-12-04 | Samsung Electronics Co., Ltd. | Method of executing voice recognition of electronic device and electronic device using the same |
US9390708B1 (en) | 2013-05-28 | 2016-07-12 | Amazon Technologies, Inc. | Low latency and memory efficient keywork spotting |
US9215545B2 (en) | 2013-05-31 | 2015-12-15 | Bose Corporation | Sound stage controller for a near-field speaker-based audio system |
US20140357248A1 (en) | 2013-06-03 | 2014-12-04 | Ford Global Technologies, Llc | Apparatus and System for Interacting with a Vehicle and a Device in a Vehicle |
US20140365225A1 (en) | 2013-06-05 | 2014-12-11 | DSP Group | Ultra-low-power adaptive, user independent, voice triggering schemes |
US9438193B2 (en) | 2013-06-05 | 2016-09-06 | Sonos, Inc. | Satellite volume control |
US9654073B2 (en) | 2013-06-07 | 2017-05-16 | Sonos, Inc. | Group volume control |
WO2014197336A1 (en) | 2013-06-07 | 2014-12-11 | Apple Inc. | System and method for detecting errors in interactions with a voice-based digital assistant |
WO2014197335A1 (en) | 2013-06-08 | 2014-12-11 | Apple Inc. | Interpreting and acting upon commands that involve sharing information with remote devices |
US10136285B2 (en) | 2013-06-09 | 2018-11-20 | Apple Inc. | Bluetooth alert notification service |
US9787273B2 (en) | 2013-06-13 | 2017-10-10 | Google Technology Holdings LLC | Smart volume control of device audio output based on received audio input |
US20140368737A1 (en) | 2013-06-17 | 2014-12-18 | Spotify Ab | System and method for playing media during navigation between media streams |
US8953778B2 (en) | 2013-06-17 | 2015-02-10 | Avaya Inc. | Real-time intelligent mute interactive features |
US9494683B1 (en) | 2013-06-18 | 2016-11-15 | Amazon Technologies, Inc. | Audio-based gesture detection |
US9324322B1 (en) | 2013-06-18 | 2016-04-26 | Amazon Technologies, Inc. | Automatic volume attenuation for speech enabled devices |
US9311298B2 (en) | 2013-06-21 | 2016-04-12 | Microsoft Technology Licensing, Llc | Building conversational understanding systems using a toolset |
US9697831B2 (en) | 2013-06-26 | 2017-07-04 | Cirrus Logic, Inc. | Speech recognition |
US9747899B2 (en) | 2013-06-27 | 2017-08-29 | Amazon Technologies, Inc. | Detecting self-generated wake expressions |
US9640179B1 (en) | 2013-06-27 | 2017-05-02 | Amazon Technologies, Inc. | Tailoring beamforming techniques to environments |
US10255930B2 (en) | 2013-06-28 | 2019-04-09 | Harman International Industries, Incorporated | Wireless control of linked devices |
US20150019201A1 (en) | 2013-07-09 | 2015-01-15 | Stanley F. Schoenbach | Real-time interpreting systems and methods |
US9298415B2 (en) | 2013-07-09 | 2016-03-29 | Sonos, Inc. | Systems and methods to provide play/pause content |
US9396727B2 (en) | 2013-07-10 | 2016-07-19 | GM Global Technology Operations LLC | Systems and methods for spoken dialog service arbitration |
US9293480B2 (en) | 2013-07-10 | 2016-03-22 | Semiconductor Energy Laboratory Co., Ltd. | Semiconductor device and display device including the semiconductor device |
CN105283836B (zh) | 2013-07-11 | 2019-06-04 | 英特尔公司 | 用于设备唤醒的设备、方法、装置及计算机可读存储介质 |
DE102014109122A1 (de) | 2013-07-12 | 2015-01-15 | Gm Global Technology Operations, Llc | Systeme und Verfahren für ergebnisbezogene Arbitrierung in Sprachdialogsystemen |
US9426598B2 (en) | 2013-07-15 | 2016-08-23 | Dts, Inc. | Spatial calibration of surround sound systems including listener position estimation |
US9445196B2 (en) | 2013-07-24 | 2016-09-13 | Mh Acoustics Llc | Inter-channel coherence reduction for stereophonic and multichannel acoustic echo cancellation |
US9772994B2 (en) | 2013-07-25 | 2017-09-26 | Intel Corporation | Self-learning statistical natural language processing for automatic production of virtual personal assistants |
US9431014B2 (en) | 2013-07-25 | 2016-08-30 | Haier Us Appliance Solutions, Inc. | Intelligent placement of appliance response to voice command |
US9666187B1 (en) | 2013-07-25 | 2017-05-30 | Google Inc. | Model for enabling service providers to address voice-activated commands |
US9548047B2 (en) | 2013-07-31 | 2017-01-17 | Google Technology Holdings LLC | Method and apparatus for evaluating trigger phrase enrollment |
US9418651B2 (en) | 2013-07-31 | 2016-08-16 | Google Technology Holdings LLC | Method and apparatus for mitigating false accepts of trigger phrases |
US10186262B2 (en) | 2013-07-31 | 2019-01-22 | Microsoft Technology Licensing, Llc | System with multiple simultaneous speech recognizers |
WO2015017303A1 (en) | 2013-07-31 | 2015-02-05 | Motorola Mobility Llc | Method and apparatus for adjusting voice recognition processing based on noise characteristics |
DE102013012811B4 (de) | 2013-08-01 | 2024-02-22 | Wolfgang Klippel | Anordnung und Verfahren zur Identifikation und Korrektur der nichtlinearen Eigenschaften elektromagnetischer Wandler |
US10873997B2 (en) | 2013-08-01 | 2020-12-22 | Fong-Min Chang | Voice controlled artificial intelligent smart illumination device |
US9565497B2 (en) | 2013-08-01 | 2017-02-07 | Caavo Inc. | Enhancing audio using a mobile device |
US10047970B2 (en) | 2013-08-21 | 2018-08-14 | Honeywell International Inc. | Devices and methods for interacting with an HVAC controller |
US9940927B2 (en) | 2013-08-23 | 2018-04-10 | Nuance Communications, Inc. | Multiple pass automatic speech recognition methods and apparatus |
US9190043B2 (en) | 2013-08-27 | 2015-11-17 | Bose Corporation | Assisting conversation in noisy environments |
TWI520127B (zh) | 2013-08-28 | 2016-02-01 | 晨星半導體股份有限公司 | 應用於音訊裝置的控制器與相關的操作方法 |
US9514747B1 (en) | 2013-08-28 | 2016-12-06 | Amazon Technologies, Inc. | Reducing speech recognition latency |
KR20160048960A (ko) | 2013-08-30 | 2016-05-04 | 후아웨이 테크놀러지 컴퍼니 리미티드 | 복수 단말의 멀티미디어 파일 협동 플레이 방법, 및 관련 장치 및 시스템 |
JP6037026B2 (ja) | 2013-09-11 | 2016-11-30 | 株式会社デンソー | 音声出力制御装置、プログラムおよび記録媒体 |
US9672812B1 (en) | 2013-09-18 | 2017-06-06 | Amazon Technologies, Inc. | Qualifying trigger expressions in speech-based systems |
US9516081B2 (en) | 2013-09-20 | 2016-12-06 | Amazon Technologies, Inc. | Reduced latency electronic content system |
US9848260B2 (en) | 2013-09-24 | 2017-12-19 | Nuance Communications, Inc. | Wearable communication enhancement device |
US9668052B2 (en) | 2013-09-25 | 2017-05-30 | Google Technology Holdings LLC | Audio routing system for routing audio data to and from a mobile device |
US9443527B1 (en) | 2013-09-27 | 2016-09-13 | Amazon Technologies, Inc. | Speech recognition capability generation and control |
US9355555B2 (en) | 2013-09-27 | 2016-05-31 | Sonos, Inc. | System and method for issuing commands in a media playback system |
CN103546616A (zh) | 2013-09-30 | 2014-01-29 | 深圳市同洲电子股份有限公司 | 一种调节音量的方法及装置 |
US9288596B2 (en) | 2013-09-30 | 2016-03-15 | Sonos, Inc. | Coordinator device for paired or consolidated players |
KR102114219B1 (ko) | 2013-10-10 | 2020-05-25 | 삼성전자주식회사 | 오디오 시스템 및 오디오 출력 방법, 그리고 스피커 장치 |
US9245527B2 (en) | 2013-10-11 | 2016-01-26 | Apple Inc. | Speech recognition wake-up of a handheld portable electronic device |
US9633671B2 (en) | 2013-10-18 | 2017-04-25 | Apple Inc. | Voice quality enhancement techniques, speech recognition techniques, and related systems |
US9300268B2 (en) | 2013-10-18 | 2016-03-29 | Apple Inc. | Content aware audio ducking |
TWI642170B (zh) | 2013-10-18 | 2018-11-21 | 半導體能源研究所股份有限公司 | 顯示裝置及電子裝置 |
US9818061B1 (en) | 2013-10-22 | 2017-11-14 | Lumin, LLC | Collaboration of audio sensors for geo-location and continuous tracking of multiple users in a device-independent artificial intelligence (AI) environment |
WO2015060867A1 (en) | 2013-10-25 | 2015-04-30 | Intel Corporation | Techniques for preventing voice replay attacks |
DK2869599T3 (da) | 2013-11-05 | 2020-12-14 | Oticon As | Binauralt høreassistancesystem, der omfatter en database med hovedrelaterede overføringsfunktioner |
JP2015090570A (ja) | 2013-11-06 | 2015-05-11 | ソニー株式会社 | 情報処理装置および制御方法 |
US10311482B2 (en) | 2013-11-11 | 2019-06-04 | At&T Intellectual Property I, Lp | Method and apparatus for adjusting a digital assistant persona |
US8775191B1 (en) | 2013-11-13 | 2014-07-08 | Google Inc. | Efficient utterance-specific endpointer triggering for always-on hotwording |
JP6236303B2 (ja) | 2013-11-26 | 2017-11-22 | 株式会社デンソーアイティーラボラトリ | 制御装置、制御方法およびプログラム |
US9698999B2 (en) | 2013-12-02 | 2017-07-04 | Amazon Technologies, Inc. | Natural language control of secondary device |
US9704478B1 (en) | 2013-12-02 | 2017-07-11 | Amazon Technologies, Inc. | Audio output masking for improved automatic speech recognition |
US9373321B2 (en) | 2013-12-02 | 2016-06-21 | Cypress Semiconductor Corporation | Generation of wake-up words |
CN104143326B (zh) | 2013-12-03 | 2016-11-02 | 腾讯科技(深圳)有限公司 | 一种语音命令识别方法和装置 |
US8719039B1 (en) | 2013-12-05 | 2014-05-06 | Google Inc. | Promoting voice actions to hotwords |
US10720153B2 (en) * | 2013-12-13 | 2020-07-21 | Harman International Industries, Incorporated | Name-sensitive listening device |
US10055190B2 (en) | 2013-12-16 | 2018-08-21 | Amazon Technologies, Inc. | Attribute-based audio channel arbitration |
US9721570B1 (en) | 2013-12-17 | 2017-08-01 | Amazon Technologies, Inc. | Outcome-oriented dialogs on a speech recognition platform |
US9378651B2 (en) | 2013-12-17 | 2016-06-28 | Google Inc. | Audio book smart pause |
US10224056B1 (en) | 2013-12-17 | 2019-03-05 | Amazon Technologies, Inc. | Contingent device actions during loss of network connectivity |
GB2523984B (en) | 2013-12-18 | 2017-07-26 | Cirrus Logic Int Semiconductor Ltd | Processing received speech data |
US20150179181A1 (en) | 2013-12-20 | 2015-06-25 | Microsoft Corporation | Adapting audio based upon detected environmental accoustics |
US9899021B1 (en) | 2013-12-20 | 2018-02-20 | Amazon Technologies, Inc. | Stochastic modeling of user interactions with a detection system |
US20150221307A1 (en) | 2013-12-20 | 2015-08-06 | Saurin Shah | Transition from low power always listening mode to high power speech recognition mode |
US9099974B2 (en) | 2013-12-20 | 2015-08-04 | Vmware, Inc. | Volume redirection |
EP2890160B1 (en) | 2013-12-24 | 2019-08-14 | Nxp B.V. | Loudspeaker controller |
US9301077B2 (en) | 2014-01-02 | 2016-03-29 | Harman International Industries, Incorporated | Context-based audio tuning |
US8938394B1 (en) | 2014-01-09 | 2015-01-20 | Google Inc. | Audio triggers based on context |
US9443516B2 (en) | 2014-01-09 | 2016-09-13 | Honeywell International Inc. | Far-field speech recognition systems and methods |
EP3092824B1 (en) | 2014-01-10 | 2017-11-01 | Dolby Laboratories Licensing Corporation | Calibration of virtual height speakers using programmable portable devices |
US9300647B2 (en) | 2014-01-15 | 2016-03-29 | Sonos, Inc. | Software application and zones |
US9288597B2 (en) | 2014-01-20 | 2016-03-15 | Sony Corporation | Distributed wireless speaker system with automatic configuration determination when new speakers are added |
DE112014006235T5 (de) | 2014-01-22 | 2016-10-13 | Apple Inc. | Koordiniertes Weiterreichen einer Audiodatenübermittlung |
US9356882B2 (en) | 2014-02-04 | 2016-05-31 | Printeron Inc. | Streamlined system for the transmission of network resource data |
US9443876B2 (en) | 2014-02-05 | 2016-09-13 | Semiconductor Energy Laboratory Co., Ltd. | Semiconductor device, display device including the semiconductor device, display module including the display device, and electronic device including the semiconductor device, the display device, and the display module |
US9929368B2 (en) | 2014-02-06 | 2018-03-27 | Semiconductor Energy Laboratory Co., Ltd. | Light-emitting element, lighting device, and electronic appliance |
US9652532B2 (en) | 2014-02-06 | 2017-05-16 | Sr Homedics, Llc | Methods for operating audio speaker systems |
TWI685116B (zh) | 2014-02-07 | 2020-02-11 | 日商半導體能源研究所股份有限公司 | 半導體裝置 |
US9318112B2 (en) | 2014-02-14 | 2016-04-19 | Google Inc. | Recognizing speech in the presence of additional audio |
FR3018024B1 (fr) | 2014-02-26 | 2016-03-18 | Devialet | Dispositif de commande d'un haut-parleur |
FR3018025B1 (fr) | 2014-02-26 | 2016-03-18 | Devialet | Dispositif de commande d'un haut-parleur |
JP6289936B2 (ja) | 2014-02-26 | 2018-03-07 | 株式会社東芝 | 音源方向推定装置、音源方向推定方法およびプログラム |
US9408008B2 (en) | 2014-02-28 | 2016-08-02 | Sonos, Inc. | Playback zone representations |
WO2015133022A1 (ja) | 2014-03-03 | 2015-09-11 | ソニー株式会社 | 情報処理装置、情報処理方法およびプログラム |
US10015593B2 (en) | 2014-03-03 | 2018-07-03 | University Of Utah | Digital signal processor for audio extensions and correction of nonlinear distortions in loudspeakers |
US9489171B2 (en) | 2014-03-04 | 2016-11-08 | Microsoft Technology Licensing, Llc | Voice-command suggestions based on user identity |
US9679054B2 (en) | 2014-03-05 | 2017-06-13 | Sonos, Inc. | Webpage media playback |
US10599287B2 (en) | 2014-03-11 | 2020-03-24 | Sonos, Inc. | Group volume control |
US9640669B2 (en) | 2014-03-13 | 2017-05-02 | Semiconductor Energy Laboratory Co., Ltd. | Semiconductor device, display device including the semiconductor device, display module including the display device, and electronic appliance including the semiconductor device, the display device, and the display module |
US9264839B2 (en) | 2014-03-17 | 2016-02-16 | Sonos, Inc. | Playback device configuration based on proximity detection |
US9226062B2 (en) | 2014-03-18 | 2015-12-29 | Cisco Technology, Inc. | Techniques to mitigate the effect of blocked sound at microphone arrays in a telepresence device |
US10514747B2 (en) | 2014-03-24 | 2019-12-24 | Silicon Laboratories Inc. | Low-power communication apparatus with wakeup detection and associated methods |
US9654076B2 (en) | 2014-03-25 | 2017-05-16 | Apple Inc. | Metadata for ducking control |
US9648564B1 (en) | 2014-03-26 | 2017-05-09 | Amazon Technologies, Inc. | Wake-up management for mobile devices |
US9916839B1 (en) | 2014-03-27 | 2018-03-13 | Amazon Technologies, Inc. | Shared audio functionality based on device grouping |
US9431021B1 (en) | 2014-03-27 | 2016-08-30 | Amazon Technologies, Inc. | Device grouping for audio based interactivity |
KR102146462B1 (ko) | 2014-03-31 | 2020-08-20 | 삼성전자주식회사 | 음성 인식 시스템 및 방법 |
US9547468B2 (en) | 2014-03-31 | 2017-01-17 | Microsoft Technology Licensing, Llc | Client-side personal voice web navigation |
US8874448B1 (en) | 2014-04-01 | 2014-10-28 | Google Inc. | Attention-based dynamic audio level adjustment |
EP2930716B1 (en) | 2014-04-07 | 2018-10-31 | Samsung Electronics Co., Ltd | Speech recognition using electronic device and server |
US9560437B2 (en) | 2014-04-08 | 2017-01-31 | Doppler Labs, Inc. | Time heuristic audio control |
US9510094B2 (en) | 2014-04-09 | 2016-11-29 | Apple Inc. | Noise estimation in a mobile device using an external acoustic microphone signal |
DE102014005381B3 (de) | 2014-04-11 | 2014-12-11 | Wolfgang Klippel | Anordnung und Verfahren zur Identifikation und Kompensation nichtlinearer Partialschwingungen elektromechanischer Wandler |
US20150302856A1 (en) | 2014-04-17 | 2015-10-22 | Qualcomm Incorporated | Method and apparatus for performing function by speech input |
US20150334471A1 (en) | 2014-05-15 | 2015-11-19 | Echostar Technologies L.L.C. | Multiple simultaneous audio video data decoding |
WO2015178950A1 (en) | 2014-05-19 | 2015-11-26 | Tiskerling Dynamics Llc | Directivity optimized sound reproduction |
US9860289B2 (en) | 2014-05-23 | 2018-01-02 | Radeeus, Inc. | Multimedia digital content retrieval, matching, and syncing systems and methods of using the same |
CN106465458B (zh) | 2014-05-23 | 2019-12-13 | 三星电子株式会社 | 用于提供通知的方法和设备 |
US9900723B1 (en) | 2014-05-28 | 2018-02-20 | Apple Inc. | Multi-channel loudspeaker matching using variable directivity |
TWI566107B (zh) | 2014-05-30 | 2017-01-11 | 蘋果公司 | 用於處理多部分語音命令之方法、非暫時性電腦可讀儲存媒體及電子裝置 |
TWI682563B (zh) | 2014-05-30 | 2020-01-11 | 日商半導體能源研究所股份有限公司 | 發光元件,發光裝置,電子裝置以及照明裝置 |
US9715875B2 (en) | 2014-05-30 | 2017-07-25 | Apple Inc. | Reducing the need for manual start/end-pointing and trigger phrases |
US10318016B2 (en) | 2014-06-03 | 2019-06-11 | Harman International Industries, Incorporated | Hands free device with directional interface |
US20150355818A1 (en) | 2014-06-04 | 2015-12-10 | Sonos, Inc. | Continuous Playback Queue |
US9720642B2 (en) | 2014-06-04 | 2017-08-01 | Sonos, Inc. | Prioritizing media content requests |
US10624612B2 (en) | 2014-06-05 | 2020-04-21 | Chikayoshi Sumi | Beamforming method, measurement and imaging instruments, and communication instruments |
US9615170B2 (en) | 2014-06-09 | 2017-04-04 | Harman International Industries, Inc. | Approach for partially preserving music in the presence of intelligible speech |
CN104092936B (zh) | 2014-06-12 | 2017-01-04 | 小米科技有限责任公司 | 自动对焦方法及装置 |
US9767159B2 (en) | 2014-06-13 | 2017-09-19 | Google Inc. | Ranking search results |
US20150363061A1 (en) | 2014-06-13 | 2015-12-17 | Autonomic Controls, Inc. | System and method for providing related digital content |
US20150373100A1 (en) | 2014-06-19 | 2015-12-24 | Pavel KRAVETS | Context sharing between different clients |
US9589556B2 (en) | 2014-06-19 | 2017-03-07 | Yang Gao | Energy adjustment of acoustic echo replica signal for speech enhancement |
US9766702B2 (en) | 2014-06-19 | 2017-09-19 | Apple Inc. | User detection by a computing device |
US9520139B2 (en) | 2014-06-19 | 2016-12-13 | Yang Gao | Post tone suppression for speech enhancement |
US9697828B1 (en) | 2014-06-20 | 2017-07-04 | Amazon Technologies, Inc. | Keyword detection modeling using contextual and environmental information |
US10152987B2 (en) | 2014-06-23 | 2018-12-11 | Google Llc | Remote invocation of mobile device actions |
US9632748B2 (en) | 2014-06-24 | 2017-04-25 | Google Inc. | Device designation for audio input monitoring |
US9639854B2 (en) | 2014-06-26 | 2017-05-02 | Nuance Communications, Inc. | Voice-controlled information exchange platform, such as for providing information to supplement advertising |
US9691379B1 (en) | 2014-06-26 | 2017-06-27 | Amazon Technologies, Inc. | Selecting from multiple content sources |
US9335819B1 (en) | 2014-06-26 | 2016-05-10 | Audible, Inc. | Automatic creation of sleep bookmarks in content items |
US9368105B1 (en) * | 2014-06-26 | 2016-06-14 | Amazon Technologies, Inc. | Preventing false wake word detections with a voice-controlled device |
US9398392B2 (en) | 2014-06-30 | 2016-07-19 | Microsoft Technology Licensing, Llc | Audio calibration and adjustment |
US9338493B2 (en) | 2014-06-30 | 2016-05-10 | Apple Inc. | Intelligent automated assistant for TV user interactions |
US9420331B2 (en) | 2014-07-07 | 2016-08-16 | Google Inc. | Method and system for categorizing detected motion events |
US11330100B2 (en) | 2014-07-09 | 2022-05-10 | Ooma, Inc. | Server based intelligent personal assistant services |
US9374634B2 (en) | 2014-07-10 | 2016-06-21 | Nxp B.V. | System for controlling displacement of a loudspeaker |
US9467737B2 (en) | 2014-07-14 | 2016-10-11 | Sonos, Inc. | Zone group control |
JP2016024212A (ja) | 2014-07-16 | 2016-02-08 | ソニー株式会社 | 情報処理装置、情報処理方法およびプログラム |
US9671997B2 (en) | 2014-07-23 | 2017-06-06 | Sonos, Inc. | Zone grouping |
US10209947B2 (en) | 2014-07-23 | 2019-02-19 | Sonos, Inc. | Device grouping |
US9263042B1 (en) | 2014-07-25 | 2016-02-16 | Google Inc. | Providing pre-computed hotword models |
KR20160017253A (ko) | 2014-08-01 | 2016-02-16 | 삼성전자주식회사 | 디스플레이 구동용 집적 회로 칩 |
US9874997B2 (en) | 2014-08-08 | 2018-01-23 | Sonos, Inc. | Social playback queues |
US9548066B2 (en) | 2014-08-11 | 2017-01-17 | Amazon Technologies, Inc. | Voice application architecture |
US9769552B2 (en) | 2014-08-19 | 2017-09-19 | Apple Inc. | Method and apparatus for estimating talker distance |
US20160055847A1 (en) | 2014-08-19 | 2016-02-25 | Nuance Communications, Inc. | System and method for speech validation |
JP6118838B2 (ja) | 2014-08-21 | 2017-04-19 | 本田技研工業株式会社 | 情報処理装置、情報処理システム、情報処理方法、及び情報処理プログラム |
DE112015003945T5 (de) | 2014-08-28 | 2017-05-11 | Knowles Electronics, Llc | Mehrquellen-Rauschunterdrückung |
KR20160026317A (ko) | 2014-08-29 | 2016-03-09 | 삼성전자주식회사 | 음성 녹음 방법 및 장치 |
US9560050B2 (en) | 2014-09-08 | 2017-01-31 | At&T Intellectual Property I, L.P | System and method to share a resource or a capability of a device |
US9910634B2 (en) | 2014-09-09 | 2018-03-06 | Sonos, Inc. | Microphone calibration |
US9354687B2 (en) | 2014-09-11 | 2016-05-31 | Nuance Communications, Inc. | Methods and apparatus for unsupervised wakeup with time-correlated acoustic events |
US10789041B2 (en) | 2014-09-12 | 2020-09-29 | Apple Inc. | Dynamic thresholds for always listening speech trigger |
US9747011B2 (en) | 2014-09-16 | 2017-08-29 | Google Inc. | Continuation of playback of media content by different output devices |
US9548053B1 (en) * | 2014-09-19 | 2017-01-17 | Amazon Technologies, Inc. | Audible command filtering |
US10645130B2 (en) | 2014-09-24 | 2020-05-05 | Sonos, Inc. | Playback updates |
US10127911B2 (en) | 2014-09-30 | 2018-11-13 | Apple Inc. | Speaker identification and unsupervised speaker adaptation techniques |
JP6624368B2 (ja) | 2014-09-30 | 2019-12-25 | パナソニックIpマネジメント株式会社 | 接客モニタリングシステム及び接客モニタリング方法 |
US9681228B2 (en) | 2014-09-30 | 2017-06-13 | Apple Inc. | Capacitive position sensing for transducers |
US9641919B1 (en) | 2014-09-30 | 2017-05-02 | Amazon Technologies, Inc. | Audio assemblies for electronic devices |
GB2525051B (en) | 2014-09-30 | 2016-04-13 | Imagination Tech Ltd | Detection of acoustic echo cancellation |
JP6671379B2 (ja) | 2014-10-01 | 2020-03-25 | エクスブレイン・インコーポレーテッド | 音声および接続プラットフォーム |
US10817672B2 (en) | 2014-10-01 | 2020-10-27 | Nuance Communications, Inc. | Natural language understanding (NLU) processing based on user-specified interests |
US9812128B2 (en) | 2014-10-09 | 2017-11-07 | Google Inc. | Device leadership negotiation among voice interface devices |
KR102287943B1 (ko) | 2014-10-14 | 2021-08-09 | 삼성전자주식회사 | 전자 기기, 상기 전자 기기의 음량 조절 방법 및 상기 전자 기기의 제어 방법 |
EP3010251B1 (en) | 2014-10-15 | 2019-11-13 | Nxp B.V. | Audio system |
US20160162469A1 (en) | 2014-10-23 | 2016-06-09 | Audience, Inc. | Dynamic Local ASR Vocabulary |
US9544637B2 (en) | 2014-10-30 | 2017-01-10 | Verizon Patent And Licensing Inc. | Context-based media program presentation methods and systems |
US9530408B2 (en) | 2014-10-31 | 2016-12-27 | At&T Intellectual Property I, L.P. | Acoustic environment recognizer for optimal speech processing |
US10368121B2 (en) | 2014-11-07 | 2019-07-30 | Roku, Inc. | System and method for collecting data |
US20160134982A1 (en) | 2014-11-12 | 2016-05-12 | Harman International Industries, Inc. | System and method for estimating the displacement of a speaker cone |
US9699550B2 (en) | 2014-11-12 | 2017-07-04 | Qualcomm Incorporated | Reduced microphone power-up latency |
JP2016095383A (ja) | 2014-11-14 | 2016-05-26 | 株式会社ATR−Trek | 音声認識クライアント装置及びサーバ型音声認識装置 |
US10116748B2 (en) | 2014-11-20 | 2018-10-30 | Microsoft Technology Licensing, Llc | Vehicle-based multi-modal interface |
US10431214B2 (en) | 2014-11-26 | 2019-10-01 | Voicebox Technologies Corporation | System and method of determining a domain and/or an action related to a natural language input |
KR102299330B1 (ko) | 2014-11-26 | 2021-09-08 | 삼성전자주식회사 | 음성 인식 방법 및 그 전자 장치 |
US9992596B2 (en) | 2014-11-28 | 2018-06-05 | Audera Acoustics Inc. | High displacement acoustic transducer systems |
US10192549B2 (en) | 2014-11-28 | 2019-01-29 | Microsoft Technology Licensing, Llc | Extending digital personal assistant action providers |
US9812126B2 (en) * | 2014-11-28 | 2017-11-07 | Microsoft Technology Licensing, Llc | Device arbitration for listening devices |
US10126406B2 (en) | 2014-12-02 | 2018-11-13 | Qualcomm Incorporated | Method and apparatus for performing ultrasonic presence detection |
CN104538030A (zh) | 2014-12-11 | 2015-04-22 | 科大讯飞股份有限公司 | 一种可以通过语音控制家电的控制系统与方法 |
US9779725B2 (en) | 2014-12-11 | 2017-10-03 | Mediatek Inc. | Voice wakeup detecting device and method |
CN107209549B (zh) | 2014-12-11 | 2020-04-17 | 微软技术许可有限责任公司 | 能够实现可动作的消息传送的虚拟助理系统 |
US9775113B2 (en) | 2014-12-11 | 2017-09-26 | Mediatek Inc. | Voice wakeup detecting device with digital microphone and associated method |
US9813812B2 (en) | 2014-12-12 | 2017-11-07 | Analog Devices Global | Method of controlling diaphragm excursion of electrodynamic loudspeakers |
US9552816B2 (en) | 2014-12-19 | 2017-01-24 | Amazon Technologies, Inc. | Application focus in speech-based systems |
CN104575504A (zh) | 2014-12-24 | 2015-04-29 | 上海师范大学 | 采用声纹和语音识别进行个性化电视语音唤醒的方法 |
US9560441B1 (en) | 2014-12-24 | 2017-01-31 | Amazon Technologies, Inc. | Determining speaker direction using a spherical microphone array |
CN104635539A (zh) | 2014-12-26 | 2015-05-20 | 东莞市掌商信息科技有限公司 | 一种智能硬件远程语音安全控制方法及其系统 |
US10572810B2 (en) | 2015-01-07 | 2020-02-25 | Microsoft Technology Licensing, Llc | Managing user interaction for input understanding determinations |
US10045140B2 (en) * | 2015-01-07 | 2018-08-07 | Knowles Electronics, Llc | Utilizing digital microphones for low power keyword detection and noise suppression |
US9934406B2 (en) | 2015-01-08 | 2018-04-03 | Microsoft Technology Licensing, Llc | Protecting private information in input understanding system |
US9584915B2 (en) | 2015-01-19 | 2017-02-28 | Microsoft Technology Licensing, Llc | Spatial audio with remote speakers |
US20160210110A1 (en) | 2015-01-21 | 2016-07-21 | Ford Global Technologies, Llc | Audio synchronization between vehicles and mobile devices |
US9947313B2 (en) | 2015-01-26 | 2018-04-17 | William Drewes | Method for substantial ongoing cumulative voice recognition error reduction |
KR102351366B1 (ko) | 2015-01-26 | 2022-01-14 | 삼성전자주식회사 | 음성 인식 방법 및 장치 |
CN104572009B (zh) * | 2015-01-28 | 2018-01-09 | 合肥联宝信息技术有限公司 | 一种自适应外界环境的音频控制方法及装置 |
US9633661B1 (en) * | 2015-02-02 | 2017-04-25 | Amazon Technologies, Inc. | Speech-responsive portable speaker |
GB201501791D0 (en) | 2015-02-03 | 2015-03-18 | Microsoft Technology Licensing Llc | Non-linear echo path detection |
US20160232451A1 (en) | 2015-02-09 | 2016-08-11 | Velocee Ltd. | Systems and methods for managing audio content |
US9521496B2 (en) | 2015-02-12 | 2016-12-13 | Harman International Industries, Inc. | Media content playback system and method |
US10121472B2 (en) | 2015-02-13 | 2018-11-06 | Knowles Electronics, Llc | Audio buffer catch-up apparatus and method with two microphones |
US20160239255A1 (en) | 2015-02-16 | 2016-08-18 | Harman International Industries, Inc. | Mobile interface for loudspeaker optimization |
US20160253050A1 (en) | 2015-02-26 | 2016-09-01 | Fingertips Lab, Inc. | System and method for audio and tactile based browsing |
JPWO2016136062A1 (ja) | 2015-02-27 | 2017-12-07 | ソニー株式会社 | 情報処理装置、情報処理方法、及びプログラム |
US9721566B2 (en) * | 2015-03-08 | 2017-08-01 | Apple Inc. | Competing devices responding to voice triggers |
US10762894B2 (en) | 2015-03-27 | 2020-09-01 | Google Llc | Convolutional neural networks |
US9697826B2 (en) | 2015-03-27 | 2017-07-04 | Google Inc. | Processing multi-channel audio waveforms |
US10192546B1 (en) | 2015-03-30 | 2019-01-29 | Amazon Technologies, Inc. | Pre-wakeword speech processing |
US10034109B2 (en) | 2015-04-09 | 2018-07-24 | Audera Acoustics Inc. | Acoustic transducer systems with position sensing |
US9678707B2 (en) | 2015-04-10 | 2017-06-13 | Sonos, Inc. | Identification of audio content facilitated by playback device |
WO2016165067A1 (en) | 2015-04-14 | 2016-10-20 | Motorola Solutions, Inc. | Method and apparatus for a volume of a device |
US10178474B2 (en) | 2015-04-21 | 2019-01-08 | Google Llc | Sound signature database for initialization of noise reduction in recordings |
US10079012B2 (en) | 2015-04-21 | 2018-09-18 | Google Llc | Customizing speech-recognition dictionaries in a smart-home environment |
US9472196B1 (en) | 2015-04-22 | 2016-10-18 | Google Inc. | Developer voice actions system |
CN104853405B (zh) | 2015-05-12 | 2018-11-30 | 浙江生辉照明有限公司 | 智能联网方法及智能设备 |
KR102623039B1 (ko) | 2015-05-15 | 2024-01-08 | 가부시키가이샤 한도오따이 에네루기 켄큐쇼 | 발광 소자, 발광 장치, 전자 기기 및 조명 장치 |
EP3096277A1 (en) | 2015-05-19 | 2016-11-23 | ResearchGate GmbH | Enhanced online user-interaction tracking |
TWI757234B (zh) | 2015-05-21 | 2022-03-11 | 日商半導體能源研究所股份有限公司 | 發光元件、顯示裝置、電子裝置、及照明裝置 |
US10070237B2 (en) | 2015-05-21 | 2018-09-04 | Analog Devices, Inc. | Optical and capacitive sensing of electroacoustic transducers |
DE112016002297T5 (de) | 2015-05-21 | 2018-03-15 | Semiconductor Energy Laboratory Co., Ltd. | Licht emittierendes Element, Anzeigevorrichtung, elektronisches Gerät und Beleuchtungsvorrichtung |
US9837547B2 (en) | 2015-05-22 | 2017-12-05 | Semiconductor Energy Laboratory Co., Ltd. | Semiconductor device comprising oxide conductor and display device including the semiconductor device |
JP2016218852A (ja) | 2015-05-22 | 2016-12-22 | ソニー株式会社 | 情報処理装置および情報処理方法、並びにプログラム |
EP3099047A1 (en) | 2015-05-28 | 2016-11-30 | Nxp B.V. | Echo controller |
US9584935B2 (en) | 2015-05-29 | 2017-02-28 | Sound United, Llc. | Multi-zone media system and method for providing multi-zone media |
US10657949B2 (en) | 2015-05-29 | 2020-05-19 | Sound United, LLC | System and method for integrating a home media system and other home systems |
US9734822B1 (en) | 2015-06-01 | 2017-08-15 | Amazon Technologies, Inc. | Feedback based beamformed signal selection |
US9864571B2 (en) | 2015-06-04 | 2018-01-09 | Sonos, Inc. | Dynamic bonding of playback devices |
US9672821B2 (en) | 2015-06-05 | 2017-06-06 | Apple Inc. | Robust speech recognition in the presence of echo and noise using multiple signals for discrimination |
US9736578B2 (en) | 2015-06-07 | 2017-08-15 | Apple Inc. | Microphone-based orientation sensors and related techniques |
US10249205B2 (en) | 2015-06-08 | 2019-04-02 | Novel Effect, Inc. | System and method for integrating special effects with a text source |
KR102444075B1 (ko) | 2015-06-09 | 2022-09-16 | 삼성전자주식회사 | 전자 장치, 주변 기기 및 그 제어 방법 |
US10248376B2 (en) | 2015-06-11 | 2019-04-02 | Sonos, Inc. | Multiple groupings in a playback system |
US20160373909A1 (en) * | 2015-06-17 | 2016-12-22 | Hive Life, LLC | Wireless audio, security communication and home automation |
KR20180017077A (ko) | 2015-06-17 | 2018-02-20 | 가부시키가이샤 한도오따이 에네루기 켄큐쇼 | 이리듐 착체, 발광 소자, 표시 장치, 전자 기기, 및 조명 장치 |
JP6739907B2 (ja) | 2015-06-18 | 2020-08-12 | パナソニック インテレクチュアル プロパティ コーポレーション オブ アメリカPanasonic Intellectual Property Corporation of America | 機器特定方法、機器特定装置及びプログラム |
US10025447B1 (en) | 2015-06-19 | 2018-07-17 | Amazon Technologies, Inc. | Multi-device user interface |
KR20170001173A (ko) | 2015-06-25 | 2017-01-04 | 엘지전자 주식회사 | 와치 타입 이동 단말기 및 그의 동작 방법 |
US9554210B1 (en) | 2015-06-25 | 2017-01-24 | Amazon Technologies, Inc. | Multichannel acoustic echo cancellation with unique individual channel estimations |
KR102317526B1 (ko) | 2015-06-25 | 2021-10-26 | 엘지전자 주식회사 | 헤드셋 및 그 제어 방법 |
US9472203B1 (en) | 2015-06-29 | 2016-10-18 | Amazon Technologies, Inc. | Clock synchronization for multichannel system |
US20160378747A1 (en) | 2015-06-29 | 2016-12-29 | Apple Inc. | Virtual assistant for media playback |
CA2990891A1 (en) | 2015-06-30 | 2017-01-05 | Fraunhofer-Gesellschaft Zur Foerderung Der Angewandten Forchung E.V. | Method and device for associating noises and for analyzing |
KR20240035638A (ko) | 2015-07-08 | 2024-03-15 | 가부시키가이샤 한도오따이 에네루기 켄큐쇼 | 발광 소자, 표시 장치, 전자 장치, 및 조명 장치 |
US10304440B1 (en) | 2015-07-10 | 2019-05-28 | Amazon Technologies, Inc. | Keyword spotting using multi-task configuration |
KR20240047495A (ko) | 2015-07-21 | 2024-04-12 | 가부시키가이샤 한도오따이 에네루기 켄큐쇼 | 발광 소자, 표시 장치, 전자 기기, 및 조명 장치 |
US9686625B2 (en) | 2015-07-21 | 2017-06-20 | Disney Enterprises, Inc. | Systems and methods for delivery of personalized audio |
US9769563B2 (en) | 2015-07-22 | 2017-09-19 | Harman International Industries, Incorporated | Audio enhancement via opportunistic use of microphones |
TWI804457B (zh) | 2015-07-23 | 2023-06-11 | 日商半導體能源研究所股份有限公司 | 發光元件,顯示裝置,電子裝置,以及照明裝置 |
US20170034263A1 (en) | 2015-07-30 | 2017-02-02 | Amp Me Inc. | Synchronized Playback of Streamed Audio Content by Multiple Internet-Capable Portable Devices |
US10529318B2 (en) | 2015-07-31 | 2020-01-07 | International Business Machines Corporation | Implementing a classification model for recognition processing |
US9691361B2 (en) | 2015-08-03 | 2017-06-27 | International Business Machines Corporation | Adjusting presentation of content on a display |
KR102402512B1 (ko) | 2015-08-04 | 2022-05-27 | 삼성전자주식회사 | 외부장치의 음량을 조정하는 전자장치 및 방법 |
CN105187907A (zh) | 2015-08-05 | 2015-12-23 | 四川长虹电器股份有限公司 | 智能电视音量控制系统及控制方法 |
US9913056B2 (en) | 2015-08-06 | 2018-03-06 | Dolby Laboratories Licensing Corporation | System and method to enhance speakers connected to devices with microphones |
US10333904B2 (en) | 2015-08-08 | 2019-06-25 | Peter J. Tormey | Voice access and control |
KR102386854B1 (ko) | 2015-08-20 | 2022-04-13 | 삼성전자주식회사 | 통합 모델 기반의 음성 인식 장치 및 방법 |
US10270041B2 (en) | 2015-08-28 | 2019-04-23 | Semiconductor Energy Laboratory Co., Ltd. | Light-emitting element, light-emitting device, electronic device, and lighting device |
WO2017039632A1 (en) | 2015-08-31 | 2017-03-09 | Nunntawi Dynamics Llc | Passive self-localization of microphone arrays |
CN106488302B (zh) | 2015-09-02 | 2021-02-23 | 哈曼国际工业有限公司 | 切换音频输出的方法、回放设备及回放系统 |
US10339917B2 (en) | 2015-09-03 | 2019-07-02 | Google Llc | Enhanced speech endpointing |
KR102417682B1 (ko) | 2015-09-09 | 2022-07-07 | 삼성전자주식회사 | 음성 인식을 이용한 닉네임 관리 장치 및 방법 |
KR20170031392A (ko) | 2015-09-11 | 2017-03-21 | 삼성전자주식회사 | 전자 장치, 음향 시스템 및 오디오 출력 방법 |
US10026399B2 (en) * | 2015-09-11 | 2018-07-17 | Amazon Technologies, Inc. | Arbitration between voice-enabled devices |
KR20170032096A (ko) | 2015-09-14 | 2017-03-22 | 삼성전자주식회사 | 전자장치, 전자장치의 구동방법, 음성인식장치, 음성인식장치의 구동 방법 및 컴퓨터 판독가능 기록매체 |
CN105206281B (zh) | 2015-09-14 | 2019-02-15 | 胡旻波 | 基于分布式麦克风阵列网络的语音增强方法 |
US10289734B2 (en) | 2015-09-18 | 2019-05-14 | Samsung Electronics Co., Ltd. | Entity-type search system |
US10706873B2 (en) | 2015-09-18 | 2020-07-07 | Sri International | Real-time speaker state analytics platform |
CN105204357B (zh) | 2015-09-18 | 2018-02-06 | 小米科技有限责任公司 | 智能家居设备的情景模式调整方法及装置 |
US9875081B2 (en) | 2015-09-21 | 2018-01-23 | Amazon Technologies, Inc. | Device selection for providing a response |
KR102420450B1 (ko) | 2015-09-23 | 2022-07-14 | 삼성전자주식회사 | 음성인식장치, 음성인식방법 및 컴퓨터 판독가능 기록매체 |
KR102446392B1 (ko) | 2015-09-23 | 2022-09-23 | 삼성전자주식회사 | 음성 인식이 가능한 전자 장치 및 방법 |
US9936156B2 (en) | 2015-09-24 | 2018-04-03 | Samantha WESTERN | Volume adjusting apparatus and method |
US10229700B2 (en) | 2015-09-24 | 2019-03-12 | Google Llc | Voice activity detection |
US10186276B2 (en) | 2015-09-25 | 2019-01-22 | Qualcomm Incorporated | Adaptive noise suppression for super wideband music |
CN105162886B (zh) | 2015-09-25 | 2019-04-12 | 北京奇艺世纪科技有限公司 | 一种声音控制方法及装置 |
US9996316B2 (en) | 2015-09-28 | 2018-06-12 | Amazon Technologies, Inc. | Mediation of wakeword response for multiple devices |
JP6536320B2 (ja) | 2015-09-28 | 2019-07-03 | 富士通株式会社 | 音声信号処理装置、音声信号処理方法及びプログラム |
CN107710770B (zh) | 2015-09-28 | 2021-02-09 | 谷歌有限责任公司 | 用于时间同步的多区域媒体流式传输的系统和方法 |
US10241754B1 (en) | 2015-09-29 | 2019-03-26 | Amazon Technologies, Inc. | Systems and methods for providing supplemental information with a response to a command |
TW202316695A (zh) | 2015-09-30 | 2023-04-16 | 日商半導體能源研究所股份有限公司 | 發光元件,顯示裝置,電子裝置,及照明裝置 |
US20170092278A1 (en) | 2015-09-30 | 2017-03-30 | Apple Inc. | Speaker recognition |
KR20170038681A (ko) | 2015-09-30 | 2017-04-07 | 가부시키가이샤 한도오따이 에네루기 켄큐쇼 | 발광 소자, 표시 장치, 전자 기기, 및 조명 장치 |
US9978366B2 (en) | 2015-10-09 | 2018-05-22 | Xappmedia, Inc. | Event-based speech interactive media player |
US9754580B2 (en) | 2015-10-12 | 2017-09-05 | Technologies For Voice Interface | System and method for extracting and using prosody features |
KR102429260B1 (ko) | 2015-10-12 | 2022-08-05 | 삼성전자주식회사 | 음성 에이전트 기반의 제어 명령 처리 장치 및 방법과, 에이전트 장치 |
CN107925818B (zh) | 2015-10-15 | 2020-10-16 | 华为技术有限公司 | 用于声音处理节点装置的声音处理节点 |
US9928840B2 (en) | 2015-10-16 | 2018-03-27 | Google Llc | Hotword recognition |
US9747926B2 (en) * | 2015-10-16 | 2017-08-29 | Google Inc. | Hotword recognition |
CN107016999B (zh) | 2015-10-16 | 2022-06-14 | 谷歌有限责任公司 | 热词识别 |
US10453450B2 (en) | 2015-10-20 | 2019-10-22 | Bragi GmbH | Wearable earpiece voice command control system and method |
KR102444061B1 (ko) | 2015-11-02 | 2022-09-16 | 삼성전자주식회사 | 음성 인식이 가능한 전자 장치 및 방법 |
CN105427861B (zh) | 2015-11-03 | 2019-02-15 | 胡旻波 | 智能家居协同麦克风语音控制的系统及其控制方法 |
US9691378B1 (en) | 2015-11-05 | 2017-06-27 | Amazon Technologies, Inc. | Methods and devices for selectively ignoring captured audio data |
US9653075B1 (en) | 2015-11-06 | 2017-05-16 | Google Inc. | Voice commands across devices |
US10863267B2 (en) | 2015-11-10 | 2020-12-08 | Savant Systems, Inc. | Volume control for audio/video devices |
US9990209B2 (en) | 2015-11-12 | 2018-06-05 | Microsoft Technology Licensing, Llc | Digital assistance device for facilitating multi-stage setup |
US10592949B2 (en) | 2015-11-13 | 2020-03-17 | [24]7.ai, Inc. | Method and apparatus for linking customer interactions with customer messaging platforms |
US10706852B2 (en) | 2015-11-13 | 2020-07-07 | Microsoft Technology Licensing, Llc | Confidence features for automated speech recognition arbitration |
US20170140750A1 (en) | 2015-11-17 | 2017-05-18 | Le Holdings (Beijing) Co., Ltd. | Method and device for speech recognition |
CN105472191B (zh) | 2015-11-18 | 2019-09-20 | 百度在线网络技术(北京)有限公司 | 一种跟踪回声时延的方法和装置 |
US11929088B2 (en) | 2015-11-20 | 2024-03-12 | Synaptics Incorporated | Input/output mode control for audio processing |
US10706853B2 (en) | 2015-11-25 | 2020-07-07 | Mitsubishi Electric Corporation | Speech dialogue device and speech dialogue method |
US10040423B2 (en) | 2015-11-27 | 2018-08-07 | Bragi GmbH | Vehicle with wearable for identifying one or more vehicle occupants |
US9484030B1 (en) | 2015-12-02 | 2016-11-01 | Amazon Technologies, Inc. | Audio triggered commands |
US9699597B2 (en) | 2015-12-07 | 2017-07-04 | Google Inc. | Wireless signal forwarding |
US9747920B2 (en) | 2015-12-17 | 2017-08-29 | Amazon Technologies, Inc. | Adaptive beamforming to create reference channels |
US10134388B1 (en) | 2015-12-23 | 2018-11-20 | Amazon Technologies, Inc. | Word generation for speech recognition |
CN105632486B (zh) * | 2015-12-23 | 2019-12-17 | 北京奇虎科技有限公司 | 一种智能硬件的语音唤醒方法和装置 |
US10311862B2 (en) | 2015-12-23 | 2019-06-04 | Rovi Guides, Inc. | Systems and methods for conversations with devices about media using interruptions and changes of subjects |
CN105679318A (zh) | 2015-12-23 | 2016-06-15 | 珠海格力电器股份有限公司 | 一种基于语音识别的显示方法、装置、显示系统和空调 |
US9826599B2 (en) | 2015-12-28 | 2017-11-21 | Amazon Technologies, Inc. | Voice-controlled light switches |
US10026401B1 (en) | 2015-12-28 | 2018-07-17 | Amazon Technologies, Inc. | Naming devices via voice commands |
US10547942B2 (en) | 2015-12-28 | 2020-01-28 | Samsung Electronics Co., Ltd. | Control of electrodynamic speaker driver using a low-order non-linear model |
US9992642B1 (en) | 2015-12-29 | 2018-06-05 | Amazon Technologies, Inc. | Automated messaging |
US9820036B1 (en) | 2015-12-30 | 2017-11-14 | Amazon Technologies, Inc. | Speech processing of reflected sound |
US9813810B1 (en) | 2016-01-05 | 2017-11-07 | Google Inc. | Multi-microphone neural network for sound recognition |
US10049666B2 (en) | 2016-01-06 | 2018-08-14 | Google Llc | Voice recognition system |
US9743207B1 (en) | 2016-01-18 | 2017-08-22 | Sonos, Inc. | Calibration using multiple recording devices |
KR20170086814A (ko) | 2016-01-19 | 2017-07-27 | 삼성전자주식회사 | 음성 인식 기능을 제공하는 전자 장치 및 그 동작 방법 |
US9997151B1 (en) | 2016-01-20 | 2018-06-12 | Amazon Technologies, Inc. | Multichannel acoustic echo cancellation for wireless applications |
KR102392113B1 (ko) | 2016-01-20 | 2022-04-29 | 삼성전자주식회사 | 전자 장치 및 전자 장치의 음성 명령 처리 방법 |
CN105741838B (zh) | 2016-01-20 | 2019-10-15 | 百度在线网络技术(北京)有限公司 | 语音唤醒方法及装置 |
US9749731B2 (en) | 2016-01-21 | 2017-08-29 | Bose Corporation | Sidetone generation using multiple microphones |
KR20170091913A (ko) | 2016-02-02 | 2017-08-10 | 삼성전자주식회사 | 영상 서비스 제공 방법 및 장치 |
US9653060B1 (en) | 2016-02-09 | 2017-05-16 | Amazon Technologies, Inc. | Hybrid reference signal for acoustic echo cancellation |
US9659555B1 (en) | 2016-02-09 | 2017-05-23 | Amazon Technologies, Inc. | Multichannel acoustic echo cancellation |
EP3414759B1 (en) | 2016-02-10 | 2020-07-01 | Cerence Operating Company | Techniques for spatially selective wake-up word recognition and related systems and methods |
US9898250B1 (en) | 2016-02-12 | 2018-02-20 | Amazon Technologies, Inc. | Controlling distributed audio outputs to enable voice output |
US9858927B2 (en) | 2016-02-12 | 2018-01-02 | Amazon Technologies, Inc | Processing spoken commands to control distributed audio outputs |
US9811314B2 (en) | 2016-02-22 | 2017-11-07 | Sonos, Inc. | Metadata exchange involving a networked playback system and a networked microphone system |
US9965247B2 (en) | 2016-02-22 | 2018-05-08 | Sonos, Inc. | Voice controlled media playback system based on user profile |
US9772817B2 (en) | 2016-02-22 | 2017-09-26 | Sonos, Inc. | Room-corrected voice detection |
US9947316B2 (en) | 2016-02-22 | 2018-04-17 | Sonos, Inc. | Voice control of a media playback system |
US10095470B2 (en) | 2016-02-22 | 2018-10-09 | Sonos, Inc. | Audio response playback |
US10264030B2 (en) | 2016-02-22 | 2019-04-16 | Sonos, Inc. | Networked microphone device control |
US9779735B2 (en) | 2016-02-24 | 2017-10-03 | Google Inc. | Methods and systems for detecting and processing speech signals |
WO2017147936A1 (zh) | 2016-03-04 | 2017-09-08 | 茹旷 | 智能家居助手 |
US10133612B2 (en) | 2016-03-17 | 2018-11-20 | Nuance Communications, Inc. | Session processing interaction between two or more virtual assistants |
US9769420B1 (en) | 2016-03-18 | 2017-09-19 | Thomas Lawrence Moses | Portable wireless remote monitoring and control systems |
US10373612B2 (en) | 2016-03-21 | 2019-08-06 | Amazon Technologies, Inc. | Anchored speech detection and speech recognition |
US9805714B2 (en) | 2016-03-22 | 2017-10-31 | Asustek Computer Inc. | Directional keyword verification method applicable to electronic device and electronic device using the same |
US10365887B1 (en) | 2016-03-25 | 2019-07-30 | Amazon Technologies, Inc. | Generating commands based on location and wakeword |
US10332508B1 (en) | 2016-03-31 | 2019-06-25 | Amazon Technologies, Inc. | Confidence checking for speech processing and query answering |
US9952827B2 (en) | 2016-04-13 | 2018-04-24 | Comcast Cable Communications, Llc | Dynamic adjustment of equalization settings of audio components via a sound device profile |
JP6686226B2 (ja) | 2016-04-18 | 2020-04-22 | グーグル エルエルシー | 適切なエージェントの自動化アシスタント呼び出し |
US10318236B1 (en) | 2016-05-05 | 2019-06-11 | Amazon Technologies, Inc. | Refining media playback |
US20170329397A1 (en) | 2016-05-12 | 2017-11-16 | Rovi Guides, Inc. | Systems and methods for navigating a media guidance application using gaze control |
US10447748B2 (en) | 2016-05-12 | 2019-10-15 | Apple Inc. | Sharing media information between applications on client devices |
US20170330564A1 (en) | 2016-05-13 | 2017-11-16 | Bose Corporation | Processing Simultaneous Speech from Distributed Microphones |
US10149049B2 (en) | 2016-05-13 | 2018-12-04 | Bose Corporation | Processing speech from distributed microphones |
US10187440B2 (en) | 2016-05-27 | 2019-01-22 | Apple Inc. | Personalization of media streams |
US10063965B2 (en) | 2016-06-01 | 2018-08-28 | Google Llc | Sound source estimation using neural networks |
US10474419B2 (en) | 2016-06-03 | 2019-11-12 | Crestron Electronics, Inc. | Audio digital signal processor utilizing a hybrid network architecture |
US10235124B2 (en) | 2016-06-08 | 2019-03-19 | Google Llc | Audio announcement prioritization system |
AU2017100581B4 (en) | 2016-06-08 | 2018-02-01 | Apple Inc. | Intelligent automated assistant for media exploration |
US9754605B1 (en) | 2016-06-09 | 2017-09-05 | Amazon Technologies, Inc. | Step-size control for multi-channel acoustic echo canceller |
AU2017100486C4 (en) | 2016-06-11 | 2019-09-05 | Apple Inc. | Intelligent device arbitration and control |
DK179415B1 (en) | 2016-06-11 | 2018-06-14 | Apple Inc | Intelligent device arbitration and control |
DK179034B1 (en) | 2016-06-12 | 2017-09-04 | Apple Inc | Devices, methods, and graphical user interfaces for dynamically adjusting presentation of audio outputs |
US11600269B2 (en) | 2016-06-15 | 2023-03-07 | Cerence Operating Company | Techniques for wake-up word recognition and related systems and methods |
US20170364371A1 (en) | 2016-06-15 | 2017-12-21 | Microsoft Technology Licensing, Llc | Context-Dependent Digital Action-Assistance Tool |
US10212029B2 (en) | 2016-06-15 | 2019-02-19 | Microsoft Technology Licensing, Llc | Service provisioning in cloud computing systems |
KR20170142001A (ko) | 2016-06-16 | 2017-12-27 | 삼성전자주식회사 | 전자 장치, 그의 반향 신호 제거 방법 및 비일시적 컴퓨터 판독가능 기록매체 |
US9749738B1 (en) | 2016-06-20 | 2017-08-29 | Gopro, Inc. | Synthesizing audio corresponding to a virtual microphone location |
US9875740B1 (en) | 2016-06-20 | 2018-01-23 | A9.Com, Inc. | Using voice information to influence importance of search result categories |
ITUA20164622A1 (it) | 2016-06-23 | 2017-12-23 | St Microelectronics Srl | Procedimento di beamforming basato su matrici di microfoni e relativo apparato |
US10091545B1 (en) | 2016-06-27 | 2018-10-02 | Amazon Technologies, Inc. | Methods and systems for detecting audio output of associated device |
US9728188B1 (en) | 2016-06-28 | 2017-08-08 | Amazon Technologies, Inc. | Methods and devices for ignoring similar audio being received by a system |
KR102471499B1 (ko) | 2016-07-05 | 2022-11-28 | 삼성전자주식회사 | 영상처리장치, 영상처리장치의 구동방법 및 컴퓨터 판독가능 기록매체 |
WO2018013564A1 (en) | 2016-07-12 | 2018-01-18 | Bose Corporation | Combining gesture and voice user interfaces |
EP3270377B1 (en) | 2016-07-12 | 2020-02-19 | Dolby Laboratories Licensing Corporation | Assessment and adjustment of audio installation |
US10152969B2 (en) | 2016-07-15 | 2018-12-11 | Sonos, Inc. | Voice detection by multiple devices |
US10134399B2 (en) | 2016-07-15 | 2018-11-20 | Sonos, Inc. | Contextualization of voice inputs |
US9860670B1 (en) | 2016-07-15 | 2018-01-02 | Sonos, Inc. | Spectral correction using spatial calibration |
US9979680B2 (en) | 2016-07-21 | 2018-05-22 | Fujitsu Limited | Smart notification scheduling and modality selection |
US10621992B2 (en) | 2016-07-22 | 2020-04-14 | Lenovo (Singapore) Pte. Ltd. | Activating voice assistant based on at least one of user proximity and context |
KR102575634B1 (ko) | 2016-07-26 | 2023-09-06 | 삼성전자주식회사 | 전자 장치 및 전자 장치의 동작 방법 |
CN106028223A (zh) | 2016-07-26 | 2016-10-12 | 广东欧珀移动通信有限公司 | 一种智能音箱的控制方法、装置及智能音箱 |
US10431211B2 (en) | 2016-07-29 | 2019-10-01 | Qualcomm Incorporated | Directional processing of far-field audio |
US10459684B2 (en) | 2016-08-05 | 2019-10-29 | Sonos, Inc. | Calibration of a playback device based on an estimated frequency response |
US10115400B2 (en) | 2016-08-05 | 2018-10-30 | Sonos, Inc. | Multiple voice services |
US10026403B2 (en) | 2016-08-12 | 2018-07-17 | Paypal, Inc. | Location based voice association system |
US9691384B1 (en) | 2016-08-19 | 2017-06-27 | Google Inc. | Voice action biasing system |
US20180053504A1 (en) | 2016-08-19 | 2018-02-22 | Otis Elevator Company | Intention recognition for triggering voice recognition system |
US9967382B2 (en) | 2016-08-19 | 2018-05-08 | Amazon Technologies, Inc. | Enabling voice control of telephone device |
CN107767863B (zh) | 2016-08-22 | 2021-05-04 | 科大讯飞股份有限公司 | 语音唤醒方法、系统及智能终端 |
US9972320B2 (en) | 2016-08-24 | 2018-05-15 | Google Llc | Hotword detection on multiple devices |
WO2018039045A1 (en) | 2016-08-24 | 2018-03-01 | Knowles Electronics, Llc | Methods and systems for keyword detection using keyword repetitions |
US10461953B2 (en) | 2016-08-29 | 2019-10-29 | Lutron Technology Company Llc | Load control system having audio control devices |
US10360910B2 (en) | 2016-08-29 | 2019-07-23 | Garmin Switzerland Gmbh | Automatic speech recognition (ASR) utilizing GPS and sensor data |
US10685656B2 (en) | 2016-08-31 | 2020-06-16 | Bose Corporation | Accessing multiple virtual personal assistants (VPA) from a single device |
US10580404B2 (en) | 2016-09-01 | 2020-03-03 | Amazon Technologies, Inc. | Indicator for voice-based communications |
US10074369B2 (en) | 2016-09-01 | 2018-09-11 | Amazon Technologies, Inc. | Voice-based communications |
US10057698B2 (en) | 2016-09-02 | 2018-08-21 | Bose Corporation | Multiple room communication system and method |
EP3497629B1 (en) | 2016-09-06 | 2020-11-04 | Deepmind Technologies Limited | Generating audio using neural networks |
EP3297298B1 (en) | 2016-09-19 | 2020-05-06 | A-Volute | Method for reproducing spatially distributed sounds |
JP6520878B2 (ja) | 2016-09-21 | 2019-05-29 | トヨタ自動車株式会社 | 音声取得システムおよび音声取得方法 |
US9972318B1 (en) | 2016-09-21 | 2018-05-15 | Amazon Technologies, Inc. | Interpreting voice commands |
US9942678B1 (en) | 2016-09-27 | 2018-04-10 | Sonos, Inc. | Audio playback settings for voice interaction |
US10409548B2 (en) | 2016-09-27 | 2019-09-10 | Grabango Co. | System and method for differentially locating and modifying audio sources |
JP2018055259A (ja) | 2016-09-27 | 2018-04-05 | キヤノン株式会社 | 情報処理装置、情報処理方法及びプログラム |
US9959861B2 (en) | 2016-09-30 | 2018-05-01 | Robert Bosch Gmbh | System and method for speech recognition |
US9743204B1 (en) | 2016-09-30 | 2017-08-22 | Sonos, Inc. | Multi-orientation playback device microphones |
WO2018067403A1 (en) | 2016-10-03 | 2018-04-12 | Google Inc. | Multi computational agent performance of tasks |
US10283138B2 (en) | 2016-10-03 | 2019-05-07 | Google Llc | Noise mitigation for a voice interface device |
KR20200035476A (ko) | 2016-10-03 | 2020-04-03 | 구글 엘엘씨 | 디바이스 토폴로지에 기초한 음성 명령 프로세싱 |
CN107919116B (zh) | 2016-10-11 | 2019-09-13 | 芋头科技(杭州)有限公司 | 一种语音激活检测方法及装置 |
US10712997B2 (en) | 2016-10-17 | 2020-07-14 | Sonos, Inc. | Room association based on name |
US10181323B2 (en) | 2016-10-19 | 2019-01-15 | Sonos, Inc. | Arbitration-based voice recognition |
US20180122372A1 (en) | 2016-10-31 | 2018-05-03 | Soundhound, Inc. | Distinguishable open sounds |
US10783883B2 (en) | 2016-11-03 | 2020-09-22 | Google Llc | Focus session at a voice interface device |
KR102241970B1 (ko) * | 2016-11-07 | 2021-04-20 | 구글 엘엘씨 | 기록된 미디어 핫워드 트리거 억제 |
US10154496B2 (en) | 2016-11-10 | 2018-12-11 | Futurewei Technologies, Inc. | System and method for beamformed reference signals in three dimensional multiple input multiple output communications systems |
US10382806B2 (en) | 2016-11-14 | 2019-08-13 | DISH Technologies L.L.C. | Apparatus, systems and methods for controlling presentation of content using a multi-media table |
US10170110B2 (en) | 2016-11-17 | 2019-01-01 | Robert Bosch Gmbh | System and method for ranking of hybrid speech recognition results with neural networks |
CN106708403A (zh) | 2016-11-30 | 2017-05-24 | 努比亚技术有限公司 | 输入滑动操作时同步播放提示音的方法及装置 |
US10079015B1 (en) | 2016-12-06 | 2018-09-18 | Amazon Technologies, Inc. | Multi-layer keyword detection |
US10186265B1 (en) | 2016-12-06 | 2019-01-22 | Amazon Technologies, Inc. | Multi-layer keyword detection to avoid detection of keywords in output audio |
US10134396B2 (en) | 2016-12-07 | 2018-11-20 | Google Llc | Preventing of audio attacks |
US10255032B2 (en) | 2016-12-13 | 2019-04-09 | EVA Automation, Inc. | Wireless coordination of audio sources |
US11184764B2 (en) | 2016-12-14 | 2021-11-23 | Amzetta Technologies, Llc | Methods and systems of establishing communication between devices |
CN106531165A (zh) | 2016-12-15 | 2017-03-22 | 北京塞宾科技有限公司 | 一种便携式智能家居语音控制系统及控制方法 |
US10339957B1 (en) | 2016-12-20 | 2019-07-02 | Amazon Technologies, Inc. | Ending communications session based on presence data |
US10068573B1 (en) | 2016-12-21 | 2018-09-04 | Amazon Technologies, Inc. | Approaches for voice-activated audio commands |
US10559309B2 (en) | 2016-12-22 | 2020-02-11 | Google Llc | Collaborative voice controlled devices |
JP7175441B2 (ja) | 2016-12-23 | 2022-11-21 | シナプティクス インコーポレイテッド | 雑音のある時変環境のための重み付け予測誤差に基づくオンライン残響除去アルゴリズム |
CN106910500B (zh) * | 2016-12-23 | 2020-04-17 | 北京小鸟听听科技有限公司 | 对带麦克风阵列的设备进行语音控制的方法及设备 |
US10546578B2 (en) | 2016-12-26 | 2020-01-28 | Samsung Electronics Co., Ltd. | Method and device for transmitting and receiving audio data |
US10580405B1 (en) | 2016-12-27 | 2020-03-03 | Amazon Technologies, Inc. | Voice control of remote device |
US10276161B2 (en) | 2016-12-27 | 2019-04-30 | Google Llc | Contextual hotwords |
US10593328B1 (en) | 2016-12-27 | 2020-03-17 | Amazon Technologies, Inc. | Voice control of remote device |
US10186266B1 (en) | 2016-12-28 | 2019-01-22 | Amazon Technologies, Inc. | Message playback using a shared device |
US10229680B1 (en) | 2016-12-29 | 2019-03-12 | Amazon Technologies, Inc. | Contextual entity resolution |
US10831366B2 (en) | 2016-12-29 | 2020-11-10 | Google Llc | Modality learning on mobile devices |
US10224031B2 (en) | 2016-12-30 | 2019-03-05 | Google Llc | Generating and transmitting invocation request to appropriate third-party agent |
US10290302B2 (en) | 2016-12-30 | 2019-05-14 | Google Llc | Compact home assistant with combined acoustic waveguide and heat sink |
KR102412202B1 (ko) | 2017-01-03 | 2022-06-27 | 삼성전자주식회사 | 냉장고 및 이의 정보 표시 방법 |
US10248613B2 (en) | 2017-01-10 | 2019-04-02 | Qualcomm Incorporated | Data bus activation in an electronic device |
US10672387B2 (en) | 2017-01-11 | 2020-06-02 | Google Llc | Systems and methods for recognizing user speech |
US10306254B2 (en) | 2017-01-17 | 2019-05-28 | Seiko Epson Corporation | Encoding free view point data in movie data container |
KR20180084392A (ko) | 2017-01-17 | 2018-07-25 | 삼성전자주식회사 | 전자 장치 및 그의 동작 방법 |
US11164570B2 (en) | 2017-01-17 | 2021-11-02 | Ford Global Technologies, Llc | Voice assistant tracking and activation |
KR20180085931A (ko) | 2017-01-20 | 2018-07-30 | 삼성전자주식회사 | 음성 입력 처리 방법 및 이를 지원하는 전자 장치 |
KR102556840B1 (ko) | 2017-01-20 | 2023-07-18 | 삼성전자주식회사 | 전자 장치 및 그의 제어 방법 |
US20180218747A1 (en) | 2017-01-28 | 2018-08-02 | Bose Corporation | Audio Device Filter Modification |
KR20180090586A (ko) | 2017-02-03 | 2018-08-13 | 삼성전자주식회사 | 알림을 제공하는 방법 및 그 전자 장치 |
CN110506452B (zh) | 2017-02-07 | 2021-12-03 | 路创技术有限责任公司 | 基于音频的负载控制系统 |
US10762891B2 (en) | 2017-02-10 | 2020-09-01 | Synaptics Incorporated | Binary and multi-class classification systems and methods using connectionist temporal classification |
CN108446281B (zh) | 2017-02-13 | 2021-03-12 | 北京嘀嘀无限科技发展有限公司 | 确定用户亲密度的方法、装置及存储介质 |
US11100384B2 (en) | 2017-02-14 | 2021-08-24 | Microsoft Technology Licensing, Llc | Intelligent device user interactions |
US20180293221A1 (en) | 2017-02-14 | 2018-10-11 | Microsoft Technology Licensing, Llc | Speech parsing with intelligent assistant |
US10311876B2 (en) | 2017-02-14 | 2019-06-04 | Google Llc | Server side hotwording |
US10467509B2 (en) | 2017-02-14 | 2019-11-05 | Microsoft Technology Licensing, Llc | Computationally-efficient human-identifying smart assistant computer |
US10264358B2 (en) | 2017-02-15 | 2019-04-16 | Amazon Technologies, Inc. | Selection of master device for synchronized audio |
US10431217B2 (en) | 2017-02-15 | 2019-10-01 | Amazon Technologies, Inc. | Audio playback device that dynamically switches between receiving audio data from a soft access point and receiving audio data from a local access point |
US10839795B2 (en) | 2017-02-15 | 2020-11-17 | Amazon Technologies, Inc. | Implicit target selection for multiple audio playback devices in an environment |
CN106921560B (zh) | 2017-02-28 | 2020-06-02 | 北京小米移动软件有限公司 | 语音通信方法、装置及系统 |
US10706843B1 (en) | 2017-03-09 | 2020-07-07 | Amazon Technologies, Inc. | Contact resolution for communications systems |
US10089981B1 (en) | 2017-03-09 | 2018-10-02 | Amazon Technologies, Inc. | Messaging account disambiguation |
US20180262793A1 (en) | 2017-03-09 | 2018-09-13 | Google Inc. | Reverse Casting from a First Screen Device to a Second Screen Device |
US10540961B2 (en) | 2017-03-13 | 2020-01-21 | Baidu Usa Llc | Convolutional recurrent neural networks for small-footprint keyword spotting |
US10074371B1 (en) | 2017-03-14 | 2018-09-11 | Amazon Technologies, Inc. | Voice control of remote device by disabling wakeword detection |
US10499139B2 (en) | 2017-03-20 | 2019-12-03 | Bose Corporation | Audio signal processing for noise reduction |
US10600406B1 (en) | 2017-03-20 | 2020-03-24 | Amazon Technologies, Inc. | Intent re-ranker |
US10621980B2 (en) | 2017-03-21 | 2020-04-14 | Harman International Industries, Inc. | Execution of voice commands in a multi-device system |
WO2018173293A1 (ja) | 2017-03-24 | 2018-09-27 | ヤマハ株式会社 | 音声端末、音声コマンド生成システム、及び音声コマンド生成システムの制御方法 |
US11183181B2 (en) | 2017-03-27 | 2021-11-23 | Sonos, Inc. | Systems and methods of multiple voice services |
CN107135443B (zh) | 2017-03-29 | 2020-06-23 | 联想(北京)有限公司 | 一种信号处理方法及电子设备 |
US10643609B1 (en) | 2017-03-29 | 2020-05-05 | Amazon Technologies, Inc. | Selecting speech inputs |
US10373630B2 (en) | 2017-03-31 | 2019-08-06 | Intel Corporation | Systems and methods for energy efficient and low power distributed automatic speech recognition on wearable devices |
US10825471B2 (en) | 2017-04-05 | 2020-11-03 | Avago Technologies International Sales Pte. Limited | Voice energy detection |
US11188808B2 (en) | 2017-04-11 | 2021-11-30 | Lenovo (Singapore) Pte. Ltd. | Indicating a responding virtual assistant from a plurality of virtual assistants |
US10748531B2 (en) | 2017-04-13 | 2020-08-18 | Harman International Industries, Incorporated | Management layer for multiple intelligent personal assistant services |
CN107122158A (zh) | 2017-04-14 | 2017-09-01 | 北京小米移动软件有限公司 | 播放信息提示音频的方法及装置、电子设备 |
KR102068182B1 (ko) | 2017-04-21 | 2020-01-20 | 엘지전자 주식회사 | 음성 인식 장치, 및 음성 인식 시스템 |
KR102392297B1 (ko) | 2017-04-24 | 2022-05-02 | 엘지전자 주식회사 | 전자기기 |
KR102298947B1 (ko) | 2017-04-28 | 2021-09-08 | 삼성전자주식회사 | 음성 데이터 처리 방법 및 이를 지원하는 전자 장치 |
US10992795B2 (en) | 2017-05-16 | 2021-04-27 | Apple Inc. | Methods and interfaces for home media control |
US10013995B1 (en) | 2017-05-10 | 2018-07-03 | Cirrus Logic, Inc. | Combined reference signal for acoustic echo cancellation |
US10311870B2 (en) | 2017-05-10 | 2019-06-04 | Ecobee Inc. | Computerized device with voice command input capability |
US20180336892A1 (en) | 2017-05-16 | 2018-11-22 | Apple Inc. | Detecting a trigger of a digital assistant |
DK179560B1 (en) | 2017-05-16 | 2019-02-18 | Apple Inc. | FAR-FIELD EXTENSION FOR DIGITAL ASSISTANT SERVICES |
US10628484B2 (en) | 2017-05-17 | 2020-04-21 | Board Of Trustees Of The University Of Illinois | Vibrational devices as sound sensors |
US10531196B2 (en) | 2017-06-02 | 2020-01-07 | Apple Inc. | Spatially ducking audio produced through a beamforming loudspeaker array |
US10403299B2 (en) | 2017-06-02 | 2019-09-03 | Apple Inc. | Multi-channel speech signal enhancement for robust voice trigger detection and automatic speech recognition |
US10564928B2 (en) | 2017-06-02 | 2020-02-18 | Rovi Guides, Inc. | Systems and methods for generating a volume- based response for multiple voice-operated user devices |
US10522146B1 (en) | 2019-07-09 | 2019-12-31 | Instreamatic, Inc. | Systems and methods for recognizing and performing voice commands during advertisement |
US10395650B2 (en) | 2017-06-05 | 2019-08-27 | Google Llc | Recorded media hotword trigger suppression |
US10410635B2 (en) | 2017-06-09 | 2019-09-10 | Soundhound, Inc. | Dual mode speech recognition |
US10983753B2 (en) | 2017-06-09 | 2021-04-20 | International Business Machines Corporation | Cognitive and interactive sensor based smart home solution |
US10984329B2 (en) | 2017-06-14 | 2021-04-20 | Ademco Inc. | Voice activated virtual assistant with a fused response |
US10028069B1 (en) | 2017-06-22 | 2018-07-17 | Sonos, Inc. | Immersive audio in a media playback system |
US10950228B1 (en) | 2017-06-28 | 2021-03-16 | Amazon Technologies, Inc. | Interactive voice controlled entertainment |
US11189273B2 (en) | 2017-06-29 | 2021-11-30 | Amazon Technologies, Inc. | Hands free always on near field wakeword solution |
WO2019005227A1 (en) | 2017-06-30 | 2019-01-03 | Google Llc | METHODS, SYSTEMS AND MEDIA FOR VOICE CALL OPERATIONS |
US20190013019A1 (en) | 2017-07-10 | 2019-01-10 | Intel Corporation | Speaker command and key phrase management for muli -virtual assistant systems |
US10687353B2 (en) | 2017-07-10 | 2020-06-16 | Qualcomm Incorporated | Management of conflicting scheduling commands in wireless networks |
US10310082B2 (en) | 2017-07-27 | 2019-06-04 | Quantenna Communications, Inc. | Acoustic spatial diagnostics for smart home management |
US11205421B2 (en) | 2017-07-28 | 2021-12-21 | Cerence Operating Company | Selection system and method |
US10475449B2 (en) | 2017-08-07 | 2019-11-12 | Sonos, Inc. | Wake-word detection suppression |
US11798544B2 (en) | 2017-08-07 | 2023-10-24 | Polycom, Llc | Replying to a spoken command |
JP6513749B2 (ja) | 2017-08-09 | 2019-05-15 | レノボ・シンガポール・プライベート・リミテッド | 音声アシストシステム、サーバ装置、その音声アシスト方法、及びコンピュータが実行するためのプログラム |
KR102389041B1 (ko) | 2017-08-11 | 2022-04-21 | 엘지전자 주식회사 | 이동단말기 및 머신 러닝을 이용한 이동 단말기의 제어방법 |
US10304475B1 (en) | 2017-08-14 | 2019-05-28 | Amazon Technologies, Inc. | Trigger word based beam selection |
US11062710B2 (en) | 2017-08-28 | 2021-07-13 | Roku, Inc. | Local and cloud speech recognition |
US20190066710A1 (en) | 2017-08-28 | 2019-02-28 | Apple Inc. | Transparent near-end user control over far-end speech enhancement processing |
US10553235B2 (en) | 2017-08-28 | 2020-02-04 | Apple Inc. | Transparent near-end user control over far-end speech enhancement processing |
US11062702B2 (en) | 2017-08-28 | 2021-07-13 | Roku, Inc. | Media system with multiple digital assistants |
US10546583B2 (en) | 2017-08-30 | 2020-01-28 | Amazon Technologies, Inc. | Context-based device arbitration |
US10366699B1 (en) | 2017-08-31 | 2019-07-30 | Amazon Technologies, Inc. | Multi-path calculations for device energy levels |
US10911596B1 (en) | 2017-08-31 | 2021-02-02 | Amazon Technologies, Inc. | Voice user interface for wired communications system |
US10515625B1 (en) | 2017-08-31 | 2019-12-24 | Amazon Technologies, Inc. | Multi-modal natural language processing |
US10482895B2 (en) | 2017-09-01 | 2019-11-19 | Cirrus Logic, Inc. | Acoustic echo cancellation (AEC) rate adaptation |
US10847149B1 (en) | 2017-09-01 | 2020-11-24 | Amazon Technologies, Inc. | Speech-based attention span for voice user interface |
US10048930B1 (en) | 2017-09-08 | 2018-08-14 | Sonos, Inc. | Dynamic computation of system response volume |
JP6571144B2 (ja) | 2017-09-08 | 2019-09-04 | シャープ株式会社 | 監視システム、監視機器、サーバ、および監視方法 |
US20190082255A1 (en) | 2017-09-08 | 2019-03-14 | Olympus Corporation | Information acquiring apparatus, information acquiring method, and computer readable recording medium |
US10083006B1 (en) | 2017-09-12 | 2018-09-25 | Google Llc | Intercom-style communication using multiple computing devices |
KR102338376B1 (ko) | 2017-09-13 | 2021-12-13 | 삼성전자주식회사 | 디바이스 그룹을 지정하기 위한 전자 장치 및 이의 제어 방법 |
US11314215B2 (en) | 2017-09-15 | 2022-04-26 | Kohler Co. | Apparatus controlling bathroom appliance lighting based on user identity |
US9973849B1 (en) | 2017-09-20 | 2018-05-15 | Amazon Technologies, Inc. | Signal quality beam selection |
US10719507B2 (en) | 2017-09-21 | 2020-07-21 | SayMosaic Inc. | System and method for natural language processing |
US10580411B2 (en) | 2017-09-25 | 2020-03-03 | Cirrus Logic, Inc. | Talker change detection |
US10586534B1 (en) | 2017-09-27 | 2020-03-10 | Amazon Technologies, Inc. | Voice-controlled device control using acoustic echo cancellation statistics |
US10051366B1 (en) | 2017-09-28 | 2018-08-14 | Sonos, Inc. | Three-dimensional beam forming with a microphone array |
US10621981B2 (en) | 2017-09-28 | 2020-04-14 | Sonos, Inc. | Tone interference cancellation |
US11233782B2 (en) | 2017-10-04 | 2022-01-25 | Resilience Magnum IP, LLC | Single node network connectivity for structure automation functionality |
US10897680B2 (en) | 2017-10-04 | 2021-01-19 | Google Llc | Orientation-based device interface |
KR102421255B1 (ko) | 2017-10-17 | 2022-07-18 | 삼성전자주식회사 | 음성 신호를 제어하기 위한 전자 장치 및 방법 |
KR102543693B1 (ko) | 2017-10-17 | 2023-06-16 | 삼성전자주식회사 | 전자 장치 및 그의 동작 방법 |
US10403266B2 (en) | 2017-10-18 | 2019-09-03 | Intel Corporation | Detecting keywords in audio using a spiking neural network |
CN107808670B (zh) | 2017-10-25 | 2021-05-14 | 百度在线网络技术(北京)有限公司 | 语音数据处理方法、装置、设备及存储介质 |
JP2019086903A (ja) | 2017-11-02 | 2019-06-06 | 東芝映像ソリューション株式会社 | 音声対話端末、および音声対話端末制御方法 |
CN107832837B (zh) | 2017-11-28 | 2021-09-28 | 南京大学 | 一种基于压缩感知原理的卷积神经网络压缩方法及解压缩方法 |
US20190163153A1 (en) | 2017-11-30 | 2019-05-30 | International Business Machines Corporation | Enforcing dynamic volume thresholds of an entertainment device |
US10546593B2 (en) | 2017-12-04 | 2020-01-28 | Apple Inc. | Deep learning driven multi-channel filtering for speech enhancement |
US10445365B2 (en) | 2017-12-04 | 2019-10-15 | Amazon Technologies, Inc. | Streaming radio with personalized content integration |
US10777189B1 (en) | 2017-12-05 | 2020-09-15 | Amazon Technologies, Inc. | Dynamic wakeword detection |
US10510340B1 (en) | 2017-12-05 | 2019-12-17 | Amazon Technologies, Inc. | Dynamic wakeword detection |
EP3610480B1 (en) | 2017-12-06 | 2022-02-16 | Google LLC | Ducking and erasing audio signals from nearby devices |
US20190172452A1 (en) | 2017-12-06 | 2019-06-06 | GM Global Technology Operations LLC | External information rendering |
CN107919123B (zh) | 2017-12-07 | 2022-06-03 | 北京小米移动软件有限公司 | 多语音助手控制方法、装置及计算机可读存储介质 |
US11182122B2 (en) | 2017-12-08 | 2021-11-23 | Amazon Technologies, Inc. | Voice control of computing devices |
US20190179611A1 (en) | 2017-12-11 | 2019-06-13 | Sonos, Inc. | Systems and Methods of Receiving Voice Input |
US10051600B1 (en) | 2017-12-12 | 2018-08-14 | Amazon Technologies, Inc. | Selective notification delivery based on user presence detections |
US10425247B2 (en) | 2017-12-12 | 2019-09-24 | Rovi Guides, Inc. | Systems and methods for modifying playback of a media asset in response to a verbal command unrelated to playback of the media asset |
US10847137B1 (en) | 2017-12-12 | 2020-11-24 | Amazon Technologies, Inc. | Trigger word detection using neural network waveform processing |
US10374816B1 (en) | 2017-12-13 | 2019-08-06 | Amazon Technologies, Inc. | Network conference management and arbitration via voice-capturing devices |
US10540971B2 (en) | 2017-12-15 | 2020-01-21 | Blue Jeans Network, Inc. | System and methods for in-meeting group assistance using a virtual assistant |
US10663313B2 (en) | 2017-12-15 | 2020-05-26 | Google Llc | Providing traffic warnings to a user based on return journey |
US11409816B2 (en) | 2017-12-19 | 2022-08-09 | Motorola Solutions, Inc. | Methods and systems for determining an action to be taken in response to a user query as a function of pre-query context information |
DE112018002857T5 (de) | 2017-12-26 | 2020-02-27 | Robert Bosch Gmbh | Sprecheridentifikation mit ultrakurzen Sprachsegmenten für Fern- und Nahfeld-Sprachunterstützungsanwendungen |
US10504507B2 (en) | 2017-12-28 | 2019-12-10 | Syntiant | Always-on keyword detector |
US10614811B2 (en) | 2017-12-29 | 2020-04-07 | Intel Corporation | Hierarchical speech recognition resolution |
JP7044415B2 (ja) | 2017-12-31 | 2022-03-30 | 美的集団股▲フン▼有限公司 | ホームアシスタント装置を制御するための方法及びシステム |
CN111512365B (zh) | 2017-12-31 | 2023-06-13 | 美的集团股份有限公司 | 对多个家庭装置进行控制的方法和系统 |
US9972343B1 (en) | 2018-01-08 | 2018-05-15 | Republic Wireless, Inc. | Multi-step validation of wakeup phrase processing |
US10795332B2 (en) | 2018-01-16 | 2020-10-06 | Resilience Magnum IP, LLC | Facilitating automating home control |
CN108198548B (zh) | 2018-01-25 | 2020-11-20 | 苏州奇梦者网络科技有限公司 | 一种语音唤醒方法及其系统 |
US20190237067A1 (en) | 2018-01-31 | 2019-08-01 | Toyota Motor Engineering & Manufacturing North America, Inc. | Multi-channel voice recognition for a vehicle environment |
US10157042B1 (en) | 2018-02-06 | 2018-12-18 | Amazon Technologies, Inc. | Audio output control |
US11024307B2 (en) | 2018-02-08 | 2021-06-01 | Computime Ltd. | Method and apparatus to provide comprehensive smart assistant services |
US11145298B2 (en) | 2018-02-13 | 2021-10-12 | Roku, Inc. | Trigger word detection with multiple digital assistants |
US10425780B1 (en) | 2018-02-22 | 2019-09-24 | Amazon Technologies, Inc. | Outputting notifications using device groups |
US11127405B1 (en) | 2018-03-14 | 2021-09-21 | Amazon Technologies, Inc. | Selective requests for authentication for voice-based launching of applications |
US10749828B2 (en) | 2018-03-14 | 2020-08-18 | Rovi Guides, Inc. | Systems and methods for presenting event notifications, based on trending communications, on devices notwithstanding a user instruction to disable event notifications |
US10491962B2 (en) | 2018-03-14 | 2019-11-26 | Rovi Guides, Inc. | Systems and methods for presenting event notifications, based on active applications in a social group, on devices notwithstanding a user instruction to disable event notifications |
US10438605B1 (en) | 2018-03-19 | 2019-10-08 | Bose Corporation | Echo control in binaural adaptive noise cancellation systems in headsets |
US10685669B1 (en) | 2018-03-20 | 2020-06-16 | Amazon Technologies, Inc. | Device selection from audio data |
US10440440B1 (en) | 2018-03-23 | 2019-10-08 | Rovi Guides, Inc. | Systems and methods for prompting a user to view an important event in a media asset presented on a first device when the user is viewing another media asset presented on a second device |
US10777203B1 (en) | 2018-03-23 | 2020-09-15 | Amazon Technologies, Inc. | Speech interface device with caching component |
US10755706B2 (en) | 2018-03-26 | 2020-08-25 | Midea Group Co., Ltd. | Voice-based user interface with dynamically switchable endpoints |
US10446169B1 (en) | 2018-03-26 | 2019-10-15 | Motorola Mobility Llc | Pre-selectable and dynamic configurable multistage echo control system for large range level of acoustic echo |
US11151991B2 (en) | 2018-03-30 | 2021-10-19 | Verizon Media Inc. | Electronic message transmission |
US11217240B2 (en) | 2018-04-05 | 2022-01-04 | Synaptics Incorporated | Context-aware control for smart devices |
US20190311710A1 (en) | 2018-04-06 | 2019-10-10 | Flex Ltd. | Device and system for accessing multiple virtual assistant services |
US10679629B2 (en) | 2018-04-09 | 2020-06-09 | Amazon Technologies, Inc. | Device arbitration by multiple speech processing systems |
US10720166B2 (en) | 2018-04-09 | 2020-07-21 | Synaptics Incorporated | Voice biometrics systems and methods |
CN108520741B (zh) | 2018-04-12 | 2021-05-04 | 科大讯飞股份有限公司 | 一种耳语音恢复方法、装置、设备及可读存储介质 |
US10928917B2 (en) | 2018-04-12 | 2021-02-23 | International Business Machines Corporation | Multiple user interaction with audio devices using speech and gestures |
US10679615B2 (en) | 2018-04-16 | 2020-06-09 | Google Llc | Adaptive interface in a voice-based networked system |
CN108538305A (zh) | 2018-04-20 | 2018-09-14 | 百度在线网络技术(北京)有限公司 | 语音识别方法、装置、设备及计算机可读存储介质 |
EP3564949A1 (en) | 2018-04-23 | 2019-11-06 | Spotify AB | Activation trigger processing |
US10803864B2 (en) | 2018-05-07 | 2020-10-13 | Spotify Ab | Voice recognition system for use with a personal media streaming appliance |
US11308947B2 (en) | 2018-05-07 | 2022-04-19 | Spotify Ab | Voice recognition system for use with a personal media streaming appliance |
US11175880B2 (en) | 2018-05-10 | 2021-11-16 | Sonos, Inc. | Systems and methods for voice-assisted media content selection |
JP2019204025A (ja) | 2018-05-24 | 2019-11-28 | レノボ・シンガポール・プライベート・リミテッド | 電子機器、制御方法、及びプログラム |
US10959029B2 (en) | 2018-05-25 | 2021-03-23 | Sonos, Inc. | Determining and adapting to changes in microphone performance of playback devices |
US10777195B2 (en) | 2018-05-31 | 2020-09-15 | International Business Machines Corporation | Wake command nullification for digital assistance and voice recognition technologies |
US20190371324A1 (en) | 2018-06-01 | 2019-12-05 | Apple Inc. | Suppression of voice response by device rendering trigger audio |
EP3756087A4 (en) | 2018-06-05 | 2021-04-21 | Samsung Electronics Co., Ltd. | PASSIVE WAKE-UP PROCESSES AND SYSTEMS OF A USER INTERACTION DEVICE |
US10433058B1 (en) | 2018-06-14 | 2019-10-01 | Sonos, Inc. | Content rules engines for audio playback devices |
US10762896B1 (en) | 2018-06-25 | 2020-09-01 | Amazon Technologies, Inc. | Wakeword detection |
US10681460B2 (en) | 2018-06-28 | 2020-06-09 | Sonos, Inc. | Systems and methods for associating playback devices with voice assistant services |
NL2021308B1 (en) | 2018-07-16 | 2020-01-24 | Hazelebach & Van Der Ven Holding B V | Methods for a voice processing system |
JP7000268B2 (ja) | 2018-07-18 | 2022-01-19 | 株式会社東芝 | 情報処理装置、情報処理方法、およびプログラム |
US11144596B2 (en) | 2018-07-24 | 2021-10-12 | Harman International Industries, Incorporated | Retroactive information searching enabled by neural sensing |
GB2576016B (en) | 2018-08-01 | 2021-06-23 | Arm Ip Ltd | Voice assistant devices |
US10461710B1 (en) | 2018-08-28 | 2019-10-29 | Sonos, Inc. | Media playback system with maximum volume setting |
KR102225984B1 (ko) | 2018-09-03 | 2021-03-10 | 엘지전자 주식회사 | 음성 인식 서비스를 제공하는 서버 |
US10622009B1 (en) | 2018-09-10 | 2020-04-14 | Amazon Technologies, Inc. | Methods for detecting double-talk |
US20200090647A1 (en) | 2018-09-14 | 2020-03-19 | Comcast Cable Communications, Llc | Keyword Detection In The Presence Of Media Output |
US10878811B2 (en) | 2018-09-14 | 2020-12-29 | Sonos, Inc. | Networked devices, systems, and methods for intelligently deactivating wake-word engines |
US10650807B2 (en) | 2018-09-18 | 2020-05-12 | Intel Corporation | Method and system of neural network keyphrase detection |
KR20200034430A (ko) | 2018-09-21 | 2020-03-31 | 삼성전자주식회사 | 전자 장치, 시스템 및 음성 인식 서비스 이용 방법 |
US10861444B2 (en) | 2018-09-24 | 2020-12-08 | Rovi Guides, Inc. | Systems and methods for determining whether to trigger a voice capable device based on speaking cadence |
US10811015B2 (en) | 2018-09-25 | 2020-10-20 | Sonos, Inc. | Voice detection optimization based on selected voice assistant service |
US10950249B2 (en) | 2018-09-25 | 2021-03-16 | Amazon Technologies, Inc. | Audio watermark encoding/decoding |
US11170758B2 (en) | 2018-09-27 | 2021-11-09 | Rovi Guides, Inc. | Systems and methods for providing notifications within a media asset without breaking immersion |
US11100923B2 (en) | 2018-09-28 | 2021-08-24 | Sonos, Inc. | Systems and methods for selective wake word detection using neural network models |
KR102606789B1 (ko) | 2018-10-01 | 2023-11-28 | 삼성전자주식회사 | 복수의 음성 인식 장치들을 제어하는 방법 및 그 방법을 지원하는 전자 장치 |
US10971158B1 (en) | 2018-10-05 | 2021-04-06 | Facebook, Inc. | Designating assistants in multi-assistant environment based on identified wake word received from a user |
US20200110571A1 (en) | 2018-10-05 | 2020-04-09 | Sonos, Inc. | Systems and methods for media content selection |
US10346122B1 (en) | 2018-10-18 | 2019-07-09 | Brent Foster Morgan | Systems and methods for a supplemental display screen |
US11899519B2 (en) | 2018-10-23 | 2024-02-13 | Sonos, Inc. | Multiple stage network microphone device with reduced power consumption and processing load |
US10943599B2 (en) | 2018-10-26 | 2021-03-09 | Spotify Ab | Audio cancellation for voice recognition |
US10573312B1 (en) | 2018-12-04 | 2020-02-25 | Sorenson Ip Holdings, Llc | Transcription generation from multiple speech recognition systems |
US10388272B1 (en) | 2018-12-04 | 2019-08-20 | Sorenson Ip Holdings, Llc | Training speech recognition systems using word sequences |
US11183183B2 (en) | 2018-12-07 | 2021-11-23 | Sonos, Inc. | Systems and methods of operating media playback systems having multiple voice assistant services |
US11132989B2 (en) | 2018-12-13 | 2021-09-28 | Sonos, Inc. | Networked microphone devices, systems, and methods of localized arbitration |
US10602268B1 (en) | 2018-12-20 | 2020-03-24 | Sonos, Inc. | Optimization of network microphone devices using noise classification |
KR102570384B1 (ko) | 2018-12-27 | 2023-08-25 | 삼성전자주식회사 | 가전기기 및 이의 음성 인식 방법 |
US11198446B2 (en) | 2019-01-04 | 2021-12-14 | Faraday & Future Inc. | On-board vehicle query system |
JP2020112692A (ja) | 2019-01-11 | 2020-07-27 | パナソニック インテレクチュアル プロパティ コーポレーション オブ アメリカPanasonic Intellectual Property Corporation of America | 方法、制御装置、及びプログラム |
US10867604B2 (en) | 2019-02-08 | 2020-12-15 | Sonos, Inc. | Devices, systems, and methods for distributed voice processing |
US11315556B2 (en) | 2019-02-08 | 2022-04-26 | Sonos, Inc. | Devices, systems, and methods for distributed voice processing by transmitting sound data associated with a wake word to an appropriate device for identification |
CN109712626B (zh) | 2019-03-04 | 2021-04-30 | 腾讯科技(深圳)有限公司 | 一种语音数据处理方法及装置 |
US10943598B2 (en) | 2019-03-18 | 2021-03-09 | Rovi Guides, Inc. | Method and apparatus for determining periods of excessive noise for receiving smart speaker voice commands |
US10964314B2 (en) | 2019-03-22 | 2021-03-30 | Cirrus Logic, Inc. | System and method for optimized noise reduction in the presence of speech distortion using adaptive microphone array |
US10984783B2 (en) | 2019-03-27 | 2021-04-20 | Intel Corporation | Spoken keyword detection based utterance-level wake on intent system |
US20200310751A1 (en) | 2019-03-29 | 2020-10-01 | Qualcomm Incorporated | System and method of managing device sound level |
EP3726856B1 (en) | 2019-04-17 | 2022-11-16 | Oticon A/s | A hearing device comprising a keyword detector and an own voice detector |
US10586540B1 (en) | 2019-06-12 | 2020-03-10 | Sonos, Inc. | Network microphone device with command keyword conditioning |
US11361756B2 (en) | 2019-06-12 | 2022-06-14 | Sonos, Inc. | Conditional wake word eventing based on environment |
US11200894B2 (en) | 2019-06-12 | 2021-12-14 | Sonos, Inc. | Network microphone device with command keyword eventing |
US20200409926A1 (en) | 2019-06-28 | 2020-12-31 | Rovi Guides, Inc. | Automated contact creation based on content communications |
US11138969B2 (en) | 2019-07-31 | 2021-10-05 | Sonos, Inc. | Locally distributed keyword detection |
US10871943B1 (en) | 2019-07-31 | 2020-12-22 | Sonos, Inc. | Noise classification for event detection |
US11138975B2 (en) | 2019-07-31 | 2021-10-05 | Sonos, Inc. | Locally distributed keyword detection |
JP7191793B2 (ja) | 2019-08-30 | 2022-12-19 | 株式会社東芝 | 信号処理装置、信号処理方法、及びプログラム |
US11172329B2 (en) | 2019-09-27 | 2021-11-09 | Sonos, Inc. | Systems and methods for target device prediction |
US11189286B2 (en) | 2019-10-22 | 2021-11-30 | Sonos, Inc. | VAS toggle based on device orientation |
KR20210066647A (ko) | 2019-11-28 | 2021-06-07 | 삼성전자주식회사 | 전자 장치 및 이의 제어 방법 |
US11823659B2 (en) | 2019-12-11 | 2023-11-21 | Amazon Technologies, Inc. | Speech recognition through disambiguation feedback |
US11445301B2 (en) | 2020-02-12 | 2022-09-13 | Sonos, Inc. | Portable playback devices with network operation modes |
CN111341306B (zh) | 2020-02-14 | 2022-06-17 | 东南大学 | 基于语音特征复用的关键词唤醒cnn的存储和计算压缩方法 |
US11206052B1 (en) | 2020-06-18 | 2021-12-21 | HAJEN Co., Ltd | Smart speaker |
US20220050585A1 (en) | 2020-08-14 | 2022-02-17 | Apple Inc. | Audio media playback user interface |
-
2017
- 2017-08-07 US US15/670,361 patent/US10475449B2/en active Active
-
2018
- 2018-08-06 CN CN202310761290.0A patent/CN116954545A/zh active Pending
- 2018-08-06 KR KR1020207006519A patent/KR102315053B1/ko active IP Right Grant
- 2018-08-06 EP EP22153523.0A patent/EP4040285A1/en active Pending
- 2018-08-06 EP EP18760101.8A patent/EP3665562B1/en active Active
- 2018-08-06 JP JP2020506725A patent/JP6963673B2/ja active Active
- 2018-08-06 AU AU2018312989A patent/AU2018312989B2/en active Active
- 2018-08-06 WO PCT/US2018/045397 patent/WO2019032462A1/en unknown
- 2018-08-06 CN CN201880064916.XA patent/CN111194439B/zh active Active
- 2018-08-06 CA CA3140979A patent/CA3140979C/en active Active
- 2018-08-06 CA CA3072492A patent/CA3072492C/en active Active
-
2019
- 2019-11-11 US US16/679,538 patent/US11380322B2/en active Active
-
2022
- 2022-07-01 US US17/810,533 patent/US11900937B2/en active Active
-
2023
- 2023-06-13 AU AU2023203687A patent/AU2023203687A1/en active Pending
Patent Citations (1)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
US20170084277A1 (en) | 2014-10-09 | 2017-03-23 | Google Inc. | Hotword detection on multiple devices |
Also Published As
Publication number | Publication date |
---|---|
KR20200035118A (ko) | 2020-04-01 |
WO2019032462A1 (en) | 2019-02-14 |
CA3072492C (en) | 2023-01-24 |
EP3665562B1 (en) | 2022-06-15 |
US20190043492A1 (en) | 2019-02-07 |
US20230021785A1 (en) | 2023-01-26 |
EP4040285A1 (en) | 2022-08-10 |
JP2020530585A (ja) | 2020-10-22 |
US20200075010A1 (en) | 2020-03-05 |
AU2018312989A1 (en) | 2020-03-05 |
US11900937B2 (en) | 2024-02-13 |
US11380322B2 (en) | 2022-07-05 |
JP6963673B2 (ja) | 2021-11-10 |
CN111194439B (zh) | 2023-07-07 |
EP3665562A1 (en) | 2020-06-17 |
CA3140979C (en) | 2024-02-27 |
CN111194439A (zh) | 2020-05-22 |
AU2023203687A1 (en) | 2023-07-06 |
CN116954545A (zh) | 2023-10-27 |
US10475449B2 (en) | 2019-11-12 |
AU2018312989B2 (en) | 2023-06-15 |
CA3140979A1 (en) | 2019-02-14 |
CA3072492A1 (en) | 2019-02-14 |
Similar Documents
Publication | Publication Date | Title |
---|---|---|
KR102315053B1 (ko) | 활성 단어 검출 억제 | |
US11947870B2 (en) | Audio response playback | |
US11467800B2 (en) | Playback expansion | |
CN109690672B (zh) | 对语音输入进行上下文化 | |
JP2020005273A (ja) | 複数の音声サービス | |
US9965243B2 (en) | Playback expansion | |
EP3641346A1 (en) | Playback expansion | |
CN112585571A (zh) | 控制多站点媒体回放系统 |
Legal Events
Date | Code | Title | Description |
---|---|---|---|
A201 | Request for examination | ||
E701 | Decision to grant or registration of patent right | ||
GRNT | Written decision to grant |