CN103811007A - 显示装置、语音获取装置及其语音识别方法 - Google Patents
显示装置、语音获取装置及其语音识别方法 Download PDFInfo
- Publication number
- CN103811007A CN103811007A CN201310553280.4A CN201310553280A CN103811007A CN 103811007 A CN103811007 A CN 103811007A CN 201310553280 A CN201310553280 A CN 201310553280A CN 103811007 A CN103811007 A CN 103811007A
- Authority
- CN
- China
- Prior art keywords
- voice
- instruction word
- display device
- speech
- acquiring unit
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Images
Classifications
-
- G—PHYSICS
- G06—COMPUTING; CALCULATING OR COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F3/00—Input arrangements for transferring data to be processed into a form capable of being handled by the computer; Output arrangements for transferring data from processing unit to output unit, e.g. interface arrangements
- G06F3/16—Sound input; Sound output
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS OR SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/28—Constructional details of speech recognition systems
- G10L15/30—Distributed recognition, e.g. in client-server systems, for mobile phones or network applications
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS OR SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING; SPEECH OR AUDIO CODING OR DECODING
- G10L21/00—Processing of the speech or voice signal to produce another audible or non-audible signal, e.g. visual or tactile, in order to modify its quality or its intelligibility
- G10L21/06—Transformation of speech into a non-audible representation, e.g. speech visualisation or speech processing for tactile aids
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04L—TRANSMISSION OF DIGITAL INFORMATION, e.g. TELEGRAPHIC COMMUNICATION
- H04L12/00—Data switching networks
- H04L12/28—Data switching networks characterised by path configuration, e.g. LAN [Local Area Networks] or WAN [Wide Area Networks]
- H04L12/2803—Home automation networks
- H04L12/2816—Controlling appliance services of a home automation network by calling their functionalities
- H04L12/282—Controlling appliance services of a home automation network by calling their functionalities based on user interaction within the home
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N21/00—Selective content distribution, e.g. interactive television or video on demand [VOD]
- H04N21/40—Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
- H04N21/41—Structure of client; Structure of client peripherals
- H04N21/4104—Peripherals receiving signals from specially adapted client devices
- H04N21/4126—The peripheral being portable, e.g. PDAs or mobile phones
- H04N21/41265—The peripheral being portable, e.g. PDAs or mobile phones having a remote control device for bidirectional communication between the remote control device and client device
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N21/00—Selective content distribution, e.g. interactive television or video on demand [VOD]
- H04N21/40—Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
- H04N21/41—Structure of client; Structure of client peripherals
- H04N21/4104—Peripherals receiving signals from specially adapted client devices
- H04N21/4131—Peripherals receiving signals from specially adapted client devices home appliance, e.g. lighting, air conditioning system, metering devices
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N21/00—Selective content distribution, e.g. interactive television or video on demand [VOD]
- H04N21/40—Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
- H04N21/41—Structure of client; Structure of client peripherals
- H04N21/422—Input-only peripherals, i.e. input devices connected to specially adapted client devices, e.g. global positioning system [GPS]
- H04N21/42203—Input-only peripherals, i.e. input devices connected to specially adapted client devices, e.g. global positioning system [GPS] sound input device, e.g. microphone
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N21/00—Selective content distribution, e.g. interactive television or video on demand [VOD]
- H04N21/40—Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
- H04N21/43—Processing of content or additional data, e.g. demultiplexing additional data from a digital video stream; Elementary client operations, e.g. monitoring of home network or synchronising decoder's clock; Client middleware
- H04N21/436—Interfacing a local distribution network, e.g. communicating with another STB or one or more peripheral devices inside the home
- H04N21/43615—Interfacing a Home Network, e.g. for connecting the client to a plurality of peripherals
-
- H—ELECTRICITY
- H04—ELECTRIC COMMUNICATION TECHNIQUE
- H04N—PICTORIAL COMMUNICATION, e.g. TELEVISION
- H04N21/00—Selective content distribution, e.g. interactive television or video on demand [VOD]
- H04N21/40—Client devices specifically adapted for the reception of or interaction with content, e.g. set-top-box [STB]; Operations thereof
- H04N21/47—End-user applications
- H04N21/485—End-user interface for client configuration
-
- G—PHYSICS
- G10—MUSICAL INSTRUMENTS; ACOUSTICS
- G10L—SPEECH ANALYSIS OR SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING; SPEECH OR AUDIO CODING OR DECODING
- G10L15/00—Speech recognition
- G10L15/22—Procedures used during a speech recognition process, e.g. man-machine dialogue
- G10L2015/221—Announcement of recognition results
Abstract
公开了显示装置、语音获取装置及其语音识别方法,所述显示装置包括:显示图像的显示单元;与多个外部装置通信的通信单元;以及控制器,其包括识别用户语音的语音识别引擎,从语音获取单元接收语音信号,并且控制所述通信单元从所述多个外部装置中的至少一个接收候选指令字以识别接收到的语音信号。
Description
技术领域
与示例性实施例一致的装置及方法涉及显示装置、语音获取装置及其语音识别方法,更具体地,涉及识别用户语音的显示装置、语音获取装置及其语音识别方法。
背景技术
语音识别功能被用在比如数字电视(TV)、空调、家庭影院、个人计算机(PC)以及移动电话等等的各种电子装置中。
为了执行语音识别功能,比如TV的主装置应该具有接收用户语音的麦克风和识别输入语音的语音识别引擎,并且语音识别引擎可以将输入语音与存储的候选指令字(instruction words)进行比较,并根据比较结果识别语音。
然而,具有语音识别功能的相关技术电子装置具有接收用户语音的固定装置,因此难以利用输入语音的各种输入装置,比如移动电话。此外,如果提供了许多候选指令字,则将提高识别率,但是电子装置将要比较候选指令字,这导致语音识别处理速度较慢。此外,因为主装置的存储容量有限,所以不能不断地增加候选指令字的数量。
发明内容
根据示例性实施例的方面,提供一种显示装置,其包括:显示单元,其在其上显示图像;通信单元,其与多个外部装置通信;以及控制器,其包括识别用户语音的语音识别引擎,从语音获取单元接收语音信号,并且控制所述通信单元从所述多个外部装置中的至少一个接收候选指令字以识别接收到的语音信号。
可以提供多个语音获取单元。如果对所述多个语音获取单元中的至少一个检测到语音输入,则所述控制器从对其检测到语音输入的语音获取单元接收语音信号。
所述语音获取单元可以包括下列各项中的至少一个:在所述显示装置中提供的内置麦克风、在多个外部装置中的至少一个中提供的第一外部麦克风、以及与内置麦克风和第一外部麦克风不同的第二外部麦克风。
所述外部装置可以包括可以管理候选指令字的至少一个应用。
所述显示装置还可以包括管理候选指令字的原生应用(nativeapplication)。
所述显示装置还可以包括存储单元,其在其中存储所接收到的候选指令字,并且所述语音识别引擎可以通过使用存储的候选指令字识别接收到的语音。
如果多个语音获取单元中的至少一个检测到唤醒关键字,则所述控制器可以启用检测到唤醒关键字的语音获取单元,并且从所启用的语音获取单元接收语音信号。
如果通过操纵在多个语音获取单元中的一个中提供的预定按钮输入了触发信号,则所述控制器可以启用通过其输入了触发信号的语音获取单元,并且从所启用的语音获取单元接收语音信号。
所述控制器可以控制所述显示单元在其上显示对于所述语音信号的语音识别结果以及与语音识别结果相对应的候选指令字。
所述显示单元可以在其上显示关于管理候选指令字的应用的信息。
所述语音识别引擎可以通过在接收到的候选指令字当中决定与接收到的语音信号相同或者相似的指令字来识别语音。
根据另一个示例性实施例的方面,提供一种语音获取装置,其包括:通信单元,其与具有语音识别功能的显示装置通信;语音获取单元,其接收用户语音;语音转换器,其将接收到的语音转换成电语音信号;以及控制器,其控制所述通信单元向所述显示装置发送所转换的语音信号以及候选指令字以识别所述语音信号。
所述语音获取装置还可以包括可以管理候选指令字的至少一个应用。
根据另一个示例性实施例的方面,提供一种显示装置的语音识别方法,其包括:从语音获取单元接收语音信号;从多个外部装置中的至少一个接收候选指令字以识别所接收到的语音信号;以及根据所接收到的语音信号以及候选指令字识别用户的语音。
所述语音识别方法还可以包括:检测输入到多个语音获取单元中的至少一个的语音,并且接收语音信号可以包括:从对其检测到语音输入的语音获取单元接收语音信号。
所述语音获取单元可以包括下列各项中的至少一个:在所述显示装置中提供的内置麦克风、在多个外部装置中的至少一个中提供的第一外部麦克风、以及在与所述显示装置和所述多个外部装置不同的装置中提供的第二外部麦克风。
所述外部装置可以包括管理候选指令字的至少一个应用。
所述显示装置还可以包括管理候选指令字的原生应用。
所述语音识别方法还可以包括存储所接收到的候选指令字,并且识别语音可以包括通过使用存储的候选指令字识别语音。
检测语音输入可以包括:检测输入到多个语音获取单元中的一个的唤醒关键字,以及启用检测到所述唤醒关键字的语音获取单元。
检测语音输入可以包括:根据在多个语音获取单元中的一个中提供的预定按钮的操纵检测触发信号的输入,以及启用通过其输入了所述触发信号的语音获取单元。
所述语音识别方法还可以包括:显示对于所述语音信号的语音识别结果以及与语音识别结果相对应的候选指令字。
所述显示可以包括:显示关于管理候选指令字的应用的信息。
识别语音可以包括:通过在接收到的候选指令字当中决定与接收到的语音信号相同或者相似的指令字来识别语音。
附图说明
从以下参照附图对示例性实施例的描述,以上和/或其它方面将变得清楚和更加容易理解,附图中:
图1图示了根据示例性实施例的语音识别系统的示例;
图2是根据示例性实施例的语音识别系统的框图;
图3图示了根据示例性实施例的语音识别执行的示例;
图4图示了作为图3中语音识别的结果显示的屏幕的示例;
图5图示了根据另一个示例性实施例的语音识别执行的示例;
图6是示出根据示例性实施例的语音识别系统的语音识别方法的流程图;
图7是示出图6中检测语音输入的过程的细节的流程图;以及
图8是示出图6中执行语音识别的过程的细节的流程图。
具体实施方式
下面,将参照附图详细描述示例性实施例。示例性实施例可以以各种形式来具体实现,而不局限于这里阐明的示例性实施例。为了清楚起见,省略了对公知部件的描述,并且相同的参考标记始终指代相同的元件。
图1图示了根据示例性实施例的语音识别系统的示例。
如图1中所示,语音识别系统包括主装置100、多个语音获取装置201和202、以及多个外部装置301、302和303。主装置100、多个语音获取装置201和202、以及多个外部装置301、302和303相互连接以相互通信。
主装置100包括用于接收用户语音的比如麦克风的语音获取单元140、以及用于识别输入语音并通过通信单元160与多个语音获取装置201和202以及多个外部装置301、302和303通信的语音识别引擎181。主装置100还包括被驱动以使主装置100执行各种功能(服务)的原生(native)应用171和172。原生应用171和172预先在其中存储与所述功能相对应的候选指令字。即,原生应用171和172被包括在可用的服务情景(available service scenario)中。存储在原生应用171和172中的候选指令字在语音识别时被发送到语音识别引擎181以使语音识别引擎181能够执行语音识别。
多个语音获取装置201和202中的每一个可以包括用于接收用户语音的比如麦克风的语音获取单元,并且与接收到的语音相对应的语音信号被发送到主装置100以用于语音识别。
多个语音获取装置201和202可以接收用户的语音,将所述语音转换为电语音信号,并且将所述电语音信号发送到主装置100。多个语音获取装置201和202可以执行与主装置100的无线通信。虽然无线通信包括无线LAN、射频(RF)通信、蓝牙、紫蜂、红外线(IR)通信等等,但是不局限于此。
多个外部装置301、302和303可以根据需要包括用于执行功能(服务)的至少一个开发应用(dev.Application)。开发应用预先在其中存储与由外部装置301、302和303执行的功能相对应的候选指令字。存储在开发应用中的候选指令字命令在语音识别时被发送到语音识别引擎181以使语音识别引擎181能够执行语音识别。
在原生应用171和172中以及在开发应用中预先存储的候选指令字可以是与应用的功能/操作相关的指令字。例如,如果主装置100是TV,则与TV的频道改变、音量调整等等相关的候选指令字可以被存储在原生应用171和172中的一个中。如果外部装置302是空调,则与空调的温度调整(升高/降低)、风的强度调整(强/弱/中等)等等相关的候选指令字可以被存储在外部装置302中所包括的应用中。
外部装置或者语音获取装置可以包括语音获取单元和开发应用两者。在这种情况下,如果语音被输入到第一外部装置301中的语音获取单元,则预先存储在第一外部装置301的开发应用中的候选指令字被发送到主装置100的语音识别引擎181以执行语音识别。
根据示例性实施例的语音识别系统包括至少一个语音获取单元。如果检测到输入到该语音获取单元的语音,则语音识别系统通过启用对其已经检测到语音输入的语音获取单元来接收语音流。如果提供了多个语音获取单元,则语音识别系统可以通过启用所述多个语音获取单元当中的对其已经检测到语音输入的语音获取单元来接收语音流。多个语音获取单元可以包括在主装置100中提供的内置麦克风、在多个外部装置301、302和303中的至少一个中提供的第一外部麦克风、以及在与主装置100及多个外部装置301、302和303不同的语音获取装置201和202中提供的第二外部麦克风。语音获取装置201和202与主装置100及多个外部装置301、302和303分离。
如果所述多个语音获取单元中的至少一个检测到唤醒关键字,则主装置100可以启用通过其检测到该唤醒关键字的语音获取单元,并且从所启用的语音获取单元接收语音信号。如果在所述多个语音获取单元中的至少一个中通过操纵预定按钮(例如,事件发生)输入了触发信号,则主装置100可以启用通过其输入了该输入触发信号的语音获取单元并且从所启用的语音获取单元接收语音信号。
主装置100可以以语音识别模式操作。如果通过唤醒关键字或者触发信号启用了至少一个语音获取单元,则主装置100可以禁用其它语音获取单元以防止出现语音识别错误。主装置100可以以远程或者进程语音识别模式(distant or adjacent voice recognition mode)操作。为了用户便利,主装置100可以显示示出连接到显示单元130(稍后将描述)的语音获取单元的用户接口(UI)。
主装置100可以从多个外部装置301、302和303中的至少一个接收候选指令字以识别接收到的语音信号。接收到的候选指令字可以被发送到语音识别引擎181以用于语音识别。
多个外部装置301、302和303包括管理候选指令字的至少一个应用。主装置100包括管理候选指令字的原生应用171和172。由原生应用171和172管理的候选指令字可以被发送到语音识别引擎181以用于语音识别。
主装置100可以被实现为如图2中的显示装置,比如电视(TV)。
图2是根据示例性实施例的语音识别系统的框图。
显示装置100处理来自外部图像供应源(未示出)的图像信号以基于经处理的图像信号显示图像。
在根据示例性实施例的语音识别系统中,显示装置100被实现为基于从广播站发射的广播信号/广播信息/广播数据来处理广播图像的TV或者机顶盒。然而,可以理解在一个或多个其它示例性实施例中,除了TV或者机顶盒之外,显示装置100可以适用于处理及显示图像的各种其它设备。例如,显示装置100可以包括个人计算机(PC)、便携式计算机等等。
此外,可以理解,可由显示装置100显示的图像的类型不局限于广播图像。例如,显示装置100可以基于由各种图像供应源(未示出)发送的信号/数据来显示例如,视频、静止图像、应用、屏上显示(OSD)、用于控制各种操作的图形用户接口(GUI)。
根据示例性实施例,显示装置100可以被实现为智能TV。智能TV可以实时接收并且显示广播信号,具有实时显示广播信号并通过互联网搜索各种内容的网络浏览器功能,并且提供用于做上述事项的便利的用户环境。智能TV可以包括给用户提供交互服务的开放的软件平台,并且可以通过该开放的软件平台给用户提供各种内容,例如,提供预定服务的应用。所述应用可以提供各种类型的服务,例如,SNS、金融、新闻、天气、地图、音乐、电影、游戏、电子书等等。
显示装置100包括用于识别用户语音的语音识别引擎181。与识别出的语音相对应的命令(例如控制命令)被发送到相应应用以执行操作。如果与控制命令相对应的应用是原生应用171和172中的一个,则显示装置100根据控制命令通过该应用来执行操作。如果与控制命令相对应的应用是开发应用,则控制命令被发送到包括开发应用的外部装置301、302和303。外部装置301、302和303可以根据控制命令通过该应用来执行操作。
参照图2,提供了多个语音获取装置,例如移动电话200及遥控器300。遥控器300可以充当语音获取装置和外部装置两者。移动电话200可以是具有语音获取功能的智能电话。
遥控器300可以通过用户操纵将预设命令(控制命令)发送给相应装置。遥控器300可以被设置为将命令发送给显示装置100或者外部装置,并且可以被实现为将命令发送给多个装置的综合遥控器(integrated remotecontroller)。遥控器300可以包括TV遥控器和/或空调遥控器。
语音获取装置可以被实现为接收用户语音的各种装置,例如,移动手机、麦克风发射器等等。
如图中所示2,提供了多个外部装置,例如遥控器300及空调400。如上所述,遥控器300可以充当语音获取装置和外部装置两者。
虽然图2图示了作为遥控器300和空调400的外部装置,但是示例性实施例不局限于此。例如,外部装置可以被实现为执行无线通信的其它各种电子设备,例如,被实现为家庭影院、无线电设备、VCR、DVD、洗衣机、电冰箱、机器人真空吸尘器等等。如果所述外部装置包括比如麦克风的语音获取单元,则外部装置也可以用作语音获取装置。
根据示例性实施例的外部装置包括分别执行功能的应用372和472。应用372和472预先存储候选指令字,并且管理所述候选指令字。所述候选指令字可以被发送到显示装置100以用于语音识别。
外部装置即遥控器300和空调400可以根据语音识别的结果执行与由显示装置100发送的控制命令相对应的操作。
下文中,参照图2,将详细描述语音识别系统的各个元件。
显示装置100可以包括:接收图像信号的图像接收器110;图像处理器120,其处理从图像接收器110接收到的图像信号;显示单元130,其基于由图像处理器120处理的图像信号显示图像;接收用户语音的第一语音获取单元140;第一语音转换器150,其将接收到的语音转换成电语音信号;与外部装置通信的第一通信单元160;存储各种数据的第一存储单元170;以及控制显示装置100的第一控制器180。
图像接收器110接收图像信号并将所述图像信号发送到图像处理器120。例如,图像接收器110可以从广播站(未示出)以无线的方式接收射频(RF)信号,或者根据比如合成视频、分量视频、超级视频、SCART(无线电与电视接收器制造商协会)、高清晰度多媒体接口(HDMI)等等的标准以有线的方式接收图像信号。如果所述图像信号包括广播信号,则图像接收器110包括通过信道调谐广播信号的调谐器。
可以从外部装置接收图像信号,所述外部装置例如,PC、AV设备、智能电话、智能平板等等。图像信号可以是通过比如互联网的网络发送的数据。在这种情况下,显示装置100可以通过第一通信单元160执行网络通信,并且可以包括附加的网络通信单元。可替换地,图像信号可以是被存储在第一存储单元170(例如,快闪存储器、硬盘驱动器(HDD)等等)中的数据。第一存储单元170可以在显示装置100的内部/外部提供。如果第一存储单元170在显示装置100的外部提供,则显示装置100可以包括第一存储单元170连接到其的连接器(未示出)。
图像处理器120对于所述图像信号执行各种图像处理操作,并且将经处理的图像信号输出到显示单元130。
图像处理器120的图像处理操作可以包括与各种图像格式相对应的解码操作、去隔行操作、帧刷新速率转换、缩放操作、用于提高图像质量的降噪操作、细节增强操作、行扫描操作等等,但是不局限于此。图像处理器120可以被实现为独立执行上述操作的单独的组,或者被实现为执行综合功能的片上系统(SoC)。
显示单元130基于由图像处理器120处理的图像信号来显示图像。显示单元130可以包括液晶显示器(LCD)、等离子体显示面板(PDP)、发光二极管(LED)、有机发光二极管(OLED)、表面传导电子发射器、碳纳米管、纳米晶体等等,但是不局限于此。
显示单元130可以根据其实施类型包括附加的元件。例如,作为LCD类型的显示单元130包括LCD面板(未示出)、将光发射到LCD面板的背光单元(未示出)以及驱动LCD面板的面板驱动基板(未示出)。
显示单元130可以显示语音识别结果作为关于识别出的语音的信息。语音识别结果可以以比如文本、图形、图标等等的各种形式来显示。文本包括字符和数字。显示单元130还可以根据语音识别结果及应用信息来显示候选指令字。稍后将参照图4更详细地对此进行描述。
用户可以基于在显示单元130上显示的语音识别结果检查是否已经正确识别出语音。用户可以操纵遥控器300中的用户输入单元330以从所显示的候选指令字选择与用户语音相对应的指令字,或者可以选择及检查与语音识别结果相关的信息。
第一语音获取单元140接收用户的语音,并且可以被实现为麦克风。
第一语音转换器150将由第一语音获取单元140输入的语音转换成电语音信号。经转换的语音信号可以采用脉冲编码调制(PCM)或者压缩的音频波形。第一语音转换器150可以被实现为将用户的语音转换成数字形式的A/D转换器。
如果第一语音获取单元140是数字麦克风,则它不需要附加的A/D转换。在这种情况下,第一语音获取单元140可以包括第一语音转换器150。
第一通信单元160与语音获取装置及外部装置通信,即,与移动电话200、遥控器300以及空调400通信。第一通信单元160可以执行包括红外通信、RF、紫蜂以及蓝牙中的至少一个的无线通信。
第一存储单元170通过第一控制器180的控制来存储数据。第一存储单元170被实现为非易失性存储介质,比如快闪存储器、硬盘驱动器(HDD)等等。第一存储单元170被读取/写入/更改/删除/更新数据的第一控制器180访问。
存储在第一存储单元170中的数据包括例如用于驱动显示装置100的操作系统(OS)、在OS上运行的各种应用、图像数据以及附加的数据等等。
第一存储单元170可以存储用于识别用户语音的各种数据。例如,第一存储单元170可以存储包括候选指令字的指令字表格171(下文中,也被称为候选指令字组),作为与接收到的语音信号相对应的识别出的语音信息。在指令字表格171中,候选指令字可以由相应应用来管理。
第一存储单元170还可以存储至少一个应用,例如第一应用172和第二应用173以执行显示装置100的功能。第一应用172和第二应用173通过第一控制器180(稍后将描述)的控制来驱动,并且执行显示装置100的各种功能。虽然图2图示了其中安装了两个应用172和173的显示装置100,但是示例性实施例不局限于此。即,可以在显示装置100中安装三个或更多个应用。
第一应用172和第二应用173可以管理与所执行的功能相对应的候选指令字。由第一应用172和第二应用173管理的候选指令字可以被注册到指令字表格171/从指令字表格171被删除。
如果候选指令字被注册到指令字表格171,则语音识别引擎181通过使用指令字表格171中的候选指令字来执行语音识别。
可以被注册到指令字表格171/从指令字表格171被删除的候选指令字可以包括由遥控器300(稍后将描述)的第三应用372管理的候选指令字以及由空调400的第四应用472管理的候选指令字。
第一控制器180控制显示装置100的各种元件。例如,第一控制器180控制图像处理器120处理图像信号,并且响应于来自遥控器300的命令执行控制操作以控制显示装置100的总体操作。
例如,第一控制器180可以被实现为与软件结合的中央处理单元(CPU)。
第一控制器180可以包括识别用户语音的语音识别引擎181。语音识别引擎181的语音识别功能可以通过使用已知的语音识别算法来执行。例如,语音识别引擎181提取所述语音信号的语音特征矢量,并且将所提取的语音特征矢量与存储在第一存储单元170的指令字表格171中的候选指令字进行比较以识别语音。如果没有与所述语音特征矢量相同的存储在指令字表格171中的候选指令字,则语音识别引擎181可以通过利用最相似的指令字调整语音识别结果来识别所述语音。如果存在多个相似的候选指令字,则第一控制器180可以在显示单元130上显示多个候选指令字,以供用户选择所述多个候选指令字中的一个。
根据示例性实施例的语音识别引擎181被实现为在CPU中提供的嵌入式语音识别引擎181,然而不限于此。例如,语音识别引擎181可以实现为与CPU分离地提供在显示装置100中的装置,即,被实现为比如微型计算机的附加芯片。
然而不限于此,示例性实施例包括在与显示装置100分离的服务器(下文中,将被称为云服务器(未示出))中提供的语音识别引擎181。云服务器通过比如互联网的网络与显示装置100通信。所述网络可以是有线网络或者无线网络。在这种情况下,语音识别引擎181可以被实现为在云服务器的CPU中提供的嵌入式语音识别引擎,或者被实现为与该CPU分离地提供在云服务器中的装置,即,比如微型计算机的附加芯片。
第一控制器180可以执行与语音识别引擎181的语音识别结果相对应的操作。例如,如果显示装置100是TV并且用户正在观看电影或者新闻,则语音识别引擎181可以识别比如“音量上升”、“音量下降”、“更大声”、“更小声”等等的语音,并且第一控制器180可以根据所述语音调整所述电影或者新闻的音量。
如果语音识别引擎181识别用于控制比如遥控器300或者空调400的外部装置的语音,则第一控制器180可以控制第一通信单元160将控制命令发送给与识别出的语音相对应的外部装置。例如,如果语音识别引擎181识别出“升高温度”的语音,则第一控制器180可以识别出该语音是用于控制空调400的,并且控制第一通信单元160将命令发送到空调400以升高空调400的温度。
下文中,将描述移动电话200的详细配置。
如图2中所示,移动电话200可以包括接收用户语音的第二语音获取单元240、将接收到的语音转换成电语音信号的第二语音转换器250、与外部通信的第二通信单元260、存储数据的第二存储单元270以及控制移动电话200的第二控制器280。
接收用户语音的第二语音获取单元240可以被实现为麦克风。第二语音转换器250将接收到的语音转换成电语音信号。经转换的语音信号可以采用脉冲编码调制(PCM)或者压缩的音频波形。第二语音转换器250可以被实现为将用户的输入语音转换成数字形式的A/D转换器。
如果第二语音获取单元240是数字麦克风,则它不需要附加的A/D转换。在这种情况下,第二语音获取单元240可以包括第二语音转换器250。
与显示装置100通信的第二通信单元260可以执行有线通信或者无线通信。所述无线通信可以包括RF、紫蜂以及蓝牙中的至少一个。
第二通信单元260可以将语音信号从第二语音转换器250发送到显示装置100。
第二存储单元270可以通过第二控制器280的控制来存储数据。第二存储单元270被实现为比如快闪存储器的非易失性存储介质。第二存储单元270被读取/写入/更改/删除/更新数据的第二控制器280访问。
存储在第二存储单元270中的数据可以包括例如用于驱动移动电话200的OS、在OS上运行的各种应用、图像数据以及附加的数据等等。
第二控制器280可以控制移动电话200的各种元件。例如,第二控制器280可以响应于用户操纵来生成命令,执行与生成的命令相对应的操作,并且在显示单元(未示出)上显示结果。
第二控制器280可以被实现为与软件结合的微控制器单元(MCU)。
如果通过第二语音获取单元240输入了用户语音,则第二控制器280控制第二语音转换器250将用户的语音转换成电语音信号并且控制第二通信单元260将经转换的语音信号发送到显示装置100。
下文中,将描述遥控器300的详细配置。
如图2中所示,作为语音获取装置以及外部装置的遥控器300可以包括:接收用户操纵的用户输入单元330;接收用户语音的第三语音获取单元340;第三语音转换器350,其将接收到的语音转换成电语音信号;与外部通信的第三通信单元360;存储数据的第三存储单元370;以及控制遥控器300的第三控制器380。
用户输入单元330可以通过用户的操纵和输入将各种控制命令或者信息发送到第三控制器380。用户输入单元330可以被实现为在遥控器300中提供的菜单键、数字键等等。如果遥控器300是TV遥控器,则用户输入单元330可以包括接收用户的触碰输入的触碰传感器(touch sensor)、和/或感测遥控器300的动作的动作传感器。
接收用户语音的第三语音获取单元340可以被实现为麦克风。
第三语音转换器350将由第三语音获取单元340输入的语音转换成电语音信号。经转换的语音信号可以采用脉冲编码调制(PCM)或者压缩的音频波形。第三语音转换器350可以被实现为将用户的输入语音转换成数字形式的A/D转换器。
如果第三语音获取单元340是数字麦克风,则它不需要附加的A/D转换。在这种情况下,第三语音获取单元340可以包括第三语音转换器350。
第三通信单元360与显示装置100通信。第三通信单元360执行无线通信。所述无线通信包括RF、紫蜂以及蓝牙中的至少一个。
第三通信单元360向显示装置100发送来自第三语音转换器350的语音信号以及由第三存储单元370(稍后将描述)的第三应用372管理的候选指令字。
通过第三控制器380的控制来存储数据的第三存储单元370可以被实现为比如快闪存储器等等的非易失性存储介质。第三存储单元370被读取/写入/更改/删除/更新数据的第三控制器380访问。
存储在第三存储单元370中的数据包括例如用于驱动遥控器300的OS、在OS上运行的各种应用、图像数据以及附加的数据等等。
第三存储单元370还可以存储至少一个应用,例如,用于执行遥控器300的功能的第三应用372。第三应用372通过第三控制器380(稍后将描述)的控制来驱动,并且执行遥控器300的各种功能。这里,第三应用372和第四应用472(稍后将描述)将被称为开发应用,以便与显示装置100的原生应用172和173区分开。
虽然图2图示了其中安装了一个应用372的遥控器300,但是示例性实施例不局限于此。即,可以在遥控器300中安装两个或更多个应用。
第三应用372可以管理与执行的功能相对应的候选指令字。由第三应用372管理的候选指令字可以被注册在显示装置100的指令字表格171中/从显示装置100的指令字表格171中删除。
第三控制器380可以控制遥控器300的各种元件。例如,第三控制器380可以响应于用户输入单元330的用户操纵生成命令,并且控制第三通信单元360将生成的命令发送给显示装置100。
第三控制器380可以被实现为与软件结合的MCU。
如果通过第三语音获取单元340输入了用户语音,则第三控制器380控制第三语音转换器350将用户的语音转换成电语音信号并且控制第三通信单元360将经转换的语音信号发送到显示装置100。
当与显示装置100通信时,第三控制器380可以向显示装置100发送由第三存储单元370的第三应用372管理的候选指令字。发送的候选指令字被注册在显示装置100的指令字表格171中并且被语音识别引擎181用来识别语音。
如果作为语音识别的结果,由显示装置100发送控制命令,则第三控制器380可以通过第三通信单元360接收所述控制命令并且执行与接收到的控制命令相对应的操作。
下文中,将描述空调400的详细配置。
如图2中所示,作为外部装置的空调400可以包括与外部通信的第四通信单元460、存储数据的第四存储单元470、以及控制空调400的第四控制器480。
与显示装置100通信的第四通信单元460可以执行包括RF、紫蜂以及蓝牙中的至少一个的无线通信。
第四通信单元460向显示装置100发送由第四存储单元470(稍后将描述)的第四应用472管理的候选指令字。
通过第四控制器480的控制存储数据的第四存储单元470可以被实现为比如快闪存储器的非易失性存储介质。第四存储单元470被读取/写入/更改/删除/更新数据的第四控制器480访问。
存储在第四存储单元470中的数据包括例如用于驱动空调400的OS、在OS上运行的各种应用、图像数据以及附加的数据等等。
第四存储单元470还可以存储至少一个应用(开发应用),例如,用于执行空调400的功能的第四应用472。第四应用472通过第四控制器480(稍后将描述)的控制来驱动,并且执行空调400的各种功能。
虽然图2图示了其中安装了一个应用472的空调400,但是示例性实施例不局限于此。即,可以在空调400中安装两个或更多个应用。
第四应用372可以管理与执行的功能相对应的候选指令字。由第四应用472管理的候选指令字可以被注册在显示装置100的指令字表格171中/从显示装置100的指令字表格171中删除。
第四控制器480控制空调400的各种元件。例如,第四控制器480可以响应于空调400的遥控器的用户操纵来接收控制命令,并且根据生成的控制命令执行控制操作,例如,调整温度。
第四控制器480可以被实现为与软件结合的MCU。
当与显示装置100通信时,第四控制器480可以向显示装置100发送由第四存储单元470的第四应用472管理的候选指令字。发送的候选指令字被注册在显示装置100的指令字表格171中并且被语音识别引擎181用来识别语音。
如果作为语音识别的结果,由显示装置100发送控制命令,则第四控制器480可以通过第四通信单元460接收所述控制命令并且执行与接收到的控制命令相对应的操作。
如果对多个语音获取单元140、240和340中的至少一个检测到语音输入,则作为根据示例性实施例的语音识别系统的主装置的显示装置100的第一控制器180控制第一通信单元140从对其已经检测到语音输入的语音获取单元接收语音信号。第一控制器180通过第一通信单元140从多个外部装置300和400的开发应用372和472中的至少一个或者从显示装置100的原生应用172和173接收候选指令字以识别接收到的语音信号,并将发送的候选指令字注册在第一存储单元170的指令字表格171中。语音识别引擎181将注册在指令字表格171中的候选指令字与所述语音信号进行比较并且识别所述语音。
显示装置100可以检测通过输入用户语音的各种装置输入的语音。显示装置100可以使用由应用提供的候选指令字来识别语音,并且可以动态地注册/删除用于语音识别的候选指令字。因此,可以防止不必要地增加显示装置100的候选指令字。
显示装置100可以从语音获取单元140接收语音识别,从原生应用172和173中的至少一个或者从开发应用372和472接收候选指令字,并且利用语音识别引擎181来执行语音识别。
下文中,将参照图3和图4更详细地描述根据示例性实施例的识别语音的语音识别系统。
图3图示了执行语音识别的示例,并且图4图示了显示图3中的语音识别结果的屏幕的示例。
如图3中所示,显示装置100可以具有注册的候选指令字,其由至少一个应用(包括原生应用和开发应用)提供并且存储在指令字表格171中。
例如,指令字A和B被第一应用172(即,原生应用)发送到指令字表格171(501),并且被存储在指令字表格171中(502)。语音识别引擎181将存储在指令字表格171中的指令字A和B注册为候选指令字(504)。
指令字C和D被第三应用372(即,开发应用)发送到指令字表格171(505),并且被存储在指令字表格171中(506)。语音识别引擎181将存储在指令字表格171中的指令字C和D注册为候选指令字(508)。
因此,语音识别引擎181将由第一应用172和第三应用372发送的指令字A、B、C以及D注册为候选指令字。
例如,当指令字A、B、C以及D被注册为候选指令字时,可以检测输入到与显示装置100分离的第二语音获取单元240的语音A。检测到的语音A被第二语音转换器250转换成语音信号,并且通过第二通信单元260和第一通信单元160被发送到语音识别引擎181(509)。
语音识别引擎181将语音A的语音信号与注册的候选指令字A、B、C以及D进行比较,决定相同的或者相似的命令,并且识别语音A(510)。
第一控制器180可以将识别结果发送到显示单元130(511),并且显示单元130可以如图4中那样显示语音识别结果。
如图4中所示,显示单元130可以显示示出语音识别结果“A”60的UI、以及根据语音识别结果的候选指令字A61、B62、C63以及D64。显示单元130还可以根据语音识别结果显示示出管理指令字A的应用信息(第一应用)65的UI。
通过在屏幕上显示的UI,用户可以检查语音识别结果以及候选指令字。如果语音识别结果不符合他的/她的说话意图,则用户可以选择所述候选指令字中的一个。用户可以通过应用信息获得与语音识别结果相关的装置的信息。
第一控制器180根据如图3中的语音识别结果将控制命令发送到第一应用172(512)。第一应用172通过第一控制器180的控制、根据识别出的语音A执行控制操作。例如,如果语音A是“音量降低”,则降低显示装置100的音量。
如图3和图4中所述,显示装置100可以预先注册一些应用的指令字(例如,A、B、C以及D),并且如果检测到用户的语音,则显示装置100可以识别所述语音,显示语音识别结果,并且基于注册的候选指令字执行相应控制操作。
虽然图3和图4图示了被注册为候选指令字的第一应用172和第三应用372的指令字,并且通过第二语音获取单元240输入用户的语音,但是示例性实施例不局限于此。例如,指令字可以由其它各种原生应用和开发应用发送以便注册/删除候选指令字,并且通过各种语音获取单元输入语音。
下文中,将参照图5详细描述根据另一个示例性实施例的执行语音识别的语音识别系统。
图5图示了根据另一个示例性实施例的执行语音识别的示例。
如图5中所示,可以检测输入到与显示装置100分离的第三语音获取单元340的语音E。检测到的语音E被第三语音转换器350转换成语音信号,并且通过第三通信单元360和第一通信单元160被发送到语音识别引擎181(701)。
显示装置100可以具有注册的候选指令字。例如,指令字E和F被第三应用372发送到指令字表格171(702),并且被存储在指令字表格171中(703)。语音识别引擎181将存储在指令字表格171中的指令字E和F注册为候选指令字(705)。
即,由第三应用372发送的指令字E和F被作为候选指令字注册到语音识别引擎181中。
当指令字E和F被注册为候选指令字时,语音识别引擎181将语音E的语音信号与注册的候选指令字E和F进行比较,决定相同的或者相似的指令字,并且识别语音E(706)。
第一控制器180可以将识别结果发送到显示单元130(707),并且显示单元130可以显示语音识别结果。
第一控制器180根据语音识别结果将控制命令发送到第三应用372(708)。第三应用372通过第三控制器380的控制、根据识别出的语音E执行控制操作。如果根据语音识别结果发送的控制命令是用于控制显示装置100的命令,则所述控制命令可以被发送到第一应用172或者第二应用173。
如图5中所示,如果检测到用户的语音,则显示装置100可以将与已经被输入了该语音的装置相对应的应用的指令字(例如E和F)注册为候选指令字,基于注册的候选指令字识别语音,显示语音识别结果,并且执行相应控制操作。
虽然图5图示了通过第三语音获取单元340输入用户语音,并且第三应用372的指令字被注册为候选指令字,但是示例性实施例不局限于此。例如,可以通过各种语音获取单元输入语音,并且指令字可以由各种原生应用和开发应用来发送以注册/删除候选指令字。
下文中,将参照附图描述根据示例性实施例的语音识别系统的语音识别方法。
图6是示出根据示例性实施例的语音识别系统的语音识别方法的流程图。
如图6中所示,语音识别系统可以检测输入到多个语音获取单元140、240和340中的至少一个的语音(操作S810)。检测到的语音通过语音转换器150、250和350被转换成电语音信号。
第一控制器180接收所述语音信号(操作S820)。如果检测到输入到外部语音获取单元240和340的语音,则可以通过第一通信单元160接收所述语音信号。
语音识别引擎181注册候选指令字以基于所述语音信号识别语音(操作S830)。注册的候选指令字可以是预先存储在指令字表格171中的字词,或者通过原生应用或者开发应用172、173、372和472接收,并且存储在指令字表格171中。
语音识别引擎181基于存储的候选指令字识别用户的语音(操作S840)。
第一控制器180在显示单元130上显示语音识别结果。显示单元130可以显示对于所述语音信号的语音识别结果、根据语音识别结果的候选指令字以及应用信息。
第一控制器180根据语音识别结果生成控制命令并将所述控制命令发送到应用(操作S860)。相应地,可以通过生成的控制命令执行操作。
图7是示出图6中检测语音输入的过程的细节的流程图。
如图7中所示,作为主装置的显示装置100可以以其中可以输入用户的语音的语音输入模式来操作(操作S811)。在所述语音输入模式中,可以通过各种语音获取单元140、240和340输入语音。
例如,第一控制器180可以从多个语音获取单元140、240和340中的一个检测关于唤醒关键字(wakeup keyword)的讲话(speaking)(操作S812)。所述唤醒关键字使得能够通过特定语音获取单元输入语音,并且可以被预先设置。例如,显示装置100的第一语音获取单元140可以将与比如频道和音量等等的TV控制相关的语音设置为唤醒关键字。移动电话200的第二语音获取单元240可以将与通话、联系信息等等相关的语音设置为唤醒关键字。
可替换地,如果作为操纵预定按钮(语音输入按钮)的结果,通过多个语音获取单元140、240和340中的一个输入了触发信号,则第一控制器180可以检测到通过语音获取单元输入的语音(操作S813)。例如,如果用户操纵在特定语音获取装置提供的语音输入按钮,则检测到输入到该特定语音获取装置的语音输入单元的语音。
根据所述检测,第一控制器180启用多个语音获取单元140、240和340当中该语音被输入到的一个语音获取单元(操作S814)。因为语音获取单元之一被启用,所以可以防止检测不必要的语音并且防止故障。
所述语音信号被启用的语音获取单元发送到语音识别引擎181以执行语音识别。
图8是示出图6中执行语音识别的过程的细节的流程图。
如图8中所示,语音识别引擎181可以从多个应用172、173、372和472中的至少一个接收候选指令字,并且注册所述候选指令字(操作S830)。
语音识别引擎181可以确定所注册的候选指令字是否与接收到的语音信号相同/相似(操作S841)。
如果确定存在相同的或者相似的候选指令字,则语音识别引擎181决定相同的/相似的指令字并且执行语音识别,并且第一控制器180在显示单元130上显示语音识别结果(操作S850)。
如果确定没有相同的或者相似的候选指令字,则语音识别引擎181可以决定是否接收和注册其它应用的候选指令字(操作S842)。第一控制器180可以根据用户的选择或者输入来接收和注册其它应用的候选指令字,并且可以以预设顺序接收和注册多个应用的候选指令字。考虑显示装置100的第一存储单元170的容量,可以选择性地删除先前注册的候选指令字。
即,如果没有候选指令字与所注册的候选指令字相同/相似,则可以顺序地执行操作S842和S841以执行语音识别。
如果在操作S842中决定不接收和注册其它应用的候选指令字,则语音识别引擎181中止语音识别,并且第一控制器180可以在显示单元130上显示语音识别失败。
因为根据示例性实施例的主装置检测通过接收用户语音的各种装置输入的语音,所以可以使用各种语音获取装置,并且可以通过所述语音获取装置提供关联的服务(linked services)。
用于语音识别的候选指令字由多个应用发送,并且被注册/删除。因此,不会不必要地增加主装置的候选指令字,可以防止处理速度变慢或者识别率下降,并且可以提高语音识别系统的总效率。
用户更容易地识别语音识别结果、候选指令字、应用信息和关于各种语音获取装置的信息、以及提供用于语音识别的候选指令字的装置,并且提高了用户的便利性。
然而不局限于此,示例性实施例能够被写为计算机程序并且能够在使用计算机可读记录介质运行所述程序的通用数字计算机中实现。计算机可读记录介质的示例包括磁存储介质(例如,ROM、软盘、硬盘等等)和光记录介质(例如,CD-ROM或者DVD)。同时,示例性实施例可以被写为通过比如载波的计算机可读传输介质发送的计算机程序,并且在运行所述程序的通用数字计算机中接收和实现。此外,尽管并非在所有方面都需要,但是装置的一个或多个单元能够包括运行存储在比如本地存储器的计算机可读介质中的计算机程序的处理器或者微处理器。
尽管已经示出和描述了几个示例性实施例,但本领域技术人员将会理解,可以改变这些示例性实施例而不偏离本发明构思的原理和精神,本发明构思的范围在权利要求及其等效物中限定。
Claims (15)
1.一种显示装置,包括:
显示单元,其在其上显示图像;
通信单元,其与多个外部装置通信;以及
控制器,其包括识别用户语音的语音识别引擎,从语音获取单元接收语音信号,并且控制所述通信单元从所述多个外部装置中的至少一个接收候选指令字以识别接收到的语音信号。
2.根据权利要求1所述的显示装置,其中,提供了多个语音获取单元,并且如果检测到输入到所述多个语音获取单元中的至少一个的语音,则所述控制器从对其检测到语音输入的语音获取单元接收语音信号。
3.根据权利要求2所述的显示装置,其中,所述语音获取单元包括下列各项中的至少一个:在所述显示装置中提供的内置麦克风、在所述多个外部装置中的至少一个中提供的第一外部麦克风、以及在与所述显示装置和所述多个外部装置不同的装置中提供的第二外部麦克风。
4.根据权利要求1所述的显示装置,其中,所述外部装置包括至少一个应用,并且所述候选指令字由所述应用管理。
5.根据权利要求1所述的显示装置,还包括存储单元,其在其中存储接收到的候选指令字,其中,所述语音识别引擎通过使用所述接收到的候选指令字来识别语音。
6.根据权利要求2所述的显示装置,其中,如果检测到对多个语音获取单元中的一个说出了唤醒关键字,则所述控制器启用通过其检测到唤醒关键字的语音获取单元,并且从所启用的语音获取单元接收语音信号。
7.根据权利要求2所述的显示装置,其中,如果通过操纵在多个语音获取单元中的一个中提供的预定按钮输入了触发信号,则所述控制器启用通过其输入了触发信号的语音获取单元,并且从所启用的语音获取单元接收语音信号。
8.根据权利要求1到7中的一项所述的显示装置,其中,所述控制器控制所述显示单元在其上显示对于所述语音信号的语音识别结果以及根据语音识别结果的候选指令字。
9.一种语音获取装置,包括:
通信单元,其与具有语音识别功能的显示装置通信;
语音获取单元,其接收用户语音;
语音转换器,其将输入语音转换成电语音信号;以及
控制器,其控制所述通信单元向所述显示装置发送所转换的语音信号以及候选指令字以识别所述语音信号。
10.一种显示装置的语音识别方法,包括:
从语音获取单元接收语音信号;
从多个外部装置中的至少一个接收候选指令字以识别所接收到的语音信号;以及
根据所接收到的语音信号以及候选指令字识别用户的语音。
11.根据权利要求10所述的语音识别方法,还包括检测输入到多个语音获取单元中的至少一个的语音,其中,接收语音信号包括:从对其检测到语音输入的语音获取单元接收语音信号。
12.根据权利要求11所述的语音识别方法,其中,所述语音获取单元包括下列各项中的至少一个:在所述显示装置中提供的内置麦克风、在多个外部装置中的至少一个中提供的第一外部麦克风、以及在与所述显示装置和所述多个外部装置不同的装置中提供的第二外部麦克风。
13.根据权利要求10所述的语音识别方法,其中,所述外部装置包括至少一个应用,并且所述候选指令字由所述应用管理。
14.根据权利要求11到13中的任意一项所述的语音识别方法,其中,检测语音输入包括:检测对多个语音获取单元中的一个说出唤醒关键字,以及启用通过其检测到所述唤醒关键字的语音获取单元。
15.根据权利要求11到13中的任意一项所述的语音识别方法,其中,检测语音输入包括:根据在多个语音获取单元中的一个中提供的预定按钮的操纵检测触发信号的输入,以及启用通过其输入了所述触发信号的语音获取单元。
Priority Applications (1)
Application Number | Priority Date | Filing Date | Title |
---|---|---|---|
CN201510276510.6A CN104883587A (zh) | 2012-11-09 | 2013-11-08 | 显示装置及其控制方法 |
Applications Claiming Priority (2)
Application Number | Priority Date | Filing Date | Title |
---|---|---|---|
KR10-2012-0126650 | 2012-11-09 | ||
KR1020120126650A KR20140060040A (ko) | 2012-11-09 | 2012-11-09 | 디스플레이장치, 음성취득장치 및 그 음성인식방법 |
Related Child Applications (1)
Application Number | Title | Priority Date | Filing Date |
---|---|---|---|
CN201510276510.6A Division CN104883587A (zh) | 2012-11-09 | 2013-11-08 | 显示装置及其控制方法 |
Publications (2)
Publication Number | Publication Date |
---|---|
CN103811007A true CN103811007A (zh) | 2014-05-21 |
CN103811007B CN103811007B (zh) | 2019-12-03 |
Family
ID=49554021
Family Applications (2)
Application Number | Title | Priority Date | Filing Date |
---|---|---|---|
CN201310553280.4A Active CN103811007B (zh) | 2012-11-09 | 2013-11-08 | 显示装置、语音获取装置及其语音识别方法 |
CN201510276510.6A Pending CN104883587A (zh) | 2012-11-09 | 2013-11-08 | 显示装置及其控制方法 |
Family Applications After (1)
Application Number | Title | Priority Date | Filing Date |
---|---|---|---|
CN201510276510.6A Pending CN104883587A (zh) | 2012-11-09 | 2013-11-08 | 显示装置及其控制方法 |
Country Status (7)
Country | Link |
---|---|
US (5) | US10043537B2 (zh) |
EP (4) | EP2731349B1 (zh) |
JP (2) | JP5868927B2 (zh) |
KR (1) | KR20140060040A (zh) |
CN (2) | CN103811007B (zh) |
RU (1) | RU2677396C2 (zh) |
WO (1) | WO2014073823A1 (zh) |
Cited By (67)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
CN105206275A (zh) * | 2015-08-31 | 2015-12-30 | 小米科技有限责任公司 | 一种设备控制方法、装置及终端 |
CN105222275A (zh) * | 2015-09-25 | 2016-01-06 | 珠海格力电器股份有限公司 | 显示数据的切换方法、装置及系统 |
CN105323607A (zh) * | 2014-06-23 | 2016-02-10 | Lg电子株式会社 | 显示设备及其操作方法 |
CN105976813A (zh) * | 2015-03-13 | 2016-09-28 | 三星电子株式会社 | 语音识别系统及其语音识别方法 |
CN107112012A (zh) * | 2015-01-07 | 2017-08-29 | 美商楼氏电子有限公司 | 利用数字麦克风用于低功率关键词检测和噪声抑制 |
CN109767761A (zh) * | 2017-11-02 | 2019-05-17 | 通用汽车环球科技运作有限责任公司 | 唤醒词检测 |
CN109791765A (zh) * | 2016-08-05 | 2019-05-21 | 搜诺思公司 | 多个语音服务 |
US10692518B2 (en) | 2018-09-29 | 2020-06-23 | Sonos, Inc. | Linear filtering for noise-suppressed speech detection via multiple network microphone devices |
US10764679B2 (en) | 2016-02-22 | 2020-09-01 | Sonos, Inc. | Voice control of a media playback system |
US10811015B2 (en) | 2018-09-25 | 2020-10-20 | Sonos, Inc. | Voice detection optimization based on selected voice assistant service |
US10847143B2 (en) | 2016-02-22 | 2020-11-24 | Sonos, Inc. | Voice control of a media playback system |
US10847178B2 (en) | 2018-05-18 | 2020-11-24 | Sonos, Inc. | Linear filtering for noise-suppressed speech detection |
US10873819B2 (en) | 2016-09-30 | 2020-12-22 | Sonos, Inc. | Orientation-based playback device microphone selection |
US10880650B2 (en) | 2017-12-10 | 2020-12-29 | Sonos, Inc. | Network microphone devices with automatic do not disturb actuation capabilities |
US10878811B2 (en) | 2018-09-14 | 2020-12-29 | Sonos, Inc. | Networked devices, systems, and methods for intelligently deactivating wake-word engines |
US10891932B2 (en) | 2017-09-28 | 2021-01-12 | Sonos, Inc. | Multi-channel acoustic echo cancellation |
US10959029B2 (en) | 2018-05-25 | 2021-03-23 | Sonos, Inc. | Determining and adapting to changes in microphone performance of playback devices |
US10970035B2 (en) | 2016-02-22 | 2021-04-06 | Sonos, Inc. | Audio response playback |
US11024331B2 (en) | 2018-09-21 | 2021-06-01 | Sonos, Inc. | Voice detection optimization using sound metadata |
US11076035B2 (en) | 2018-08-28 | 2021-07-27 | Sonos, Inc. | Do not disturb feature for audio notifications |
US11080005B2 (en) | 2017-09-08 | 2021-08-03 | Sonos, Inc. | Dynamic computation of system response volume |
US11100923B2 (en) | 2018-09-28 | 2021-08-24 | Sonos, Inc. | Systems and methods for selective wake word detection using neural network models |
US11133018B2 (en) | 2016-06-09 | 2021-09-28 | Sonos, Inc. | Dynamic player selection for audio signal processing |
US11132989B2 (en) | 2018-12-13 | 2021-09-28 | Sonos, Inc. | Networked microphone devices, systems, and methods of localized arbitration |
US11159880B2 (en) | 2018-12-20 | 2021-10-26 | Sonos, Inc. | Optimization of network microphone devices using noise classification |
US11172312B2 (en) | 2013-05-23 | 2021-11-09 | Knowles Electronics, Llc | Acoustic activity detecting microphone |
US11175888B2 (en) | 2017-09-29 | 2021-11-16 | Sonos, Inc. | Media playback system with concurrent voice assistance |
US11175880B2 (en) | 2018-05-10 | 2021-11-16 | Sonos, Inc. | Systems and methods for voice-assisted media content selection |
US11183183B2 (en) | 2018-12-07 | 2021-11-23 | Sonos, Inc. | Systems and methods of operating media playback systems having multiple voice assistant services |
US11183181B2 (en) | 2017-03-27 | 2021-11-23 | Sonos, Inc. | Systems and methods of multiple voice services |
US11184969B2 (en) | 2016-07-15 | 2021-11-23 | Sonos, Inc. | Contextualization of voice inputs |
US11189286B2 (en) | 2019-10-22 | 2021-11-30 | Sonos, Inc. | VAS toggle based on device orientation |
US11197096B2 (en) | 2018-06-28 | 2021-12-07 | Sonos, Inc. | Systems and methods for associating playback devices with voice assistant services |
US11200889B2 (en) | 2018-11-15 | 2021-12-14 | Sonos, Inc. | Dilated convolutions and gating for efficient keyword spotting |
US11200900B2 (en) | 2019-12-20 | 2021-12-14 | Sonos, Inc. | Offline voice control |
US11200894B2 (en) | 2019-06-12 | 2021-12-14 | Sonos, Inc. | Network microphone device with command keyword eventing |
US11302326B2 (en) | 2017-09-28 | 2022-04-12 | Sonos, Inc. | Tone interference cancellation |
US11308961B2 (en) | 2016-10-19 | 2022-04-19 | Sonos, Inc. | Arbitration-based voice recognition |
US11308958B2 (en) | 2020-02-07 | 2022-04-19 | Sonos, Inc. | Localized wakeword verification |
US11308962B2 (en) | 2020-05-20 | 2022-04-19 | Sonos, Inc. | Input detection windowing |
US11315556B2 (en) | 2019-02-08 | 2022-04-26 | Sonos, Inc. | Devices, systems, and methods for distributed voice processing by transmitting sound data associated with a wake word to an appropriate device for identification |
US11343614B2 (en) | 2018-01-31 | 2022-05-24 | Sonos, Inc. | Device designation of playback and network microphone device arrangements |
US11354092B2 (en) | 2019-07-31 | 2022-06-07 | Sonos, Inc. | Noise classification for event detection |
US11361756B2 (en) | 2019-06-12 | 2022-06-14 | Sonos, Inc. | Conditional wake word eventing based on environment |
US11380322B2 (en) | 2017-08-07 | 2022-07-05 | Sonos, Inc. | Wake-word detection suppression |
US11405430B2 (en) | 2016-02-22 | 2022-08-02 | Sonos, Inc. | Networked microphone device control |
US11432030B2 (en) | 2018-09-14 | 2022-08-30 | Sonos, Inc. | Networked devices, systems, and methods for associating playback devices based on sound codes |
US11482978B2 (en) | 2018-08-28 | 2022-10-25 | Sonos, Inc. | Audio notifications |
US11482224B2 (en) | 2020-05-20 | 2022-10-25 | Sonos, Inc. | Command keywords with input detection windowing |
US11501773B2 (en) | 2019-06-12 | 2022-11-15 | Sonos, Inc. | Network microphone device with command keyword conditioning |
US11551669B2 (en) | 2019-07-31 | 2023-01-10 | Sonos, Inc. | Locally distributed keyword detection |
US11551700B2 (en) | 2021-01-25 | 2023-01-10 | Sonos, Inc. | Systems and methods for power-efficient keyword detection |
US11556307B2 (en) | 2020-01-31 | 2023-01-17 | Sonos, Inc. | Local voice data processing |
US11556306B2 (en) | 2016-02-22 | 2023-01-17 | Sonos, Inc. | Voice controlled media playback system |
US11562740B2 (en) | 2020-01-07 | 2023-01-24 | Sonos, Inc. | Voice verification for media playback |
US11641559B2 (en) | 2016-09-27 | 2023-05-02 | Sonos, Inc. | Audio playback settings for voice interaction |
US11646023B2 (en) | 2019-02-08 | 2023-05-09 | Sonos, Inc. | Devices, systems, and methods for distributed voice processing |
US11646045B2 (en) | 2017-09-27 | 2023-05-09 | Sonos, Inc. | Robust short-time fourier transform acoustic echo cancellation during audio playback |
US11664023B2 (en) | 2016-07-15 | 2023-05-30 | Sonos, Inc. | Voice detection by multiple devices |
US11676590B2 (en) | 2017-12-11 | 2023-06-13 | Sonos, Inc. | Home graph |
US11698771B2 (en) | 2020-08-25 | 2023-07-11 | Sonos, Inc. | Vocal guidance engines for playback devices |
US11710487B2 (en) | 2019-07-31 | 2023-07-25 | Sonos, Inc. | Locally distributed keyword detection |
US11726742B2 (en) | 2016-02-22 | 2023-08-15 | Sonos, Inc. | Handling of loss of pairing between networked devices |
US11727919B2 (en) | 2020-05-20 | 2023-08-15 | Sonos, Inc. | Memory allocation for keyword spotting engines |
US11798553B2 (en) | 2019-05-03 | 2023-10-24 | Sonos, Inc. | Voice assistant persistence across multiple network microphone devices |
US11899519B2 (en) | 2018-10-23 | 2024-02-13 | Sonos, Inc. | Multiple stage network microphone device with reduced power consumption and processing load |
US11961519B2 (en) | 2022-04-18 | 2024-04-16 | Sonos, Inc. | Localized wakeword verification |
Families Citing this family (27)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
KR20140060040A (ko) | 2012-11-09 | 2014-05-19 | 삼성전자주식회사 | 디스플레이장치, 음성취득장치 및 그 음성인식방법 |
CN105023575B (zh) * | 2014-04-30 | 2019-09-17 | 中兴通讯股份有限公司 | 语音识别方法、装置和系统 |
KR102147329B1 (ko) | 2014-06-17 | 2020-08-24 | 엘지전자 주식회사 | 영상 표시 기기 및 그의 동작 방법 |
WO2016161641A1 (zh) * | 2015-04-10 | 2016-10-13 | 华为技术有限公司 | 语音识别方法、语音唤醒装置、语音识别装置及终端 |
CN105185379B (zh) * | 2015-06-17 | 2017-08-18 | 百度在线网络技术(北京)有限公司 | 声纹认证方法和装置 |
CN106683668A (zh) * | 2015-11-05 | 2017-05-17 | 芋头科技(杭州)有限公司 | 一种智能设备的唤醒控制的方法以及系统 |
KR20170082349A (ko) * | 2016-01-06 | 2017-07-14 | 삼성전자주식회사 | 디스플레이 장치 및 그 제어 방법 |
CN105791934A (zh) * | 2016-03-25 | 2016-07-20 | 福建新大陆通信科技股份有限公司 | 一种机顶盒智能麦克风的实现方法及系统 |
KR102562287B1 (ko) * | 2016-10-14 | 2023-08-02 | 삼성전자주식회사 | 전자 장치 및 전자 장치의 오디오 신호 처리 방법 |
KR102598082B1 (ko) * | 2016-10-28 | 2023-11-03 | 삼성전자주식회사 | 영상 표시 장치, 모바일 장치 및 그 동작방법 |
US10593328B1 (en) * | 2016-12-27 | 2020-03-17 | Amazon Technologies, Inc. | Voice control of remote device |
EP4036709B1 (en) * | 2017-07-14 | 2024-04-24 | Daikin Industries, Ltd. | Environment control system |
CN109584862B (zh) * | 2017-09-29 | 2024-01-12 | 上海寒武纪信息科技有限公司 | 图像处理装置和方法 |
CN109584864B (zh) * | 2017-09-29 | 2023-11-24 | 上海寒武纪信息科技有限公司 | 图像处理装置和方法 |
US11445235B2 (en) | 2017-10-24 | 2022-09-13 | Comcast Cable Communications, Llc | Determining context to initiate interactivity |
JP7133969B2 (ja) * | 2018-04-27 | 2022-09-09 | シャープ株式会社 | 音声入力装置、及び遠隔対話システム |
US20220046310A1 (en) * | 2018-10-15 | 2022-02-10 | Sony Corporation | Information processing device, information processing method, and computer program |
JP2020129252A (ja) * | 2019-02-08 | 2020-08-27 | 三菱電機株式会社 | 機器制御システムおよび端末装置 |
JP7449070B2 (ja) | 2019-03-27 | 2024-03-13 | パナソニック インテレクチュアル プロパティ コーポレーション オブ アメリカ | 音声入力装置、音声入力方法及びそのプログラム |
CN110046045B (zh) * | 2019-04-03 | 2021-07-30 | 百度在线网络技术(北京)有限公司 | 语音唤醒的数据包处理方法和装置 |
US11019402B2 (en) * | 2019-09-26 | 2021-05-25 | Dish Network L.L.C. | Method and system for implementing an elastic cloud-based voice search utilized by set-top box (STB) clients |
CN112581946A (zh) * | 2019-09-29 | 2021-03-30 | 百度在线网络技术(北京)有限公司 | 语音控制方法、装置、电子设备和可读存储介质 |
JP2021071797A (ja) * | 2019-10-29 | 2021-05-06 | 富士通クライアントコンピューティング株式会社 | 表示装置および情報処理装置 |
EP4080348A4 (en) * | 2019-12-19 | 2023-09-13 | LG Electronics Inc. | DISPLAY DEVICE |
CN113360125A (zh) * | 2020-03-05 | 2021-09-07 | 西安诺瓦星云科技股份有限公司 | 图像显示方法、装置和系统 |
CN111934957B (zh) * | 2020-07-16 | 2021-06-25 | 宁波方太厨具有限公司 | 支持WiFi和离线语音的应用系统及方法 |
WO2022265623A1 (en) * | 2021-06-15 | 2022-12-22 | Hewlett-Packard Development Company, L.P. | Acknowledgement based audio communications |
Citations (6)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
CN1342308A (zh) * | 2000-01-05 | 2002-03-27 | 松下电器产业株式会社 | 机器设定装置、机器设定系统以及记录机器设定处理程序的记录媒体 |
US20020072912A1 (en) * | 2000-07-28 | 2002-06-13 | Chih-Chuan Yen | System for controlling an apparatus with speech commands |
US20040010409A1 (en) * | 2002-04-01 | 2004-01-15 | Hirohide Ushida | Voice recognition system, device, voice recognition method and voice recognition program |
CN101625864A (zh) * | 2008-07-10 | 2010-01-13 | 富士通株式会社 | 声音识别装置和声音识别方法 |
US20100299143A1 (en) * | 2009-05-22 | 2010-11-25 | Alpine Electronics, Inc. | Voice Recognition Dictionary Generation Apparatus and Voice Recognition Dictionary Generation Method |
CN202033897U (zh) * | 2011-01-25 | 2011-11-09 | 张国鸿 | 语音遥控接收模块及具语音遥控功能的电器 |
Family Cites Families (75)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
US5752232A (en) * | 1994-11-14 | 1998-05-12 | Lucent Technologies Inc. | Voice activated device and method for providing access to remotely retrieved data |
JP3697748B2 (ja) | 1995-08-21 | 2005-09-21 | セイコーエプソン株式会社 | 端末、音声認識装置 |
US6665639B2 (en) | 1996-12-06 | 2003-12-16 | Sensory, Inc. | Speech recognition in consumer electronic products |
US6188985B1 (en) * | 1997-01-06 | 2001-02-13 | Texas Instruments Incorporated | Wireless voice-activated device for control of a processor-based host system |
KR100237385B1 (ko) | 1997-08-05 | 2000-01-15 | 정선종 | 웹 브라우저 상의 음성 인식기 구현방법 |
EP0911808B1 (en) | 1997-10-23 | 2002-05-08 | Sony International (Europe) GmbH | Speech interface in a home network environment |
CN1223508A (zh) | 1998-01-13 | 1999-07-21 | 黄金富 | 声控红外线遥控器 |
JP2000099306A (ja) * | 1998-05-28 | 2000-04-07 | Canon Inc | 制御装置およびその制御方法およびその動作処理を実行するプログラムを記憶した記憶媒体 |
JP2000200395A (ja) | 1999-01-07 | 2000-07-18 | Matsushita Electric Ind Co Ltd | 防火システム |
US6556970B1 (en) * | 1999-01-28 | 2003-04-29 | Denso Corporation | Apparatus for determining appropriate series of words carrying information to be recognized |
EP1045374B1 (en) * | 1999-04-13 | 2010-08-11 | Sony Deutschland GmbH | Merging of speech interfaces for concurrent use of devices and applications |
JP4314680B2 (ja) | 1999-07-27 | 2009-08-19 | ソニー株式会社 | 音声認識制御システム及び音声認識制御方法 |
US6397186B1 (en) * | 1999-12-22 | 2002-05-28 | Ambush Interactive, Inc. | Hands-free, voice-operated remote control transmitter |
US8271287B1 (en) | 2000-01-14 | 2012-09-18 | Alcatel Lucent | Voice command remote control system |
JP2001296881A (ja) * | 2000-04-14 | 2001-10-26 | Sony Corp | 情報処理装置および方法、並びに記録媒体 |
JP2002116787A (ja) | 2000-07-10 | 2002-04-19 | Matsushita Electric Ind Co Ltd | 優先順位決定装置、優先順位決定方法及び優先順位決定プログラム |
DE10040466C2 (de) * | 2000-08-18 | 2003-04-10 | Bosch Gmbh Robert | Verfahren zur Steuerung einer Spracheingabe und -ausgabe |
EP1314310A1 (en) | 2000-08-21 | 2003-05-28 | Koninklijke Philips Electronics N.V. | A voice controlled remote control with downloadable set of voice commands |
EP1184841A1 (de) * | 2000-08-31 | 2002-03-06 | Siemens Aktiengesellschaft | Sprachgesteuerte Anordnung und Verfahren zur Spracheingabe und -erkennung |
US20020110246A1 (en) | 2001-02-14 | 2002-08-15 | Jason Gosior | Wireless audio system |
US7369997B2 (en) * | 2001-08-01 | 2008-05-06 | Microsoft Corporation | Controlling speech recognition functionality in a computing device |
US20030061033A1 (en) * | 2001-09-26 | 2003-03-27 | Dishert Lee R. | Remote control system for translating an utterance to a control parameter for use by an electronic device |
CN1437377A (zh) * | 2002-02-04 | 2003-08-20 | 义隆电子股份有限公司 | 集成多功能及信息服务的系统及其使用的电子装置 |
US20030177012A1 (en) * | 2002-03-13 | 2003-09-18 | Brett Drennan | Voice activated thermostat |
KR100434545B1 (ko) * | 2002-03-15 | 2004-06-05 | 삼성전자주식회사 | 홈네트워크로 연결된 가전기기들을 제어하는 방법 및 장치 |
JP3715584B2 (ja) * | 2002-03-28 | 2005-11-09 | 富士通株式会社 | 機器制御装置および機器制御方法 |
US20040001040A1 (en) * | 2002-06-28 | 2004-01-01 | Kardach James P. | Methods and apparatus for providing light to a display |
US6834265B2 (en) | 2002-12-13 | 2004-12-21 | Motorola, Inc. | Method and apparatus for selective speech recognition |
JP2004275360A (ja) * | 2003-03-14 | 2004-10-07 | Olympus Corp | 内視鏡システム |
CN2620913Y (zh) * | 2003-04-21 | 2004-06-16 | 叶龙 | 语音控制家电遥控器 |
JP2005072764A (ja) | 2003-08-21 | 2005-03-17 | Hitachi Ltd | 機器制御システムとそのための装置及び機器制御方法 |
JP2006033795A (ja) | 2004-06-15 | 2006-02-02 | Sanyo Electric Co Ltd | リモートコントロールシステム、コントローラ、コンピュータにコントローラの機能を付与するプログラム、当該プログラムを格納した記憶媒体、およびサーバ。 |
CN1713271A (zh) * | 2004-06-15 | 2005-12-28 | 三洋电机株式会社 | 遥控系统、控制器、向计算机提供控制器功能的程序 |
CN1725902A (zh) * | 2004-07-20 | 2006-01-25 | 李廷玉 | 手机遥控器 |
US7085673B2 (en) | 2004-08-31 | 2006-08-01 | Hewlett-Packard Development Company, L.P. | Displacement estimation system and method |
US20060074658A1 (en) * | 2004-10-01 | 2006-04-06 | Siemens Information And Communication Mobile, Llc | Systems and methods for hands-free voice-activated devices |
KR100682897B1 (ko) | 2004-11-09 | 2007-02-15 | 삼성전자주식회사 | 사전 업데이트 방법 및 그 장치 |
US8942985B2 (en) * | 2004-11-16 | 2015-01-27 | Microsoft Corporation | Centralized method and system for clarifying voice commands |
US20070299670A1 (en) * | 2006-06-27 | 2007-12-27 | Sbc Knowledge Ventures, Lp | Biometric and speech recognition system and method |
US20080037727A1 (en) * | 2006-07-13 | 2008-02-14 | Clas Sivertsen | Audio appliance with speech recognition, voice command control, and speech generation |
US7899673B2 (en) * | 2006-08-09 | 2011-03-01 | Microsoft Corporation | Automatic pruning of grammars in a multi-application speech recognition interface |
KR20080036697A (ko) * | 2006-10-24 | 2008-04-29 | 삼성전자주식회사 | 휴대용 단말기에서 원격 제어 방법 및 장치 |
CN100538762C (zh) | 2006-12-15 | 2009-09-09 | 广东协联科贸发展有限公司 | 一种按键语音一体化遥控装置 |
US8260618B2 (en) * | 2006-12-21 | 2012-09-04 | Nuance Communications, Inc. | Method and apparatus for remote control of devices through a wireless headset using voice activation |
US8140325B2 (en) * | 2007-01-04 | 2012-03-20 | International Business Machines Corporation | Systems and methods for intelligent control of microphones for speech recognition applications |
KR20080096239A (ko) * | 2007-04-27 | 2008-10-30 | 정장오 | 주방tv 및 홈네트워크시스템 및 가전기기를 음성으로제어하는 음성인식 네트워크주방tv시스템. |
US20090018830A1 (en) * | 2007-07-11 | 2009-01-15 | Vandinburg Gmbh | Speech control of computing devices |
US8825468B2 (en) * | 2007-07-31 | 2014-09-02 | Kopin Corporation | Mobile wireless display providing speech to speech translation and avatar simulating human attributes |
US8099289B2 (en) * | 2008-02-13 | 2012-01-17 | Sensory, Inc. | Voice interface and search for electronic devices including bluetooth headsets and remote systems |
TWI385932B (zh) * | 2008-03-26 | 2013-02-11 | Asustek Comp Inc | 遙控器以及其系統 |
US9135809B2 (en) * | 2008-06-20 | 2015-09-15 | At&T Intellectual Property I, Lp | Voice enabled remote control for a set-top box |
US8676904B2 (en) * | 2008-10-02 | 2014-03-18 | Apple Inc. | Electronic devices with voice command and contextual data processing capabilities |
US20100332236A1 (en) * | 2009-06-25 | 2010-12-30 | Blueant Wireless Pty Limited | Voice-triggered operation of electronic devices |
CN102576487A (zh) | 2009-09-01 | 2012-07-11 | Lg电子株式会社 | 用于控制外部装置及其远程控制器的方法 |
KR20110028103A (ko) | 2009-09-11 | 2011-03-17 | 주식회사 카서 | 다목적 근거리 무선 통신 장치 및 시스템 |
US20110067059A1 (en) * | 2009-09-15 | 2011-03-17 | At&T Intellectual Property I, L.P. | Media control |
US8510103B2 (en) * | 2009-10-15 | 2013-08-13 | Paul Angott | System and method for voice recognition |
KR20110052863A (ko) * | 2009-11-13 | 2011-05-19 | 삼성전자주식회사 | 모바일 기기 및 그 제어 신호 생성 방법 |
US9865263B2 (en) | 2009-12-01 | 2018-01-09 | Nuance Communications, Inc. | Real-time voice recognition on a handheld device |
CN101778198A (zh) * | 2010-01-25 | 2010-07-14 | 上海享云信息系统有限公司 | 一种增强型电视终端系统 |
US20110246902A1 (en) | 2010-04-01 | 2011-10-06 | Tsung-Han Tsai | Method for portable phones to control computers |
CN102255780A (zh) | 2010-05-20 | 2011-11-23 | 株式会社曙飞电子 | 家庭网络系统及其控制方法 |
US20120078635A1 (en) * | 2010-09-24 | 2012-03-29 | Apple Inc. | Voice control system |
US8914287B2 (en) * | 2010-12-31 | 2014-12-16 | Echostar Technologies L.L.C. | Remote control audio link |
EP2518722A3 (en) * | 2011-04-28 | 2013-08-28 | Samsung Electronics Co., Ltd. | Method for providing link list and display apparatus applying the same |
US20130027613A1 (en) | 2011-05-03 | 2013-01-31 | Lg Electronics Inc. | Image display apparatus, portable terminal, and methods for operating the same |
CN102196207B (zh) | 2011-05-12 | 2014-06-18 | 深圳市车音网科技有限公司 | 语音控制电视机的方法、装置和系统 |
US20130073293A1 (en) * | 2011-09-20 | 2013-03-21 | Lg Electronics Inc. | Electronic device and method for controlling the same |
US20130144618A1 (en) | 2011-12-02 | 2013-06-06 | Liang-Che Sun | Methods and electronic devices for speech recognition |
US20130238326A1 (en) * | 2012-03-08 | 2013-09-12 | Lg Electronics Inc. | Apparatus and method for multiple device voice control |
KR101946364B1 (ko) * | 2012-05-01 | 2019-02-11 | 엘지전자 주식회사 | 적어도 하나의 마이크 센서를 갖는 모바일 디바이스 및 그 제어방법 |
RU121608U1 (ru) * | 2012-06-05 | 2012-10-27 | Закрытое акционерное общество "Титан-информационный сервис" | Устройство для управления электронной техникой |
US20140074472A1 (en) * | 2012-09-12 | 2014-03-13 | Chih-Hung Lin | Voice control system with portable voice control device |
US9646610B2 (en) * | 2012-10-30 | 2017-05-09 | Motorola Solutions, Inc. | Method and apparatus for activating a particular wireless communication device to accept speech and/or voice commands using identification data consisting of speech, voice, image recognition |
KR20140060040A (ko) | 2012-11-09 | 2014-05-19 | 삼성전자주식회사 | 디스플레이장치, 음성취득장치 및 그 음성인식방법 |
-
2012
- 2012-11-09 KR KR1020120126650A patent/KR20140060040A/ko not_active IP Right Cessation
-
2013
- 2013-11-01 EP EP13191285.9A patent/EP2731349B1/en active Active
- 2013-11-01 EP EP20202566.4A patent/EP3790285A1/en active Pending
- 2013-11-01 EP EP22187072.8A patent/EP4106339A1/en active Pending
- 2013-11-01 EP EP18159291.6A patent/EP3352471B1/en active Active
- 2013-11-04 WO PCT/KR2013/009880 patent/WO2014073823A1/en active Application Filing
- 2013-11-04 RU RU2015121906A patent/RU2677396C2/ru active
- 2013-11-08 CN CN201310553280.4A patent/CN103811007B/zh active Active
- 2013-11-08 CN CN201510276510.6A patent/CN104883587A/zh active Pending
- 2013-11-08 JP JP2013231944A patent/JP5868927B2/ja active Active
- 2013-11-11 US US14/076,361 patent/US10043537B2/en active Active
-
2015
- 2015-09-10 JP JP2015178839A patent/JP6640502B2/ja active Active
-
2017
- 2017-08-08 US US15/671,178 patent/US10586554B2/en active Active
-
2020
- 2020-02-13 US US16/790,237 patent/US11727951B2/en active Active
-
2022
- 2022-07-22 US US17/871,576 patent/US20220358949A1/en active Pending
- 2022-12-20 US US18/068,935 patent/US20230121055A1/en active Pending
Patent Citations (6)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
CN1342308A (zh) * | 2000-01-05 | 2002-03-27 | 松下电器产业株式会社 | 机器设定装置、机器设定系统以及记录机器设定处理程序的记录媒体 |
US20020072912A1 (en) * | 2000-07-28 | 2002-06-13 | Chih-Chuan Yen | System for controlling an apparatus with speech commands |
US20040010409A1 (en) * | 2002-04-01 | 2004-01-15 | Hirohide Ushida | Voice recognition system, device, voice recognition method and voice recognition program |
CN101625864A (zh) * | 2008-07-10 | 2010-01-13 | 富士通株式会社 | 声音识别装置和声音识别方法 |
US20100299143A1 (en) * | 2009-05-22 | 2010-11-25 | Alpine Electronics, Inc. | Voice Recognition Dictionary Generation Apparatus and Voice Recognition Dictionary Generation Method |
CN202033897U (zh) * | 2011-01-25 | 2011-11-09 | 张国鸿 | 语音遥控接收模块及具语音遥控功能的电器 |
Non-Patent Citations (1)
Title |
---|
马争鸣: "《网络工程师考试辅导 考点精讲、例题分析、强化训练》", 28 February 2005 * |
Cited By (116)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
US11172312B2 (en) | 2013-05-23 | 2021-11-09 | Knowles Electronics, Llc | Acoustic activity detecting microphone |
CN105323607A (zh) * | 2014-06-23 | 2016-02-10 | Lg电子株式会社 | 显示设备及其操作方法 |
CN105323607B (zh) * | 2014-06-23 | 2019-04-16 | Lg电子株式会社 | 显示设备及其操作方法 |
CN107112012B (zh) * | 2015-01-07 | 2020-11-20 | 美商楼氏电子有限公司 | 用于音频处理的方法和系统及计算机可读存储介质 |
CN107112012A (zh) * | 2015-01-07 | 2017-08-29 | 美商楼氏电子有限公司 | 利用数字麦克风用于低功率关键词检测和噪声抑制 |
CN105976813A (zh) * | 2015-03-13 | 2016-09-28 | 三星电子株式会社 | 语音识别系统及其语音识别方法 |
CN105976813B (zh) * | 2015-03-13 | 2021-08-10 | 三星电子株式会社 | 语音识别系统及其语音识别方法 |
CN105206275A (zh) * | 2015-08-31 | 2015-12-30 | 小米科技有限责任公司 | 一种设备控制方法、装置及终端 |
CN105222275A (zh) * | 2015-09-25 | 2016-01-06 | 珠海格力电器股份有限公司 | 显示数据的切换方法、装置及系统 |
CN105222275B (zh) * | 2015-09-25 | 2018-04-13 | 珠海格力电器股份有限公司 | 显示数据的切换方法、装置及系统 |
US11184704B2 (en) | 2016-02-22 | 2021-11-23 | Sonos, Inc. | Music service selection |
US11556306B2 (en) | 2016-02-22 | 2023-01-17 | Sonos, Inc. | Voice controlled media playback system |
US11513763B2 (en) | 2016-02-22 | 2022-11-29 | Sonos, Inc. | Audio response playback |
US10764679B2 (en) | 2016-02-22 | 2020-09-01 | Sonos, Inc. | Voice control of a media playback system |
US11212612B2 (en) | 2016-02-22 | 2021-12-28 | Sonos, Inc. | Voice control of a media playback system |
US10847143B2 (en) | 2016-02-22 | 2020-11-24 | Sonos, Inc. | Voice control of a media playback system |
US11863593B2 (en) | 2016-02-22 | 2024-01-02 | Sonos, Inc. | Networked microphone device control |
US11726742B2 (en) | 2016-02-22 | 2023-08-15 | Sonos, Inc. | Handling of loss of pairing between networked devices |
US11832068B2 (en) | 2016-02-22 | 2023-11-28 | Sonos, Inc. | Music service selection |
US11514898B2 (en) | 2016-02-22 | 2022-11-29 | Sonos, Inc. | Voice control of a media playback system |
US11405430B2 (en) | 2016-02-22 | 2022-08-02 | Sonos, Inc. | Networked microphone device control |
US11750969B2 (en) | 2016-02-22 | 2023-09-05 | Sonos, Inc. | Default playback device designation |
US10970035B2 (en) | 2016-02-22 | 2021-04-06 | Sonos, Inc. | Audio response playback |
US10971139B2 (en) | 2016-02-22 | 2021-04-06 | Sonos, Inc. | Voice control of a media playback system |
US11006214B2 (en) | 2016-02-22 | 2021-05-11 | Sonos, Inc. | Default playback device designation |
US11736860B2 (en) | 2016-02-22 | 2023-08-22 | Sonos, Inc. | Voice control of a media playback system |
US11133018B2 (en) | 2016-06-09 | 2021-09-28 | Sonos, Inc. | Dynamic player selection for audio signal processing |
US11545169B2 (en) | 2016-06-09 | 2023-01-03 | Sonos, Inc. | Dynamic player selection for audio signal processing |
US11184969B2 (en) | 2016-07-15 | 2021-11-23 | Sonos, Inc. | Contextualization of voice inputs |
US11664023B2 (en) | 2016-07-15 | 2023-05-30 | Sonos, Inc. | Voice detection by multiple devices |
US10847164B2 (en) | 2016-08-05 | 2020-11-24 | Sonos, Inc. | Playback device supporting concurrent voice assistants |
CN109791765A (zh) * | 2016-08-05 | 2019-05-21 | 搜诺思公司 | 多个语音服务 |
CN109791765B (zh) * | 2016-08-05 | 2020-11-03 | 搜诺思公司 | 多个语音服务 |
US11531520B2 (en) | 2016-08-05 | 2022-12-20 | Sonos, Inc. | Playback device supporting concurrent voice assistants |
US11641559B2 (en) | 2016-09-27 | 2023-05-02 | Sonos, Inc. | Audio playback settings for voice interaction |
US11516610B2 (en) | 2016-09-30 | 2022-11-29 | Sonos, Inc. | Orientation-based playback device microphone selection |
US10873819B2 (en) | 2016-09-30 | 2020-12-22 | Sonos, Inc. | Orientation-based playback device microphone selection |
US11727933B2 (en) | 2016-10-19 | 2023-08-15 | Sonos, Inc. | Arbitration-based voice recognition |
US11308961B2 (en) | 2016-10-19 | 2022-04-19 | Sonos, Inc. | Arbitration-based voice recognition |
US11183181B2 (en) | 2017-03-27 | 2021-11-23 | Sonos, Inc. | Systems and methods of multiple voice services |
US11380322B2 (en) | 2017-08-07 | 2022-07-05 | Sonos, Inc. | Wake-word detection suppression |
US11900937B2 (en) | 2017-08-07 | 2024-02-13 | Sonos, Inc. | Wake-word detection suppression |
US11080005B2 (en) | 2017-09-08 | 2021-08-03 | Sonos, Inc. | Dynamic computation of system response volume |
US11500611B2 (en) | 2017-09-08 | 2022-11-15 | Sonos, Inc. | Dynamic computation of system response volume |
US11646045B2 (en) | 2017-09-27 | 2023-05-09 | Sonos, Inc. | Robust short-time fourier transform acoustic echo cancellation during audio playback |
US11538451B2 (en) | 2017-09-28 | 2022-12-27 | Sonos, Inc. | Multi-channel acoustic echo cancellation |
US11769505B2 (en) | 2017-09-28 | 2023-09-26 | Sonos, Inc. | Echo of tone interferance cancellation using two acoustic echo cancellers |
US10891932B2 (en) | 2017-09-28 | 2021-01-12 | Sonos, Inc. | Multi-channel acoustic echo cancellation |
US11302326B2 (en) | 2017-09-28 | 2022-04-12 | Sonos, Inc. | Tone interference cancellation |
US11175888B2 (en) | 2017-09-29 | 2021-11-16 | Sonos, Inc. | Media playback system with concurrent voice assistance |
US11288039B2 (en) | 2017-09-29 | 2022-03-29 | Sonos, Inc. | Media playback system with concurrent voice assistance |
US11893308B2 (en) | 2017-09-29 | 2024-02-06 | Sonos, Inc. | Media playback system with concurrent voice assistance |
CN109767761A (zh) * | 2017-11-02 | 2019-05-17 | 通用汽车环球科技运作有限责任公司 | 唤醒词检测 |
US11451908B2 (en) | 2017-12-10 | 2022-09-20 | Sonos, Inc. | Network microphone devices with automatic do not disturb actuation capabilities |
US10880650B2 (en) | 2017-12-10 | 2020-12-29 | Sonos, Inc. | Network microphone devices with automatic do not disturb actuation capabilities |
US11676590B2 (en) | 2017-12-11 | 2023-06-13 | Sonos, Inc. | Home graph |
US11343614B2 (en) | 2018-01-31 | 2022-05-24 | Sonos, Inc. | Device designation of playback and network microphone device arrangements |
US11689858B2 (en) | 2018-01-31 | 2023-06-27 | Sonos, Inc. | Device designation of playback and network microphone device arrangements |
US11175880B2 (en) | 2018-05-10 | 2021-11-16 | Sonos, Inc. | Systems and methods for voice-assisted media content selection |
US11797263B2 (en) | 2018-05-10 | 2023-10-24 | Sonos, Inc. | Systems and methods for voice-assisted media content selection |
US11715489B2 (en) | 2018-05-18 | 2023-08-01 | Sonos, Inc. | Linear filtering for noise-suppressed speech detection |
US10847178B2 (en) | 2018-05-18 | 2020-11-24 | Sonos, Inc. | Linear filtering for noise-suppressed speech detection |
US10959029B2 (en) | 2018-05-25 | 2021-03-23 | Sonos, Inc. | Determining and adapting to changes in microphone performance of playback devices |
US11792590B2 (en) | 2018-05-25 | 2023-10-17 | Sonos, Inc. | Determining and adapting to changes in microphone performance of playback devices |
US11696074B2 (en) | 2018-06-28 | 2023-07-04 | Sonos, Inc. | Systems and methods for associating playback devices with voice assistant services |
US11197096B2 (en) | 2018-06-28 | 2021-12-07 | Sonos, Inc. | Systems and methods for associating playback devices with voice assistant services |
US11563842B2 (en) | 2018-08-28 | 2023-01-24 | Sonos, Inc. | Do not disturb feature for audio notifications |
US11482978B2 (en) | 2018-08-28 | 2022-10-25 | Sonos, Inc. | Audio notifications |
US11076035B2 (en) | 2018-08-28 | 2021-07-27 | Sonos, Inc. | Do not disturb feature for audio notifications |
US11778259B2 (en) | 2018-09-14 | 2023-10-03 | Sonos, Inc. | Networked devices, systems and methods for associating playback devices based on sound codes |
US10878811B2 (en) | 2018-09-14 | 2020-12-29 | Sonos, Inc. | Networked devices, systems, and methods for intelligently deactivating wake-word engines |
US11432030B2 (en) | 2018-09-14 | 2022-08-30 | Sonos, Inc. | Networked devices, systems, and methods for associating playback devices based on sound codes |
US11551690B2 (en) | 2018-09-14 | 2023-01-10 | Sonos, Inc. | Networked devices, systems, and methods for intelligently deactivating wake-word engines |
US11790937B2 (en) | 2018-09-21 | 2023-10-17 | Sonos, Inc. | Voice detection optimization using sound metadata |
US11024331B2 (en) | 2018-09-21 | 2021-06-01 | Sonos, Inc. | Voice detection optimization using sound metadata |
US11727936B2 (en) | 2018-09-25 | 2023-08-15 | Sonos, Inc. | Voice detection optimization based on selected voice assistant service |
US11031014B2 (en) | 2018-09-25 | 2021-06-08 | Sonos, Inc. | Voice detection optimization based on selected voice assistant service |
US10811015B2 (en) | 2018-09-25 | 2020-10-20 | Sonos, Inc. | Voice detection optimization based on selected voice assistant service |
US11100923B2 (en) | 2018-09-28 | 2021-08-24 | Sonos, Inc. | Systems and methods for selective wake word detection using neural network models |
US11790911B2 (en) | 2018-09-28 | 2023-10-17 | Sonos, Inc. | Systems and methods for selective wake word detection using neural network models |
US10692518B2 (en) | 2018-09-29 | 2020-06-23 | Sonos, Inc. | Linear filtering for noise-suppressed speech detection via multiple network microphone devices |
US11501795B2 (en) | 2018-09-29 | 2022-11-15 | Sonos, Inc. | Linear filtering for noise-suppressed speech detection via multiple network microphone devices |
US11899519B2 (en) | 2018-10-23 | 2024-02-13 | Sonos, Inc. | Multiple stage network microphone device with reduced power consumption and processing load |
US11200889B2 (en) | 2018-11-15 | 2021-12-14 | Sonos, Inc. | Dilated convolutions and gating for efficient keyword spotting |
US11741948B2 (en) | 2018-11-15 | 2023-08-29 | Sonos Vox France Sas | Dilated convolutions and gating for efficient keyword spotting |
US11557294B2 (en) | 2018-12-07 | 2023-01-17 | Sonos, Inc. | Systems and methods of operating media playback systems having multiple voice assistant services |
US11183183B2 (en) | 2018-12-07 | 2021-11-23 | Sonos, Inc. | Systems and methods of operating media playback systems having multiple voice assistant services |
US11132989B2 (en) | 2018-12-13 | 2021-09-28 | Sonos, Inc. | Networked microphone devices, systems, and methods of localized arbitration |
US11538460B2 (en) | 2018-12-13 | 2022-12-27 | Sonos, Inc. | Networked microphone devices, systems, and methods of localized arbitration |
US11540047B2 (en) | 2018-12-20 | 2022-12-27 | Sonos, Inc. | Optimization of network microphone devices using noise classification |
US11159880B2 (en) | 2018-12-20 | 2021-10-26 | Sonos, Inc. | Optimization of network microphone devices using noise classification |
US11315556B2 (en) | 2019-02-08 | 2022-04-26 | Sonos, Inc. | Devices, systems, and methods for distributed voice processing by transmitting sound data associated with a wake word to an appropriate device for identification |
US11646023B2 (en) | 2019-02-08 | 2023-05-09 | Sonos, Inc. | Devices, systems, and methods for distributed voice processing |
US11798553B2 (en) | 2019-05-03 | 2023-10-24 | Sonos, Inc. | Voice assistant persistence across multiple network microphone devices |
US11854547B2 (en) | 2019-06-12 | 2023-12-26 | Sonos, Inc. | Network microphone device with command keyword eventing |
US11361756B2 (en) | 2019-06-12 | 2022-06-14 | Sonos, Inc. | Conditional wake word eventing based on environment |
US11501773B2 (en) | 2019-06-12 | 2022-11-15 | Sonos, Inc. | Network microphone device with command keyword conditioning |
US11200894B2 (en) | 2019-06-12 | 2021-12-14 | Sonos, Inc. | Network microphone device with command keyword eventing |
US11551669B2 (en) | 2019-07-31 | 2023-01-10 | Sonos, Inc. | Locally distributed keyword detection |
US11710487B2 (en) | 2019-07-31 | 2023-07-25 | Sonos, Inc. | Locally distributed keyword detection |
US11354092B2 (en) | 2019-07-31 | 2022-06-07 | Sonos, Inc. | Noise classification for event detection |
US11714600B2 (en) | 2019-07-31 | 2023-08-01 | Sonos, Inc. | Noise classification for event detection |
US11189286B2 (en) | 2019-10-22 | 2021-11-30 | Sonos, Inc. | VAS toggle based on device orientation |
US11862161B2 (en) | 2019-10-22 | 2024-01-02 | Sonos, Inc. | VAS toggle based on device orientation |
US11869503B2 (en) | 2019-12-20 | 2024-01-09 | Sonos, Inc. | Offline voice control |
US11200900B2 (en) | 2019-12-20 | 2021-12-14 | Sonos, Inc. | Offline voice control |
US11562740B2 (en) | 2020-01-07 | 2023-01-24 | Sonos, Inc. | Voice verification for media playback |
US11556307B2 (en) | 2020-01-31 | 2023-01-17 | Sonos, Inc. | Local voice data processing |
US11308958B2 (en) | 2020-02-07 | 2022-04-19 | Sonos, Inc. | Localized wakeword verification |
US11482224B2 (en) | 2020-05-20 | 2022-10-25 | Sonos, Inc. | Command keywords with input detection windowing |
US11308962B2 (en) | 2020-05-20 | 2022-04-19 | Sonos, Inc. | Input detection windowing |
US11727919B2 (en) | 2020-05-20 | 2023-08-15 | Sonos, Inc. | Memory allocation for keyword spotting engines |
US11694689B2 (en) | 2020-05-20 | 2023-07-04 | Sonos, Inc. | Input detection windowing |
US11698771B2 (en) | 2020-08-25 | 2023-07-11 | Sonos, Inc. | Vocal guidance engines for playback devices |
US11551700B2 (en) | 2021-01-25 | 2023-01-10 | Sonos, Inc. | Systems and methods for power-efficient keyword detection |
US11961519B2 (en) | 2022-04-18 | 2024-04-16 | Sonos, Inc. | Localized wakeword verification |
Also Published As
Publication number | Publication date |
---|---|
RU2015121906A (ru) | 2016-12-27 |
KR20140060040A (ko) | 2014-05-19 |
JP6640502B2 (ja) | 2020-02-05 |
CN103811007B (zh) | 2019-12-03 |
CN104883587A (zh) | 2015-09-02 |
EP4106339A1 (en) | 2022-12-21 |
EP2731349B1 (en) | 2018-04-18 |
US20140136205A1 (en) | 2014-05-15 |
EP3352471B1 (en) | 2020-12-30 |
US11727951B2 (en) | 2023-08-15 |
JP5868927B2 (ja) | 2016-02-24 |
US10043537B2 (en) | 2018-08-07 |
EP3352471A1 (en) | 2018-07-25 |
JP2016027484A (ja) | 2016-02-18 |
JP2014096153A (ja) | 2014-05-22 |
EP2731349A1 (en) | 2014-05-14 |
US20170337937A1 (en) | 2017-11-23 |
US20230121055A1 (en) | 2023-04-20 |
US10586554B2 (en) | 2020-03-10 |
US20200184989A1 (en) | 2020-06-11 |
EP3790285A1 (en) | 2021-03-10 |
US20220358949A1 (en) | 2022-11-10 |
RU2677396C2 (ru) | 2019-01-16 |
WO2014073823A1 (en) | 2014-05-15 |
Similar Documents
Publication | Publication Date | Title |
---|---|---|
CN103811007A (zh) | 显示装置、语音获取装置及其语音识别方法 | |
US20170223301A1 (en) | Image processing apparatus, voice acquiring apparatus, voice recognition method thereof and voice recognition system | |
US9699292B2 (en) | Method and system for reproducing contents, and computer-readable recording medium thereof | |
EP3160151B1 (en) | Video display device and operation method therefor | |
KR102527082B1 (ko) | 디스플레이장치 및 그 제어방법 | |
KR20150054490A (ko) | 음성인식 시스템, 음성인식 서버 및 디스플레이 장치의 제어방법 | |
KR102501655B1 (ko) | 디스플레이장치, 음성취득장치 및 그 음성인식방법 | |
KR102516728B1 (ko) | 전자 장치 및 그의 제어 방법 | |
KR102262050B1 (ko) | 디스플레이장치, 음성취득장치 및 그 음성인식방법 |
Legal Events
Date | Code | Title | Description |
---|---|---|---|
C06 | Publication | ||
PB01 | Publication | ||
C10 | Entry into substantive examination | ||
SE01 | Entry into force of request for substantive examination | ||
GR01 | Patent grant | ||
GR01 | Patent grant |