CN102682771B - 一种适用于云平台的多语音控制方法 - Google Patents

一种适用于云平台的多语音控制方法 Download PDF

Info

Publication number
CN102682771B
CN102682771B CN201210127707XA CN201210127707A CN102682771B CN 102682771 B CN102682771 B CN 102682771B CN 201210127707X A CN201210127707X A CN 201210127707XA CN 201210127707 A CN201210127707 A CN 201210127707A CN 102682771 B CN102682771 B CN 102682771B
Authority
CN
China
Prior art keywords
engine
user
information
password
nonspecific
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Expired - Fee Related
Application number
CN201210127707XA
Other languages
English (en)
Other versions
CN102682771A (zh
Inventor
林声滨
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Xiamen cloud Smart Technology Co., Ltd.
Original Assignee
XIAMEN SEED ELECTRONIC TECHNOLOGY Co Ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by XIAMEN SEED ELECTRONIC TECHNOLOGY Co Ltd filed Critical XIAMEN SEED ELECTRONIC TECHNOLOGY Co Ltd
Priority to CN201210127707XA priority Critical patent/CN102682771B/zh
Publication of CN102682771A publication Critical patent/CN102682771A/zh
Application granted granted Critical
Publication of CN102682771B publication Critical patent/CN102682771B/zh
Expired - Fee Related legal-status Critical Current
Anticipated expiration legal-status Critical

Links

Images

Landscapes

  • Telephonic Communication Services (AREA)

Abstract

本发明一种适用于云平台的多语音控制方法,将特定人声识别引擎和非特定人声采集引擎相结合,通过特定人声识别引擎对用户的身份和口令进行认证,唤醒非特定人声采集引擎,这样,用户能够通过简单的口令唤醒整个语音引擎,然后再发出复杂的语音指令,由非特定人声采集引擎进行识别,转换成特定的加密命令并通过本地主机传送到控制终端,实现对整个智能平台的控制;用户无需专业知识和操作学习,就能完成对整个智能平台的操控,而且本发明可以判断命令者身份,由用户指定管理者和使用者,避免误操作。

Description

一种适用于云平台的多语音控制方法
技术领域
本发明涉及一种适用于云平台的多语音控制方法。
背景技术
目前的物联网平台多采用手动操控或计算机远程操控,存在操作繁杂及接口不统一的弊端,用户需要熟悉了产品的操作流程后方可进行操控,十分不方便。而且现有的语音控制方法因其单一性和非指向性,无法识别特定人员所发送的指令,极易受干扰并产生误操作。
发明内容
 本发明目的在于提供一种适用于云平台的多语音控制方法,用语音识别技术和云服务相结合,使用户可以非常容易地操控整个物联网智能控制平台,例如家居系统,生产系统,物流系统等,并可以通过语音控制从互联网及云端获取相应的资源。
一种适用于云平台的多语音控制方法,包括如下几个步骤:
步骤1、用户的口令采集
采集用户的口令信息,将预录入的口令信息转换成声纹和声音波形信息存入用户特征数据库;
步骤2、口令识别,激活非特定人声识别引擎:
特定人声识别引擎处于待机状态,当语音采集装置采集到声音信息时,将分解的声纹和声音波形信息发送给特定人声识别引擎,该特定人声识别引擎首先将收到的声纹信息与用户特征数据库中预录入的声纹信息进行比对,若相符则确认用户身份,进一步将声音波形信息与用户特征数据库中预录入的声音波形信息进行比对,若相符则确认口令,并发出包含经确认的用户身份和口令的激活编码,去激活非特定人声采集引擎,该特定人声识别引擎进入休眠状态;
当激活非特定人声采集引擎后,特定人声识别引擎进入休眠状态,二者不能同时进行工作;激活非特定人声采集引擎后,下一次语言采集装置采集到声音只会发送到非特定人声采集引擎中,非特定人声采集引擎若在一定时间内未接收到语音指令信息就进入休眠状态,而该特定人声识别引擎进入待机状态;
步骤3、识别用户发出的语音指令
语音采集装置将采集到的用户语音指令发送给非特定人声采集引擎,由其识别出包括“指令头+指令内容”的数据内容,经编码、加密和打包后上传给本地主机,本地主机对该上传数据校验、解密后,分离出该数据内容中的指令头进行判断,若是控制指令头,则识别该控制指令头对应的指令内容,由本地主机对相应设备实施控制;若为信息指令头,则将包括“指令头+指令内容”的数据内容上传给云端服务器,该云端服务器从该数据内容的指令内容中识别出关键字,由搜索引擎对关键字进行智能匹配后获得相关检索信息,并将该检索信息从云端服务器返回给本地主机,通过显示器显示给用户。
由于本发明将特定人声识别引擎和非特定人声采集引擎相结合,通过特定人声识别引擎对用户的身份和口令进行认证,唤醒非特定人声采集引擎,这样,用户能够通过简单的口令唤醒整个语音引擎,然后再发出复杂的语音指令,由非特定人声采集引擎进行识别,转换成特定的加密命令并通过本地主机传送到控制终端,实现对整个智能平台的控制。用户无需专业知识和操作学习,就能完成对整个智能平台的操控,而且本发明可以判断命令者身份,由用户指定管理者和使用者,避免误操作。本发明适用于家庭用户和行业用户,该家庭用户主要指智能家居、智能社区、智能建筑以及和家居相关的各个环境;行业用户主要指物流行业、监控行业、生产行业、服务行业和其他测控类行业。
附图说明
图1为本发明的工作流程图。
以下结合附图和具体实施例对本发明做进一步详述。
具体实施方式
本发明中的特定人声识别引擎指的是:用户可以通过呼叫预先设定好的系统识别关键字,如系统昵称等进行整个语音系统的唤醒和登录,该特定人声识别引擎中包含了特定人声识别系统以及声纹系统,可以同时判断发声人的身份和命令,并进行特定操作,该操作可由用户自行指定并保存在引擎中;
非特定人声识别引擎指的是:一个大型的语音识别和处理引擎,可以将用户所发出的指令和信息转换成特定格式的数据流,并进行关键字识别和拆分,并通过一定的规则将结果反馈到指定数据库或云平台,进行用户所需的操作转换。
如图1所示,本发明一种适用于云平台的多语音控制方法,包括如下几个步骤:
步骤1、用户的口令采集
采集用户的口令信息,将预录入的口令信息转换成声纹和声音波形信息存入用户特征数据库;
步骤2、口令识别,激活非特定人声识别引擎:
特定人声识别引擎处于待机状态,当语音采集装置采集到声音信息时,将分解的声纹和声音波形信息发送给特定人声识别引擎,该特定人声识别引擎首先将收到的声纹信息与用户特征数据库中预录入的声纹信息进行比对,若相符则确认用户身份,进一步将声音波形信息与用户特征数据库中预录入的声音波形信息进行比对,若相符则确认口令,并发出包含经确认的用户身份和口令的激活编码,去激活非特定人声采集引擎,该特定人声识别引擎进入休眠状态;
当激活非特定人声采集引擎后,特定人声识别引擎进入休眠状态,二者不能同时进行工作;激活非特定人声采集引擎后,下一次语言采集装置采集到声音只会发送到非特定人声采集引擎中,非特定人声采集引擎若在一定时间内未接收到语音指令信息就进入休眠状态,而该特定人声识别引擎进入待机状态;
步骤3、识别用户发出的语音指令
语音采集装置将采集到的用户语音指令发送给非特定人声采集引擎,由其识别出包括“指令头+指令内容”的数据内容,经编码、加密和打包后上传给本地主机,本地主机对该上传数据校验、解密后,分离出该数据内容中的指令头进行判断,若是控制指令头,则识别该控制指令头对应的指令内容,由本地主机对相应设备实施控制;若为信息指令头,则将包括“指令头+指令内容”的数据内容上传给云端服务器,该云端服务器从该数据内容的指令内容中识别出关键字,由搜索引擎对关键字进行智能匹配后获得相关检索信息,并将该检索信息从云端服务器返回给本地主机,通过显示器显示给用户。
本发明的重点在于:将特定人声识别引擎和非特定人声采集引擎相结合,通过特定人声识别引擎对用户的身份和口令进行认证,唤醒非特定人声采集引擎,这样,用户能够通过简单的口令唤醒整个语音引擎,然后再发出复杂的语音指令,由非特定人声采集引擎进行识别,转换成特定的加密命令并通过本地主机传送到控制终端,实现对整个智能平台的控制。用户无需专业知识和操作学习,就能完成对整个智能平台的操控,而且本发明可以判断命令者身份,由用户指定管理者和使用者,避免误操作。
以上所述,仅是本发明较佳实施例而已,并非对本发明的技术范围作任何限制,故凡是依据本发明的技术实质对以上实施例所作的任何细微修改、等同变化与修饰,均仍属于本发明技术方案的范围内。

Claims (1)

1.一种适用于云平台的多语音控制方法,其特征在于包括如下几个步骤:
步骤1、用户的口令采集
采集用户的口令信息,将预录入的口令信息转换成声纹和声音波形信息存入用户特征数据库;
步骤2、口令识别,激活非特定人声识别引擎:
特定人声识别引擎处于待机状态,当语音采集装置采集到声音信息时,将分解的声纹和声音波形信息发送给特定人声识别引擎,该特定人声识别引擎首先将收到的声纹信息与用户特征数据库中预录入的声纹信息进行比对,若相符则确认用户身份,进一步将声音波形信息与用户特征数据库中预录入的声音波形信息进行比对,若相符则确认口令,并发出包含经确认的用户身份和口令内容的激活编码,去激活非特定人声采集引擎,该特定人声识别引擎进入休眠状态;
当激活非特定人声采集引擎后,特定人声识别引擎进入休眠状态,二者不能同时进行工作;激活非特定人声采集引擎后,下一次语言采集装置采集到声音只会发送到非特定人声采集引擎中,非特定人声采集引擎若在一定时间内未接收到语音指令信息就进入休眠状态,而该特定人声识别引擎进入待机状态;
步骤3、识别用户发出的语音指令
语音采集装置将采集到的用户语音指令发送给非特定人声采集引擎,由其识别出包括“指令头+指令内容”的数据内容,其中“指令头”为机器可识别的语言,而“指令内容”仍为声音信息,待由本地主机或云端服务器进一步识别,该包括“指令头+指令内容”的数据内容经编码、加密和打包后上传给本地主机,本地主机对该上传数据校验、解密后,分离出该数据内容中的“指令头”进行判断,若是控制指令头,则进一步识别该“指令头”对应的“指令内容”,该“指令内容”即是控制指令,由本地主机按照该“指令内容”对相应设备实施控制;若为信息指令头,则本地主机直接将包括“指令头+指令内容”的数据内容上传给云端服务器,通过云端服务器中的云平台特征库从该数据内容的“指令内容”中识别出关键字,由搜索引擎对关键字进行智能匹配后获得相关检索信息,并将该检索信息从云端服务器返回给本地主机,通过显示器显示给用户。
CN201210127707XA 2012-04-27 2012-04-27 一种适用于云平台的多语音控制方法 Expired - Fee Related CN102682771B (zh)

Priority Applications (1)

Application Number Priority Date Filing Date Title
CN201210127707XA CN102682771B (zh) 2012-04-27 2012-04-27 一种适用于云平台的多语音控制方法

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
CN201210127707XA CN102682771B (zh) 2012-04-27 2012-04-27 一种适用于云平台的多语音控制方法

Publications (2)

Publication Number Publication Date
CN102682771A CN102682771A (zh) 2012-09-19
CN102682771B true CN102682771B (zh) 2013-11-20

Family

ID=46814586

Family Applications (1)

Application Number Title Priority Date Filing Date
CN201210127707XA Expired - Fee Related CN102682771B (zh) 2012-04-27 2012-04-27 一种适用于云平台的多语音控制方法

Country Status (1)

Country Link
CN (1) CN102682771B (zh)

Families Citing this family (144)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US8677377B2 (en) 2005-09-08 2014-03-18 Apple Inc. Method and apparatus for building an intelligent automated assistant
US9318108B2 (en) 2010-01-18 2016-04-19 Apple Inc. Intelligent automated assistant
US8977255B2 (en) 2007-04-03 2015-03-10 Apple Inc. Method and system for operating a multi-function portable electronic device using voice-activation
US10002189B2 (en) 2007-12-20 2018-06-19 Apple Inc. Method and apparatus for searching using an active ontology
US9330720B2 (en) 2008-01-03 2016-05-03 Apple Inc. Methods and apparatus for altering audio output signals
US20100030549A1 (en) 2008-07-31 2010-02-04 Lee Michael M Mobile device having human language translation capability with positional feedback
US8676904B2 (en) 2008-10-02 2014-03-18 Apple Inc. Electronic devices with voice command and contextual data processing capabilities
US20120309363A1 (en) 2011-06-03 2012-12-06 Apple Inc. Triggering notifications associated with tasks items that represent tasks to perform
US10276170B2 (en) 2010-01-18 2019-04-30 Apple Inc. Intelligent automated assistant
US8682667B2 (en) 2010-02-25 2014-03-25 Apple Inc. User profiling for selecting user specific voice input processing information
US9262612B2 (en) 2011-03-21 2016-02-16 Apple Inc. Device access using voice authentication
US10057736B2 (en) 2011-06-03 2018-08-21 Apple Inc. Active transport based notifications
US10134385B2 (en) 2012-03-02 2018-11-20 Apple Inc. Systems and methods for name pronunciation
US10417037B2 (en) 2012-05-15 2019-09-17 Apple Inc. Systems and methods for integrating third party services with a digital assistant
CN103152505A (zh) * 2012-10-23 2013-06-12 艾塔斯科技(镇江)有限公司 智慧型扫描仪及操作方法
CN102945671A (zh) * 2012-10-31 2013-02-27 四川长虹电器股份有限公司 语音识别方法
US9959865B2 (en) 2012-11-13 2018-05-01 Beijing Lenovo Software Ltd. Information processing method with voice recognition
CN103021409B (zh) * 2012-11-13 2016-02-24 安徽科大讯飞信息科技股份有限公司 一种语音启动拍照系统
CN103811004A (zh) * 2012-11-15 2014-05-21 上海船舶运输科学研究所 船舶主动力语音控制方法及系统
CN103095813A (zh) * 2012-12-31 2013-05-08 威盛电子股份有限公司 语音交互系统、移动终端装置及语音通信的方法
CN103051734A (zh) * 2013-01-23 2013-04-17 广东志高空调有限公司 家电远程语音控制方法、系统及通信终端
EP3809407A1 (en) 2013-02-07 2021-04-21 Apple Inc. Voice trigger for a digital assistant
US10652394B2 (en) 2013-03-14 2020-05-12 Apple Inc. System and method for processing voicemail
US10748529B1 (en) 2013-03-15 2020-08-18 Apple Inc. Voice activated device for use with a voice-based digital assistant
US9892729B2 (en) * 2013-05-07 2018-02-13 Qualcomm Incorporated Method and apparatus for controlling voice activation
WO2014197335A1 (en) 2013-06-08 2014-12-11 Apple Inc. Interpreting and acting upon commands that involve sharing information with remote devices
KR101922663B1 (ko) 2013-06-09 2018-11-28 애플 인크. 디지털 어시스턴트의 둘 이상의 인스턴스들에 걸친 대화 지속성을 가능하게 하기 위한 디바이스, 방법 및 그래픽 사용자 인터페이스
US10176167B2 (en) 2013-06-09 2019-01-08 Apple Inc. System and method for inferring user intent from speech inputs
CN103646646B (zh) * 2013-11-27 2018-08-31 联想(北京)有限公司 一种语音控制方法及电子设备
US9443522B2 (en) 2013-11-18 2016-09-13 Beijing Lenovo Software Ltd. Voice recognition method, voice controlling method, information processing method, and electronic apparatus
US10296160B2 (en) 2013-12-06 2019-05-21 Apple Inc. Method for extracting salient dialog usage from live data
US9633004B2 (en) 2014-05-30 2017-04-25 Apple Inc. Better resolution when referencing to concepts
US10170123B2 (en) 2014-05-30 2019-01-01 Apple Inc. Intelligent assistant for home automation
US9715875B2 (en) 2014-05-30 2017-07-25 Apple Inc. Reducing the need for manual start/end-pointing and trigger phrases
US9966065B2 (en) 2014-05-30 2018-05-08 Apple Inc. Multi-command single utterance input method
US9430463B2 (en) 2014-05-30 2016-08-30 Apple Inc. Exemplar-based natural language processing
US9338493B2 (en) 2014-06-30 2016-05-10 Apple Inc. Intelligent automated assistant for TV user interactions
US9818400B2 (en) 2014-09-11 2017-11-14 Apple Inc. Method and apparatus for discovering trending terms in speech requests
US10074360B2 (en) 2014-09-30 2018-09-11 Apple Inc. Providing an indication of the suitability of speech recognition
US9668121B2 (en) 2014-09-30 2017-05-30 Apple Inc. Social reminders
US10127911B2 (en) 2014-09-30 2018-11-13 Apple Inc. Speaker identification and unsupervised speaker adaptation techniques
CN105703978A (zh) * 2014-11-24 2016-06-22 武汉物联远科技有限公司 智能家居控制系统和方法
US10152299B2 (en) 2015-03-06 2018-12-11 Apple Inc. Reducing response latency of intelligent automated assistants
US9886953B2 (en) 2015-03-08 2018-02-06 Apple Inc. Virtual assistant activation
US9721566B2 (en) 2015-03-08 2017-08-01 Apple Inc. Competing devices responding to voice triggers
US10567477B2 (en) 2015-03-08 2020-02-18 Apple Inc. Virtual assistant continuity
CN104795068B (zh) * 2015-04-28 2018-08-17 深圳市锐曼智能装备有限公司 机器人的唤醒控制方法及其控制系统
US10460227B2 (en) 2015-05-15 2019-10-29 Apple Inc. Virtual assistant in a communication session
US10200824B2 (en) 2015-05-27 2019-02-05 Apple Inc. Systems and methods for proactively identifying and surfacing relevant content on a touch-sensitive device
US10083688B2 (en) 2015-05-27 2018-09-25 Apple Inc. Device voice control for selecting a displayed affordance
US9578173B2 (en) 2015-06-05 2017-02-21 Apple Inc. Virtual assistant aided communication with 3rd party service in a communication session
US11025565B2 (en) 2015-06-07 2021-06-01 Apple Inc. Personalized prediction of responses for instant messaging
US20160378747A1 (en) 2015-06-29 2016-12-29 Apple Inc. Virtual assistant for media playback
US10671428B2 (en) 2015-09-08 2020-06-02 Apple Inc. Distributed personal assistant
US10331312B2 (en) 2015-09-08 2019-06-25 Apple Inc. Intelligent automated assistant in a media environment
US10740384B2 (en) 2015-09-08 2020-08-11 Apple Inc. Intelligent automated assistant for media search and playback
US10747498B2 (en) 2015-09-08 2020-08-18 Apple Inc. Zero latency digital assistant
CN105629750A (zh) * 2015-10-29 2016-06-01 东莞酷派软件技术有限公司 一种智能家居控制方法及系统
CN105427861B (zh) * 2015-11-03 2019-02-15 胡旻波 智能家居协同麦克风语音控制的系统及其控制方法
US10691473B2 (en) 2015-11-06 2020-06-23 Apple Inc. Intelligent automated assistant in a messaging environment
US10956666B2 (en) 2015-11-09 2021-03-23 Apple Inc. Unconventional virtual assistant interactions
US10049668B2 (en) 2015-12-02 2018-08-14 Apple Inc. Applying neural network language models to weighted finite state transducers for automatic speech recognition
US10223066B2 (en) 2015-12-23 2019-03-05 Apple Inc. Proactive assistance based on dialog communication between devices
CN105609110A (zh) * 2016-01-25 2016-05-25 上海斐讯数据通信技术有限公司 一种应用在网络设备中的语音识别方法及系统
CN107464570A (zh) * 2016-06-06 2017-12-12 中兴通讯股份有限公司 一种语音过滤方法、装置及系统
US11227589B2 (en) 2016-06-06 2022-01-18 Apple Inc. Intelligent list reading
US10049663B2 (en) 2016-06-08 2018-08-14 Apple, Inc. Intelligent automated assistant for media exploration
US10586535B2 (en) 2016-06-10 2020-03-10 Apple Inc. Intelligent digital assistant in a multi-tasking environment
DK201670540A1 (en) 2016-06-11 2018-01-08 Apple Inc Application integration with a digital assistant
DK179415B1 (en) 2016-06-11 2018-06-14 Apple Inc Intelligent device arbitration and control
US10474753B2 (en) 2016-09-07 2019-11-12 Apple Inc. Language identification using recurrent neural networks
US10043516B2 (en) 2016-09-23 2018-08-07 Apple Inc. Intelligent automated assistant
US11281993B2 (en) 2016-12-05 2022-03-22 Apple Inc. Model and ensemble compression for metric learning
US11204787B2 (en) 2017-01-09 2021-12-21 Apple Inc. Application integration with a digital assistant
US20200013405A1 (en) * 2017-03-15 2020-01-09 Carrier Corporation A wireless event notification system with voice-based interaction
US10417266B2 (en) 2017-05-09 2019-09-17 Apple Inc. Context-aware ranking of intelligent response suggestions
DK201770383A1 (en) 2017-05-09 2018-12-14 Apple Inc. USER INTERFACE FOR CORRECTING RECOGNITION ERRORS
DK180048B1 (en) 2017-05-11 2020-02-04 Apple Inc. MAINTAINING THE DATA PROTECTION OF PERSONAL INFORMATION
US10395654B2 (en) 2017-05-11 2019-08-27 Apple Inc. Text normalization based on a data-driven learning network
US10726832B2 (en) 2017-05-11 2020-07-28 Apple Inc. Maintaining privacy of personal information
DK201770439A1 (en) 2017-05-11 2018-12-13 Apple Inc. Offline personal assistant
DK179745B1 (en) 2017-05-12 2019-05-01 Apple Inc. SYNCHRONIZATION AND TASK DELEGATION OF A DIGITAL ASSISTANT
DK179496B1 (en) 2017-05-12 2019-01-15 Apple Inc. USER-SPECIFIC Acoustic Models
DK201770429A1 (en) 2017-05-12 2018-12-14 Apple Inc. LOW-LATENCY INTELLIGENT AUTOMATED ASSISTANT
US11301477B2 (en) 2017-05-12 2022-04-12 Apple Inc. Feedback analysis of a digital assistant
DK201770431A1 (en) 2017-05-15 2018-12-20 Apple Inc. Optimizing dialogue policy decisions for digital assistants using implicit feedback
DK201770432A1 (en) 2017-05-15 2018-12-21 Apple Inc. Hierarchical belief states for digital assistants
US20180336892A1 (en) 2017-05-16 2018-11-22 Apple Inc. Detecting a trigger of a digital assistant
US10303715B2 (en) 2017-05-16 2019-05-28 Apple Inc. Intelligent automated assistant for media exploration
US10403278B2 (en) 2017-05-16 2019-09-03 Apple Inc. Methods and systems for phonetic matching in digital assistant services
DK179549B1 (en) 2017-05-16 2019-02-12 Apple Inc. FAR-FIELD EXTENSION FOR DIGITAL ASSISTANT SERVICES
US10311144B2 (en) 2017-05-16 2019-06-04 Apple Inc. Emoji word sense disambiguation
US10657328B2 (en) 2017-06-02 2020-05-19 Apple Inc. Multi-task recurrent neural network architecture for efficient morphology handling in neural language modeling
CN107564517A (zh) 2017-07-05 2018-01-09 百度在线网络技术(北京)有限公司 语音唤醒方法、设备及系统、云端服务器与可读介质
US10445429B2 (en) 2017-09-21 2019-10-15 Apple Inc. Natural language understanding using vocabularies with compressed serialized tries
US10755051B2 (en) 2017-09-29 2020-08-25 Apple Inc. Rule-based natural language processing
US10636424B2 (en) 2017-11-30 2020-04-28 Apple Inc. Multi-turn canned dialog
CN108062949A (zh) * 2017-12-11 2018-05-22 广州朗国电子科技有限公司 语音控制跑步机的方法及装置
CN108074571A (zh) * 2017-12-27 2018-05-25 深圳市亿道信息股份有限公司 增强现实设备的语音控制方法、系统及存储介质
US10733982B2 (en) 2018-01-08 2020-08-04 Apple Inc. Multi-directional dialog
US10733375B2 (en) 2018-01-31 2020-08-04 Apple Inc. Knowledge-based framework for improving natural language understanding
US10789959B2 (en) 2018-03-02 2020-09-29 Apple Inc. Training speaker recognition models for digital assistants
US10592604B2 (en) 2018-03-12 2020-03-17 Apple Inc. Inverse text normalization for automatic speech recognition
CN108538297B (zh) * 2018-03-12 2020-12-04 恒玄科技(上海)股份有限公司 一种基于无线麦克风阵列的智能语音交互方法及交互系统
US10818288B2 (en) 2018-03-26 2020-10-27 Apple Inc. Natural assistant interaction
US10909331B2 (en) 2018-03-30 2021-02-02 Apple Inc. Implicit identification of translation payload with neural machine translation
CN108665900B (zh) 2018-04-23 2020-03-03 百度在线网络技术(北京)有限公司 云端唤醒方法及系统、终端以及计算机可读存储介质
US11145294B2 (en) 2018-05-07 2021-10-12 Apple Inc. Intelligent automated assistant for delivering content from user experiences
US10928918B2 (en) 2018-05-07 2021-02-23 Apple Inc. Raise to speak
US10984780B2 (en) 2018-05-21 2021-04-20 Apple Inc. Global semantic word embeddings using bi-directional recurrent neural networks
CN108670128A (zh) * 2018-05-21 2018-10-19 深圳市沃特沃德股份有限公司 语音控制扫地机器人的方法和扫地机器人
US11386266B2 (en) 2018-06-01 2022-07-12 Apple Inc. Text correction
DK179822B1 (da) 2018-06-01 2019-07-12 Apple Inc. Voice interaction at a primary device to access call functionality of a companion device
DK201870355A1 (en) 2018-06-01 2019-12-16 Apple Inc. VIRTUAL ASSISTANT OPERATION IN MULTI-DEVICE ENVIRONMENTS
US10892996B2 (en) 2018-06-01 2021-01-12 Apple Inc. Variable latency device coordination
DK180639B1 (en) 2018-06-01 2021-11-04 Apple Inc DISABILITY OF ATTENTION-ATTENTIVE VIRTUAL ASSISTANT
US10496705B1 (en) 2018-06-03 2019-12-03 Apple Inc. Accelerated task performance
CN109102805A (zh) * 2018-09-20 2018-12-28 北京长城华冠汽车技术开发有限公司 语音交互方法、装置及实现装置
US11010561B2 (en) 2018-09-27 2021-05-18 Apple Inc. Sentiment prediction from textual data
US10839159B2 (en) 2018-09-28 2020-11-17 Apple Inc. Named entity normalization in a spoken dialog system
US11462215B2 (en) 2018-09-28 2022-10-04 Apple Inc. Multi-modal inputs for voice commands
US11170166B2 (en) 2018-09-28 2021-11-09 Apple Inc. Neural typographical error modeling via generative adversarial networks
US11475898B2 (en) 2018-10-26 2022-10-18 Apple Inc. Low-latency multi-speaker speech recognition
US11638059B2 (en) 2019-01-04 2023-04-25 Apple Inc. Content playback on multiple devices
US11348573B2 (en) 2019-03-18 2022-05-31 Apple Inc. Multimodality in digital assistant systems
DK201970509A1 (en) 2019-05-06 2021-01-15 Apple Inc Spoken notifications
US11423908B2 (en) 2019-05-06 2022-08-23 Apple Inc. Interpreting spoken requests
US11475884B2 (en) 2019-05-06 2022-10-18 Apple Inc. Reducing digital assistant latency when a language is incorrectly determined
US11307752B2 (en) 2019-05-06 2022-04-19 Apple Inc. User configurable task triggers
US11140099B2 (en) 2019-05-21 2021-10-05 Apple Inc. Providing message response suggestions
DK180129B1 (en) 2019-05-31 2020-06-02 Apple Inc. USER ACTIVITY SHORTCUT SUGGESTIONS
US11496600B2 (en) 2019-05-31 2022-11-08 Apple Inc. Remote execution of machine-learned models
US11289073B2 (en) 2019-05-31 2022-03-29 Apple Inc. Device text to speech
DK201970511A1 (en) 2019-05-31 2021-02-15 Apple Inc Voice identification in digital assistant systems
US11468890B2 (en) 2019-06-01 2022-10-11 Apple Inc. Methods and user interfaces for voice-based control of electronic devices
US11360641B2 (en) 2019-06-01 2022-06-14 Apple Inc. Increasing the relevance of new available information
WO2021056255A1 (en) 2019-09-25 2021-04-01 Apple Inc. Text detection using global geometry estimators
US11038934B1 (en) 2020-05-11 2021-06-15 Apple Inc. Digital assistant hardware abstraction
US11061543B1 (en) 2020-05-11 2021-07-13 Apple Inc. Providing relevant data items based on context
US11755276B2 (en) 2020-05-12 2023-09-12 Apple Inc. Reducing description length based on confidence
US11490204B2 (en) 2020-07-20 2022-11-01 Apple Inc. Multi-device audio adjustment coordination
US11438683B2 (en) 2020-07-21 2022-09-06 Apple Inc. User identification using headphones
CN111904728A (zh) * 2020-08-04 2020-11-10 无锡绿科源电子科技有限公司 基于辅助车的操作控制方法、装置以及电子设备
CN115881128B (zh) * 2023-02-07 2023-05-02 北京合思信息技术有限公司 一种基于历史匹配度的语音行为交互方法和装置

Citations (6)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
EP1426924A1 (en) * 2002-12-03 2004-06-09 Alcatel Speaker recognition for rejecting background speakers
CN101441869A (zh) * 2007-11-21 2009-05-27 联想(北京)有限公司 语音识别终端用户身份的方法及终端
CN101937693A (zh) * 2010-08-17 2011-01-05 深圳市子栋科技有限公司 基于语音命令的视音频播放方法及系统
CN101951553A (zh) * 2010-08-17 2011-01-19 深圳市子栋科技有限公司 基于语音命令的导航方法及系统
CN102299934A (zh) * 2010-06-23 2011-12-28 上海博路信息技术有限公司 一种基于云模式和语音识别的语音输入方法
CN102387131A (zh) * 2011-08-24 2012-03-21 厦门市鼎朔信息技术有限公司 一种基于无线网络和云数据中心的处理系统

Family Cites Families (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US7496510B2 (en) * 2000-11-30 2009-02-24 International Business Machines Corporation Method and apparatus for the automatic separating and indexing of multi-speaker conversations
US7519534B2 (en) * 2002-10-31 2009-04-14 Agiletv Corporation Speech controlled access to content on a presentation medium

Patent Citations (6)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
EP1426924A1 (en) * 2002-12-03 2004-06-09 Alcatel Speaker recognition for rejecting background speakers
CN101441869A (zh) * 2007-11-21 2009-05-27 联想(北京)有限公司 语音识别终端用户身份的方法及终端
CN102299934A (zh) * 2010-06-23 2011-12-28 上海博路信息技术有限公司 一种基于云模式和语音识别的语音输入方法
CN101937693A (zh) * 2010-08-17 2011-01-05 深圳市子栋科技有限公司 基于语音命令的视音频播放方法及系统
CN101951553A (zh) * 2010-08-17 2011-01-19 深圳市子栋科技有限公司 基于语音命令的导航方法及系统
CN102387131A (zh) * 2011-08-24 2012-03-21 厦门市鼎朔信息技术有限公司 一种基于无线网络和云数据中心的处理系统

Also Published As

Publication number Publication date
CN102682771A (zh) 2012-09-19

Similar Documents

Publication Publication Date Title
CN102682771B (zh) 一种适用于云平台的多语音控制方法
KR102216034B1 (ko) 스택 데이터 구조 백그라운드의 디지털 어시스턴트 프로세싱
CN204791954U (zh) 一种家居智能机器人的语音交互系统
CN203038075U (zh) 基于Android手机和电脑的远程语音智能控制系统
CN104538034A (zh) 一种语音识别方法及系统
JP6667931B2 (ja) 音声情報から時間情報を認識するための方法およびデバイス
CN103729193A (zh) 一种人机交互方法及装置
CN103714816A (zh) 电子装置、服务器及其控制方法
US11114095B2 (en) Information processing device
US20140004826A1 (en) System and method of speaker recognition
WO2018099000A1 (zh) 语音输入的处理方法、终端和网络服务器
CN103106717A (zh) 基于声纹识别的智能仓库声控门卫系统及其身份认证方法
CN105185378A (zh) 声控方法、声控系统及能够进行声控的空调
CN109346069A (zh) 一种基于人工智能的交互系统及装置
CN108304155A (zh) 一种人机交互控制方法
JP2017192091A (ja) 音声制御機能付きiotシステム及びその情報処理方法
CN106782547B (zh) 一种基于语音识别的机器人语义识别系统
CN114582318B (zh) 一种基于语音识别的智能家居控制方法及系统
CN110716706B (zh) 智能人机交互指令转换方法及系统
CN111583921A (zh) 语音控制方法、装置、计算机设备和存储介质
CN102855427A (zh) 一种设备解锁方法、装置及用户设备
CN106354538A (zh) 一种整机柜服务器操作系统的远程配置装置及方法
CN108055192A (zh) 群组生成方法、装置及系统
WO2018023523A1 (zh) 一种运动及情感识别家居控制系统
WO2018023514A1 (zh) 一种家居背景音乐控制系统

Legal Events

Date Code Title Description
C06 Publication
PB01 Publication
C10 Entry into substantive examination
SE01 Entry into force of request for substantive examination
C14 Grant of patent or utility model
GR01 Patent grant
TR01 Transfer of patent right

Effective date of registration: 20170320

Address after: Haicang District of Xiamen City, Fujian province 361000 Xinyang Street Weng Kok Road No. 289 Chong Building 209-2 unit

Patentee after: Xiamen cloud Smart Technology Co., Ltd.

Address before: 361000 Fujian province Xiamen City Siming District Siming Nan Lu 287-289 first layer unit 120

Patentee before: Xiamen Seed Electronic Technology Co., Ltd.

TR01 Transfer of patent right
CF01 Termination of patent right due to non-payment of annual fee

Granted publication date: 20131120

Termination date: 20190427

CF01 Termination of patent right due to non-payment of annual fee