WO2021031290A1 - 一种用于耳机对的翻译方法、装置、耳机对及翻译系统 - Google Patents

一种用于耳机对的翻译方法、装置、耳机对及翻译系统 Download PDF

Info

Publication number
WO2021031290A1
WO2021031290A1 PCT/CN2019/107897 CN2019107897W WO2021031290A1 WO 2021031290 A1 WO2021031290 A1 WO 2021031290A1 CN 2019107897 W CN2019107897 W CN 2019107897W WO 2021031290 A1 WO2021031290 A1 WO 2021031290A1
Authority
WO
WIPO (PCT)
Prior art keywords
earphone
translation
signal
electronic device
voice signal
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Ceased
Application number
PCT/CN2019/107897
Other languages
English (en)
French (fr)
Inventor
张海宏
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Goertek Inc
Original Assignee
Goertek Inc
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Goertek Inc filed Critical Goertek Inc
Publication of WO2021031290A1 publication Critical patent/WO2021031290A1/zh
Anticipated expiration legal-status Critical
Ceased legal-status Critical Current

Links

Images

Classifications

    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L13/00Speech synthesis; Text to speech systems
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/005Language recognition
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition
    • G10L15/26Speech to text systems
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04WWIRELESS COMMUNICATION NETWORKS
    • H04W4/00Services specially adapted for wireless communication networks; Facilities therefor
    • H04W4/80Services using short range communication, e.g. near-field communication [NFC], radio-frequency identification [RFID] or low energy communication
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04WWIRELESS COMMUNICATION NETWORKS
    • H04W76/00Connection management
    • H04W76/10Connection setup
    • H04W76/14Direct-mode setup
    • HELECTRICITY
    • H04ELECTRIC COMMUNICATION TECHNIQUE
    • H04WWIRELESS COMMUNICATION NETWORKS
    • H04W76/00Connection management
    • H04W76/30Connection release

Definitions

  • the signal is translated and processed to obtain a second translated signal
  • the translation method may further include:
  • the translation method may further include:
  • the first continuous duration of the first voice signal detected by the first user not inputting the first voice signal exceeds the preset third duration threshold, it can indicate that the translation process is over, and therefore, the first headset can be disconnected from the electronic device Bluetooth link between.
  • the first user A uses the first headset M
  • the second user B uses the second headset S
  • the first headset M and the second headset S can be used to establish a Bluetooth link with the electronic device P road.
  • the processor 1100 may be a mobile version processor.
  • the memory 1200 includes, for example, ROM (Read Only Memory), RAM (Random Access Memory), non-volatile memory such as a hard disk, and the like.
  • the interface device 1300 includes, for example, a USB interface, a headphone interface, and the like.
  • the communication device 1400 can perform wired or wireless communication, for example.
  • the communication device 1400 may include a Bluetooth device for performing Bluetooth communication with the first earphone M or the second earphone S through the Bluetooth protocol.
  • the display device 1500 is, for example, a liquid crystal display, a touch display, or the like.
  • the input device 1600 may include, for example, a touch screen, a keyboard, and the like. The user can input/output voice information through the speaker 1700 and the microphone 1800.
  • the present invention may only involve some of the devices.
  • the electronic device P only involves the memory 1200, the processor 1100, and the communication device 1400.
  • step S2004 the first earphone M detects whether the translation process of the second earphone S is finished when the first event occurs when the first user A inputs the first voice signal.
  • step S2007 the first earphone M obtains the first voice signal input by the first user A, and uploads the first voice signal to the electronic device P through the Bluetooth link.
  • step S2008 the electronic device P performs translation processing on the first voice signal to obtain the first translated signal.
  • step S2014 the first earphone M detects the first continuous duration during which the first user A has not input the first voice signal.
  • step S3007 the electronic device P performs translation processing on the second speech signal to obtain a second translated signal.
  • Step S3008 The electronic device P sends the second translation signal through the Bluetooth link.
  • the translation device 5000 may further include:
  • the translation device 5000 for the earphone pair may have multiple implementation forms.
  • the translation device 5000 for the earphone pair may be any software product or functional module running in an application that provides network access services. , Or peripheral embedded parts, plug-ins, patches, etc. of these software products or applications, or these software products or applications themselves.

Landscapes

  • Engineering & Computer Science (AREA)
  • Computer Networks & Wireless Communication (AREA)
  • Signal Processing (AREA)
  • Computational Linguistics (AREA)
  • Health & Medical Sciences (AREA)
  • Audiology, Speech & Language Pathology (AREA)
  • Human Computer Interaction (AREA)
  • Physics & Mathematics (AREA)
  • Acoustics & Sound (AREA)
  • Multimedia (AREA)
  • Telephone Function (AREA)
  • Headphones And Earphones (AREA)

Abstract

本发明公开了一种用于耳机对的翻译方法、装置、耳机对及翻译系统,该耳机对包括对应的第一耳机和第二耳机,用于与电子设备建立蓝牙链路;该翻译方法包括:控制第一耳机与电子设备建立蓝牙链路;控制第一耳机获取用户输入的第一语音信号,并通过蓝牙链路将第一语音信号上传至电子设备,以供电子设备对第一语音信号进行翻译处理得到第一翻译信号;控制第一耳机和第二耳机获取电子设备通过蓝牙链路发送的第一翻译信号;控制第一耳机和第二耳机播放第一翻译信号。

Description

一种用于耳机对的翻译方法、装置、耳机对及翻译系统
本申请要求于2019年8月22日提交中国专利局、申请号201910780680.6、申请名称为“一种用于耳机对的翻译方法、装置、耳机对及翻译系统”的中国专利申请的优先权,其全部内容通过引用结合在本申请中。
技术领域
本发明涉及耳机翻译技术领域,更具体地,本发明涉及一种用于耳机对的翻译方法、装置、耳机对及翻译系统。
背景技术
随着社会的发展和进步,各行各业全球化国际化的步伐越来越快,不管在工作还是在生活中和外国人沟通的概率越来越高。虽然手机应用和桌面应用都开启了语音在线翻译服务,为两个说着不同语言的人架起了沟通的桥梁,但这两种方式实在是不够便捷,实用性不高。而且只能完成单向完成从第一语言到第二语言的同声翻译,无法实现不同用户分别使用第一语言到第二语言进行无障碍交谈的效果。
如果单独使用手机进行交流翻译服务,用户需要手动在第一语言到第二语言上进行切换,导致不同用户分别使用第一语言到第二语言进行交谈时非常的不便利。
因此,提出一种语音翻译方法,以使用户获得更好的使用体验的方案。
发明内容
本发明的一个目的是提供一种能够解决上述问题之一的新的技术方案。
根据本发明的第一方面,提供了一种用于耳机对的翻译方法,所述耳机对包括对应的第一耳机和第二耳机,所述耳机对用于与电子设备建立蓝牙链路;所述翻译方法包括:
控制所述第一耳机与所述电子设备建立蓝牙链路;
控制所述第一耳机获取第一用户输入的第一语音信号,并通过所述蓝牙链路将所述第一语音信号上传至所述电子设备,以供所述电子设备对所述第一语音信号进行翻译处理得到第一翻译信号;
控制所述第一耳机和所述第二耳机获取所述电子设备通过所述蓝牙链路发送的所述第一翻译信号;
控制所述第一耳机和所述第二耳机播放所述第一翻译信号。
可选的,所述翻译方法还包括:
控制所述第二耳机获取所述蓝牙链路的信道参数;
控制所述第二耳机获取第二用户输入的第二语音信号,并根据所述信道参数,将所述第二语音信号上传至所述电子设备,以供所述电子设备对所述第二语音信号进行翻译处理得到第二翻译信号;
控制所述第一耳机和所述第二耳机获取所述电子设备通过所述蓝牙链路发送的所述第二翻译信号;
控制所述第一耳机和所述第二耳机播放所述第二翻译信号。
可选的,控制所述第一耳机和所述第二耳机获取所述电子设备通过所述蓝牙链路发送的所述翻译信号包括:
控制所述第一耳机通过所述蓝牙链路接收所述翻译信号;其中,所述翻译信号为所述第一翻译信号或所述第二翻译信号;
控制所述第二耳机根据所述信道参数监听所述蓝牙链路,获取所述翻译信号。
可选的,所述翻译方法还包括:
在控制所述第一耳机播放所述第一翻译信号之后,控制所述第一耳机检测所述第一用户未输入所述第一语音信号的第一连续时长;
在所述第一连续时长超过预设的第一时长阈值时,控制所述第一耳机向所述第二耳机发送自身翻译过程结束的第一结束通知,以供所述第二耳机在接收到所述第一结束通知的情况下,获取所述第二用户输入的所述第二语音信号。
可选的,所述翻译方法还包括:
在所述第一耳机向所述第二耳机发送所述第一结束通知的情况下,控制所述第一耳机的第一麦克风和第一射频发送单元停止工作。
可选的,所述翻译方法还包括:
控制所述第一耳机检测用户输入第一语音信号的第一事件是否发生;
在所述第一事件发生的情况下,控制所述第一耳机的第一麦克风和第一射频发送单元启动工作,以获取所述第一用户输入的所述第一语音信号。
可选的,所述翻译方法还包括:
在控制所述第一耳机的第一麦克风和第一射频发送单元启动工作的情况下,控制所述第一耳机发出提醒警报。
可选的,所述翻译方法还包括:
在控制所述第一耳机获取第一用户输入的第一语音信号的情况下,控制所述第一耳机向所述第二耳机发送自身翻译过程启动的第一启动通知,以在所述第二耳机在接收到所述 第一启动通知、且未接收到所述第一结束通知的情况下,控制所述第二耳机停止获取所述第二用户输入的所述第二语音信号。
可选的,所述翻译方法还包括:
通过所述第一耳机检测用户未输入所述第一语音信号的连续时长;
在所述连续时长超过预设的第三时长阈值时,断开所述第一耳机与所述电子设备之间的所述蓝牙链路。
可选的,所述蓝牙链路为SCO同步链路或者ACL异步链路或者BLE链路。
根据本发明的第二方面,提供了一种用于耳机对的翻译装置,所述耳机对包括对应的第一耳机和第二耳机,所述耳机对用于与电子设备建立蓝牙链路;所述翻译装置包括:
第一链路建立模块,用于控制所述第一耳机与所述电子设备建立蓝牙链路;
第一语音上传模块,用于控制所述第一耳机获取用户输入的第一语音信号,并通过所述蓝牙链路将所述第一语音信号上传至所述电子设备,以供所述电子设备对所述第一语音信号进行翻译处理得到第一翻译信号;
第一翻译获取模块,用于控制所述第一耳机和所述第二耳机获取所述电子设备通过所述蓝牙链路发送的所述第一翻译信号;
第一信号播放模块,用于控制所述第一耳机和所述第二耳机播放所述第一翻译信号。
根据本发明的第三方面,提供了一种耳机对,所述耳机对包括:
根据本发明第二方面所述的翻译装置;或者,
处理器和存储器,所述存储器用于存储指令,所述指令用于控制所述处理器执行根据本发明第一方面所述的翻译方法。
根据本发明的第四方面,提供了一种翻译系统,包括电子设备、及根据本发明第三方面所述的耳机对;其中,所述电子设备用于与所述耳机对的第一耳机建立蓝牙链路,通过所述蓝牙链路接收所述第一耳机上传的第一语音信号,并对所述第一语音信号进行翻译处理,得到第一翻译信号,并将所述第一翻译信号通过所述蓝牙链路发送至所述第一耳机。
本发明的一个有益效果在于,通过本实施例的翻译方法,两个不同语言的用户分别佩戴第一耳机和第二耳机,使用不同的语言进行交谈时,可以分别听到对方语音翻译成本国语言的语音,无语言障碍地进行沟通交谈。而且第一耳机和第二耳机均可以获取到电子设备发送的第一翻译信号,无需第一耳机将获取的第一翻译信号转发至第二耳机中,可以使得第一耳机和第二耳机获取到第一翻译信号的延迟较小;无需第一耳机断开蓝牙链路和第二耳机重新连接蓝牙链路的过程,可以使得第一用户和第二用户在交谈时无需等待蓝牙链路建立的过程时间。
通过以下参照附图对本发明的示例性实施例的详细描述,本发明的其它特征及其优点将会变得清楚。
附图说明
被结合在说明书中并构成说明书的一部分的附图示出了本发明的实施例,并且连同其说明一起用于解释本发明的原理。
图1为根据本发明实施例的用于耳机对的翻译方法的流程图;
图2为根据本发明实施例的用于耳机对的翻译方法的一个例子的流程图;
图3为根据本发明实施例的用于耳机对的翻译方法的另一个例子的流程图;
图4为根据本发明实施例的翻译系统的示意图;
图5为根据本发明实施例的用于耳机对的翻译装置的一个例子的原理框图;
图6为根据本发明实施例的用于耳机对的翻译装置的一个例子的原理框图;
图7为根据本发明实施例的耳机对一个例子的原理框图。
具体实施方式
现在将参照附图来详细描述本发明的各种示例性实施例。应注意到:除非另外具体说明,否则在这些实施例中阐述的部件和步骤的相对布置、数字表达式和数值不限制本发明的范围。
以下对至少一个示例性实施例的描述实际上仅仅是说明性的,决不作为对本发明及其应用或使用的任何限制。
对于相关领域普通技术人员已知的技术、方法和设备可能不作详细讨论,但在适当情况下,所述技术、方法和设备应当被视为说明书的一部分。
在这里示出和讨论的所有例子中,任何具体值应被解释为仅仅是示例性的,而不是作为限制。因此,示例性实施例的其它例子可以具有不同的值。
应注意到:相似的标号和字母在下面的附图中表示类似项,因此,一旦某一项在一个附图中被定义,则在随后的附图中不需要对其进行进一步讨论。
<方法实施例>
为了解决现有技术中存在的不同语言用户之间沟通通过电子设备上的翻译应用来实现的方法实用性较差问题,提供了一种用于耳机对的翻译方法。该翻译方法可以是由耳机对来实现,该耳机对可以包括对应的第一耳机和第二耳机,该耳机对用于与电子设备建立蓝牙链路。
相对应的第一耳机和第二耳机是一副真无线耳机(TWS耳机),第一耳机和第二耳机之间可以通过TWS协议传输数据。在本发明的实施例中,第一耳机和第二耳机之间可以通过TWS协议传输信道参数和通知,无需在第一耳机和第二耳机之间传输语音信号或者是翻译信号。
图1为根据本发明实施例的用于耳机对的翻译方法的流程图。
如图1所示,该翻译方法可以包括如下所示的步骤S1100~S1400:
步骤S1100,控制第一耳机与电子设备建立蓝牙链路。
在本发明的一个实施例中,第一耳机与电子设备之间可以是通过蓝牙连接,建立蓝牙链路。
该蓝牙链路可以是SCO同步链路或者ACL异步链路或者BLE链路。
在蓝牙链路为SCO同步链路的情况下,第一耳机与电子设备之间可以建立HFP连接,第一耳机与电子设备之间可以通过HFP协议在SCO同步链路上直接进行语音信号的上下行同步传输(如打电话)。
在蓝牙链路为ACL异步链路的情况下,第一耳机与电子设备之间可以建立A2DP连接和SPP连接,第一耳机与电子设备之间可以在ACL异步链路中,通过A2DP协议进行语音信号的下行异步传输(如听音乐),通过SPP协议进行语音信号的上下行异步传输。
在蓝牙链路时BLE链路的情况下,第一耳机与电子设备建立BLE链接,第一耳机和电子设备通过数据协议或语音协议进行上下行传输。可选的是,第二耳机和电子设备也可以建立BLE链接,通过数据协议或语音协议进行上下行传输。步骤S1200,控制第一耳机获取第一用户输入的第一语音信号,并通过蓝牙链路将第一语音信号上传至电子设备,以供电子设备对第一语音信号进行翻译处理得到第一翻译信号。
在本实施例中,第一耳机上可以是设置有第一麦克风和第一射频发送单元,第一麦克风以用于采集第一用户输入的第一语音信号,第一射频发送单元可以用于将第一语音信号上传至电子设备中。该第一射频发送单元可以是由第一耳机中的蓝牙芯片提供。
本实施例中的电子设备可以是手机、智能手表、平板电脑等能够实现语音翻译功能的电子产品。
当电子设备接收到第一语音信号之后,可以将第一语音信号转换为文字进行翻译,再将翻译后的文字转换为语音信号,得到第一翻译信号。
进一步地,电子设备需提前设置好翻译的源语言类型为第一用户使用的第一语言,目标语言类型为使用第二耳机的第二用户能够听懂的第二语言,当检测到的第一语音信号的语音为源语言类型时,电子设备就能够将第一语言的第一语音信号翻译为第二语言的第一翻译信号。
上述文字翻译过程可以是通过翻译引擎实现的,文字和语音之间的转换例如可以是通过语音识别引擎来实现的。
在本实施例中,电子设备在得到第一翻译信号之后,可以是将第一翻译信号通过该蓝牙链路进行发送。
步骤S1300,控制第一耳机和第二耳机获取电子设备通过蓝牙链路发送的第一翻译信号。
在一个实施例中,第一耳机在与电子设备建立蓝牙链路的情况下,会将该蓝牙链路的信道参数发送至第二耳机,供第二耳机获取。
在此基础上,控制第一耳机和第二耳机获取电子设备通过蓝牙链路发送的第一翻译信号的步骤包括:
控制第一耳机通过该蓝牙链路接收第一翻译信号;控制第二耳机根据信道参数监听该蓝牙链路,获取第一翻译信号。
具体的,电子设备可以是通过蓝牙链路来发送第一翻译信号,由于第一耳机通过蓝牙链路与电子设备连接,因此,第一耳机可以直接接收到电子设备通过蓝牙链路发送的第一翻译信号。
另外,第二耳机可以是采用监听的方式,接收跳频点和频带等信道参数和第一耳机完全相同。因此,第二耳机可以采用监听的方式获取到电子设备通过蓝牙链路发送的第一翻译信号,无需第一耳机转发。
这个过程就像从电子设备到第二耳机之间有一条虚拟的蓝牙链路来同时传输第一翻译信号。
在本实施例中,可以是第一耳机和第二耳机之间建立TWS连接,可以通过TWS协议传输信道参数。
具体的,可以是第一耳机将自身的蓝牙地址、发送频点、接收跳频点和频带等信道参数通过TWS协议传输至第二耳机,供第二耳机模拟第一耳机的接收跳频点和频带,实现蓝牙链路的监听,获取电子设备通过蓝牙链路发送至第一耳机的第一翻译信号。
在蓝牙链路为SCO链路的情况下,电子设备可以将第一翻译信号通过基带编码成蓝牙数据包,并通过射频发送。第二耳机采用监听的方式,接收跳频点和频带等信息和第一耳机完全相同。第一耳机和第二耳机均收到相同的蓝牙基带数据包,并进行解析得到第一翻译信号。这个过程就相当于是从电子设备到第二耳机之间有一条虚拟的SCO链路来同时传输第一翻译信号。
在蓝牙链路为ACL链路的情况下,电子设备可以是对第一翻译信号进行编码并封装成A2DP协议的数据包,然后再封装成蓝牙基带协议包,通过ACL链路向第一耳机的蓝牙地址发送。第一耳机直接接收并解析该蓝牙基带协议包,得到第一翻译信号。第二耳机采用 监听的方式,和第一耳机采用同样的频点策略进行蓝牙基带协议包的接收,并用与第一耳机相同的耳机蓝牙地址等信息进行解析,得到第一翻译信号。这样第一耳机和第二耳机就同时收到了下行的协议的数据包,并解码成第一翻译信号。这个过程看起来相当于是第二耳机和电子设备之间建立了一条虚拟的A2DP异步链路。
在蓝牙链路为BLE链路的情况下,电子设备可以将第一翻译信号通过按照相关数据协议或语音协议,直接发送给第一耳机和第二耳机。
步骤S1400,控制第一耳机和第二耳机播放第一翻译信号。
在本实施例中,第一耳机和第二耳机均可以获取到电子设备发送的第一翻译信号,无需第一耳机将获取的第一翻译信号转发至第二耳机中,可以使得第一耳机和第二耳机获取到第一翻译信号的延迟较小。
在本发明的一个实施例中,该翻译方法还可以包括如下所示的步骤S2100~S2400:
步骤S2100,控制第二耳机获取蓝牙链路的信道参数。
步骤S2200,控制第二耳机获取第二用户输入的第二语音信号,并根据该信道参数将第二语音信号上传至电子设备,以供电子设备对第二语音信号进行翻译处理得到第二翻译信号。
在本发明的一个或多个实施例中,第二语音信号为通过第二耳机采集的语音信号。对应的,第二耳机上可以设置有第二麦克风,可以用于采集第二用户输入的二语音信号。
在本实施例中,第二耳机可以是根据蓝牙链路的信道参数,模拟第一耳机向电子设备上传第二语音信号,无需第一耳机断开蓝牙链路和第二耳机重新连接蓝牙链路的过程,可以使得第一用户和第二用户在交谈时无需等待蓝牙链路建立的过程时间。
在一个实施例中,第二耳机上可以是设置有第二麦克风和第二射频发送单元。第二麦克风用于采集第二语音信号,第二射频发送单元用于将第二语音信号上传至电子设备中。该第二射频发送单元可以是由第二耳机中的蓝牙芯片提供。
在本实施例中,当电子设备接收到第二语音信号之后,可以将第二语音信号转换为文字进行翻译,再将翻译后的文字转换为语音信号,得到第二翻译信号。
进一步地,电子设备需提前设置好翻译的源语言类型为第二用户使用的第二语言,目标语言类型为使用第一耳机的第一用户能够听懂的第一语言,当检测到的第二语音信号的语音为源语言类型时,电子设备就能够将第二语言的第二语音信号翻译为第一语言的第二翻译信号。
步骤S2300,控制第一耳机和第二耳机获取电子设备通过蓝牙链路发送的第二翻译信号。
在一个例子中,控制第一耳机和第二耳机获取电子设备通过第二翻译链路发送的第二翻译信号可以包括:
控制第一耳机通过蓝牙链路接收第二翻译信号;控制第一耳机根据信道参数监听蓝牙链路,获取第二翻译信号。具体可以参照前述的控制第一耳机和第二耳机获取电子设备通过蓝牙链路发送的第一翻译信号的描述,在此不再赘述。
步骤S2400,控制第一耳机和第二耳机播放第二翻译信号。
在本发明的一个或多个实施例中,该翻译方法还可以包括:
在控制第一耳机播放第一翻译信号之后,控制第一耳机检测第一用户未输入第一语音信号的第一连续时长;在第一连续时长超过预设的第一时长阈值的情况下,控制第一耳机向第二耳机发送自身翻译过程结束的第一结束通知,以供第二耳机在接收到第一结束通知的情况下,获取第二用户输入的第二语音信号。
具体的,第一连续时长具体可以是第一耳机在播放完第一翻译信号之后,检测到的第一用户未输入第一语音信号的连续时长。
在本实施例中,第一耳机和第二耳机之间通过蓝牙连接,并可以通过TWS协议传输该第一结束通知。
该第一时长阈值可以是预先根据应用场景或具体需求预先设定,还可以根据用户实际需求进行更改。
对应的,该翻译方法还可以包括:
在控制第二耳机播放第二翻译信号之后,控制第二耳机检测第二用户未输入第二语音信号的第二连续时长;在第二连续时长超过预设的第二时长阈值时,控制第二耳机向第一耳机发送自身翻译过程结束的第二结束通知,以供第一耳机在接收到第二结束通知的情况下,获取第一用户输入的第一语音信号。
具体的,第二连续时长具体可以是第二耳机在播放完第二翻译信号之后,检测到的第二用户未输入第二语音信号的连续时长。
在本实施例中,第一耳机和第二耳机之间可以通过TWS协议传输该第二结束通知。
该第二时长阈值可以是预先根据应用场景或具体需求预先设定,还可以根据用户实际需求进行更改。
进一步地,第一时长阈值和第二时长阈值可以相等,也可以不相等。
在本发明的一个或多个实施例中,该翻译方法还可以包括:
在第一耳机向第二耳机发送第一结束通知的情况下,控制第一耳机的第一麦克风和第一射频发送单元停止工作。
这样,可以降低第一耳机在未进行翻译过程中的功耗,延长第一耳机的使用时长。
对应的,该翻译方法还可以包括:
在第二耳机向第一耳机发送第二结束通知的情况下,控制第二耳机的第二麦克风和第二射频发送单元停止工作。
这样,可以降低第二耳机在未进行翻译过程中的功耗,延长第二耳机的使用时长。
在本发明的一个或多个实施例中,该翻译方法还可以包括:
控制第一耳机检测用户输入第一语音信号的第一事件是否发生;
在第一事件发生的情况下,控制第一耳机的第一麦克风和第一射频发送单元启动工作,以获取第一用户输入的第一语音信号。
该第一事件可以包括:
接收到第一用户输入的第一语音信号;和/或,
第一用户针对第一耳机执行的指定操作。
在第一事件为接收到用户输入的第一语音信号的情况下,第一耳机可以是通过语音活性检测算法,来检测第一用户输入第一语音信号的第一事件是否发生。语音活性检测(Voice activity detection,VAD)也称为speech activity detection or speech detection,是一项用于语音处理的技术,目的是检测语音信号是否存在。对应的,第一耳机中可以设置有第一语音活性检测单元,用于检测第一用户输入第一语音信号的第一事件是否发生。
在第一事件为第一用户针对第一耳机执行的指定操作的情况下,该指定操作可以是第一用户控制第一耳机执行指定的动作、或者第一用户点击第一耳机上的指定按键。
在检测到第一事件发生的情况下,表明第一用户要讲话,因此,需要控制第一耳机的第一麦克风和第一射频发送单元启动工作,保证第一耳机正常工作。
对应的,该翻译方法还可以包括:
控制第二耳机检测用户输入第二语音信号的第二事件是否发生;
在第二事件发生的情况下,控制第二耳机的第二麦克风和第二射频发送单元启动工作,以获取第二用户输入的第二语音信号。
其中,第二事件可以包括:
接收到第二用户输入的第二语音信号;和/或,
第二用户针对第二耳机执行的指定操作。
在第二事件为接收到用户输入的第二语音信号的情况下,第二耳机可以是通过语音活性检测算法,来检测第二用户输入第二语音信号的第二事件是否发生。对应的,第二耳机 中可以设置有第二语音活性检测单元,用于检测第二用户输入第二语音信号的第二事件是否发生。
在第二事件为第二用户针对第二耳机执行的指定操作的情况下,该指定操作可以是第二用户控制第二耳机执行指定的动作、或者第二用户点击第二耳机上的指定按键。
在检测到第二事件发生的情况下,表明第二用户要讲话,因此,需要控制第二耳机的第二麦克风和第二射频发送单元启动工作,保证第二耳机正常工作。
在本发明的一个或多个实施例中,该翻译方法还可以包括:
在控制第一耳机的第一麦克风和第一射频发送单元启动工作的情况下,控制第一耳机发出提醒警报。
在本实施例中,在第一耳机的第一麦克风和第一射频发送单元启动工作的情况下,控制第一耳机发出提醒警报,可以提醒第一用户可以开始讲话,且可以通过该耳机对和电子设备翻译给第二用户。
对应的,该翻译方法还可以包括:
在控制第二耳机的第二麦克风和第一射频发送单元启动工作的情况下,控制第二耳机发出提醒警报,可以提醒第二用户可以开始讲话,且可以通过该耳机对和电子设备翻译给第一用户。
在一个例子中,提醒警报的方式例如可以是播放指定的提示音、发光或者是振动等。
以蓝牙链路上行采用的是SCO链路为例,当需要第一耳机向电子设备通过SCO蓝牙链路发送第一语音信号时,第一耳机的第一麦克风开启,第一射频发送单元开启射频发送功能;第二耳机的第二麦克风关闭,第二射频发送单元关闭射频发送功能。第一耳机按照HFP协议,对第一麦克风采集的第一语音信号进行封装以及基带封包,向电子设备的蓝牙地址发送第一语音信号。
当需要第二耳机向电子设备通过SCO蓝牙链路发送第二语音信号时,第二耳机的第二麦克风开启,第二射频发送单元开启射频发送功能;第一耳机的第一麦克风关闭,第一射频发送单元关闭射频发送功能。第二耳机按照相同的HFP协议,对第二麦克风采集的第二语音信号进行封装以及基带封包,向电子设备的蓝牙地址发送第二语音信号。
上行语音信号的发送可以是由第一耳机或者是第二耳机执行的,这个过程中电子设备的HFP是始终和第一耳机的蓝牙地址保持连接(具体的,是第一耳机和第二耳机用同一个蓝牙地址和电子设备保持连接)。
这样,在翻译过程中,第一耳机和电子设备之间的蓝牙链路不需要断开再连接,而是类似于在第二耳机和电子设备之间建立一种虚拟连接的方式进行语音信号的下行和上行的 传输。从而整个过程中的链路延时非常小,从而使得真正的同声翻译在耳机对中的应用有了可能性。
通过本实施例的翻译方法,两个不同语言的用户分别佩戴第一耳机和第二耳机,使用不同的语言进行交谈时,可以分别听到对方语音翻译成本国语言的语音,无语言障碍地进行沟通交谈。
在本发明的一个或多个实施例中,为了保证在第二用户讲话的过程中,第一用户说话对翻译过程产生干扰,该翻译方法还可以包括:
在控制第一耳机获取第一用户输入的第一语音信号的情况下,控制第一耳机向第二耳机发送自身翻译过程启动的第一启动通知,以在第二耳机在接收到第一启动通知、且未接收到第一结束通知的情况下,控制第二耳机停止获取第二用户输入的第二语音信号。
在第二耳机接收到第一启动通知、且未接收到第一结束通知的情况下,表明该耳机对和电子设备正在执行对第一语音信号的翻译过程,因此,通过控制第二耳机停止获取第二用户输入的第二语音信号,来防止语音信号间的干扰。
在第二耳机接收到第一启动通知、且未接收到第一结束通知的情况下,如果第二耳机检测到第二事件发生,则可以通过发出指定提示音、发光或者是振动提醒第二用户进行等待。
对应的,为了保证在第一用户讲话的过程中,第二用户说话对翻译过程产生干扰,该翻译方法还可以包括:
在控制第二耳机获取第二用户输入的第一语音信号的情况下,控制第二耳机向第一耳机发送自身翻译过程启动的第二启动通知,以供第一耳机在接收到第二启动通知、且未接收到第二结束通知的情况下,控制第一耳机停止获取第一用户输入的第一语音信号。
在第一耳机接收到第二启动通知、且未接收到第二结束通知的情况下,表明该耳机对和电子设备正在执行对第二语音信号的翻译过程,因此,通过控制第一耳机停止获取第一用户输入的第一语音信号,来防止语音信号间的干扰。
在第一耳机接收到第二启动通知、且未接收到第二结束通知的情况下,如果第一耳机检测到第一事件发生,则可以通过发出指定提示音、发光或者是振动提醒第一用户进行等待。
在本发明的一个实施例中,该翻译方法还可以包括:
在第一耳机检测到的第一用户未输入第一语音信号的第一连续时长超过预设的第三时长阈值的情况下,断开第一耳机与电子设备之间的蓝牙链路。
在第一耳机检测到的第一用户未输入第一语音信号的第一连续时长超过预设的第三时长阈值的情况下,可以表明翻译过程结束,因此,可以断开第一耳机与电子设备之间的蓝牙链路。
<翻译系统>
图4为用于实现本发明的翻译方法的翻译系统的示意图。
在如图4所示的翻译系统中,第一用户A使用第一耳机M,第二用户B使用第二耳机S,第一耳机M和第二耳机S可以用于与电子设备P建立蓝牙链路。
参照图4所示,第一耳机M可以包括第一语音活性检测单元M1、第一麦克风M2、第一扬声器M3、第一射频发送单元M4、第一射频接收模块M5和第一处理单元M6。
第一语音模型检测单元M1可以用于检测第一用户A输入第一语音信号的第一事件是否发生。第一麦克风M2用于获取第一用户A输入的第一语音信号。第一处理单元M6用于按照对应的协议对第一语音信号进行封装,得到对应的数据包。第一射频发送单元M4用于将第一处理单元M6得到的数据包发送至电子设备P。第一射频接收单元M5用于接收电子设备P发送的数据包。第一处理单元M6还用于对接收到的数据包进行解析,得到第一翻译信号。第一扬声器M3用于播放第一翻译信号。第一处理单元M6还可以用于在第一语音模型检测单元M1检测到第一事件发生的情况下,控制第一麦克风M2和第一射频发送单元M4启动工作;在检测到第一用户A未输入第一语音信号的连续时长超过预设的时长阈值的情况下,控制第一麦克风M2和第一射频发送单元M4停止工作。
第二语音模型检测单元S1可以用于检测第二用户B输入第二语音信号的第二事件是否发生。第二麦克风S2用于获取第二用户B输入的第二语音信号。第二处理单元S6用于按照对应的协议对第二语音信号进行封装,得到对应的数据包。第二射频发送单元S4用于将第二处理单元S6得到的数据包发送至电子设备P。第二射频接收单元S5用于接收电子设备P发送的数据包。第二处理单元S6还用于对接收到的数据包进行解析,得到第二翻译信号。第二扬声器S3用于播放第二翻译信号。第二处理单元S6还可以用于在第二语音模型检测单元S1检测到第二事件发生的情况下,控制第二麦克风S2和第二射频发送单元S4启动工作;在检测到第二用户B未输入第二语音信号的连续时长超过预设的时长阈值的情况下,控制第二麦克风S2和第二射频发送单元S4停止工作。
本实施例中,参照图4所示,电子设备P可以包括处理器1100、存储器1200、接口装置1300、通信装置1400、显示装置1500、输入装置1600、扬声器1700、麦克风1800等等。
处理器1100可以是移动版处理器。存储器1200例如包括ROM(只读存储器)、RAM(随机存取存储器)、诸如硬盘的非易失性存储器等。接口装置1300例如包括USB接口、耳机接口等。通信装置1400例如能够进行有线或无线通信,通信装置1400可以包括蓝牙 装置,用于通过蓝牙协议与第一耳机M或第二耳机S进行蓝牙通信。显示装置1500例如是液晶显示屏、触摸显示屏等。输入装置1600例如可以包括触摸屏、键盘等。用户可以通过扬声器1700和麦克风1800输入/输出语音信息。
尽管在图4中示出了电子设备P的多个装置,但是,本发明可以仅涉及其中的部分装置,例如,电子设备P只涉及存储器1200和处理器1100和通信装置1400。
<例子1>
下面以一个具体的例子来说明本发明实施例的翻译方法实施的过程。该例子1以图4所示的翻译系统为例,对本实施例的翻译方法进行描述。
该翻译方法可以包括如图2所示的步骤S2001~S2015:
步骤S2001,第一耳机M与电子设备P建立蓝牙链路。
步骤S2002,第一耳机M检测第一用户A输入第一语音信号的第一事件是否发生。
步骤S2003,第一用户A使用第一耳机M输入第一语音信号。
步骤S2004,第一耳机M在检测到第一用户A输入第一语音信号的第一事件发生的情况下,检测第二耳机S的翻译过程是否结束。
在第一耳机M接收到第二耳机S发送的第二结束通知的情况下,确定第二耳机S的翻译过程结束。
步骤S2005,第一耳机M在检测到第二耳机S的翻译过程结束的情况下,控制第一麦克风和第一射频发送单元启动,并发出提醒警报,以提醒使用第一用户A可以输入第一语音信号,与使用第二耳机S的第二用户B进行交谈。
步骤S2006,第一耳机M向第二耳机S发送第一启动通知和蓝牙链路的信道参数。
步骤S2007,第一耳机M获取第一用户A输入的第一语音信号,并通过蓝牙链路将第一语音信号上传至电子设备P。
步骤S2008,电子设备P对第一语音信号进行翻译处理得到第一翻译信号。
步骤S2009,电子设备P通过蓝牙链路发送第一翻译信号。
步骤S2010,第一耳机M通过蓝牙链路接收第一翻译信号。
步骤S2011,第二耳机S根据信道参数监听蓝牙链路,获取第一翻译信号。
步骤S2012,第一耳机M播放第一翻译信号。
步骤S2013,第二耳机S播放第一翻译信号。
步骤S2014,第一耳机M检测第一用户A未输入第一语音信号的第一连续时长。
步骤S2015,第一耳机M在第一连续时长超过预设的第一时长阈值的情况下,向第二耳机发送第一结束通知,以通知第二耳机自身的翻译过程结束。
步骤S2016,第一耳机M在第一连续时长超过预设的第三时长阈值的情况下,,断开与电子设备P之间的蓝牙链路。
<例子2>
在以上例子1基础上,该翻译方法还可以包括如图3所示的步骤S3001~S3015:
步骤S3001,第二耳机S检测第二用户B输入第二语音信号的第二事件是否发生。
步骤S3002,第二用户B使用第二耳机S输入第二语音信号。
步骤S3003,第二耳机S在检测到第二用户B输入第二语音信号的第二事件发生的情况下,检测第一耳机M的翻译过程是否结束。
在第二耳机S接收到第一耳机M发送的第一结束通知的情况下,确定第一耳机M的翻译过程结束。
步骤S3004,第二耳机S在检测到第一耳机M的翻译过程结束的情况下,控制第二麦克风和第二射频发送单元启动,并发出提醒警报,以提醒使用第二用户B可以输入第二语音信号,与使用第一耳机M的第一用户A进行交谈。
步骤S3005,第二耳机S向第一耳机M发送第二启动通知。
步骤S3006,第二耳机S获取第二用户B输入的第二语音信号,并根据信道参数,将第二语音信号上传至电子设备P。
步骤S3007,电子设备P对第二语音信号进行翻译处理得到第二翻译信号。
步骤S3008,电子设备P通过蓝牙链路发送第二翻译信号。
步骤S3009,第一耳机M通过蓝牙链路接收第二翻译信号。
步骤S3010,第二耳机S根据信道参数监听蓝牙链路,获取第二翻译信号。
步骤S3011,第二耳机S播放第二翻译信号。
步骤S3012,第一耳机M播放第二翻译信号。
步骤S3013,第二耳机S检测第二用户B未输入第二语音信号的第二连续时长。
步骤S3014,第二耳机S在第二连续时长超过预设的第二时长阈值的情况下,向第一耳机发送第一结束通知,以通知第一耳机自身的翻译过程结束。
<装置实施例>
在本实施例中,提供一种用于耳机对的翻译装置5000,其中,该耳机对包括对应的第一耳机和第二耳机,该耳机对用于与电子设备建立蓝牙链路。
如图5所示,翻译装置5000包括第一链路建立模块5100、第一语音上传模块5200、第一翻译获取模块5300和第一信号播放模块5400,该第一链路建立模块5100用于控制第一耳机与电子设备建立蓝牙链路;该第一语音上传模块5200用于控制第一耳机获取用户输入的第一语音信号,并通过蓝牙链路将第一语音信号上传至电子设备,以供电子设备对第一语音信号进行翻译处理得到第一翻译信号;该第一翻译获取模块5300用于控制第一耳机和第二耳机获取电子设备通过蓝牙链路发送的第一翻译信号;该第一信号播放模块5400用于控制第一耳机和第二耳机播放第一翻译信号。
在本发明的一个或多个实施例中,如图6所示,该翻译装置5000还可以包括:信道参数获取模块6100、第二语音上传模块6200、第二翻译获取模块6300和第二信号播放模块6400。该信道参数获取模块6100用于控制第二耳机获取蓝牙链路的信道参数;该第二语音上传模块6200用于控制第二耳机获取第二用户输入的第二语音信号,并根据信道参数,将第二语音信号上传至电子设备,以供电子设备对第二语音信号进行翻译处理得到第二翻译信号;该第二翻译获取模块6300用于控制第一耳机和第二耳机获取电子设备通过蓝牙链路发送的第二翻译信号;该第二信号播放模块6400用于控制第一耳机和第二耳机播放第二翻译信号。
在本发明的一个或多个实施例中,第一翻译获取模块5300还可以用于:控制第一耳机通过蓝牙链路接收第一翻译信号;控制第二耳机根据信道参数监听蓝牙链路,获取第一翻译信号。第二翻译获取模块6300还可以用于:控制第一耳机通过蓝牙链路接收第二翻译信号;控制第二耳机根据信道参数监听蓝牙链路,获取第二翻译信号。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在控制第一耳机播放第一翻译信号之后,控制第一耳机检测第一用户未输入第一语音信号的第一连续时长的模块;
用于在第一连续时长超过预设的第一时长阈值时,控制第一耳机向第二耳机发送自身翻译过程结束的第一结束通知,以供第二耳机在接收到第一结束通知的情况下,获取第二用户输入的第二语音信号的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在控制第二耳机播放第二翻译信号之后,控制第二耳机检测第二用户未输入第二语音信号的第二连续时长的模块;
用于在第二连续时长超过预设的第二时长阈值时,控制第二耳机向第一耳机发送自身翻译过程结束的第二结束通知,以供第一耳机在接收到第二结束通知的情况下,获取第一用户输入的第一语音信号的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在第一耳机向第二耳机发送第一结束通知的情况下,控制第一耳机的第一麦克风和第一射频发送单元停止工作的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在第二耳机向第一耳机发送第二结束通知的情况下,控制第二耳机的第二麦克风和第二射频发送单元停止工作的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于控制第一耳机检测用户输入第一语音信号的第一事件是否发生的模块;
用于在第一事件发生的情况下,控制第一耳机的第一麦克风和第一射频发送单元启动工作,以获取第一用户输入的第一语音信号的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于控制第二耳机检测用户输入第二语音信号的第二事件是否发生的模块;
用于在第二事件发生的情况下,控制第二耳机的第二麦克风和第二射频发送单元启动工作,以获取第二用户输入的第二语音信号的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在控制第一耳机的第一麦克风和第一射频发送单元启动工作的情况下,控制第一耳机发出提醒警报的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在控制第二耳机的第二麦克风和第二射频发送单元启动工作的情况下,控制第二耳机发出提醒警报的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在控制第一耳机获取第一用户输入的第一语音信号的情况下,控制第一耳机向第二耳机发送自身翻译过程启动的第一启动通知,以在第二耳机在接收到第一启动通知、且未接收到第一结束通知的情况下,控制第二耳机停止获取第二用户输入的第二语音信号的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在控制第二耳机获取第二用户输入的第二语音信号的情况下,控制第二耳机向第一耳机发送自身翻译过程启动的第二启动通知,以在第一耳机在接收到第二启动通知、且未接收到第二结束通知的情况下,控制第一耳机停止获取第一用户输入的第一语音信号的模块。
在本发明的一个或多个实施例中,该翻译装置5000还可以包括:
用于在第一用户未输入第一语音信号的第一连续时长超过预设的第三时长阈值时,断开第一耳机与电子设备之间的蓝牙链路的模块。
在本发明的一个或多个实施例中,该蓝牙链路为SCO同步链路或者ACL异步链路或者BLE链路。
本领域技术人员应当明白,可以通过各种方式来实现用于耳机对的翻译装置5000。例如,可以通过指令配置处理器来实现用于耳机对的翻译装置5000。例如,可以将指令存储在ROM中,并且当启动设备时,将指令从ROM读取到可编程器件中来实现用于耳机对的翻译装置5000。例如,可以将用于耳机对的翻译装置5000固化到专用器件(例如ASIC)中。可以将用于耳机对的翻译装置5000分成相互独立的单元,或者可以将它们合并在一起实现。用于耳机对的翻译装置5000可以通过上述各种实现方式中的一种来实现,或者可以通过上述各种实现方式中的两种或更多种方式的组合来实现。
在本实施例中,用于耳机对的翻译装置5000可以具有多种实现形式,例如,用于耳机对的翻译装置5000可以是任何的提供网络访问服务的软件产品或者应用程序中运行的功能模块,或者是这些软件产品或者应用程序的外设嵌入件、插件、补丁件等,还可以是这些软件产品或者应用程序本身。
<耳机对>
在本实施例中,还提供一种耳机对7000,该耳机对7000包括对应的第一耳机和第二耳机,且第一耳机和/或第二耳机可以通过蓝牙与电子设备建立对应的蓝牙链路。
在一个实施例中,该耳机对7000可以包括根据本发明任意实施例的用于耳机对的翻译装置5000,用于实施本发明任意实施例的用于耳机对的翻译方法。
在另一个实施例中,如图7所示,耳机对7000还可以包括处理器7100和存储器7200,该存储器7200用于存储可执行的指令;该处理器7100用于根据指令的控制运行耳机对7000执行根据本发明任意实施例的用于耳机对的翻译方法。
<翻译系统>
在本实施例中,还提供一种翻译系统,该翻译系统包括电子设备和前述任意实施例的耳机对。该耳机对用于执行本发明任意实施例的用于耳机对的翻译方法。
该电子设备用于:与耳机对的第一耳机建立蓝牙链路,通过蓝牙链路接收第一耳机上传的第一语音信号,并对第一语音信号进行翻译处理,得到第一翻译信号,并将第一翻译信号通过蓝牙链路发送至第一耳机。
上述各实施例主要重点描述与其他实施例的不同之处,但本领域技术人员应当清楚的是,上述各实施例可以根据需要单独使用或者相互结合使用。
本说明书中的各个实施例均采用递进的方式描述,各个实施例之间相同相似的部分相互参见即可,每个实施例重点说明的都是与其他实施例的不同之处,但本领域技术人员应当清楚的是,上述各实施例可以根据需要单独使用或者相互结合使用。另外,对于装置实施例而言,由于其是与方法实施例相对应,所以描述得比较简单,相关之处参见方法实施例的对应部分的说明即可。以上所描述的系统实施例仅仅是示意性的,其中作为分离部件说明的模块可以是或者也可以不是物理上分开的。
本发明可以是装置、方法和/或计算机程序产品。计算机程序产品可以包括计算机可读存储介质,其上载有用于使处理器实现本发明的各个方面的计算机可读程序指令。
计算机可读存储介质可以是可以保持和存储由指令执行设备使用的指令的有形设备。计算机可读存储介质例如可以是――但不限于――电存储设备、磁存储设备、光存储设备、电磁存储设备、半导体存储设备或者上述的任意合适的组合。计算机可读存储介质的更具体的例子(非穷举的列表)包括:便携式计算机盘、硬盘、随机存取存储器(RAM)、只读存储器(ROM)、可擦式可编程只读存储器(EPROM或闪存)、静态随机存取存储器(SRAM)、便携式压缩盘只读存储器(CD-ROM)、数字多功能盘(DVD)、记忆棒、软盘、机械编码设备、例如其上存储有指令的打孔卡或凹槽内凸起结构、以及上述的任意合适的组合。这里所使用的计算机可读存储介质不被解释为瞬时信号本身,诸如无线电波或者其他自由传播的电磁波、通过波导或其他传输媒介传播的电磁波(例如,通过光纤电缆的光脉冲)、或者通过电线传输的电信号。
这里所描述的计算机可读程序指令可以从计算机可读存储介质下载到各个计算/处理设备,或者通过网络、例如因特网、局域网、广域网和/或无线网下载到外部计算机或外部存储设备。网络可以包括铜传输电缆、光纤传输、无线传输、路由器、防火墙、交换机、网关计算机和/或边缘服务器。每个计算/处理设备中的网络适配卡或者网络接口从网络接收计算机可读程序指令,并转发该计算机可读程序指令,以供存储在各个计算/处理设备中的计算机可读存储介质中。
用于执行本发明操作的计算机程序指令可以是汇编指令、指令集架构(ISA)指令、机器指令、机器相关指令、微代码、固件指令、状态设置数据、或者以一种或多种编程语言的任意组合编写的源代码或目标代码,所述编程语言包括面向对象的编程语言—诸如Smalltalk、C++等,以及常规的过程式编程语言—诸如“C”语言或类似的编程语言。计算机可读程序指令可以完全地在用户计算机上执行、部分地在用户计算机上执行、作为一个 独立的软件包执行、部分在用户计算机上部分在远程计算机上执行、或者完全在远程计算机或服务器上执行。在涉及远程计算机的情形中,远程计算机可以通过任意种类的网络—包括局域网(LAN)或广域网(WAN)—连接到用户计算机,或者,可以连接到外部计算机(例如利用因特网服务提供商来通过因特网连接)。在一些实施例中,通过利用计算机可读程序指令的状态信息来个性化定制电子电路,例如可编程逻辑电路、现场可编程门阵列(FPGA)或可编程逻辑阵列(PLA),该电子电路可以执行计算机可读程序指令,从而实现本发明的各个方面。
这里参照根据本发明实施例的方法、装置(系统)和计算机程序产品的流程图和/或框图描述了本发明的各个方面。应当理解,流程图和/或框图的每个方框以及流程图和/或框图中各方框的组合,都可以由计算机可读程序指令实现。
这些计算机可读程序指令可以提供给通用计算机、专用计算机或其它可编程数据处理装置的处理器,从而生产出一种机器,使得这些指令在通过计算机或其它可编程数据处理装置的处理器执行时,产生了实现流程图和/或框图中的一个或多个方框中规定的功能/动作的装置。也可以把这些计算机可读程序指令存储在计算机可读存储介质中,这些指令使得计算机、可编程数据处理装置和/或其他设备以特定方式工作,从而,存储有指令的计算机可读介质则包括一个制造品,其包括实现流程图和/或框图中的一个或多个方框中规定的功能/动作的各个方面的指令。
也可以把计算机可读程序指令加载到计算机、其它可编程数据处理装置、或其它设备上,使得在计算机、其它可编程数据处理装置或其它设备上执行一系列操作步骤,以产生计算机实现的过程,从而使得在计算机、其它可编程数据处理装置、或其它设备上执行的指令实现流程图和/或框图中的一个或多个方框中规定的功能/动作。
附图中的流程图和框图显示了根据本发明的多个实施例的系统、方法和计算机程序产品的可能实现的体系架构、功能和操作。在这点上,流程图或框图中的每个方框可以代表一个模块、程序段或指令的一部分,所述模块、程序段或指令的一部分包含一个或多个用于实现规定的逻辑功能的可执行指令。在有些作为替换的实现中,方框中所标注的功能也可以以不同于附图中所标注的顺序发生。例如,两个连续的方框实际上可以基本并行地执行,它们有时也可以按相反的顺序执行,这依所涉及的功能而定。也要注意的是,框图和/或流程图中的每个方框、以及框图和/或流程图中的方框的组合,可以用执行规定的功能或动作的专用的基于硬件的系统来实现,或者可以用专用硬件与计算机指令的组合来实现。对于本领域技术人员来说公知的是,通过硬件方式实现、通过软件方式实现以及通过软件和硬件结合的方式实现都是等价的。
以上已经描述了本发明的各实施例,上述说明是示例性的,并非穷尽性的,并且也不限于所披露的各实施例。在不偏离所说明的各实施例的范围和精神的情况下,对于本技术领域的普通技术人员来说许多修改和变更都是显而易见的。本文中所用术语的选择,旨在最好地解释各实施例的原理、实际应用或对市场中的技术的技术改进,或者使本技术领域的其它普通技术人员能理解本文披露的各实施例。本发明的范围由所附权利要求来限定。

Claims (13)

  1. 一种用于耳机对的翻译方法,其特征在于,所述耳机对包括对应的第一耳机和第二耳机,所述耳机对用于与电子设备建立蓝牙链路;所述翻译方法包括:
    控制所述第一耳机与所述电子设备建立蓝牙链路;
    控制所述第一耳机获取第一用户输入的第一语音信号,并通过所述蓝牙链路将所述第一语音信号上传至所述电子设备,以供所述电子设备对所述第一语音信号进行翻译处理得到第一翻译信号;
    控制所述第一耳机和所述第二耳机获取所述电子设备通过所述蓝牙链路发送的所述第一翻译信号;
    控制所述第一耳机和所述第二耳机播放所述第一翻译信号。
  2. 根据权利要求1所述的翻译方法,其特征在于,所述翻译方法还包括:
    控制所述第二耳机获取所述蓝牙链路的信道参数;
    控制所述第二耳机获取第二用户输入的第二语音信号,并根据所述信道参数,将所述第二语音信号上传至所述电子设备,以供所述电子设备对所述第二语音信号进行翻译处理得到第二翻译信号;
    控制所述第一耳机和所述第二耳机获取所述电子设备通过所述蓝牙链路发送的所述第二翻译信号;
    控制所述第一耳机和所述第二耳机播放所述第二翻译信号。
  3. 根据权利要求2所述的翻译方法,其特征在于,所述控制所述第一耳机和所述第二耳机获取所述电子设备通过所述蓝牙链路发送的所述翻译信号包括:
    控制所述第一耳机通过所述蓝牙链路接收所述翻译信号;其中,所述翻译信号为所述第一翻译信号或所述第二翻译信号;
    控制所述第二耳机根据所述信道参数监听所述蓝牙链路,获取所述翻译信号。
  4. 根据权利要求2所述的翻译方法,其特征在于,所述翻译方法还包括:
    在控制所述第一耳机播放所述第一翻译信号之后,控制所述第一耳机检测所述第一用户未输入所述第一语音信号的第一连续时长;
    在所述第一连续时长超过预设的第一时长阈值时,控制所述第一耳机向所述第二耳机发送自身翻译过程结束的第一结束通知,以供所述第二耳机在接收到所述第一结束通知的情况下,获取所述第二用户输入的所述第二语音信号。
  5. 根据权利要求4所述的翻译方法,其特征在于,所述翻译方法还包括:
    在所述第一耳机向所述第二耳机发送所述第一结束通知的情况下,控制所述第一耳机的第一麦克风和第一射频发送单元停止工作。
  6. 根据权利要求5所述的翻译方法,其特征在于,所述翻译方法还包括:
    控制所述第一耳机检测用户输入第一语音信号的第一事件是否发生;
    在所述第一事件发生的情况下,控制所述第一耳机的第一麦克风和第一射频发送单元启动工作,以获取所述第一用户输入的所述第一语音信号。
  7. 根据权利要求6所述的翻译方法,其特征在于,所述翻译方法还包括:
    在控制所述第一耳机的第一麦克风和第一射频发送单元启动工作的情况下,控制所述第一耳机发出提醒警报。
  8. 根据权利要求4所述的翻译方法,其特征在于,所述翻译方法还包括:
    在控制所述第一耳机获取第一用户输入的第一语音信号的情况下,控制所述第一耳机向所述第二耳机发送自身翻译过程启动的第一启动通知,以在所述第二耳机在接收到所述第一启动通知、且未接收到所述第一结束通知的情况下,控制所述第二耳机停止获取所述第二用户输入的所述第二语音信号。
  9. 根据权利要求1所述的翻译方法,其特征在于,所述翻译方法还包括:
    通过所述第一耳机检测用户未输入所述第一语音信号的连续时长;
    在所述连续时长超过预设的第三时长阈值时,断开所述第一耳机与所述电子设备之间的所述蓝牙链路。
  10. 根据权利要求1所述的翻译方法,其特征在于,所述蓝牙链路为SCO同步链路或者ACL异步链路或者BLE链路。
  11. 一种用于耳机对的翻译装置,其特征在于,所述耳机对包括对应的第一耳机和第二耳机,所述耳机对用于与电子设备建立蓝牙链路;所述翻译装置包括:
    第一链路建立模块,用于控制所述第一耳机与所述电子设备建立蓝牙链路;
    第一语音上传模块,用于控制所述第一耳机获取用户输入的第一语音信号,并通过所述蓝牙链路将所述第一语音信号上传至所述电子设备,以供所述电子设备对所述第一语音信号进行翻译处理得到第一翻译信号;
    第一翻译获取模块,用于控制所述第一耳机和所述第二耳机获取所述电子设备通过所述蓝牙链路发送的所述第一翻译信号;
    第一信号播放模块,用于控制所述第一耳机和所述第二耳机播放所述第一翻译信号。
  12. 一种耳机对,其特征在于,所述耳机对包括:
    根据权利要求11所述的翻译装置;或者,
    处理器和存储器,所述存储器用于存储指令,所述指令用于控制所述处理器执行根据权利要求1至10中任一项所述的翻译方法。
  13. 一种翻译系统,其特征在于,包括电子设备、及根据权利要求12所述的耳机对;其中,所述电子设备用于与所述耳机对的第一耳机建立蓝牙链路,通过所述蓝牙链路接收所述第一耳机上传的第一语音信号,并对所述第一语音信号进行翻译处理,得到第一翻译信号,并将所述第一翻译信号通过所述蓝牙链路发送至所述第一耳机。
PCT/CN2019/107897 2019-08-22 2019-09-25 一种用于耳机对的翻译方法、装置、耳机对及翻译系统 Ceased WO2021031290A1 (zh)

Applications Claiming Priority (2)

Application Number Priority Date Filing Date Title
CN201910780680.6 2019-08-22
CN201910780680.6A CN110602675A (zh) 2019-08-22 2019-08-22 一种用于耳机对的翻译方法、装置、耳机对及翻译系统

Publications (1)

Publication Number Publication Date
WO2021031290A1 true WO2021031290A1 (zh) 2021-02-25

Family

ID=68855210

Family Applications (1)

Application Number Title Priority Date Filing Date
PCT/CN2019/107897 Ceased WO2021031290A1 (zh) 2019-08-22 2019-09-25 一种用于耳机对的翻译方法、装置、耳机对及翻译系统

Country Status (2)

Country Link
CN (1) CN110602675A (zh)
WO (1) WO2021031290A1 (zh)

Families Citing this family (7)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN111314814A (zh) * 2020-01-19 2020-06-19 湖南国声声学科技股份有限公司 基于tws蓝牙耳机的翻译方法、移动终端、tws蓝牙耳机及存储介质
CN111556476B (zh) * 2020-04-17 2021-01-19 炬力(珠海)微电子有限公司 蓝牙tws设备间的数据传输方法及蓝牙tws设备
CN111526440B (zh) 2020-04-27 2022-03-01 歌尔科技有限公司 一种通话场景下tws耳机的主从耳切换方法、装置及介质
CN111696554B (zh) * 2020-06-05 2022-04-26 北京搜狗科技发展有限公司 一种翻译方法、装置、耳机和耳机收纳装置
CN111696552B (zh) * 2020-06-05 2023-09-22 北京搜狗科技发展有限公司 一种翻译方法、装置和耳机
CN112446223B (zh) * 2020-11-23 2024-09-20 维沃移动通信有限公司 翻译方法、装置及电子设备
WO2025043558A1 (zh) * 2023-08-30 2025-03-06 深圳时空壶技术有限公司 一种基于蓝牙耳机的语音翻译系统及其方法

Citations (5)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN106851450A (zh) * 2016-12-26 2017-06-13 歌尔科技有限公司 一种无线耳机对及电子设备
CN107885731A (zh) * 2017-11-06 2018-04-06 深圳市沃特沃德股份有限公司 语音翻译方法和装置
CN107894881A (zh) * 2017-10-18 2018-04-10 恒玄科技(上海)有限公司 蓝牙耳机的主从连接切换、通话监听和麦克切换的方法
CN109543198A (zh) * 2018-11-29 2019-03-29 与德科技有限公司 翻译方法、装置、系统及存储介质
EP3474156A1 (en) * 2017-10-20 2019-04-24 Tap Sound System Real-time voice processing

Family Cites Families (4)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
WO2018057524A1 (en) * 2016-09-21 2018-03-29 Apple Inc. Real-time relay of wireless communications
US10517111B2 (en) * 2016-09-21 2019-12-24 Apple Inc. Mitigating scheduling conflicts in wireless communication devices
CN109151789B (zh) * 2018-09-30 2021-08-17 Oppo广东移动通信有限公司 翻译方法、装置、系统以及蓝牙耳机
CN110046358A (zh) * 2019-03-11 2019-07-23 厦门盈趣科技股份有限公司 一种基于tws技术的无线蓝牙翻译耳机

Patent Citations (5)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN106851450A (zh) * 2016-12-26 2017-06-13 歌尔科技有限公司 一种无线耳机对及电子设备
CN107894881A (zh) * 2017-10-18 2018-04-10 恒玄科技(上海)有限公司 蓝牙耳机的主从连接切换、通话监听和麦克切换的方法
EP3474156A1 (en) * 2017-10-20 2019-04-24 Tap Sound System Real-time voice processing
CN107885731A (zh) * 2017-11-06 2018-04-06 深圳市沃特沃德股份有限公司 语音翻译方法和装置
CN109543198A (zh) * 2018-11-29 2019-03-29 与德科技有限公司 翻译方法、装置、系统及存储介质

Also Published As

Publication number Publication date
CN110602675A (zh) 2019-12-20

Similar Documents

Publication Publication Date Title
WO2021031290A1 (zh) 一种用于耳机对的翻译方法、装置、耳机对及翻译系统
US10803880B2 (en) Method, device, and system for audio data processing
US10225510B2 (en) Providing a log of events to an isolated user
US9973561B2 (en) Conferencing based on portable multifunction devices
TWI593270B (zh) 有效混合網路電話資料之系統及方法
JP2015515643A (ja) インスタントコミュニケーション音声認識方法および端末
US11573761B2 (en) Audio-based near field communication
CN105493177A (zh) 保护来自周围环境的谈话的隐私
CN106982286B (zh) 一种录音方法、设备和计算机可读存储介质
CN107481721A (zh) 用于可穿戴电子设备的语音交互方法和可穿戴电子设备
WO2025060820A1 (zh) 基于人工智能的翻译系统、翻译用智能眼镜及翻译方法
US20170195817A1 (en) Simultaneous Binaural Presentation of Multiple Audio Streams
CN105721492B (zh) 一种语音处理的方法、装置以及终端
Lopez et al. Development and technical validation of the mobile based assistive listening system: a smartphone-based remote microphone
US10678499B1 (en) Audio interface device and audio interface system
CN106528037B (zh) 一种音频处理方法及终端
US20110216915A1 (en) Providing audible information to a speaker system via a mobile communication device
KR101945174B1 (ko) Ptt 통신 서비스를 실행하기 위한 기록매체에 저장된 프로그램
WO2015175938A1 (en) Asynchronous auditory messaging facilitation apparatuses, methods and systems
Lesner et al. Apps with amps: Mobile devices, hearing assistive technology, and older adults
Jeevitha et al. A review on voice over internet protocol on conference call with mobile phone
US20220131621A1 (en) Pairing electronic devices through an accessory device
Ito et al. A Study on Effect of IP Performance Degradation on Horizontal Sound Localization in a VoIP Phone Service with 3D Sound Effects
WO2018010432A1 (zh) 一种基于声码标签的配置方法及设备、存储介质

Legal Events

Date Code Title Description
121 Ep: the epo has been informed by wipo that ep was designated in this application

Ref document number: 19942487

Country of ref document: EP

Kind code of ref document: A1

NENP Non-entry into the national phase

Ref country code: DE

122 Ep: pct application non-entry in european phase

Ref document number: 19942487

Country of ref document: EP

Kind code of ref document: A1