HK40596A - Optimal method of data reduction in a speech recognition system - Google Patents

Optimal method of data reduction in a speech recognition system Download PDF

Info

Publication number
HK40596A
HK40596A HK40596A HK40596A HK40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A HK 40596 A HK40596 A HK 40596A
Authority
HK
Hong Kong
Prior art keywords
frames
frame
block
word
representative
Prior art date
Application number
HK40596A
Other languages
English (en)
French (fr)
Inventor
Alan Gerson Ira
Louis Lindsley Brett
Original Assignee
Motorola, Inc.
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Motorola, Inc. filed Critical Motorola, Inc.
Publication of HK40596A publication Critical patent/HK40596A/en

Links

Classifications

    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L13/00Speech synthesis; Text to speech systems
    • GPHYSICS
    • G10MUSICAL INSTRUMENTS; ACOUSTICS
    • G10LSPEECH ANALYSIS TECHNIQUES OR SPEECH SYNTHESIS; SPEECH RECOGNITION; SPEECH OR VOICE PROCESSING TECHNIQUES; SPEECH OR AUDIO CODING OR DECODING
    • G10L15/00Speech recognition

Landscapes

  • Engineering & Computer Science (AREA)
  • Computational Linguistics (AREA)
  • Health & Medical Sciences (AREA)
  • Audiology, Speech & Language Pathology (AREA)
  • Human Computer Interaction (AREA)
  • Physics & Mathematics (AREA)
  • Acoustics & Sound (AREA)
  • Multimedia (AREA)
  • Telephonic Communication Services (AREA)
  • Transmission Systems Not Characterized By The Medium Used For Transmission (AREA)
  • Complex Calculations (AREA)
  • Time-Division Multiplex Systems (AREA)

Claims (8)

  1. Ein Verfahren zum Verringern einer Folge ursprünglicher Rahmen von Sprache (510) zu einem verringerten Satz repräsentativer Rahmen (514), die folgende Schritte umfassend:    Speichern einer Mehrzahl ursprünglicher Rahmen der Folge;    Kombinieren der genannten gespeicherten, ursprünglichen Rahmen zu einer Mehrzahl repräsentativer Rahmen;    Erzeugen eines Verzerrungsmaßes (D1-D5) für jeden repräsentativen Rahmen, das dem Abstand zwischen jedem genannten repräsentativen Rahmen und den darin kombinierten genannten ursprünglichen Rahmen entspricht;    Vergleichen von jedem genannten Verzerrungsmaß mit einer vorbestimmten Verzerrungsschwelle; gekennzeichnet durch    Auswählen von wenigstens einem repräsentativen Rahmen aus der genannten Mehrzahl repräsentativer Rahmen, der ein kleineres Verzerrungsmaß als die genannte vorbestimmte Verzerrungsschwelle aufweist und die größte Anzahl gespeicherter ursprünglicher Rahmen darstellt und    Auswählen eines repräsentativen Rahmens von dem genannten ausgewählten wenigstens einem repräsentativen Rahmen, der ein erzeugtes Verzerrungsmaß hat, das das geringste der erzeugten Verzerrungsmaße des genannten ausgewählten wenigstens einen repräsentativen Rahmens ist.
  2. Verfahren zum Verringern einer Folge ursprünglicher Rahmen von Sprache (510) zu einem verringerten Satz repräsentativer Rahmen (514), die Schritte umfassend:    Bilden von Bündelwegen, die bei jedem ursprünglichen Rahmen in der Folge enden, wobei die genannten Rahmen in einer Folge sind, die mit m bis n, mit m<n, bezeichnet ist, wobei jeder Bündelweg aus einer Reihe von kombinierten ursprünglichen Rahmen zusammengesetzt ist;    Bilden eines zusätzlichen repräsentativen Rahmens, indem Rahmen j bis n+1, mit m≦j≦n und j einer ganzen Zahl, die einen Rahmen in der Reihe bezeichnet, kombiniert werden, wobei das genannte Bilden eines zusätzlichen, repräsentativen Rahmens die Schritte einschließt:    Erzeugen eines Verzerrungsmaßes (D1-D5) für den genannten zusätzlichen, repräsentativen Rahmen, das dem Abstand zwischen dem genannten zusätzlichen, repräsentativen Rahmen und ursprünglichen Rahmen entspricht, die darin kombiniert sind, und Vergleichen des genannten Verzerrungsmaßes mit einer vorbestimmten Verzerrungsschwelle;    Anfügen des genannten zusätzlichen, repräsentativen Rahmens an die genannten vorhergehend gebildeten Bündelwege, wenn das genannte Verzerrungsmaß die genannte Verzerrungsschwelle nicht überschreitet, wodurch der sich ergebende, verringerte Satz repräsentativer Rahmen aus dem genannten zusätzlichen, repräsentativen Rahmen besteht, der an den genannten Bündelweg angefügt worden ist, der bei dem Rahmen j-1 gebildet wurde; und    Ungültigmachen von wenigstens einem der genannten Bündelwege, wenn von einem anderen Bündelweg bestimmt wird, daß er weniger repräsentative Rahmen hat.
  3. Das Verfahren des Anspruches 1 oder 2, das weiter den Schritt des Bestimmens eines Konvergenz-Bezugsrahmens einschließt.
  4. Das Verfahren des Anspruches 2, das ferner den Schritt des Bestimmens eines Verzerrungsmaßes einschließt, das mit dem Satz repräsentativer Rahmen verbunden ist.
  5. Eine Einrichtung zum Verringern einer Folge ursprünglicher Rahmen von Sprache (510) zu einem verringerten Satz repräsentativer Rahmen (514), umfassend:    eine Einrichtung zum Speichern einer Mehrzahl ursprünglicher Rahmen aus der Folge;    eine Einrichtung zum Kombinieren der genannten gespeicherten, ursprünglichen Rahmen zu einer Mehrzahl repräsentativer Rahmen;    eine Einrichtung zum Erzeugen eines Verzerrungsmaßes (D1-D5) für jeden repräsentativen Rahmen, das dem Abstand zwischen jedem genannten repräsentativen Rahmen und den genannten ursprünglichen, darin kombinierten Rahmen entspricht;    eine Einrichtung zum Vergleichen von jedem genannten Verzerrungsmaß mit einer vorbestimmten Verzerrungsschwelle;    eine Einrichtung zum Auswählen wenigstens eines repräsentativen Rahmens aus der genannten Mehrzahl repräsentativer Rahmen, der ein Verzerrungsmaß hat, das kleiner als die genannte vorbestimmte Verzerrungsschwelle ist und die größte Anzahl an gespeicherten ursprünglichen Rahmen darstellt, und    eine Einrichtung zum Auswählen eines repräsentativen Rahmens aus dem genannten ausgewählten wenigstens einem repräsentativen Rahmen, der ein erzeugtes Verzerrungsmaß hat, das das niedrigste der erzeugten Verzerrungsmaße des genannten ausgewählten wenigstens einen repräsentativen Rahmens hat.
  6. Eine Einrichtung zum Verringern einer Folge ursprünglicher Rahmen von Sprache (510) zu einem verringerten Satz repräsentativer Rahmen (514) umfassend:    eine Einrichtung zum Bilden von Bündelwegen, die an jedem ursprünglichen Rahmen in der Reihe enden, wobei die genannten Rahmen in einer mit m bis n bezeichneten Reihe sind, mit m<n, wobei jeder genannte Bündelweg aus einer Reihe kombinierter ursprünglicher Rahmen zusammengesetzt ist;    eine Einrichtung zum Bilden eines zusätzlichen, repräsentativen Rahmens durch Kombinieren von Rahmen j bis n+1, mit m≦j≦n und j einer ganzen Zahl, die einen Rahmen in der Reihe bezeichnet, wobei die genannte Einrichtung zum Bilden eines zusätzlichen, repräsentativen Rahmens einschließt: eine Einrichtung zum Erzeugen eines Verzerrungsmaßes (D1-D5) für den genannten zusätzlichen, repräsentativen Rahmen, das dem Abstand zwischen dem genannten zusätzlichen, repräsentativen Rahmen und den ursprünglichen, darin kombinierten Rahmen entspricht, und eine Einrichtung zum Vergleichen des genannten Verzerrungsmaßes mit einer vorbestimmten Verzerrungsschwelle, gekennzeichnet durch:    eine Einrichtung zum Anfügen des genannten zusätzlichen, repräsentativen Rahmens an die genannten vorhergehend gebildeten Bündelwege, wenn das genannte Verzerrungsmaß die genannte Verzerrungsschwelle nicht überschreitet, wodurch der sich ergebende verringerte Satz repräsentativer Rahmen aus dem genannten zusätzlichen, repräsentativen Rahmen besteht, der an den genannten Bündelweg angefügt worden ist, der bei dem Rahmen j-1 gebildet wurde; und    eine Einrichtung zum Ungültigmachen von wenigstens einem genannten Bündelweg, wenn ein anderer Bündelweg bestimmt wird, daß er weniger repräsentative Rahmen hat.
  7. Die Einrichtung des Anspruches 5 oder 6, die ferner eine Einrichtung zum Bestimmen eines Konvergenz-Bezugsrahmens einschließt.
  8. Die Einrichtung des Anspruches 6, die ferner eine Einrichtung zum Bestimmen eines Verzerrungsmaßes einschließt, das mit dem Satz repräsentativer Rahmen verbunden ist.
HK40596A 1986-01-03 1996-03-07 Optimal method of data reduction in a speech recognition system HK40596A (en)

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
US81616386A 1986-01-03 1986-01-03

Publications (1)

Publication Number Publication Date
HK40596A true HK40596A (en) 1996-03-15

Family

ID=25219842

Family Applications (1)

Application Number Title Priority Date Filing Date
HK40596A HK40596A (en) 1986-01-03 1996-03-07 Optimal method of data reduction in a speech recognition system

Country Status (8)

Country Link
US (1) US4905288A (de)
EP (1) EP0252946B1 (de)
JP (1) JP3168562B2 (de)
KR (1) KR950008539B1 (de)
CA (1) CA1299750C (de)
DE (1) DE3688747T2 (de)
HK (1) HK40596A (de)
WO (1) WO1987004290A1 (de)

Families Citing this family (29)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US4802224A (en) * 1985-09-26 1989-01-31 Nippon Telegraph And Telephone Corporation Reference speech pattern generating method
JPH0782359B2 (ja) * 1989-04-21 1995-09-06 三菱電機株式会社 音声符号化装置、音声復号化装置及び音声符号化・復号化装置
US5146538A (en) * 1989-08-31 1992-09-08 Motorola, Inc. Communication system and method with voice steering
US5271089A (en) * 1990-11-02 1993-12-14 Nec Corporation Speech parameter encoding method capable of transmitting a spectrum parameter at a reduced number of bits
US5195168A (en) * 1991-03-15 1993-03-16 Codex Corporation Speech coder and method having spectral interpolation and fast codebook search
US5152007A (en) * 1991-04-23 1992-09-29 Motorola, Inc. Method and apparatus for detecting speech
US5485621A (en) * 1991-05-10 1996-01-16 Siemens Corporate Research, Inc. Interactive method of using a group similarity measure for providing a decision on which groups to combine
CA2483324C (en) * 1991-06-11 2008-05-06 Qualcomm Incorporated Estimation of background noise in a variable rate vocoder
US5548681A (en) * 1991-08-13 1996-08-20 Kabushiki Kaisha Toshiba Speech dialogue system for realizing improved communication between user and system
GB2272554A (en) * 1992-11-13 1994-05-18 Creative Tech Ltd Recognizing speech by using wavelet transform and transient response therefrom
US5351046A (en) * 1993-05-28 1994-09-27 Adcox Thomas A Method and system for compacting binary coded decimal data
TW271524B (de) 1994-08-05 1996-03-01 Qualcomm Inc
US5742734A (en) * 1994-08-10 1998-04-21 Qualcomm Incorporated Encoding rate selection in a variable rate vocoder
US5960395A (en) * 1996-02-09 1999-09-28 Canon Kabushiki Kaisha Pattern matching method, apparatus and computer readable memory medium for speech recognition using dynamic programming
US5751901A (en) * 1996-07-31 1998-05-12 Qualcomm Incorporated Method for searching an excitation codebook in a code excited linear prediction (CELP) coder
US6131084A (en) * 1997-03-14 2000-10-10 Digital Voice Systems, Inc. Dual subframe quantization of spectral magnitudes
US6161089A (en) * 1997-03-14 2000-12-12 Digital Voice Systems, Inc. Multi-subframe quantization of spectral parameters
US6009383A (en) * 1997-10-30 1999-12-28 Nortel Networks Corporation Digital connection for voice activated services on wireless networks
KR100277105B1 (ko) * 1998-02-27 2001-01-15 윤종용 음성 인식 데이터 결정 장치 및 방법
US6208969B1 (en) 1998-07-24 2001-03-27 Lucent Technologies Inc. Electronic data processing apparatus and method for sound synthesis using transfer functions of sound samples
US6073093A (en) * 1998-10-14 2000-06-06 Lockheed Martin Corp. Combined residual and analysis-by-synthesis pitch-dependent gain estimation for linear predictive coders
US6735563B1 (en) * 2000-07-13 2004-05-11 Qualcomm, Inc. Method and apparatus for constructing voice templates for a speaker-independent voice recognition system
DE10054583C2 (de) * 2000-11-03 2003-06-18 Digital Design Gmbh Verfahren und Vorrichtung zum Aufzeichnen, Suchen und Wiedergeben von Notizen
US20030046084A1 (en) * 2001-08-28 2003-03-06 Blair Wyman Method and apparatus for providing location-specific responses in an automated voice response system
US7165028B2 (en) * 2001-12-12 2007-01-16 Texas Instruments Incorporated Method of speech recognition resistant to convolutive distortion and additive distortion
WO2008107027A1 (en) * 2007-03-02 2008-09-12 Telefonaktiebolaget Lm Ericsson (Publ) Methods and arrangements in a telecommunications network
US11082510B2 (en) * 2012-01-26 2021-08-03 Micro Focus Llc Identifying a push communication pattern
US9373338B1 (en) * 2012-06-25 2016-06-21 Amazon Technologies, Inc. Acoustic echo cancellation processing based on feedback from speech recognizer
CN114550694B (zh) * 2022-02-16 2025-10-28 深圳Tcl新技术有限公司 设备的语音测试方法、装置、存储介质及计算机设备

Family Cites Families (20)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
DE1162398B (de) * 1961-10-24 1964-02-06 Ibm Verdichter fuer Daten, die aus Bits verschiedener Wertigkeit bestehen
US3582559A (en) * 1969-04-21 1971-06-01 Scope Inc Method and apparatus for interpretation of time-varying signals
US3812291A (en) * 1972-06-19 1974-05-21 Scope Inc Signal pattern encoder and classifier
DE2657365C2 (de) * 1976-12-17 1978-11-02 Siemens Ag, 1000 Berlin Und 8000 Muenchen Verfahren und Schaltungsanordnung zur Durchführung des Verfahrens zur Rahmensynchronisierung eines Zeitmultiplexsystems
US4227177A (en) * 1978-04-27 1980-10-07 Dialog Systems, Inc. Continuous speech recognition method
US4227176A (en) * 1978-04-27 1980-10-07 Dialog Systems, Inc. Continuous speech recognition method
US4181813A (en) * 1978-05-08 1980-01-01 John Marley System and method for speech recognition
US4181821A (en) * 1978-10-31 1980-01-01 Bell Telephone Laboratories, Incorporated Multiple template speech recognition system
US4412098A (en) * 1979-09-10 1983-10-25 Interstate Electronics Corporation Audio signal recognition computer
JPS56101200A (en) * 1980-01-16 1981-08-13 Matsushita Electric Industrial Co Ltd Compacting method of voice pattern
US4449233A (en) * 1980-02-04 1984-05-15 Texas Instruments Incorporated Speech synthesis system with parameter look up table
US4328395A (en) * 1980-02-04 1982-05-04 Texas Instruments Incorporated Speech synthesis system with variable interpolation capability
US4624009A (en) * 1980-05-02 1986-11-18 Figgie International, Inc. Signal pattern encoder and classifier
US4513436A (en) * 1980-09-16 1985-04-23 Oki Electric Industry, Co., Ltd. Speech recognition system
US4415767A (en) * 1981-10-19 1983-11-15 Votan Method and apparatus for speech recognition and reproduction
JPS58105295A (ja) * 1981-12-18 1983-06-23 株式会社日立製作所 音声標準パタン作成方法
US4449190A (en) * 1982-01-27 1984-05-15 Bell Telephone Laboratories, Incorporated Silence editing speech processor
JPS58137899A (ja) * 1982-02-12 1983-08-16 日本電気株式会社 パタン認識装置
US4520499A (en) * 1982-06-25 1985-05-28 Milton Bradley Company Combination speech synthesis and recognition apparatus
US4550425A (en) * 1982-09-20 1985-10-29 Sperry Corporation Speech sampling and companding device

Also Published As

Publication number Publication date
US4905288A (en) 1990-02-27
KR950008539B1 (ko) 1995-07-31
DE3688747D1 (de) 1993-08-26
DE3688747T2 (de) 1993-10-28
WO1987004290A1 (en) 1987-07-16
CA1299750C (en) 1992-04-28
EP0252946A1 (de) 1988-01-20
JP3168562B2 (ja) 2001-05-21
JPS63502145A (ja) 1988-08-18
KR880700986A (ko) 1988-04-13
EP0252946B1 (de) 1993-07-21
EP0252946A4 (de) 1988-05-31

Similar Documents

Publication Publication Date Title
EP0249635B1 (de) Worterkennung in einem spracherkennungssystem unter verwendung datenermässigter wortmuster
EP0252946B1 (de) Optimales verfahren für datenermässigung in einem spracherkennungssystem
EP0255524B1 (de) Verfahren und vorrichtung zur sprachsynthese ohne informationen über die stimme oder hinsichtlich stimmhöhe
US4220819A (en) Residual excited predictive speech coding system
EP0255523B1 (de) Verfahren und vorrichtung zur sprachsynthese aus spracherkennungsmodellen
US4791670A (en) Method of and device for speech signal coding and decoding by vector quantization techniques
EP1141939A1 (de) Einrichtung und verfahren zur sprachsegmentierung und spracherkennung
US20040148160A1 (en) Method and apparatus for noise suppression within a distributed speech recognition system
EP1076895B1 (de) Vorrichtung und verfahren zur verbesserung der qualität kodierter sprache mittels hintergrundrauschen
KR100205060B1 (ko) 정규 펄스 여기 방식을 이용한 celp 보코더의 피치검색 방법
Gersho Concepts and paradigms in speech coding
GB2266213A (en) Digital signal coding

Legal Events

Date Code Title Description
PF Patent in force
PE Patent expired

Effective date: 20061217