<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE ep-patent-document PUBLIC "-//EPO//EP PATENT DOCUMENT 1.4//EN" "ep-patent-document-v1-4.dtd">
<ep-patent-document id="EP07800169B1" file="EP07800169NWB1.xml" lang="de" country="EP" doc-number="2080197" kind="B1" date-publ="20110112" status="n" dtd-version="ep-patent-document-v1-4">
<SDOBI lang="de"><B000><eptags><B001EP>ATBECHDEDKESFRGBGRITLILUNLSEMCPTIESILTLVFIRO..CY..TRBGCZEEHUPLSK....IS..MT..........................</B001EP><B003EP>*</B003EP><B005EP>J</B005EP><B007EP>DIM360 Ver 2.15 (14 Jul 2008) -  2100000/0</B007EP></eptags></B000><B100><B110>2080197</B110><B120><B121>EUROPÄISCHE PATENTSCHRIFT</B121></B120><B130>B1</B130><B140><date>20110112</date></B140><B190>EP</B190></B100><B200><B210>07800169.0</B210><B220><date>20070906</date></B220><B240><B241><date>20090408</date></B241><B242><date>20100219</date></B242></B240><B250>de</B250><B251EP>de</B251EP><B260>de</B260></B200><B300><B310>15472006</B310><B320><date>20060915</date></B320><B330><ctry>AT</ctry></B330></B300><B400><B405><date>20110112</date><bnum>201102</bnum></B405><B430><date>20090722</date><bnum>200930</bnum></B430><B450><date>20110112</date><bnum>201102</bnum></B450><B452EP><date>20100810</date></B452EP></B400><B500><B510EP><classification-ipcr sequence="1"><text>G10L  21/02        20060101AFI20080415BHEP        </text></classification-ipcr></B510EP><B540><B541>de</B541><B542>VORRICHTUNG ZUR GERÄUSCHUNTERDRÜCKUNG BEI EINEM AUDIOSIGNAL</B542><B541>en</B541><B542>APPARATUS FOR NOISE SUPPRESSION IN AN AUDIO SIGNAL</B542><B541>fr</B541><B542>DISPOSITIF D'ÉLIMINATION DU BRUIT DANS UN SIGNAL AUDIO</B542></B540><B560><B561><text>US-A1- 2001 005 822</text></B561><B562><text>KAWAMURA A ET AL: "A NOISE REDUCTION METHOD BASED ON LINEAR PREDICTION ANALYSIS" ELECTRONICS &amp; COMMUNICATIONS IN JAPAN, PART III - FUNDAMENTAL ELECTRONIC SCIENCE, WILEY, HOBOKEN, NJ, US, Bd. 3,part-3, Nr. 86, 2003, Seiten 1-10, XP001141501 ISSN: 1042-0967 in der Anmeldung erwähnt</text></B562><B562><text>MAKHOUL J I &amp; COSELL L K: "Adaptive lattice analysis of speech" IEEE TRANSACTIONS ON CIRCUITS AND SYSTEMS, Bd. CAS-28, Nr. 6, Juni 1981 (1981-06), Seiten 494-499, XP002457971 Bolt Beranek &amp; Newman Inc., Cambridge, MA; USA ISSN: 0098-4094 in der Anmeldung erwähnt</text></B562><B562><text>RANK E &amp; KUBIN G: "Lattice LP Filtering for Noise Reduction in Speech Signals" PROC. INTERNATIONAL CONFERENCE ON SPOKEN LANGUAGE PROCESSING (INTERSPEECH - ICSLP), 21. September 2006 (2006-09-21), Seiten 265-268, XP001536700</text></B562></B560></B500><B700><B720><B721><snm>RANK, Erhard</snm><adr><str>Wolfganggasse 14/1/12</str><city>1120 Wien</city><ctry>AT</ctry></adr></B721><B721><snm>KUBIN, Gernot</snm><adr><str>Franz-Schmidt-Weg 14</str><city>8046 Graz</city><ctry>AT</ctry></adr></B721></B720><B730><B731><snm>Technische Universität Graz</snm><iid>100735078</iid><irf>P11282pct-eu</irf><adr><str>Rechbauerstraße 12</str><city>8010 Graz</city><ctry>AT</ctry></adr></B731><B731><snm>Forschungsholding TU Graz GmbH</snm><iid>100805557</iid><irf>P11282pct-eu</irf><adr><str>Rechbauerstraße 12</str><city>8010 Graz</city><ctry>AT</ctry></adr></B731></B730><B740><B741><snm>Matschnig, Franz</snm><iid>100020451</iid><adr><str>Patentanwaltskanzlei Matschnig &amp; Forsthuber OG 
Siebensterngasse 54</str><city>1071 Wien</city><ctry>AT</ctry></adr></B741></B740></B700><B800><B840><ctry>AT</ctry><ctry>BE</ctry><ctry>BG</ctry><ctry>CH</ctry><ctry>CY</ctry><ctry>CZ</ctry><ctry>DE</ctry><ctry>DK</ctry><ctry>EE</ctry><ctry>ES</ctry><ctry>FI</ctry><ctry>FR</ctry><ctry>GB</ctry><ctry>GR</ctry><ctry>HU</ctry><ctry>IE</ctry><ctry>IS</ctry><ctry>IT</ctry><ctry>LI</ctry><ctry>LT</ctry><ctry>LU</ctry><ctry>LV</ctry><ctry>MC</ctry><ctry>MT</ctry><ctry>NL</ctry><ctry>PL</ctry><ctry>PT</ctry><ctry>RO</ctry><ctry>SE</ctry><ctry>SI</ctry><ctry>SK</ctry><ctry>TR</ctry></B840><B860><B861><dnum><anum>AT2007000424</anum></dnum><date>20070906</date></B861><B862>de</B862></B860><B870><B871><dnum><pnum>WO2008031124</pnum></dnum><date>20080320</date><bnum>200812</bnum></B871></B870><B880><date>20090722</date><bnum>200930</bnum></B880></B800></SDOBI><!-- EPO <DP n="1"> -->
<description id="desc" lang="de">
<p id="p0001" num="0001">Die Erfindung bezieht sich auf eine Vorrichtung nach dem Oberbegriff des Hauptanspruches.</p>
<p id="p0002" num="0002">Die Geräuschunterdrückung bei Audiosignalen, insbesondere auch bei Sprachsignalen gewinnt immer mehr an Bedeutung, so in der Telephonie, der automatischen Spracherkennung oder, als nur eines von vielen weiteren Beispielen, bei digitalen Hörgeräten. Geräusche, die es zu unterdrücken gilt, sind in erster Linie nicht-weißes Rauschen, nichtstationäre Geräusche und stark impulsartige Geräusche.</p>
<p id="p0003" num="0003">Verfahren zur Geräuschunterdrückung für Audiosignale sind in einer großen Vielfalt bekannt geworden, und als Beispiele seien genannt: Verfahren, bei welchen leise Audiosignale zunächst angehoben und später wieder abgesenkt werden, wie Pre/Deemphase für den Rundfunk oder die Dolby-Rauschunterdrückungsverfahren für Tonträgeraufzeichnungen. Weiters Verfahren der spektralen Subtraktion, bei welchen z.B. in Gesprächspausen das Geräusch geschätzt und dann von dem Eingangssignal abgezogen wird. Zu den letztgenannten Verfahren zählen auch Wiener-Filter sowie Ephraim-Malah Filter mit adaptiver Verstärkung für in mehrere Transformationskanäle aufgespaltete Signale. Die bekannten Verfahren sind zum Teil nicht sehr wirkungsvoll, da sie von einem sehr vereinfachten Modell des Geräuschsignals ausgehen, oder sie führen auf Grund einer blockweisen Verarbeitung des Eingangssignals zu Artefakten, die sich als unangenehme Nebengeräusche bemerkbar machen, als so genannte Musical Tones, die im Signal nach der Geräuschreduktion verbleiben. Viele Verfahren führen auch zu einer relativ großen Verzögerung des Ausgangssignals.</p>
<p id="p0004" num="0004">Der Stand der Technik, von welchem die vorliegende Erfindung ausgeht, sind lineare Prädiktionsfilter (LP-Filter), in direkter oder in Lattice-Form (Kreuzglied-Kettenfilter), bei welchen Eigenschaften des gesamten Eingangssignals zur Einstellung der Filterkoeffizienten herangezogen werden. Eine entsprechende Vorrichtung, wie z.B. in der <patcit id="pcit0001" dnum="US20010005822A1"><text>US 2001/0005822 A1</text></patcit> offenbart, besteht aus einem Lattice-Filter, dem ein Eingangssignal y(n) zugeführt ist, welches eine Sprach/Audiokomponente sowie eine Geräuschkomponente aufweist. Für die Einstellung der Komponenten ist eine Koeffizientenberechnungseinheit KBE vorgesehen, welcher die Vorwärts- und Rückwärtsfehlersignale, diese beinhalten in der ersten Stufe auch das Eingangssignal, zugeführt werden. Die Koeffizientenberechnungeinheit liefert dem Filter sodann immer im Sinne einer Minimierung des Prädiktionsfehlers aktualisierte<!-- EPO <DP n="2"> --> Filterkoeffizienten. Eine Geräuschreduktion unter Verwendung linearer Prädiktionsfilter ist unter anderem auch in der <patcit id="pcit0002" dnum="GB1520148A"><text>GB 1 520 148 A</text></patcit> oder in der <patcit id="pcit0003" dnum="US4587620A"><text>US 4, 587, 620</text></patcit> offenbart. Die Verfahren bzw. Vorrichtungen nach dem Stand der Technik gehen immer von dem Eingangssignal aus, ohne dass die besonderen Eigenschaften des Sprachsignals einerseits und des Geräusches andererseits ausreichend Berücksichtigung finden.</p>
<p id="p0005" num="0005">Bei der Vorrichtung nach der <patcit id="pcit0004" dnum="US7065468B"><text>US 7, 065,468</text></patcit> wird das Eingangssignal dazu herangezogen, die Koeffizienten für das Prädiktionsfilter zu bestimmen (Einheit 212 bzw. 312 und 318) und aufgrund dieser Koeffizienten erfolgt dann eine Schätzung des Sprachsignals wobei - unter Verwendung einer zusätzlichen Sprachaktivitätsschätzungseinheit (VAD, Einheit 232 bzw. 332) eine Schätzung des Geräuschsignals, nämlich in einer Einheit 234 bzw. 334 dazu erfolgt, mittels eines weiteren zweiten Filters (Einheit 240 bzw. 340) eine Geräuschunterdrückung vorzunehmen.</p>
<p id="p0006" num="0006">Wesentliche Merkmale sind dabei, dass die Schätzung der Koeffizienten des linearen Prädiktionsfilters (Einheit 214) bzw. der linearen Prädiktionsfilter (Einheit 314 und 320 in <figref idref="f0001">Fig. 3</figref>) nur unter Verwendung des Eingangssignals (bzw. des Fehlersignals des ersten Prädiktionsfilters e ST(n) (Pfad 316)) vorgenommen wird. Ein weiterer wesentlicher Unterschied zur Erfindung liegt darin, dass eine Sprachaktivitätsschätzung unabhängig vom linearen Prädiktionsfilter 214 von den linearen Prädiktionsfiltem 314 und 320 ausgeführt wird, sowie, dass das eigentliche Filter zur Geräuschunterdrückung (Einheit 240 bzw. 340) selbst kein lineares Prädiktionsfilter darstellt. Dabei erfolgt die Geräuschschätzung ("Update Noise Model") nur auf der Basis des Prädiktionsfehlers (vgl. Anspruch 1 der <patcit id="pcit0005" dnum="US7065468B"><text>US 7, 065,468</text></patcit>), wogegen, wie weiter unten beschrieben, bei der Erfindung die Geräuschschätzung anhand der internen Signale des LP-Fehler-Filters durchgeführt wird. Dieser Unterschied ist auch an Hand der <figref idref="f0001">Fig. 2</figref> der <patcit id="pcit0006" dnum="US7065468B"><text>US 7, 065,468</text></patcit> ersichtlich.</p>
<p id="p0007" num="0007">Insgesamt zeigt die <patcit id="pcit0007" dnum="US7065468B"><text>US 7, 065,468</text></patcit> eine Struktur, die sich bereits von dem Stand der Technik nach der <patcit id="pcit0008" dnum="US20010005822A1"><text>US 2001/0005822 A1</text></patcit> unterscheidet und die noch dazu - verglichen mit der Erfindung - aufwändiger ist. In der <patcit id="pcit0009" dnum="US7065468B"><text>US 7, 065,468</text></patcit> wird letztlich ein anderer Weg beschritten, der den Fachmann, dem die <patcit id="pcit0010" dnum="US20010005822A1"><text>US 2001/0005822 A1</text></patcit> bekannt ist und der sich die der Erfindung zugrunde liegende Aufgabe gestellt hat, in eine andere Richtung als jene der Erfindung führen würde.</p>
<p id="p0008" num="0008">Als Publikationen auf diesem Gebiet seien weiters nachstehend genannt
<ul id="ul0001" list-style="none">
<li>[1] <nplcit id="ncit0001" npl-type="b"><text>J. D. Markel and A. H. Gray, Jr., Linear Prediction of Speech. Berlin, Heidelberg, New York: Springer, 1976</text></nplcit>.<!-- EPO <DP n="3"> --></li>
<li>[2] <nplcit id="ncit0002" npl-type="s"><text>J. I. Makhoul and L.K. Cosell, "Adaptive lattice analysis of speech," IEEE Transactions on Acoustics, Speech, and Signal Processing, vol. 29, pp.654-659, June 1981</text></nplcit>.</li>
<li>[3] <nplcit id="ncit0003" npl-type="b"><text>M. L. Honig and D. G. Messerschmitt, Adaptive Filters: Structures, Algorithms, and Applications. Boston-The Hague-London-Lancaster: Kluwer Academic Publishers,1984</text></nplcit>.</li>
<li>[4] <nplcit id="ncit0004" npl-type="s"><text>A. Kawamura, K. Fujü, Y. Itoh, and Y. Fukui, "A noise reduction method based on linear prediction analysis," Electronics and Communications in Japan, Part 3, vol. 86, no. 3, pp. 1-10, 2003</text></nplcit>.</li>
<li>[5] <nplcit id="ncit0005" npl-type="s"><text>M. H. Savoji, "Effective noise reduction of speech signals using adaptive lattice filtering, segmentation and soft decision," in IEE Colloquium on New Directions in Adaptive Signal Processing, pp. 7/1-7/5, Feb. 1993</text></nplcit>.</li>
</ul></p>
<p id="p0009" num="0009">Eine Aufgabe der Erfindung liegt in der Schaffung einer Vorrichtung zur Geräuschunterdrückung für Audiosignale, insbesondere für Sprachsignale, welche ein praktisch unverzögertes Ausgangs-Audiosignal liefert, das auch keine störenden Artefakte mit sich führt.</p>
<p id="p0010" num="0010">Diese Aufgabe wird mit einer Vorrichtung der eingangs genannten Art gelöst, welche erfindungsgemäß die Merkmale des Kennzeichens des Anspruches 1 aufweist.</p>
<p id="p0011" num="0011">Zweckmäßige Weiterbildungen der Erfindung sind in den abhängigen Ansprüchen 2 bis 9 gekennzeichnet.</p>
<p id="p0012" num="0012">Die Erfindung samt weiteren Vorteilen ist im folgenden an Hand beispielsweiser Ausführungsformen näher erläutert, die in der Zeichnung veranschaulicht sind. In dieser zeigen
<ul id="ul0002" list-style="none">
<li><figref idref="f0001">Fig. 1</figref> ein Lattice-Filter nach dem Stand der Technik,</li>
<li><figref idref="f0001">Fig. 2</figref> aus dem geräuschbehafteten Signal ohne Korrektur berechnete Werte des Reflexionskoeffizienten in einem Diagramm,</li>
<li><figref idref="f0001">Fig. 3</figref> a und b den Frequenzgang von im Rahmen der Erfindung verwendeten Tiefpässen,</li>
<li><figref idref="f0002">Fig. 4</figref> den zeitlichen Verlauf sowie das Spektrogramm eines geräuschbehafteten Eingangssignals (oben) und dessen Geräuschbefreiung (unten) nach der Erfindung,<!-- EPO <DP n="4"> --></li>
<li><figref idref="f0002">Fig. 5</figref> das Blockschaltbild einer prinzipiellen Vorrichtung zur Geräuschbefreiung nach dem Stand der Technik</li>
<li><figref idref="f0003">Fig. 6</figref> das Blockschaltbild einer ersten Ausführungsform einer Vorrichtung nach der Erfindung,</li>
<li><figref idref="f0003">Fig. 7</figref> das Blockschaltbild einer zweiten Ausführungsform einer Vorrichtung nach der Erfindung und</li>
<li><figref idref="f0003">Fig. 8</figref> das Blockschaltbild einer prinzipiellen Vorrichtung zur Geräuschbefreiung nach dem Stand der Technik unter Verwendung eines LP-Fehler-Filters in direkter Filterform (DFF).</li>
</ul></p>
<p id="p0013" num="0013">Lineare Prädiktion wird üblicherweise auf ein Sprachsignal <i>x</i>(<i>n</i>) angewendet, beispielsweise um die Varianz eines Sprachsignals für dessen Übertragung zu reduzieren. Um einen Signalwert vorher zu sagen, werden langsam zeitveränderliche FIR-Filter (finite impulse response filter, Filter mit endlicher Impulsantwort) niedriger Ordnung verwendet<!-- EPO <DP n="5"> --> <maths id="math0001" num="(1)"><math display="block"><mover><mi>x</mi><mo>^</mo></mover><mfenced><mi>n</mi></mfenced><mo>=</mo><mstyle displaystyle="true"><munderover><mo>∑</mo><mrow><mi>i</mi><mo>=</mo><mn>1</mn></mrow><mi>M</mi></munderover></mstyle><msub><mi>b</mi><mi>i</mi></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><mi>x</mi><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mi>i</mi></mfenced><mn>.</mn></math><img id="ib0001" file="imgb0001.tif" wi="87" he="19" img-content="math" img-format="tif"/></maths></p>
<p id="p0014" num="0014">Hier bedeuten <i>M</i> die Ordnung des LP-Filters und <i>b<sub>i</sub></i>(<i>n</i>) die Filterkoeffizienten, die auf Basis der Signaleigenschaften geschätzt und rahmenweise, z.B. alle 10 ms, aufgefrischt werden. Algorithmen welche die Koeffizienten bi(n) für das Filter direkt ergeben sind das so genannte "Autokorrelationsverfahren" oder das "Kovarianzverfahren". Die zur Modellierung der spektralen Hüllkurve üblicherweise verwendete Filterordnung liegt, abhängig von der Abtastrate, bei M =10...20.</p>
<p id="p0015" num="0015">Ein dem eben beschriebenen direkten FIR-Filter ebenbürtiges ist das bereits genannte Lattice-Filter, welches einen unmittelbaren Bezug zum menschlichen Stimmtrakt besitzt [1].</p>
<p id="p0016" num="0016">Charakterisiert ist ein solches Filter durch die Gleichungen <maths id="math0002" num=""><math display="block"><msub><mi>f</mi><mn>0</mn></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi>b</mi><mn>0</mn></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><mi>x</mi><mfenced><mi>n</mi></mfenced><mo>,</mo></math><img id="ib0002" file="imgb0002.tif" wi="70" he="13" img-content="math" img-format="tif"/></maths> <maths id="math0003" num="(2)"><math display="block"><msub><mi>f</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi>f</mi><mrow><mi>m</mi><mo>-</mo><mn>1</mn></mrow></msub><mfenced><mi>n</mi></mfenced><mo>+</mo><msub><mi>k</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><msub><mi>b</mi><mrow><mi>m</mi><mo>-</mo><mn>1</mn></mrow></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>,</mo></math><img id="ib0003" file="imgb0003.tif" wi="110" he="15" img-content="math" img-format="tif"/></maths> <maths id="math0004" num="(3)"><math display="block"><msub><mi>b</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi>f</mi><mrow><mi>m</mi><mo>-</mo><mn mathvariant="italic">1</mn></mrow></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><msub><mi>k</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><msub><mi>f</mi><mrow><mi>m</mi><mo>-</mo><mn>1</mn></mrow></msub><mfenced><mi>n</mi></mfenced><mn>.</mn></math><img id="ib0004" file="imgb0004.tif" wi="115" he="12" img-content="math" img-format="tif"/></maths><br/>
welche zu jedem Zeitpunkt n für alle Gliederstufen <i>m</i> = 1...M berechnet werden. Dabei bedeuten <i>f<sub>m</sub></i>(<i>n</i>) und <i>b<sub>m</sub></i>(<i>n</i>) den Vorwärts- bzw. Rückwärts-Fehler in der Stufe <i>m</i> zur Zeit <i>n</i> und <i>k<sub>m</sub></i>(<i>n</i>) die Reflexionskoeffizienten des Filters. Hier sei angemerkt, dass bei einer verallgemeinerten Darstellung die Reflexionskoeffizienten in (2) und (3) unterschiedlich sind, hier jedoch gleiche Reflexionskoeffizienten für vorwärts und rückwärts verwendet werden. In <figref idref="f0001">Fig. 1</figref> ist ein Lattice-Filter wie eben beschrieben schematisch dargestellt. Auf ein solches Filter bezieht sich beispielsweise Patentanspruch 6.</p>
<p id="p0017" num="0017">Der Vorwärtsfehler in der Stufe <i>M</i> ist das Vorhersage-Fehlersignal des LP-Filters: <maths id="math0005" num="(4)"><math display="block"><msub><mi>f</mi><mi>M</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><mi>e</mi><mfenced><mi>n</mi></mfenced><mo>=</mo><mi>x</mi><mfenced><mi>n</mi></mfenced><mo>-</mo><mover><mi>x</mi><mo>^</mo></mover><mfenced><mi>n</mi></mfenced><mn>.</mn></math><img id="ib0005" file="imgb0005.tif" wi="115" he="14" img-content="math" img-format="tif"/></maths></p>
<p id="p0018" num="0018">Optimale Reflexionskoeffizienten <i>k<sub>m</sub></i> zur Minimierung des quadratischen Mittelwertes des Vorhersagefehlers eines unverzerrten Signals ergeben sich als:<!-- EPO <DP n="6"> --> <maths id="math0006" num="(5)"><math display="block"><msub><mi>k</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><mo>-</mo><mfrac><mrow><msub><mi>r</mi><mrow><mi>m</mi><mo>-</mo><mn>1</mn></mrow></msub><mfenced><mi>n</mi></mfenced></mrow><mrow><msub><mi>q</mi><mrow><mi>m</mi><mo>-</mo><mn>1</mn></mrow></msub><mfenced><mi>n</mi></mfenced></mrow></mfrac><mn>.</mn></math><img id="ib0006" file="imgb0006.tif" wi="80" he="19" img-content="math" img-format="tif"/></maths><br/>
mit den erwarteten Werten für Vorwärts- und Rückwärts- Fehlerkorrelation bzw. Leistung zu: <maths id="math0007" num="(6)"><math display="block"><msub><mi>r</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msub><mi>f</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><msub><mi>b</mi><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced><mo>,</mo></math><img id="ib0007" file="imgb0007.tif" wi="105" he="16" img-content="math" img-format="tif"/></maths> <maths id="math0008" num="(7)"><math display="block"><msub><mi>q</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msubsup><mi>f</mi><mi>m</mi><mn>2</mn></msubsup><mfenced><mi>n</mi></mfenced><mo>+</mo><msubsup><mi>b</mi><mi>m</mi><mn>2</mn></msubsup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced><mn>.</mn></math><img id="ib0008" file="imgb0008.tif" wi="105" he="14" img-content="math" img-format="tif"/></maths></p>
<p id="p0019" num="0019">Üblicherweise werden die Erwartungswertoperatoren E in (6) und (7) unter Verwendung Tiefpass-gefilterter Augenblickswerte von <i>f<sub>m</sub></i>(<i>n</i>)<i>b<sub>m</sub></i>(<i>n</i>-1) bzw. <maths id="math0009" num=""><math display="inline"><msubsup><mi>f</mi><mi>m</mi><mn>2</mn></msubsup><mfenced><mi>n</mi></mfenced><mo>+</mo><msubsup><mi>b</mi><mi>m</mi><mn>2</mn></msubsup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></math><img id="ib0009" file="imgb0009.tif" wi="38" he="7" img-content="math" img-format="tif" inline="yes"/></maths> ausgewertet, beispielsweise mit Hilfe einpoliger rekursiver Tiefpassfilter ("lossy integration", verlustbehaftete Integration, siehe weiter unten).</p>
<p id="p0020" num="0020">Somit erfolgt das Adaptieren des Lattice-Filters zur Formung des sich langsam ändernden Eingangs-Sprachsignals durch Berechnung der Gleichungen (6), (7) und (5) für jeden Zeitpunkt <i>n</i> nach dem Filtern - im Gegensatz zur dem rahmenweisen Aktualisieren der Koeffizienten bei der direkten Form des LP-Filters entsprechend Gleichung (1).</p>
<p id="p0021" num="0021">Was die Geräuschverminderung betrifft, sei angenommen, dass ein beobachtetes Signal <i>y</i>(<i>n</i>) eines additiven linearen Geräuschmodells vorliege: <maths id="math0010" num="(8)"><math display="block"><mi>y</mi><mfenced><mi>n</mi></mfenced><mo>=</mo><mi>x</mi><mfenced><mi>n</mi></mfenced><mo>+</mo><mi>ε</mi><mfenced><mi>n</mi></mfenced><mo>,</mo></math><img id="ib0010" file="imgb0010.tif" wi="102" he="14" img-content="math" img-format="tif"/></maths><br/>
wobei <i>x</i>(<i>n</i>) die Sprachkomponente und ε(<i>n</i>) eine additive Hintergrund-Geräuschkomponente sei. Gegenstand der Geräuschreduktion ist es, eine gute Schätzung für die SprachsignalKomponente <i>x</i>(<i>n</i>) zu liefern. Für den vorliegenden einkanaligen Fall beruht diese Schätzung ausschließlich auf der Beobachtung des geräuschbehafteten Signals <i>y</i>(<i>n</i>) d.h. es wird keine zusätzliche Information verwendet, wie beispielsweise ein zweites Signal eines Mikrophons, welches lediglich die Hintergrundgeräusche aufnimmt.</p>
<p id="p0022" num="0022">Eine Verringerung des Hintergrundgeräusches in Sprachsignalen unter Verwendung linearer Prädiktionsfilterung kann auf der Annahme basieren, dass die Sprachsignalkomponente gut vorhersagbar ist, wogegen die Geräuschkomponente diese Eigenschaft nicht besitzt. Somit kann das vorhergesagte Signal <i>x̂</i>(<i>n</i>) als Schätzung für die Sprachkomponente genommen werden. Während bei den Prädiktionsfiltern in der direkten Form in Gleichung (1)<!-- EPO <DP n="7"> --> der Ausgang unmittelbar das vorhergesagte Signal ist, wird bei den Lattice-Filtern <i>x̂</i>(<i>n</i>) wirksam als die Differenz zwischen dem Eingangssignal und dem Ausgang des Vorwärts-Prädiktionspfades berechnet <maths id="math0011" num="(9)"><math display="block"><mover><mi>x</mi><mo>^</mo></mover><mfenced><mi>n</mi></mfenced><mo>=</mo><mi>y</mi><mfenced><mi>n</mi></mfenced><mo>-</mo><mi>e</mi><mfenced><mi>n</mi></mfenced></math><img id="ib0011" file="imgb0011.tif" wi="96" he="14" img-content="math" img-format="tif"/></maths><br/>
<i>x̂</i>(<i>n</i>) ist die Schätzung der Sprachkomponente mit <i>e</i>(<i>n</i>) = <i>f<sub>M</sub></i>(<i>n</i>). Vergleiche Gleichung (4).</p>
<p id="p0023" num="0023">Wenn man ein Lattice-LP-Filter für die Geräuschverminderung nach A. Kawamura et al. verwendet, wo ein Filter hoher Ordnung (N = 256) benutzt wird, um die spektrale Feinstruktur der Sprache zu modellieren, kann man beobachten, dass <i>r<sub>m</sub></i>(<i>n</i>) eine große Varianz aufgrund der Geräuschsignalkomponente in den höheren Filterstufen aufweist. Es wird vorgeschlagen, die entsprechende Varianz der Reflexionskoeffizienten dadurch zu reduzieren, dass man einen festen (großen) Wert für die Leistungsschätzungen <i>q<sub>m</sub></i>(<i>n</i>) = G verwendet. Die Verringerung des Betrags der Reflexionskoeffizienten oder die Verringerung der Radien der Nullstellen der LP-Filterübertragungsfunktion wurde auch für andere Zwecke vorgeschlagen, z.B. für die Modellierung der spektralen Hüllkurve oder für eine genauere Schätzung der Formanten.</p>
<p id="p0024" num="0024">Eine Verringerung des Betrags der Reflexionskoeffizienten kann durch die Herleitung von Schätzern für <i>r<sub>m</sub></i> und <i>q<sub>m</sub></i> erfolgen, die den mittleren quadratischen Schätzfehler minimieren. Zur Berechnung der Reflexionskoeffizienten für das Lattice-Filter oder der partiellen Korrelationen, welche gleich -<i>k<sub>m</sub></i> sind und auf den Schätzungen von einem Geräuschsignal beruhen, sei für das zusätzliche Geräuschsignal weißes Rauschen mit der Varianz σ<i><sub>n</sub></i><sup>2</sup> angenommen, das auch mit <i>x</i>(<i>n</i>) nicht korreliert sein soll. Dies stellt das am wenigsten informierte Modell (maximale Entropie) dar.</p>
<p id="p0025" num="0025">Es ist zwar diese Annahme für das Umgebungsgeräusch im Allgemeinen nicht realistisch, doch beweist sie die Notwendigkeit einer Korrektur der Reflexionskoeffizienten.</p>
<p id="p0026" num="0026">Die Schätzungen für die Korrelation in Gleichung (6) und die Leistung in Gleichung (7) aus der Berechung der Reflexionskoeffizienten in Gleichung (5) beruhen nun auf dem geräuschbehafteten beobachteten Signal <i>y</i>(<i>n</i>), und man kann die Notwendigkeit eines Korrekturterms, zeigen, um die Schätzungen für die Reflexionskoeffizienten <i>k̂<sub>m</sub></i> bezogen auf das geräuschfreie Signal <i>x</i>(<i>n</i>) zu gewinnen.</p>
<p id="p0027" num="0027">Im besonderen erhält man für die Schätzung der Reflexionskoeffizienten k̂<i><sub>m</sub></i> in der ersten Filterstufe <i>m</i> =1 den folgenden Erwartungswert für <i>r</i><sub>0</sub>:<!-- EPO <DP n="8"> --> <maths id="math0012" num="(10)"><math display="block"><mtable columnalign="left"><mtr><mtd><msub><mi>r</mi><mn>0</mn></msub></mtd><mtd><mo>=</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msub><mi>f</mi><mn>0</mn></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><msub><mi>b</mi><mn>0</mn></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></mtd></mtr><mtr><mtd><mspace width="1em"/></mtd><mtd><mo>=</mo><mi>E</mi><mfenced open="{" close="}" separators=""><mi>y</mi><mfenced><mi>n</mi></mfenced><mo>⁢</mo><mi>y</mi><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></mtd></mtr><mtr><mtd><mspace width="1em"/></mtd><mtd><mo>=</mo><mi>E</mi><mfenced open="{" close="}" separators=""><mfenced separators=""><mi>x</mi><mfenced><mi>n</mi></mfenced><mo>+</mo><mi>ε</mi><mfenced><mi>n</mi></mfenced></mfenced><mo>⁢</mo><mfenced separators=""><mi>x</mi><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><mi>ε</mi><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></mfenced></mtd></mtr><mtr><mtd><mspace width="1em"/></mtd><mtd><mo>=</mo><mi>E</mi><mfenced open="{" close="}" separators=""><mi>x</mi><mfenced><mi>n</mi></mfenced><mo>⁢</mo><mi>x</mi><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></mtd></mtr></mtable></math><img id="ib0012" file="imgb0012.tif" wi="113" he="34" img-content="math" img-format="tif"/></maths></p>
<p id="p0028" num="0028">Für die Fehlervarianz <i>q</i><sub>0</sub> in der ersten Filterstufe erhält man <maths id="math0013" num="(11)"><math display="block"><mtable columnalign="left"><mtr><mtd><msub><mi>q</mi><mn>0</mn></msub></mtd><mtd><mo>=</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msubsup><mi>f</mi><mn>0</mn><mn>2</mn></msubsup><mfenced><mi>n</mi></mfenced><mo>+</mo><msubsup><mi>b</mi><mn>0</mn><mn>2</mn></msubsup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></mtd></mtr><mtr><mtd><mspace width="1em"/></mtd><mtd><mo>=</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msup><mi>y</mi><mn>2</mn></msup><mfenced><mi>n</mi></mfenced><mo>+</mo><msup><mi>y</mi><mn>2</mn></msup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></mtd></mtr><mtr><mtd><mspace width="1em"/></mtd><mtd><mo>=</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msup><mfenced separators=""><mi>x</mi><mfenced><mi>n</mi></mfenced><mo>+</mo><mi>ε</mi><mfenced><mi>n</mi></mfenced></mfenced><mn>2</mn></msup><mo>+</mo><msup><mfenced separators=""><mi>x</mi><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><mi>ε</mi><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced><mn>2</mn></msup></mfenced></mtd></mtr><mtr><mtd><mspace width="1em"/></mtd><mtd><mo>=</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msup><mi>x</mi><mn>2</mn></msup><mfenced><mi>n</mi></mfenced><mo>+</mo><msup><mi>x</mi><mn>2</mn></msup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced><mo>+</mo><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mtd></mtr></mtable></math><img id="ib0013" file="imgb0013.tif" wi="142" he="52" img-content="math" img-format="tif"/></maths></p>
<p id="p0029" num="0029">Der resultierende Fehler in den Werten der Reflexionsfaktoren ist in <figref idref="f0001">Fig. 2</figref> dargestellt. Genauer gesagt sind hier aus dem geräuschbehafteten Signal ohne Korrektur berechnete Werte des Reflexionskoeffizienten <i>k</i><sub>1</sub> als Funktion eines a priori Signal/Geräusch-Abstandes für unterschiedliche Werte der Autokorrelation ρ<i><sub>xx</sub></i>(1) des ungestörten Signals <i>x</i>(<i>n</i>) veranschaulicht.</p>
<p id="p0030" num="0030">Was die auf das geräuschfreie Signal <i>x</i>(<i>n</i>) bezogenen Reflexionskoeffizienten betrifft, kann die Korrelationsschätzung aus der geräuschbehafteten Beobachtung unverändert verwendet werden, das heißt <i>r̂</i><sub>0</sub>= <i>r</i><sub>0</sub> wogegen die berechnete Fehlerleistungsschätzung zu korrigieren ist als <maths id="math0014" num="(12)"><math display="block"><msub><mover><mi>q</mi><mo>^</mo></mover><mn>0</mn></msub><mo>=</mo><msub><mi mathvariant="normal">q</mi><mn>0</mn></msub><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></math><img id="ib0014" file="imgb0014.tif" wi="63" he="14" img-content="math" img-format="tif"/></maths><br/>
und der korrigierte Reflexionskoeffizient berechnet wird als <maths id="math0015" num="(13)"><math display="block"><msub><mover><mi>k</mi><mo>^</mo></mover><mn>1</mn></msub><mo>=</mo><mo>-</mo><mfrac><msub><mover><mi>r</mi><mo>^</mo></mover><mn>0</mn></msub><msub><mover><mi>q</mi><mo>^</mo></mover><mn>0</mn></msub></mfrac><mo>=</mo><mo>-</mo><mfrac><msub><mi>r</mi><mn>0</mn></msub><mrow><msub><mi>q</mi><mn>0</mn></msub><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mrow></mfrac><mn>.</mn></math><img id="ib0015" file="imgb0015.tif" wi="126" he="20" img-content="math" img-format="tif"/></maths></p>
<p id="p0031" num="0031">Wenn man einführt: <maths id="math0016" num=""><math display="inline"><mi>γ</mi><mo>=</mo><mfrac><mrow><mi>E</mi><mfenced open="{" close="}"><msup><mi>y</mi><mn>2</mn></msup></mfenced></mrow><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mfrac></math><img id="ib0016" file="imgb0016.tif" wi="25" he="14" img-content="math" img-format="tif" inline="yes"/></maths> wobei <maths id="math0017" num=""><math display="inline"><mi>γ</mi><mo>-</mo><mn>1</mn><mo>=</mo><mfrac><mrow><mi>E</mi><mfenced open="{" close="}"><msup><mi>y</mi><mn>2</mn></msup></mfenced><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mrow><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mfrac></math><img id="ib0017" file="imgb0017.tif" wi="42" he="16" img-content="math" img-format="tif" inline="yes"/></maths> der a posteriori bestimmte Signalstörabstand ist und beachtet wird dass <maths id="math0018" num=""><math display="inline"><msub><mi>q</mi><mn>0</mn></msub><mo>=</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msubsup><mi>f</mi><mn>0</mn><mn>2</mn></msubsup><mfenced><mi>n</mi></mfenced><mo>+</mo><msubsup><mi>b</mi><mn>0</mn><mn>2</mn></msubsup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></math><img id="ib0018" file="imgb0018.tif" wi="63" he="11" img-content="math" img-format="tif" inline="yes"/></maths> kann man diese Gleichung erneut anschreiben als<!-- EPO <DP n="9"> --> <maths id="math0019" num="(14)"><math display="block"><msub><mover><mi>k</mi><mo>^</mo></mover><mn>1</mn></msub><mo>=</mo><mo>-</mo><mfrac><mn>1</mn><mrow><mn>1</mn><mo>-</mo><mfrac><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup><msub><mi>q</mi><mn>0</mn></msub></mfrac></mrow></mfrac><mo>⁢</mo><mfrac><msub><mi>r</mi><mn>0</mn></msub><msub><mi>q</mi><mn>0</mn></msub></mfrac><mo>=</mo><mfrac><mn>1</mn><mrow><mn>1</mn><mo>-</mo><mfrac><mn>1</mn><mi>γ</mi></mfrac></mrow></mfrac><mo>⁢</mo><msub><mi>k</mi><mn>1</mn></msub><mn>.</mn></math><img id="ib0019" file="imgb0019.tif" wi="113" he="22" img-content="math" img-format="tif"/></maths></p>
<p id="p0032" num="0032">Das bedeutet eine Skalierung des Reflexionskoeffizienten <i>k</i><sub>1</sub>, der ursprünglich für das gestörte Signal <i>y</i>(<i>n</i>) berechnet wurde unter Verwendung der Gleichungen (5), (6) und (7) mit einem Faktor <maths id="math0020" num=""><math display="inline"><mfrac><mn>1</mn><mrow><mn>1</mn><mo>-</mo><mfrac><mn>1</mn><mi>γ</mi></mfrac></mrow></mfrac></math><img id="ib0020" file="imgb0020.tif" wi="21" he="16" img-content="math" img-format="tif" inline="yes"/></maths></p>
<p id="p0033" num="0033">Eine Schätzung der Geräuschleistung σ<i><sub>n</sub></i><sup>2</sup> kann erfolgen anhand der Leistung des Ausgangssignals <i>e</i>(<i>n</i>) des LP-Fehler-Filters, <maths id="math0021" num=""><math display="block"><msubsup><mi mathvariant="normal">σ</mi><mi mathvariant="italic">n</mi><mn>2</mn></msubsup><mo>=</mo><mi mathvariant="italic">E</mi><mfenced open="{" close="}" separators=""><msup><mi mathvariant="italic">e</mi><mn>2</mn></msup><mfenced><mi mathvariant="italic">n</mi></mfenced></mfenced></math><img id="ib0021" file="imgb0021.tif" wi="43" he="13" img-content="math" img-format="tif"/></maths> für das Lattice-Filter ist eine möglich Auswertung des Erwartungswerts gegeben durch die Leistungsschätzung in der letzten Stufe des Lattice Filters <i>q</i><sub><i>M</i>-1</sub>(<i>n</i>)<i>:</i> <maths id="math0022" num=""><math display="block"><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup><mo>=</mo><msub><mi>q</mi><mrow><mi>M</mi><mo>-</mo><mn>1</mn></mrow></msub><mfenced><mi>n</mi></mfenced><mo>,</mo></math><img id="ib0022" file="imgb0022.tif" wi="46" he="14" img-content="math" img-format="tif"/></maths><br/>
oder, bei Verwendung der Sprachaktivitätsschätzung (siehe unten) anhand der Leistungsschätzung des Gesamteingangssignales bei fehlender Sprachaktivität: <maths id="math0023" num=""><math display="block"><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup><mo>=</mo><msub><mi>q</mi><mn>0</mn></msub><mfenced><mi>n</mi></mfenced><mo>,</mo><msup><mrow><mi>wenn</mi><mspace width="3em"/></mrow><mrow><mi mathvariant="italic">ν</mi><mo>≈</mo><mn>0</mn></mrow></msup></math><img id="ib0023" file="imgb0023.tif" wi="70" he="12" img-content="math" img-format="tif"/></maths></p>
<p id="p0034" num="0034">Für die höheren Lattice-Stufen <i>m</i> = 2,3, ..... kann die Gleichung (14) verallgemeinert werden, wodurch sich eine Korrektur der übrigen Reflexionskoeffizienten <i>k̂<sub>m</sub></i> ergibt.</p>
<p id="p0035" num="0035">Dessen ungeachtet kann man aus dem obigen schließen, dass eine Verminderung der Größe der Reflexionskoeffizienten, das heißt eine Verringerung des Verhältnisses zwischen Korrelation und Leistungsschätzung für die Vorhersage eines Signals <i>x</i>(<i>n</i>) bei Beobachtung eines Signal <i>y</i>(<i>n</i>), welches zusätzliches Geräusch enthält, zweckmäßig ist. Das Auffinden der Korrekturgrößen setzt eine verlässliche Schätzung der Geräuschleistung σ<i><sub>n</sub></i><sup>2</sup> voraus. Weiters berücksichtigt das Modell bis jetzt nicht irgendwelche Kenntnisse bezüglich der Eigenschaften der Sprache und des zu erwartenden Geräuschsignals.</p>
<p id="p0036" num="0036">Die Erfindung schafft nun eine Verfahren bzw. eine Vorrichtung, mit welcher man, basierend auf einfachen Annahmen über die Änderung der Korrelation und der Leistung der Sprach- und Geräuschsignale nach der Zeit eine Korrektur der Reflexionsfaktoren erhält.<!-- EPO <DP n="10"> --> Wie oben ausgeführt, beruhen die Schätzungen der Fehlerkorrelation (6) und der Fehlervarianz (7) üblicherweise auf einer Tiefpassfilterung der Augenblickswerte. Oft wird auch eine einpolige Tiefpassfilterung (verlustbehaftet Integration) verwendet: <maths id="math0024" num="(15)"><math display="block"><msub><mover><mi>r</mi><mo> ˜</mo></mover><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi mathvariant="italic">λ</mi><mi>r</mi></msub><mo>⁢</mo><msub><mover><mi>r</mi><mo> ˜</mo></mover><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><msub><mi>f</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><msub><mi>b</mi><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>,</mo></math><img id="ib0024" file="imgb0024.tif" wi="132" he="13" img-content="math" img-format="tif"/></maths> <maths id="math0025" num="(16)"><math display="block"><msub><mover><mi>q</mi><mo> ˜</mo></mover><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi mathvariant="italic">λ</mi><mi>q</mi></msub><mo>⁢</mo><msub><mover><mi>q</mi><mo> ˜</mo></mover><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mfenced separators=""><msubsup><mi>f</mi><mi>m</mi><mn>2</mn></msubsup><mfenced><mi>n</mi></mfenced><mo>+</mo><msubsup><mi>b</mi><mi>m</mi><mn>2</mn></msubsup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced><mo>,</mo></math><img id="ib0025" file="imgb0025.tif" wi="122" he="15" img-content="math" img-format="tif"/></maths><br/>
mit den gleichen Polen bzw. Integrationsfaktoren λ<i><sub>r</sub></i> = λ<i><sub>q</sub></i> sowohl für die Korrelations- als auch die Leistungsschätzung.</p>
<p id="p0037" num="0037">In Einklang mit der Erfindung sind verschiedene Pollagen λ<i><sub>q</sub></i> ≥ λ<i><sub>r</sub></i> erlaubt. Die resultierenden Filterfunktionen <maths id="math0026" num="(17)"><math display="block"><mtable><mtr><mtd><msub><mi>H</mi><mi>r</mi></msub><mfenced><mi>z</mi></mfenced><mo>=</mo><mfrac><mn>1</mn><mrow><mn>1</mn><mo>-</mo><msub><mi mathvariant="italic">λ</mi><mi>r</mi></msub><mo>⁢</mo><msup><mi>z</mi><mrow><mo>-</mo><mn>1</mn></mrow></msup></mrow></mfrac><mo>,</mo></mtd><mtd><msub><mi>H</mi><mi>q</mi></msub><mfenced><mi>z</mi></mfenced><mo>=</mo><mfrac><mn>1</mn><mrow><mn>1</mn><mo>-</mo><msub><mi mathvariant="italic">λ</mi><mi>q</mi></msub><mo>⁢</mo><msup><mi>z</mi><mrow><mo>-</mo><mn>1</mn></mrow></msup></mrow></mfrac><mo>,</mo></mtd></mtr></mtable></math><img id="ib0026" file="imgb0026.tif" wi="154" he="21" img-content="math" img-format="tif"/></maths><br/>
für λ<i><sub>r</sub></i> = 0,99608 und λ<i><sub>q</sub></i> = 0,99843 und eine Abtastrate von 16 kHz sind in <figref idref="f0001">Fig.3a</figref> dargestellt Man kann sehen, dass das Verhältnis von <i>r̃<sub>m</sub></i>(<i>n</i>) und <i>q̃<sub>m</sub></i>(<i>n</i>) bei geringeren Frequenzen beeinflusst wird, das heißt für langsam sich ändernde Korrelation und Leistung, wogegen für raschere Änderungen (über ≈ 10Hz) das Verhältnis verglichen mit den Schätzungen mit λ<i><sub>r</sub></i> = λ<i><sub>q</sub></i> ungeändert bleibt. Unter der Annahme, dass diese Parameter sich für das Sprachsignal rascher ändern (unter der Annahme beispielsweise einer Phonemrate von 10 pro Sekunde) als für das Geräuschsignal (stationäres oder langsam sich mit der Zeit änderndes Geräusch) wird das sich ergebende Lattice-Prädiktionsfilter die Sprachsignalkomponente gut vorhersagen, wogegen die Geräuschkomponente unterdrückt wird.</p>
<p id="p0038" num="0038">Was impulsartige Geräusche betrifft, kann man vorsehen, das Verhältnis zwischen Korrelation und Leistungsschätzung auch für hohe Frequenzen zu reduzieren, was beispielsweise durch Verwendung eines zweiten Pols in dem Tiefpassfilter für die Korrelation <i>H<sub>r</sub></i>(<i>z</i>) erfolgen kann. Eine entsprechende Übertragungsfunktion ist in <figref idref="f0001">Fig.3b</figref> dargestellt.</p>
<p id="p0039" num="0039">Im Einzelnen zeigen die <figref idref="f0001">Figuren 3a und b</figref> die Frequenzgänge eines Tiefpassfilters für eine Fehlerkorrelation <i>H<sub>r</sub></i>(<i>z</i>) (ausgezogene Linien) und die Varianz <i>H<sub>q</sub></i>(<i>z</i>) (punktierte Linien) für in <figref idref="f0001">Fig. 3a</figref> zwei einpolige Tiefpassfilter mit λ<i><sub>r</sub></i> = 0,99608 und λ<i><sub>q</sub></i> = 0,99843 bzw. <figref idref="f0001">Figur 3b</figref> einen<!-- EPO <DP n="11"> --> einpoligen Tiefpass für die Leistungsschätzung von <i>q̃</i>(<i>n</i>) mit λ<i><sub>q</sub></i> = 0,99843 und einen zweipoligen Tiefpass für die Korrelationsschätzung <i>r̃</i>(<i>n</i>) mit λ<sub><i>r</i>1</sub> = 0,99608 und λ<sub><i>r</i>2</sub> = 0,9. Je größer der Abstand zwischen den beiden Übertragungsfunktionen umso stärker ist die Geräuschunterdrückung.</p>
<p id="p0040" num="0040">Um eine gute Reduzierung des Geräusches zu erreichen, kann unter diesen Umständen die Ordnung M des LP-Filters überraschend niedrig gewählt werden, sogar niedriger als die üblicherweise zur Modellierung der spektralen Hüllkurve von Sprachsignalen verwendete Ordnung. Beispielsweise wurde in dem in <figref idref="f0002">Fig. 4a</figref> gezeigten Beispiel ein Prädiktor mit der Ordnung <i>M</i> = 10 für ein Signal mit einer Abtastrate von 16 kHz verwendet. Dieses Beispiel enthält ein mehrmaliges Auftreten von starken, nicht stationären Geräuschbursts, die dank der Erfindung gut beseitigt werden. Das gezeigte Geräusch stammt aus einer Fabrikhallen-Umgebung, das heißt einer äußerst ungünstigen akustischen Umgebung.</p>
<p id="p0041" num="0041">Die Wirksamkeit der Geräuschunterdrückung kann gesteuert werden durch die Einstellung unterschiedlicher Werte für λ<i><sub>r</sub></i> (bzw. λ<sub><i>r</i>1</sub> und λ<sub><i>r</i>2</sub>) und λ<i><sub>q</sub></i>. Wobei diese in Abhängigkeit von der Signalleistung und der Geräuschleistung gewählt werden: <maths id="math0027" num="(18)"><math display="block"><mfenced><msub><mi mathvariant="italic">λ</mi><mi mathvariant="italic">r</mi></msub><msub><mi mathvariant="italic">λ</mi><mi mathvariant="italic">q</mi></msub></mfenced><mo>=</mo><mi>f</mi><mfenced><msubsup><mi>σ</mi><mi>x</mi><mn>2</mn></msubsup><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mfenced><mo>,</mo><mi>bzw</mi><mn>.</mn><mfenced><msub><mi mathvariant="italic">λ</mi><mrow><mi mathvariant="italic">r</mi><mo>⁢</mo><mn mathvariant="italic">1</mn></mrow></msub><msub><mi mathvariant="italic">λ</mi><mrow><mi mathvariant="italic">r</mi><mo>⁢</mo><mn mathvariant="italic">2</mn></mrow></msub><msub><mi mathvariant="italic">λ</mi><mi mathvariant="italic">q</mi></msub></mfenced><mo>=</mo><mi>g</mi><mfenced><msubsup><mi>σ</mi><mi>x</mi><mn>2</mn></msubsup><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mfenced><mn>.</mn></math><img id="ib0027" file="imgb0027.tif" wi="139" he="16" img-content="math" img-format="tif"/></maths></p>
<p id="p0042" num="0042">Weiters ist es zweckmäßig, die Wirksamkeit der Geräuschunterdrückung anhand einer Schätzung der Sprachaktivität zu steuern. Bei der Verwendung eines LP-Fehler-Filters bietet sich (vgl. auch [5]) die Schätzung der wahrscheinlichen Sprachaktivität als reeller Zahl im Wertebereich von 0 bis 1 anhand der Leistungen des Filtereingangssignals und des Filterausgangssignals an: <maths id="math0028" num=""><math display="block"><mi mathvariant="italic">ν</mi><mo>=</mo><mfrac><mrow><mi>E</mi><mfenced open="{" close="}" separators=""><msup><mi>y</mi><mn>2</mn></msup><mfenced><mi>n</mi></mfenced></mfenced><mo>-</mo><mi>E</mi><mfenced open="{" close="}" separators=""><msup><mi>e</mi><mn>2</mn></msup><mfenced><mi>n</mi></mfenced></mfenced></mrow><mrow><mi>E</mi><mfenced open="{" close="}" separators=""><msup><mi>e</mi><mn>2</mn></msup><mfenced><mi>n</mi></mfenced></mfenced></mrow></mfrac></math><img id="ib0028" file="imgb0028.tif" wi="71" he="21" img-content="math" img-format="tif"/></maths><br/>
für ein Lattice Filter ist eine mögliche Auswertung der Erwartungswerte gegeben durch <maths id="math0029" num=""><math display="block"><mi mathvariant="italic">ν</mi><mo>=</mo><mfrac><mrow><msub><mi>q</mi><mn>0</mn></msub><mfenced><mi>n</mi></mfenced><mo>-</mo><msub><mi>q</mi><mrow><mi>M</mi><mo>-</mo><mn>1</mn></mrow></msub><mfenced><mi>n</mi></mfenced></mrow><mrow><msub><mi>q</mi><mrow><mi>M</mi><mo>-</mo><mn>1</mn></mrow></msub><mfenced><mi>n</mi></mfenced></mrow></mfrac><mn>.</mn></math><img id="ib0029" file="imgb0029.tif" wi="63" he="19" img-content="math" img-format="tif"/></maths></p>
<p id="p0043" num="0043">Zur Steuerung der Geräuschunterdrückung kann dann ein Faktor <maths id="math0030" num=""><math display="block"><msub><mi>k</mi><mi>n</mi></msub><mo>=</mo><mn>1</mn><mo>-</mo><mi mathvariant="italic">ν</mi><mo>,</mo></math><img id="ib0030" file="imgb0030.tif" wi="53" he="13" img-content="math" img-format="tif"/></maths><br/>
<!-- EPO <DP n="12"> -->für das Ausgangssignal des Lattice Filters <i>e</i>(<i>n</i>), und/oder ein Faktor <maths id="math0031" num=""><math display="block"><msub><mi>k</mi><mi>g</mi></msub><mo>=</mo><mi mathvariant="italic">ν</mi><mo>,</mo></math><img id="ib0031" file="imgb0031.tif" wi="24" he="13" img-content="math" img-format="tif"/></maths><br/>
für das Ausgangssignal verwendet werden.</p>
<p id="p0044" num="0044">Das LP-Fehler-Filter kann als Filter in direkter Filterform (DFF) ausgebildet sein, welches aus dem Eingangssignal ein Prädiktionssignal an seinem Ausgang erzeugt, wobei ein Subtrahierer das Prädiktionssignal vom Eingangssignal abzieht und somit das Ausgangssignal des LP-Fehler-Filters <i>e</i>(<i>n</i>) erzeugt. Die verzögerten Abtastwerte des Eingangssignals (vgl. Gleichung 1) sowie das Ausgangssignal des Subtrahierers <i>e</i>(<i>n</i>) entsprechen den internen Signalen des LP-Fehler-Filters.</p>
<p id="p0045" num="0045">Ein wichtiges Merkmal der erfindungsgemäßen Geräuschunterdrückung besteht in der an die Eigenschaften des Sprach- und des Geräuschsignales angepassten Auswertung der Erwartungswertoperatoren und damit der optimalen Einstellung der Filterkoeffizienten für das lineare Prädiktionsfilter, sowie in der Sprachaktivitätsschätzung und deren Verwendung bei der Schätzung des Geräuschsignals, und zur Steuerung der Wirksamkeit der Geräuschunterdrückung und der Amplitude des Ausgangssignales.</p>
<p id="p0046" num="0046">Wenngleich es klar sein sollte, dass der Rechenaufwand mit der gewählten Filterordnung steigt und daher der Rechenaufwand unter Umständen größer sein kann, als jener bei Verwendung einer schnellen Fouriertransformation, liegt ein wesentlicher Vorteil der Erfindung darin, dass sie eine Geräuschreduktion ohne Verzögerung des Sprachsignals ermöglicht, was ein besonderer Vorteil ist, vor allem beim Einsatz in Hörgeräten.</p>
</description><!-- EPO <DP n="13"> -->
<claims id="claims01" lang="de">
<claim id="c-de-01-0001" num="0001">
<claim-text>Vorrichtung zur Geräuschunterdrückung mit einer linearen Prädiktions-Analysierschaltung mit einem LP-Fehler-Filter (LFF), das aus einem Lattice-Filter besteht und auf Basis eines ersten, von Geräusch überlagerten Sprachsignals <i>y</i>(<i>n</i>) = <i>x</i>(<i>n</i>) + ε(<i>n</i>), wobei <i>x</i>(<i>n</i>) ein nicht von Geräusch überlagertes Sprachsignal und ε(<i>n</i>) das Geräusch darstellen, ein LP-Fehler-Filter Ausgangssignal <i>e</i>(<i>n</i>) erzeugt, einer Koeffizientenberechnungseinheit (KBE), welche die Koeffizienten des LP-Fehler-Filters auf Basis der Vorwärts und Rückwärtstehlersignale f<sub>m</sub>(n) und b<sub>m</sub>(n) der Lattice-Filterstufen des LP-Fehler-Filters sowie des Ein- und Ausgangssignals <i>y</i>(<i>n</i>) und <i>e</i>(<i>n</i>) des LP-Fehler-Filters aktualisiert, und einer Subtrahiereinheit, welche das LP-Fehler-Filter-Ausgangssignal <i>e</i>(<i>n</i>) von dem ersten Sprachsignal <i>y</i>(<i>n</i>) in einem Subtrahierer subtrahiert und nach der Subtraktion den Rest als zweites Sprachsignal <i>x̂</i>(<i>n</i>) = <i>y</i>(<i>n</i>)-<i>e</i>(<i>n</i>) ausgibt, in welchem das Geräusch unterdrückt ist, eine Geräuschschätzungseinheit (GSE) vorgesehen ist, welche auf Basis der Signale f<sub>m</sub>(n), b<sub>m</sub>(<i>n</i>), y(<i>n</i>) und e(<i>n</i>) des LP-Fehler-Filters ein Geräuschleistungssignal σ<i><sub>n</sub></i><sup>2</sup> und ein Sprachleistungssignal σ<i><sub>x</sub></i><sup>2</sup> erzeugen, die der Koeffizientenberechnungseinheit (KBE) zugeführt sind, in welcher die Koeffizienten des LP-Fehler-Filters zu jeden Zeitpunkt <i>n</i> berechnet werden,<br/>
<b>dadurch gekennzeichnet, dass</b><br/>
die Koeffizientenberechnungseinheit (KBE) weiters dazu eingerichtet ist, die korrigierte Fehlervarianz <i>q̃</i><sub>0</sub> gemäß <maths id="math0032" num=""><math display="block"><msub><mover><mi>q</mi><mo>^</mo></mover><mn>0</mn></msub><mo>=</mo><msub><mi mathvariant="normal">q</mi><mn>0</mn></msub><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn mathvariant="italic">2</mn></msubsup></math><img id="ib0032" file="imgb0032.tif" wi="39" he="14" img-content="math" img-format="tif"/></maths><br/>
und den korrigierten Reflexionskoeffizienten k̂ gemäß <maths id="math0033" num=""><math display="block"><msub><mover><mi>k</mi><mo>^</mo></mover><mn>1</mn></msub><mo>=</mo><mo>-</mo><mfrac><msub><mover><mi>r</mi><mo>^</mo></mover><mn>0</mn></msub><msub><mover><mi>q</mi><mo>^</mo></mover><mn>0</mn></msub></mfrac><mo>=</mo><mo>-</mo><mfrac><msub><mi>r</mi><mn>0</mn></msub><mrow><msub><mi>q</mi><mn>0</mn></msub><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mrow></mfrac></math><img id="ib0033" file="imgb0033.tif" wi="79" he="18" img-content="math" img-format="tif"/></maths><br/>
zu ermitteln, mit qo als Fehlervarianz und r<sub>0</sub> als Reflexionskoeffizient,<br/>
und die Koeffizientenberechnungseinheit (KBE) weiters dazu eingerichtet ist,<br/>
die Fehlerkorrelation gemäß <maths id="math0034" num=""><math display="block"><msub><mover><mi>r</mi><mo> ˜</mo></mover><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi mathvariant="italic">λ</mi><mi>r</mi></msub><mo>⁢</mo><msub><mover><mi>r</mi><mo> ˜</mo></mover><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><msub><mi>f</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><msub><mi>b</mi><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></math><img id="ib0034" file="imgb0034.tif" wi="88" he="15" img-content="math" img-format="tif"/></maths><br/>
und die Fehlervarianz gemäß<!-- EPO <DP n="14"> --> <maths id="math0035" num=""><math display="block"><msub><mover><mi>q</mi><mo> ˜</mo></mover><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi mathvariant="italic">λ</mi><mi>q</mi></msub><mo>⁢</mo><msub><mover><mi>q</mi><mo> ˜</mo></mover><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mfenced separators=""><msubsup><mi>f</mi><mi>m</mi><mn>2</mn></msubsup><mfenced><mi>n</mi></mfenced><mo>+</mo><msubsup><mi>b</mi><mi>m</mi><mn>2</mn></msubsup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></math><img id="ib0035" file="imgb0035.tif" wi="92" he="14" img-content="math" img-format="tif"/></maths> mit λ<i><sub>q</sub></i> &gt; λ,<br/>
zu ermitteln, wobei λ, und λ<i><sub>q</sub></i> Pole der fürr̃<i><sub>m</sub></i>(<i>n</i>) und q̃<i><sub>m</sub></i>(<i>n</i>) angegebenen Tiefpassfiltergleichnungen sind. .</claim-text></claim>
<claim id="c-de-01-0002" num="0002">
<claim-text>Vorrichtung nach Anspruch 1, <b>dadurch gekennzeichnet, dass</b> in der Koeffizientenberechnungseinheit (KBE) für die Korrelationsschätzung der Fehlerkorrelation <i>r̃</i>(<i>n</i>) ein zweipoliger Tiefpass vorgesehen ist.</claim-text></claim>
<claim id="c-de-01-0003" num="0003">
<claim-text>Vorrichtung nach Anspruch 1 oder 2, <b>dadurch gekennzeichnet, dass</b> eine Sprachaktivitätsschätzungseinheit (SAE) vorgesehen ist, welche auf Basis der Signale <i>fm</i>(<i>n</i>), <i>bm</i>(<i>n</i>), <i>y</i>(<i>n</i>) und <i>e</i>(<i>n</i>) ein Sprachaktivitätssignal <i>v</i> erzeugt, das der Koeffizientenberechnungseinheit (KBE) zugeführt ist und von dieser im Sinne einer Optimierung der Geräuschunterdrückung berücksichtigt wird.</claim-text></claim>
<claim id="c-de-01-0004" num="0004">
<claim-text>Vorrichtung nach Anspruch 3, <b>dadurch gekennzeichnet, dass</b> die Sprachaktivitätsschätzungseinheit (SAE) zur Bildung eines Geräuschunterdrückungsfaktors (<i>k<sub>n</sub></i>) eingerichtet ist, welcher einem Eingang eines ersten Multiplizierers (MU1) zugeführt ist und dessen anderem Eingang das Ausgangssignal des LP-Fehler-Filters zugeführt ist und der vor der Subtrahiereinheit liegt.</claim-text></claim>
<claim id="c-de-01-0005" num="0005">
<claim-text>Vorrichtung nach Anspruch 4, <b>dadurch gekennzeichnet, dass</b> die Sprachaktivitätsschätzungseinheit (SAE) zur Bildung eines Gesamtsignalfaktors (<i>k<sub>8</sub></i>) eingerichtet ist, welcher einem Eingang eines zweiten Multiplizierers (MU2) zugeführt ist, dessen anderem Eingang das Ausgangssignal der Subtrahiereinheit zugeführt ist.<!-- EPO <DP n="15"> --></claim-text></claim>
<claim id="c-de-01-0006" num="0006">
<claim-text>Kaskade, bestehend aus zumindest zwei hintereinander geschalteten Vorrichtungen nach einem der Ansprüche 1 bis 5.</claim-text></claim>
</claims><!-- EPO <DP n="16"> -->
<claims id="claims02" lang="en">
<claim id="c-en-01-0001" num="0001">
<claim-text>Device for noise reduction with a linear predictive analyser circuit with an LP error filter (LFF), which consists of a lattice filter and generates an LP error filter output signal <b><i>e</i>(<i>n</i>)<i>,</i></b> on the basis of a first speech signal <b><i>y</i>(<i>n</i>)= <i>x</i>(<i>n</i>)+<i>ε</i>(<i>n</i>)</b> overwritten with noise, whereby <b><i>x</i>(<i>n</i>)</b> represents a speech signal not overwritten with noise and <b>ε<i>(n)</i></b> represents the noise, a coefficient calculation unit (KBE), which updates the coefficients of the LP error filter on the basis of the input and output signals <i><b>y(n)</b></i> and <b><i>e(n)</i>,</b> forward and backward error signals <i>fm(n) <b>and b(n)</b></i> of the lattice filter stages of the LP error filter, as well as the LP error filter, and a subtraction unit, which subtracts the LP error filter output signal <b><i>e(n)</i></b> from the first speech signal <b><i>y(n)</i></b> in a subtractor, and after the subtraction emits the remainder as a second speech signal <b>x̂(n)= <i>y</i>(<i>n</i>)<i>-e</i>(<i>n</i>)</b> in which the noise is reduced, a noise estimation unit (GSE) is provided, which, on the basis of signals <i><b>fm(n), b(n), y(n)</b></i> and <b><i>e(n)</i></b> of the LP error filter, generates a noise performance signal <b>σ<i><sub>n</sub></i><sup>2</sup></b> and a speech performance signal <b>σ<i><sub>x</sub></i><sup>2</sup></b> which are fed into the coefficient calculation unit (KBE), in which the coefficients of the LP error filter are calculated at each point n,<br/>
<b>characterised in that</b>,<br/>
the coefficient calculation unit (KBE) is also equipped to calculate the corrected error variance <b><i>q̂<sub>0</sub></i></b> according to <maths id="math0036" num=""><math display="block"><msub><mover><mi>q</mi><mo>^</mo></mover><mn>0</mn></msub><mo>=</mo><msub><mi mathvariant="normal">q</mi><mn>0</mn></msub><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn mathvariant="italic">2</mn></msubsup></math><img id="ib0036" file="imgb0036.tif" wi="43" he="13" img-content="math" img-format="tif"/></maths><br/>
and the corrected reflection coefficients <b><i>k̂</i></b> according to<!-- EPO <DP n="17"> --> <maths id="math0037" num=""><math display="block"><msub><mover><mi>k</mi><mo>^</mo></mover><mn>1</mn></msub><mo>=</mo><mo>-</mo><mfrac><msub><mover><mi>r</mi><mo>^</mo></mover><mn>0</mn></msub><msub><mover><mi>q</mi><mo>^</mo></mover><mn>0</mn></msub></mfrac><mo>=</mo><mo>-</mo><mfrac><msub><mi>r</mi><mn>0</mn></msub><mrow><msub><mi>q</mi><mn>0</mn></msub><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mrow></mfrac></math><img id="ib0037" file="imgb0037.tif" wi="99" he="22" img-content="math" img-format="tif"/></maths> with <b>q<sub>0</sub></b> denoting the error variance and <b>r<sub>0</sub></b> denoting the reflection coefficient,<br/>
and the coefficient calculation unit (KBE) is also equipped to calculate the error correlation according to <maths id="math0038" num=""><math display="block"><msub><mover><mi>r</mi><mo> ˜</mo></mover><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi mathvariant="italic">λ</mi><mi>r</mi></msub><mo>⁢</mo><msub><mover><mi>r</mi><mo> ˜</mo></mover><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><msub><mi>f</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><msub><mi>b</mi><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></math><img id="ib0038" file="imgb0038.tif" wi="108" he="13" img-content="math" img-format="tif"/></maths><br/>
and the error variance according to <maths id="math0039" num=""><math display="block"><msub><mover><mi>q</mi><mo> ˜</mo></mover><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi mathvariant="italic">λ</mi><mi>q</mi></msub><mo>⁢</mo><msub><mover><mi>q</mi><mo> ˜</mo></mover><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mfenced separators=""><msubsup><mi>f</mi><mi>m</mi><mn>2</mn></msubsup><mfenced><mi>n</mi></mfenced><mo>+</mo><msubsup><mi>b</mi><mi>m</mi><mn>2</mn></msubsup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></math><img id="ib0039" file="imgb0039.tif" wi="124" he="15" img-content="math" img-format="tif"/></maths><br/>
with λ<b><sub>r</sub></b> &gt; λ<b><sub>q</sub></b><br/>
whereby λ<b><sub>r</sub></b> and λ<b><sub>q</sub></b> are poles which are for low-pass filter equations denoted as <b><i>r̃<sub>m</sub></i>(<i>n</i>)</b> and <b><i>q<sub>m̃</sub></i><sub>(<i>n</i>)</sub></b>.</claim-text></claim>
<claim id="c-en-01-0002" num="0002">
<claim-text>Device according to claim 1, <b>characterised in that</b> a bipolar low-pass is provided in the coefficient calculation unit (KBE) for the correlation estimate of the error correlation <b><i>r</i><sub>r̃</sub>(<i>n</i>)</b>.</claim-text></claim>
<claim id="c-en-01-0003" num="0003">
<claim-text>Device according to claim 1 or 2, <b>characterised in that</b> a voice activity estimation unit (SAE) is provided, which on the basis of signals <i><b>fm(n) and b(n), y(n)</b></i> and <i>e(n)</i> generates a voice activity signal <i>v</i>, which is fed into the coefficient calculation unit (KBE) and is considered by the same in terms of optimising noise reduction.</claim-text></claim>
<claim id="c-en-01-0004" num="0004">
<claim-text>Device according to claim 3, <b>characterised in that</b> the voice activity estimation unit (SAE) is equipped to generate a noise reduction factor <b>(k<sub>n</sub>),</b> which is fed into an input of a first multiplier (MU1), and with the output signal of the LP error filter being fed into the other input thereof, and which lies before the subtraction unit.</claim-text></claim>
<claim id="c-en-01-0005" num="0005">
<claim-text>Device according to claim 4, <b>characterised in that</b> the voice activity estimation unit (SAE) is equipped to generate a total signal factor <b>(K</b><sub>g</sub><b>)</b> which is fed into an input of a second multiplier (MU2), with the output signal of the subtraction unit being fed into the other input thereof.<!-- EPO <DP n="18"> --></claim-text></claim>
<claim id="c-en-01-0006" num="0006">
<claim-text>Cascade, consisting of at least two devices connected in series according to any one of claims 1 to 5.</claim-text></claim>
</claims><!-- EPO <DP n="19"> -->
<claims id="claims03" lang="fr">
<claim id="c-fr-01-0001" num="0001">
<claim-text>Dispositif d'atténuation du bruit comprenant un circuit de prédiction et d'analyse linéaire avec un filtre d'erreur passe-bas (LFF) qui se compose d'un filtre lattice et qui, sur la base d'un premier signal vocal <i>y(n) - x(n) + ε(η)</i> auquel est superposé du bruit, <i>x</i>(<i>n</i>) représentant un signal vocal non superposé de bruit et ε<i>(</i>η<i>)</i> le bruit, génère un signal de sortie de filtre d'erreur passe-bas <i>e(n)</i>, avec une unité de calcul de coefficient (KBE) qui actualise les coefficients du filtre d'erreur passe-bas sur la base des signaux d'erreur avant et arrière <i>fm(n)</i> et <i>bm(n)</i> des étages de filtre lattice du filtre d'erreur passe-bas et sur la base du signal d'entrée et du signal de sortie <i>y(n)</i> et <i>e</i>(<i>n</i>) du filtre d'erreur passe-bas, et avec une unité de soustraction qui soustrait le signal de sortie de filtre d'erreur passe-bas <i>e(n)</i> du premier signal vocal <i>y(n)</i> dans un soustracteur et, après soustraction, sort le reste sous la forme d'un deuxième signal vocal <b>x̂(n)</b> = <i>y(n)</i> - <i>e</i>(<i>n</i>) où le bruit est atténué, où une unité d'évaluation du bruit (GSE) est prévue, laquelle génère sur la base des signaux <i>fm(n), bm(n), y(n)</i> et <i>e</i>(<i>n</i>) du filtre d'erreur passe-bas un signal de puissance du bruit σ<sub>n</sub><sup>2</sup> et un signal de puissance vocale σ<sub>x</sub><sup>2</sup>, lesdits signaux étant acheminés vers l'unité de calcul de coefficient (KBE) où les coefficients du filtre d'erreur passe-bas sont calculés à chaque moment <i>n</i>,<br/>
<b>caractérisé</b><br/>
<b>en ce que</b> l'unité de calcul de coefficient (KBE) est en outre prévue pour déterminer la variance d'erreur corrigée <b><i>q̂</i><sub>0</sub></b> selon<!-- EPO <DP n="20"> --> <maths id="math0040" num=""><math display="block"><msub><mover><mi>q</mi><mo>^</mo></mover><mn>0</mn></msub><mo>=</mo><msub><mi mathvariant="normal">q</mi><mn>0</mn></msub><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn mathvariant="italic">2</mn></msubsup></math><img id="ib0040" file="imgb0040.tif" wi="34" he="10" img-content="math" img-format="tif"/></maths><br/>
et le coefficient de réflexion corrigé <b><i>k̂</i></b> selon <maths id="math0041" num=""><math display="block"><msub><mover><mi>k</mi><mo>^</mo></mover><mn>1</mn></msub><mo>=</mo><mo>-</mo><mfrac><msub><mover><mi>r</mi><mo>^</mo></mover><mn>0</mn></msub><msub><mover><mi>q</mi><mo>^</mo></mover><mn>0</mn></msub></mfrac><mo>=</mo><mo>-</mo><mfrac><msub><mi>r</mi><mn>0</mn></msub><mrow><msub><mi>q</mi><mn>0</mn></msub><mo>-</mo><msubsup><mi>σ</mi><mi>n</mi><mn>2</mn></msubsup></mrow></mfrac></math><img id="ib0041" file="imgb0041.tif" wi="55" he="12" img-content="math" img-format="tif"/></maths><br/>
avec q<sub>0</sub> comme variance d'erreur et r<sub>0</sub> comme coefficient de réflexion,<br/>
et <b>en ce que</b> l'unité de calcul de coefficient (KBE) est en outre prévue<br/>
pour déterminer la corrélation d'erreur selon <maths id="math0042" num=""><math display="block"><msub><mover><mi>r</mi><mo> ˜</mo></mover><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi mathvariant="italic">λ</mi><mi>r</mi></msub><mo>⁢</mo><msub><mover><mi>r</mi><mo> ˜</mo></mover><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><msub><mi>f</mi><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>⁢</mo><msub><mi>b</mi><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></math><img id="ib0042" file="imgb0042.tif" wi="63" he="11" img-content="math" img-format="tif"/></maths><br/>
et la variance d'erreur selon <maths id="math0043" num=""><math display="block"><msub><mover><mi>q</mi><mo> ˜</mo></mover><mi>m</mi></msub><mfenced><mi>n</mi></mfenced><mo>=</mo><msub><mi mathvariant="italic">λ</mi><mi>q</mi></msub><mo>⁢</mo><msub><mover><mi>q</mi><mo> ˜</mo></mover><mi>m</mi></msub><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced><mo>+</mo><mfrac><mn>1</mn><mn>2</mn></mfrac><mo>⁢</mo><mfenced separators=""><msubsup><mi>f</mi><mi>m</mi><mn mathvariant="italic">2</mn></msubsup><mfenced><mi>n</mi></mfenced><mo>+</mo><msubsup><mi>b</mi><mi>m</mi><mn mathvariant="italic">2</mn></msubsup><mo>⁢</mo><mfenced separators=""><mi>n</mi><mo>-</mo><mn>1</mn></mfenced></mfenced></math><img id="ib0043" file="imgb0043.tif" wi="65" he="9" img-content="math" img-format="tif"/></maths><br/>
avec λ<sub>q</sub> &gt; λ<sub>r</sub>,<br/>
λ<sub>r</sub> et λ<sub>q</sub> étant des pôles des équations de filtre passe-bas données pour <i>r̃<sub>m</sub></i>(n) et q̃<i><sub>m</sub></i>(n).</claim-text></claim>
<claim id="c-fr-01-0002" num="0002">
<claim-text>Dispositif selon la revendication 1, <b>caractérisé en ce qu'</b>un filtre passe-bas bipolaire est prévu dans l'unité de calcul de coefficient (KBE) pour l'évaluation de corrélation de la corrélation d'erreur <i>r̃(n).</i></claim-text></claim>
<claim id="c-fr-01-0003" num="0003">
<claim-text>Dispositif selon la revendication 1 ou la revendication 2, <b>caractérisé en ce qu'</b>une unité d'évaluation d'activité vocale (SAE) est prévue, laquelle génère sur la base des signaux <i>fm(n), bm(n), y(n)</i> et <i>e(n)</i> du filtre d'erreur passe-bas un signal d'activité vocale <i>v</i> qui est acheminé vers l'unité de calcul de coefficient (KBE) et qui est pris en compte par celle-ci en vue d'une optimisation de l'atténuation du bruit.<!-- EPO <DP n="21"> --></claim-text></claim>
<claim id="c-fr-01-0004" num="0004">
<claim-text>Dispositif selon la revendication 3, <b>caractérisé en ce que</b> l'unité d'évaluation d'activité vocale (SAE) est prévue pour former un facteur d'atténuation du bruit (<i>k<sub>n</sub></i>) qui est acheminé vers une entrée d'un premier multiplicateur (MU1), vers l'autre entrée duquel est acheminé le signal de sortie du filtre d'erreur passe-bas, ledit multiplicateur étant situé en amont de l'unité de soustraction.</claim-text></claim>
<claim id="c-fr-01-0005" num="0005">
<claim-text>Dispositif selon la revendication 4, <b>caractérisé en ce que</b> l'unité d'évaluation d'activité vocale (SAE) forme un facteur de signal global (<i>k<sub>g</sub></i>) qui est acheminé vers une entrée d'un deuxième multiplicateur (MU2), vers l'autre entrée duquel est acheminé le signal de sortie de l'unité de soustraction.</claim-text></claim>
<claim id="c-fr-01-0006" num="0006">
<claim-text>Cascade composée d'au moins deux dispositifs selon l'une des revendications 1 à 5, montés l'un derrière l'autre.</claim-text></claim>
</claims><!-- EPO <DP n="22"> -->
<drawings id="draw" lang="de">
<figure id="f0001" num="1,2,3a,3b"><img id="if0001" file="imgf0001.tif" wi="165" he="176" img-content="drawing" img-format="tif"/></figure><!-- EPO <DP n="23"> -->
<figure id="f0002" num="4,5"><img id="if0002" file="imgf0002.tif" wi="165" he="178" img-content="drawing" img-format="tif"/></figure><!-- EPO <DP n="24"> -->
<figure id="f0003" num="6,7,8"><img id="if0003" file="imgf0003.tif" wi="143" he="224" img-content="drawing" img-format="tif"/></figure>
</drawings>
<ep-reference-list id="ref-list">
<heading id="ref-h0001"><b>IN DER BESCHREIBUNG AUFGEFÜHRTE DOKUMENTE</b></heading>
<p id="ref-p0001" num=""><i>Diese Liste der vom Anmelder aufgeführten Dokumente wurde ausschließlich zur Information des Lesers aufgenommen und ist nicht Bestandteil des europäischen Patentdokumentes. Sie wurde mit größter Sorgfalt zusammengestellt; das EPA übernimmt jedoch keinerlei Haftung für etwaige Fehler oder Auslassungen.</i></p>
<heading id="ref-h0002"><b>In der Beschreibung aufgeführte Patentdokumente</b></heading>
<p id="ref-p0002" num="">
<ul id="ref-ul0001" list-style="bullet">
<li><patcit id="ref-pcit0001" dnum="US20010005822A1"><document-id><country>US</country><doc-number>20010005822</doc-number><kind>A1</kind></document-id></patcit><crossref idref="pcit0001">[0004]</crossref><crossref idref="pcit0008">[0007]</crossref><crossref idref="pcit0010">[0007]</crossref></li>
<li><patcit id="ref-pcit0002" dnum="GB1520148A"><document-id><country>GB</country><doc-number>1520148</doc-number><kind>A</kind></document-id></patcit><crossref idref="pcit0002">[0004]</crossref></li>
<li><patcit id="ref-pcit0003" dnum="US4587620A"><document-id><country>US</country><doc-number>4587620</doc-number><kind>A</kind></document-id></patcit><crossref idref="pcit0003">[0004]</crossref></li>
<li><patcit id="ref-pcit0004" dnum="US7065468B"><document-id><country>US</country><doc-number>7065468</doc-number><kind>B</kind></document-id></patcit><crossref idref="pcit0004">[0005]</crossref><crossref idref="pcit0005">[0006]</crossref><crossref idref="pcit0006">[0006]</crossref><crossref idref="pcit0007">[0007]</crossref><crossref idref="pcit0009">[0007]</crossref></li>
</ul></p>
<heading id="ref-h0003"><b>In der Beschreibung aufgeführte Nicht-Patentliteratur</b></heading>
<p id="ref-p0003" num="">
<ul id="ref-ul0002" list-style="bullet">
<li><nplcit id="ref-ncit0001" npl-type="b"><article><atl/><book><author><name>J. D. Markel</name></author><author><name>A. H. Gray</name></author><author><name>Jr., Linear</name></author><book-title>Prediction of Speech.</book-title><imprint><name>Springer</name><pubdate>19760000</pubdate></imprint></book></article></nplcit><crossref idref="ncit0001">[0008]</crossref></li>
<li><nplcit id="ref-ncit0002" npl-type="s"><article><author><name>J. I. Makhoul</name></author><author><name>L.K. Cosell</name></author><atl>Adaptive lattice analysis of speech</atl><serial><sertitle>IEEE Transactions on Acoustics, Speech, and Signal Processing</sertitle><pubdate><sdate>19810000</sdate><edate/></pubdate><vid>29</vid></serial><location><pp><ppf>654</ppf><ppl>659</ppl></pp></location></article></nplcit><crossref idref="ncit0002">[0008]</crossref></li>
<li><nplcit id="ref-ncit0003" npl-type="b"><article><atl>Boston-The Hague-London-Lancaster</atl><book><author><name>M. L. Honig</name></author><author><name>D. G. Messerschmitt</name></author><book-title>Adaptive Filters: Structures, Algorithms, and Applications</book-title><imprint><name>Kluwer Academic Publishers</name><pubdate>19840000</pubdate></imprint></book></article></nplcit><crossref idref="ncit0003">[0008]</crossref></li>
<li><nplcit id="ref-ncit0004" npl-type="s"><article><author><name>A. Kawamura</name></author><author><name>K. Fujü</name></author><author><name>Y. Itoh</name></author><author><name>Y. Fukui</name></author><atl>A noise reduction method based on linear prediction analysis</atl><serial><sertitle>Electronics and Communications in Japan</sertitle><pubdate><sdate>20030000</sdate><edate/></pubdate><vid>86</vid><ino>3</ino></serial><location><pp><ppf>1</ppf><ppl>10</ppl></pp></location></article></nplcit><crossref idref="ncit0004">[0008]</crossref></li>
<li><nplcit id="ref-ncit0005" npl-type="s"><article><author><name>M. H. Savoji</name></author><atl>Effective noise reduction of speech signals using adaptive lattice filtering, segmentation and soft decision</atl><serial><sertitle>IEE Colloquium on New Directions in Adaptive Signal Processing</sertitle><pubdate><sdate>19930200</sdate><edate/></pubdate></serial><location><pp><ppf>7</ppf><ppl/></pp><pp><ppf>1</ppf><ppl>7</ppl></pp><pp><ppf>5</ppf><ppl/></pp></location></article></nplcit><crossref idref="ncit0005">[0008]</crossref></li>
</ul></p>
</ep-reference-list>
</ep-patent-document>
