Technik

Piper für NVDA, eine Offline-Neural-TTS

Started by radiorobbe 85 posts last post 2 years ago Page 2 of 5

#21

Bisher war das höchste, was ich gesehen habe, medium, und zwar bei einer englischen Stimme. Also die sind schon sehr ehrlich, was deren Qualität angeht :D

#22 Archived

Zumindest vor ein paar Tagen waren noch zwei High-Stimmen unter den Englischendabei.

#23 Archived

Habe gerade nochmal kurz geschaut, bei den English US sind High-Stimmen dabei.

#24 Edited

Wo du recht hast, hast du recht. Genauer umschauen kann von vorteil sein.

#25

Ich habe mir jetzt das ADD-ON installiert. Jetzt brauche ich die Stimmpakete. Wenn ich auf die Stimmendownloadseite gehe, kann ich mir nur Hörbeispiele anhören. Wenn ich dann bei der gewünschten Stimme den Download-Button drücke, gelange ich auf eine GitHub-Seite. Dort finde ich aber die tar.gz Datei nicht. Da ist nur eine JSON und eine ONNYX. Wo finde ich die STimmdatei?
Check out my projects: https://jokyboy129.github.io/

#26

ich kann dir gerne links zu einigen stimmen geben als vorleufige lösung. ich glaube, ich habe grade aber nur die deutschen.

#27

Transcription

Die haben irgendeine andere Möglichkeit genutzt, die Stimmen zu verbreiten. Ich finde sie aktuell auch nicht oder zumindest nicht in so einem Format, wo man sie bequem als TAR.gz runterladen kann. Das ist so eine Art Repository, wo man die einzelnen Dateien dann findet. Ich verstehe auch gerade nicht, wie das funktionieren soll. Aber das NVDA-Add-on soll irgendwann mal ein Update bekommen, wo man dann direkt aus dem Add-on heraus die Stimmen installieren kann. Dann erspart man sich das separate Runterladen. Also vielleicht sollte man einfach noch ein bisschen Geduld haben und dann geht es direkt aus dem Add-on heraus.

Steffen

The man with the big fett Bauch, caught in the back of a Knallerbsenstrauch!

#28

Transcription

Man kann hier auch irgendwie seine eigenen Stimmen trainen. Das finde ich interessant, weil nur weil die Pre-Mail-Durchschnittsstimmen so schlecht sind, müssen das ja nicht auch die sein, die man selbst macht. Das wollte ich dann bald mal ausprobieren.

hiyo

#29

die frage ist wie man das genau macht.

#30

Ich habe jetzt das Add-On, mit dem man die Stimmen direkt aus dem NVDA-Menü heruntergeldaen werden könen.
Check out my projects: https://jokyboy129.github.io/

#31

nice.

#33

Also wenn es möglich wäre, ich hätte daran Interesse.
Gruß von Janagirl!

#36

Vielen Dank für das Addon.
Gruß von Janagirl!

#37

Transcription

Also sagen wir mal so, diese Piper Neural Voices Medium Qualität kann man aber nicht wirklich zum Arbeiten nehmen. Also ich habe jetzt mal mit der russischen Stimme rumprobiert, weil ich dachte, ich würde mir dann Gefallen tun. Aber gut, dass das so klingt, als würde eine Russe im Wohnzimmer sitzen, von mir aus, das stört mich ja noch nicht mal. Aber die Geschwindigkeit, wie das Ding reagiert, ist ja grauenvoll. Da ist ja selbst eine Vocalizer schneller und die ist schon richtig groß, die Vocalizer.

Werwoelfchens Blog: https://werwoelfchenstestecke.blogspot.com TG-Kanal: https://t.me/werwoelfchensblog Mail: wolfruht@mail.deTelegram: telegram.me/werwoelfchen85

#38

Transcription

So, ich lasse mir jetzt nicht nehmen, mal die Kerstin erklingen zu lassen und mal zu zeigen, wie komisch das klingt. Indem ich das Ganze hier einmal umstelle. Also, bevor ich das mache, erst mal. So, das ist die. Das ist die normale. Jetzt machen wir den Piper NVDA mal rein. Sprachausgabe auswählen, Dialogfeld. Sprachausgabe, Kombinationsfeld, Nuanze, Piper, Neural, Voices. Achtung. Bitte. Startfenster. Suche Fenster. Feld suchen, Eingabe, Feld leer. Bitte. Aufnahme stoppen, Scheiter. Bereit, Scheiter. Bereit, Scheiter. Gut, das. Aufnahme, Aufnahme pausieren, Scheiter. Das geht ja alles noch. Aber wenn man in den NVDA-Dialogen. ist. Insbesondere bei Voice. Ich gehe da mal rein. NVDA, der Einstellungen, Sprachausgabe, Standardkonfiguration, Dialogfeld, Sprachausgabe, Eigenschaftszeiten, Sprachausgabe, Gruppierung. In der Zeite IC. Stimme Kombinationsfeld, Kerstin DDE, eingeklappt, Alt S. Variante Kombinationsfeld, Luf, eingeklappt, Alt V. Luf. Also LOW, wahrscheinlich. Spirka Kombinationsfeld, Default, eingeklappt, Alt S. Geschwindigkeit, Schieber 50, Alt G. Gerade bei den Zahlen verschluckt die ganz viel. Dann spricht die jetzt auch gerade mal nicht. Lautstärke schieben. Geschwindigkeit, zusätzlich erhöhen, Kontrollfeld nicht aktiviert, Alt Z. Also sie verschluckt so viel, das klingt grauenhaft. Bitte. Ich gehe jetzt gleich auch wieder in Sprachausgabe. Nierse Vokalize, bilden. Mal abgesehen davon, dass sie das andere nicht aussprechen kann. Startfenster, bilden. Aber, ähm, das ist... Sprachausgabe auswählen, Dialog, Autoausgabegerät, Kombinationsfeld, laut Micro. Wieder umschalten. Es klingt echt grauenvoll. Also, alles schön und gut für die Versuche und dass das natürlich klingt. Aber es verschnuschelt, verschnuschelt so viel, wenn ich jetzt den Schnabel nicht ganz aufmache, dann klingt das auch so schön. Aber es verschnuschelt, verschnuschelt so viel, wenn ich jetzt den Schnabel nicht ganz aufmache, dann klingt das auch so schön. Aber es verschnuschelt, verschnuschelt so viel, wenn ich jetzt den Schnabel nicht ganz aufmache, dann klingt das auch so schön. Also, naja. Also richtig zum Arbeiten kann man die echt nicht nehmen. Noch nicht mal als Vorlesestimme.

Werwoelfchens Blog: https://werwoelfchenstestecke.blogspot.com TG-Kanal: https://t.me/werwoelfchensblog Mail: wolfruht@mail.deTelegram: telegram.me/werwoelfchen85

#40

Mal eine andere Frage, @werwoelfchen, wo hast du den die nyonce Stimmen oder wie auch immer man die richtig schreibt her? Also die Anna.