Unter Stimmenklonenden

KI

Ich habe etwas für mich zusammengestellt – ich will damit irgendwann herumspielen. „Mit welcher Software, die von künstlicher Intelligenz gestützt wird, kann ich meine Stimme imitieren? Nenne Beispiele!“

ChatGPT: Es gibt mehrere KI-gestützte Softwarelösungen, mit denen man Stimmen imitieren oder nachahmen kann. Hier sind einige Beispiele:

Descript Overdub
Descript ist eine Audio- und Videobearbeitungssoftware, die Overdub bietet, ein KI-Tool zur Sprachsynthese. Es ermöglicht das Klonen deiner Stimme, indem du eine bestimmte Anzahl an Sätzen aufnimmst. Mit Overdub kannst du dann Text eingeben, und die KI generiert die gesprochene Ausgabe mit deiner Stimme.

iSpeech
iSpeech ist ein Text-zu-Sprache- und Sprach-zu-Text-Dienst, der auch Stimmenkloning bietet. Die Software kann eine Stimme nachahmen, nachdem sie eine Audioaufnahme der gewünschten Stimme analysiert hat.

Respeecher
Respeecher spezialisiert sich auf hochqualitatives Stimmenklonen, das in Filmen und Spielen eingesetzt wird. Es ist dafür bekannt, Stimmen authentisch und realistisch zu imitieren, auch historische Stimmen oder Stimmen verstorbener Personen.

VocaliD
VocaliD bietet ebenfalls die Möglichkeit, Stimmen zu klonen und synthetisch zu reproduzieren. Es wird häufig in der personalisierten Sprachsynthese eingesetzt, etwa für Menschen, die ihre Stimme aufgrund von Erkrankungen verloren haben.

Voicemod
Voicemod ist eine beliebte Anwendung für Echtzeit-Sprachveränderungen und bietet verschiedene KI-gestützte Stimmoptionen. Es ist vor allem bei Gamern beliebt, kann aber auch zur Imitation von Stimmen in Echtzeit verwendet werden.

Adobe Voco (Experimentell)
Adobe Voco war eine experimentelle Software, die es ermöglichte, Stimmen zu imitieren, nachdem nur etwa 20 Minuten Audiomaterial der Zielstimme analysiert wurde. Das Projekt wurde jedoch aufgrund ethischer Bedenken zurückgestellt.

Diese Tools variieren in ihrer Genauigkeit und dem Grad an Kontrolle, den sie über die synthetisierten Stimmen bieten.

KI

Welche der Programme, die eigenes Stimme zu klonen, funktioniert auch mit Linux?

ChatGPT: Von den erwähnten Programmen sind nicht alle plattformübergreifend oder direkt unter Linux verfügbar. Hier ist eine Übersicht, welche Programme zur Stimmenklonung auch auf Linux funktionieren oder Alternativen bieten:

Descript Overdub
Descript ist momentan nur für Windows und macOS verfügbar und unterstützt Linux nicht direkt. Allerdings könntest du versuchen, es über Wine oder eine Virtualisierungslösung wie VirtualBox zum Laufen zu bringen, jedoch kann es hierbei zu Performance-Problemen kommen.

iSpeech
iSpeech ist eine cloudbasierte Lösung, die über den Browser zugänglich ist. Somit kannst du es auf Linux nutzen, solange du einen Webbrowser hast. Es gibt keine native Linux-Anwendung, aber die Web-Plattform funktioniert auf allen Betriebssystemen.

Respeecher
Respeecher ist ebenfalls ein cloudbasierter Dienst, der über den Browser verfügbar ist. Ähnlich wie iSpeech ist es also auch unter Linux nutzbar, da keine spezielle Softwareinstallation notwendig ist.

VocaliD
VocaliD ist ein weiterer cloudbasierter Dienst, der über den Webbrowser genutzt werden kann. Solange du einen Browser auf deinem Linux-System hast, kannst du diesen Service ebenfalls verwenden.

KI-Alternativen für Linux:
Wenn du speziell nach Tools suchst, die auf Linux nativ funktionieren, gibt es einige Alternativen, die Stimmenklonung und -synthese auf Open-Source-Basis ermöglichen:

Coqui TTS
Coqui TTS ist ein Open-Source-Projekt für Text-to-Speech (TTS), das sich auf die Erzeugung synthetischer Stimmen spezialisiert hat. Es ermöglicht dir, deine eigene Stimme mit genug Trainingsdaten zu klonen. Es ist vollständig auf Linux und anderen Plattformen nutzbar.

Mozilla TTS
Mozilla TTS ist ein weiteres Open-Source-Projekt, das für Sprachsynthese entwickelt wurde. Es bietet die Möglichkeit, eigene Modelle zu trainieren und Stimmen zu klonen. Es kann problemlos auf Linux installiert und verwendet werden.

Piper (ehemals Mimic3)
Piper ist ein Echtzeit-TTS-System, das auf Linux funktioniert und ebenfalls für die Sprachnachahmung genutzt werden kann. Es kann direkt von GitHub heruntergeladen und konfiguriert werden, um personalisierte Stimmen zu erzeugen.

KI

Fazit:
Für native Linux-Nutzung sind Coqui TTS, Mozilla TTS und Piper gute Alternativen, die auf Open-Source-Basis arbeiten und flexibel angepasst werden können. Cloudbasierte Dienste wie iSpeech, Respeecher und VocaliD sind ebenfalls über den Browser auf Linux-Systemen nutzbar.

image_pdfimage_print

Kommentare

2 Kommentare zu “Unter Stimmenklonenden”

  1. nOby am September 11th, 2024 2:34 p.m.

    Was?

    Du willst jetzt singen?

    Nach dem Kauf des weißen Piano hatte ich irgendwann Auftritte von Dir als Solist vor Deiner Leserschaft erhofft. Das wären in der Mehrheit unmusikalische Alt-Kommunisten und einige Schwerhörige. Kommunisten sind – bis auf Erich Mielke – immer unmusikalisch gewesen! Du bist nicht Walter Scheel. Der schaffte es bei seinem ersten Auftritt gleich ins ÖRR und wurde vom DJV die nächsten 20 Jahre gefeiert. Gerne kann Dein Repertoire Musik sein, und sich anhören als wäre die für Frauen gemacht. Womöglich kannst Du das im Video gezeigte (wie viele andere?) sogar OHNE Verrenkungen und Grimassen viel besser spielen! Gerne darfst Du einfache Musik wie so was vortragen. Das im Video gezeigte läuft heute unter advanced Barpiano. Das ist unter Stalinisten nicht sehr populär. Grundsätzlich duldet der Alt-Kommunist aber Solo auftretende Pianisten.

    So was müßtest Du mit 60 Jahren Piano Erfahrung (??) eigentlich adhoc können und wäre meine Empfehlung. Ist alles improvisiert sagen Deine Kollegen vom DJV. Hm? Wenn Deine Finger das mitmachen würd‘ ich es versuchen. Das braucht Gehirn (hast Du) und ein fotografisches Gehör.

    Nicht fehlen darf Gerissenheit. Du mußt Dir das wie mit Joseph Beuys vorstellen, der mit Kies gefüllte Badewannen, Blumentöpfe mit Strohblumen und um Küchenstühle gewickelte Gardinen als Kunstwerk deklarierte, sich das vom DJV und dem ÖRR bestätigen ließ und jedes Kunstwerk – nun teuer wie ein Porsche – vertickte.

    Laß aber bei diesen Gelegenheiten Deine Finger von Bach. Das wird – wie in dem Video zu hören – schnell zur Persiflage oder so was, das können mittlerweile 8-jährige Chinesen besser nachspielen. Und die können das präziser als jeder Computer.

    Denk dran das Deine musikalischen Auftritte womöglich Musiker wie der oder der besuchen, um daraus Inspiration ziehen zu wollen oder mit Dir gemeinsam auftreten wollen oder die einfach Noten von Dir klauen wollen. Mit diesen Kalibern mußt Du mithalten. Versager mag die BILD-Zeitung in dieser Kategorie der Musikschaffenden ganz und gar nicht.

    Wenn Du den Zeitgeist voll ausnutzen willst, kannst Du vielleicht erbuntet und nach mehreren operativen Eingriffen den Platz von diesem Schnuckel einnehmen. Der wird frei. Wie ich hörte hat oder will die aufgegeben und Kinder machen. Oder will die in den Escort wechseln? Ja, schlimm, wenn Hintergrundsängerinnen besser singen können als der Star und selbst die Tontechnik nichts korrigieren kann. Und wenn Du, Burks, glaubst so gut tanzen zu können wie die Tänzerin in dem Video mit dem Double Bun auf dem Kopf, dann solltest Du Dich fragen „lebe ich noch oder bin ich eine Animation aus dem Jenseits?“. Die Dame bewegt sich wie eine Mischung aus Fledermaus und Michael Jackson! Das Konzert habe ich selbst – nicht ganz freiwillig – besucht. Meine jugendlichen Begleiter fanden es toll. Ich nur die genannte Tänzerin.

    Bisher nichts dabei für Dich, Burks?

    Notfalls geht Musik gegen Unterdrückung immer. Darin kennst Du Dich aus und kannst bestimmt fulminante Liedtexte schreiben. Ja, ohne Gesang geht da nichts. Oder wie wär es mit Musik in einer Umgebung zwischen Sarg oder Urne und Blumengebinden?

    Als Epilog ein Musikbeispiel und Musikbeispiel jetzt wäre ich endlich beim Thema. Das ist alles vom Computer generiert. Kein Musikinstrument ist zu hören. Nur Bits und Bytes. Aus meiner Sicht der Dinge ist das eine ganz schwache Komposition und soll eine Warnung für Dich sein. Der Danisch behauptet er könne ähnliches ohne Beteiligung eines Musikinstruments komponieren. Was könnte Bach mit dieser Technik leisten? Dem Nachfolger Mozarts, also Herbert Grönemeyer, dem hat das bisher nicht geholfen. Überhaupt Bach? Wäre der verfressene Bach heute Imbissbudenbesitzer? Mensch + Talent + Computer sollten Bach, Mozart, Beethoven und Grönemeyer zusammen locker toppen. Klappt aber nicht. Selbst so was bringt niemand zustande.

    Jetzt komme ich wirklich zum Ende. Der Tatort Münster Ermittler Kriminalhauptkommissar Frank Thiel und der Tatort Münster Rechtsmediziner Prof. Dr. Dr. Karl-Friedrich Boerne aka Axel Prahl und Jan Josef Liefers sind erfolgreiche Nebenerwerbsmusiker und treten vor 2-3000 Leuten auf. Während Herr Prahl seine Gitarre mit ein oder zwei Fingern malträtiert und sich im 1/2 Takt bewegt, machte sich Liefers mit drei oder vier Fingern gleich an Prince’s Meisterwerk „Purple Rain“ ran. Ja, es ging womöglich nicht kleiner. Mach das bloß nicht, Burks. Mach auf Pianist – die sind nur von Pianisten zu beurteilen – und orientiere Dich an Herrn Beuys. Wenn Dir Deine Freunde vom DJV helfen und das ist Dein Pik-As, dann füllst Du Opern. :)

  2. blu_frisbee am September 11th, 2024 4:56 p.m.

    Profis von BS und Polizei nutzen längst online Videos und Stimmen.
    Erst zum erkennen bald auch zum faken.
    https://blog.fefe.de/?ts=981e0c3a

Schreibe einen Kommentar