Telliminator

Sample-Collector
Sprechprobe
Link
Superbeispiel @Mr_Kubi

Wenn die den Soundtrack von Blade-Runner klaut, wird sich Vangelis bestimmt nicht aus dem Jenseits melden und höchstpersönlich einen Löschantrag stellen.

Die K.I. weiß eben nicht, dass es Du Du ist den Soundtrack oder die Stimmen 1:1 zu benutzen, sondern das nur Lerninhalt ist und nicht zum Zwecke der Reproduktion da ist. Das muss unterschieden werden können und dann ist es fraglich, was die aus meinen Stimmproben noch lernen könnte. Aber ich denke vermutlich zu einfach, wie man das Problem des "Diebstahls" lösen könnte. Wenn man der K.I. verbietet erlentte Inhalte 1:1 zu übernehmen ist die Frage wo die Grenze ist. Wenn man sagtr ein Kreis, den darfst Du nicht nachmalen weil er Kunst von xy war, aber einen Kreis zeichnest Du mit "2-Pi-mal-R" ...

Aber zum Glück muss ich das Dilemma nicht lösen und diese Grenze finden oder definieren.
 
Sorry, aber das sind Scheinargumente. Und dazu noch solche, mit denen sich Kinder(hafte) bis hin zu höchsten Ebenen aus der Verantwortung stehlen. Wir sehen das täglich im Fernsehen. Der Mensch ist für sein Handeln verantwortlich. Immer. Wenn er ein Werkzeug benutzt - und die KI ist ein solches - dann ist er für das, was dieses Werkzeug in seinem Auftrag anrichtet, verantwortlich. Leider erleben wir seit Jahren, wie dieses Prinzip aufgeweicht wird. Es wird getan, und die Verantwortung sollen andere übernehmen. Aber auch hier - ich will keine Prügelei vom Zaun brechen. Es gibt immer mehr Menschen, die nicht einmal mehr wissen, wie Verantwortung geschrieben wird.
 

DarkHeart

Queeres Goth-Girl
Sprechprobe
Link
Portfolio
Link
Ja, das hatte ich schon mal irgendwo gesehen, aber das dauert dann auch nicht mehr lang, dann hat das auch irgendwann Top-Qualität :mad:
Jetzt kann ich als All in One Producer (bis auf Stimmen) auch hier bald einpacken.
Entweder geb ich mir jetzt die Kugel- oder nachher den Grünkohl vom letzten Weihnachten... kommt aufs Gleiche raus.

Wird Zeit sich ein anderes Betätigungsfeld zu suchen, was die KI (noch) nicht kann.... Nasepopeln oder Däumchendrehen... vlt. fang ich heute mit den Daumen an und stell `n Weltrekord auf ? 🤷‍♂️
(Gibbet da eigentlich einen Weltrekord beim Drehen ? Ha... gerade nachgeschaut... nö, sowas gibbet noch nicht... also... aaaab jetzt:los)
Bei Stimmen wird die KI zwar irgendwann Betonungen können, aber nie wirklich menschliche Emotionen. Ich denke, wenn Menschen es nicht anfangen groß zu konsumieren, wird das Zeug genauso schnell wieder gehen, wie's gekommen ist.
 

Ellerbrok

Sprecher, Cutter & Fledermaus
Teammitglied
Sprechprobe
Link
Ich denke, wenn Menschen es nicht anfangen groß zu konsumieren, wird das Zeug genauso schnell wieder gehen, wie's gekommen ist.
Ich fürchte, das wird ein Problem. Menschen neigen oft dazu ALLES zu konsumieren, Hauptsache es ist billig. Ich rede nicht von echten Hörspielfans, sondern z.b. von genervt Eltern, die ihrem quängelndem Nachwuchs schnell was anmachen, damit es ruhig wird. Denen ist es völlig egal wie etwas erstellt wurde.
 

DarkHeart

Queeres Goth-Girl
Sprechprobe
Link
Portfolio
Link
Ich fürchte, das wird ein Problem. Menschen neigen oft dazu ALLES zu konsumieren, Hauptsache es ist billig. Ich rede nicht von echten Hörspielfans, sondern z.b. von genervt Eltern, die ihrem quängelndem Nachwuchs schnell was anmachen, damit es ruhig wird. Denen ist es völlig egal wie etwas erstellt wurde.
Klar. Aber ob sich das lohnt, wird sich zeigen. Zum Glück hat sich in manchen Feldern gezeigt, das sich AI nicht lohnt.
 

Telliminator

Sample-Collector
Sprechprobe
Link
Leute, Qualität wird sich in der Regel immer durchsetzen. Den Zahn das K.I. die Emotionen nicht können wird muss ich Euch ziehen. Die Anfänge zeigt das vorgestellte System deutlich und die sind jetzt nicht der Vorreiter für K.I. generiere Emotionen, aber sie zeigen wie es technisch geht.

Elevenlabs wird da die Maßstäbe nach oben schrauben und mit Ihrer eigenen Metasprache die Texte und Emotionen steuern können. Das wird in Zukunft auch anhand des Kontext von K..I. automatisiert erkannt werden und automatisch gesteuert werden können. Die Nuoancen von Echt zu Künstlich werden immer weniger werden durch verbesserte Modelle. Die Sprache wird analysiert, die Maschinen lernen anhand fertiger Hörbücher, Hörspiele und Filme und Synchronisationen Texte zu erkennen, zu verarbeiten und zu interpretieren.

Ihr habt gar keine Vorstellung davon, was die an Rechenpower und Methoden am Start haben, um aus einem simplen Text, einem Video, oder auch nur aus einer Audo stammenden Information alles raus hölen können und lernen. Was glaubt ihr was für schiere Datenmengen an WhatsApp Sprachnachrichten benutzt werden um eine K.I. in Sprache zu trainieren, jede Spracheingabe bei Alexa führt dazu, dass sie lernt Euch besser zu verstehen, selbst wenn ihr nuschelt oder in einem anderen Raum seid. Zig tausend Radiosender streamen täglich, Sprache und Musik - alles frei für K.I. zum einlesen analysieren und lernen.

Die Frage ob sich das lohnt stellt sich bei den möglichen Kosteneinsparungen die durch den Einsatz von K.I. machbar ist nicht. Selsbt wenn man die Sprecher nicht durch K.I. ersetzt, wird der Einsatz von K.I. helfen die Produktionskosten von Hörspielen zu senken.
 

soundjob

HÖRSPIEL MUSIK AUDIO
Teammitglied
Sprechprobe
Link
Bei Stimmen wird die KI zwar irgendwann Betonungen können, aber nie
Selbstverständlich wird sie (leider) alles das können, von dem wir heute denken, das wird aber nie nie niemals passieren.
Der Unterschied, weswegen wir das so ein bissken anders sehen ist, das wir älteren Säcke (wie auch Bernie als noch älterer Sack) die Entwicklung der Sprachsynthese ja nun nicht erst mit Aufkommen der KI erlebt haben.
Ganz besonders, wenn man dann auch anwenderspezifisch mit drin steckt- und es nicht nur tangiert von Außen betrachtet.

Als z.B. ich 1986 mit u.a. einem Emax-I HD/SE Sampler mit der Musik anfing (und natürlich auch Kraftwerkfan war) interessierte mich vor allem auch die resampelnde Synthesefähigkeit (SE) des Emax, mit welcher man allerlei Vocoder-ähnliche Effekte auf gesampelte Stimmen erzeugen konnte, die sich homogener als auch futuristischer anhörten, als S.A.M.
Natürlich hatten alle geglaubt, das TTS-Sprachcomputer wie SAM&Co eines Tages in der Lage wären, mit einer wirklich menschlich klingenden Stimme zu sprechen.
Explizit in der Musik hellhörig werdend, als aufkommende Software auch noch zu singen anfing und Yamaha mit ihren Vocaloids dann auch die Spitze der Entwicklung war.
Aber nie nie niemals hätten wir auch nur annähernd im entferntesten Traum daran gedacht- wozu eine Entwicklung names KI mal in der Lage wäre... sei es in der Musik, Grafik, Video, Animation. Das war bestenfalls spinnerter SciFi einer Star Trek Episode.

Natürlich haben wir nicht über die Konsequenzen bzgl. Arbeitsplätze in diesem Ausmaß nachgedacht, bzw. dürften das nur die Allerwenigsten getan haben, die ein bisserl weiter über den Horizont geschaut haben, als das nur (physische) Industrieroboter Arbeitsplätze abschaffen.
Die Diskussion, die heute mit KI und Stimmenklau und arbeitslosen Synchronsprechern etc. geführt wird, ist für uns wiederum gewissermaßen ein alter Hut.
Damals war es die nahezu ähnliche Diskussion mit großem Geschrei, das mit dem Aufkommen von Sampler & Computer, Musiker arbeitslos werden würden- explizit Orchestermusiker (Damals war man noch weit weit von der Qualität entfernt, die erst KONTAKT-VSTi`s mitbrachten, aber diese Prophezeiung zwei Dekaden später eintraf).

Als mein kommerzieller Vetrieb mir vor ein paar Jahren die Pistole auf die Brust setzte, hat sie uns Composer vor die Wahl gestellt:
"Hört mal, da ist KI-Technologie auf dem Vorsprung und ob es uns gefällt oder nicht- sie wird den Markt zunehmend dominieren und die fetten Zeiten von Exklusivaufträgen werden vorbei sein. Den Vorschlag den ich euch machen möchte wird bedeuten, dass ihr an eurem eigenen Ast sägen werdet, aber andererseits wird durch die Entwicklung gerade am ganzen Baum gesägt !"
Fazit der Geschichte war, dass unser Backkatalog zum KI-Training lizenziert wurde (u.a. um auch SUNO zu trainieren), um damit noch `ne Zeit lang gutes Geld zu verdienen, denn KI-Training war (und ist) die aktuelle Goldgrube.
Klar waren wir nicht begeistert, aber wenn man auf seinen Kontoauszug schielend ersah, dass du mit deinem eigenem Package von 800 Titeln nur noch durch Tantiemen verdienst... dann siehst du mehr als nur die Grundlage deines Einkommens flöten tröten, sondern du stellst den Sinn deiner Ausbildung und Lebenswerk in Frage. 🤷‍♂️

Und wenn ich nun auch sehe, dass mir das gleiche Schicksal im Hobbybereich blüht... 🤪

Und nun bezüglich deines Einwands:
Bei "Emotion", bzw. Dynamisierung von Sprache- und Sprachmodellen der KI, sprechen wir nur noch von Modifikationen.
Die Technologie dafür ist längst vorhanden.
Die Samples mit der die Modelle gefüttert wurden, sind ja nun nicht brüllend, weinend, wütend, ängstlich etc. vorgenommen worden, sondern im Sinne einer Moderationssprache.
Die nächste Stufe wird sein, die Modelle mit neuen "Emotion-Samples" zu füttern, um auch Postedit die Stimmen "spielen" zu lassen.
Das ist ja nun kein Ding.

Ich denke, wenn Menschen es nicht anfangen groß zu konsumieren, wird das Zeug genauso schnell wieder gehen, wie's gekommen ist.
Dieser Tsunami technologischer Entwicklung, der rollt doch nicht erst seit gestern auf uns zu, sondern seit Jahrzehnten schon. 🤷‍♂️
Es ist dabei völlig unerheblich, ob das nun explizit "KI" heißt (ist auch nur Software) oder "Hexenwerk" explizit durch jedwedes verfügbares Endgerät in die Kinderzimmer, Klassenräume, Wohnzimmer, Büros kolportiert werden... sei es Internet, Handy, Tablet, PC, TV & Co.
Die Generation heute- und somit die Anwender als auch Verbraucher von heute und ganz besonders von morgen, wachsen mit der Selbstverständlichkeit der Verfügbarkeit dieser Technologien und Technologiebezugs auf.
Die Begehrlichkeiten sind schon lange erweckt worden und sie werden zu Abermillionen konsumiert und Abermillionen generiert- alleine nur in dieser Minute.
 
Hoerspielprojekt.de

Neu

Discord Server
Oben