Telliminator

Sample-Collector
Sprechprobe
Link
Hi Leute,

wir haben es immer wieder mit K.I., ob und wann eine „KI“ in der Lage sein wird, aus einem einfachen Text-Prompt ein komplettes Hörspiel zu bauen. Ich habe mit der Plattform AudioProducer.ai einen Orchestrator entdeckt. Das Tool macht aktuell genau das!

Es fungiert als All-in-One-Regisseur und setzt die gesamte Audio-Pipeline vollautomatisch um. Hier mal eine schnelle Übersicht, was das Ding kann und was es kostet.

🛠️ Die wichtigsten Features
  • Intelligentes AI-Markup: Du lädst deinen Text (z. B. als EPUB) hoch und die KI erkennt automatisch die einzelnen Charaktere, Dialoge, mitschwingende Emotionen und passende Soundeffekte.
  • Stimmen-Zuweisung & Klonen: Du kannst jedem Charakter eine feste Stimme aus einer Bibliothek von über 100 Stimmen zuweisen oder eigene Stimmen per Kurz-Sample klonen.
  • Automatische Soundscapes: Das Tool bettet Geräusche (Wind, Schritte, zuschlagende Türen) passend zur Story im Hintergrund ein.
  • Visueller Editor: Wer nachbessern will, kann im Editor Pausen sekundengenau einbauen, die Emotionen der Sprecher feintunen oder Soundeffekte verschieben.

📊 Tarife & Preise im Überblick

TarifPreis (Monat)WörterFokus
Free$01.200Perfekt zum Testen des Editors
Beginner Writer$39.997.000Für Kurzgeschichten / einzelne Kapitel
Amateur Writer$69.9915.000Für längere Geschichten
Professional Writer$199.99100.000Für komplette Romane / Buchserien
Wichtig für Creator: Die Urheberrechte an den exportierten Audiodateien bleiben zu 100 % bei euch. Die Dateien lassen sich kapitelweise als fertiger Mix herunterladen.

💡 Was gibt es noch?
Neben der Hörspiel-Funktion gibt es noch ein AI-Podcast-Studio (erstellt News-Podcasts mit mehreren Sprechern) und ein Comic-Studio, das aus Romanen fertige, illustrierte Webtoons/Comics plant und zeichnet.


So, nun geh ich mal eine Runde kotzen, weil wenn der Kram funktioniert, wie beschrieben, in der Qualität, wie ich sie befürchte - funktioniert das Wirklich so, wie mein Plan - Buch rein, Hörbuch raus - nur in besser, als das was ich da angefangen hatte zu basteln... Irgendwas in mir will das testen... 0 Euro...

Achja, Link?
 
Zuletzt bearbeitet:

Telliminator

Sample-Collector
Sprechprobe
Link
Recherche_

Der Gründer und Inhaber von AudioProducer.ai ist Anton Remizov

Er hat die Plattform ins Leben gerufen, um Autoren das automatische Verwandeln von Büchern in cineastische Hörspiele zu ermöglichen.
Falls du dich für die genauen rechtlichen Bedingungen oder den Datenschutz der Plattform interessierst, findest du alle Details in den offiziellen Nutzungsbedingungen (Terms of Service) sowie in der Datenschutzerklärung direkt auf der Website.


Wer ist Anton Remizov?

Eist ein erfahrener Software-Ingenieur, Tech-Unternehmer und Manager im Silicon Valley, der auf eine über 20-jährige Karriere bei einigen der größten Technologieunternehmen der Welt zurückblickt. Neben seiner Arbeit an Großprojekten entwickelt er als „Creator“ innovative KI-Anwendungen wie AudioProducer.ai.

Beruflicher Hintergrund & Karriere
Remizov wuchs in Russland auf und absolvierte sein Studium an der renommierten Lomonossow-Universität in Moskau. Später zog er nach Kalifornien, wo er tief in die Tech-Szene des Silicon Valley eintauchte. [1, 2]
Seine beruflichen Stationen umfangen Schlüsselrollen bei den führenden Tech-Giganten:
  • Google: Aktuell arbeitet er dort als Engineering Manager (Tech Lead Manager) im Hauptquartier in Mountain View.
  • Facebook (Meta): Zuvor war er als Senior Software Engineer tätig.
  • Apple: Auch hier sammelte er tiefgehende Erfahrungen in der Software-Entwicklung als Senior Software Engineer.
  • Start-ups: Vor seinen Rollen bei den Großkonzernen war er unter anderem als Chief Technology Officer (CTO) bei Synchora aktiv und leitete als Director of Client Engineering die Softwareentwicklung bei Level Home Inc., wo er half, über 100 Millionen Dollar an Investorengeldern zu sichern.

Seine Rolle bei AudioProducer.ai

Als leidenschaftlicher Entwickler nutzt er seine fundierten Kenntnisse in den Bereichen Künstliche Intelligenz, mobile Ökosysteme und Automatisierung, um eigene Web-Projekte umzusetzen. AudioProducer.ai ist das Ergebnis dieser Arbeit: Eine Plattform, die seine Expertise im Bereich von NLP (Natural Language Processing) und automatisierten Workflows bündelt, um geschriebene Romane ohne menschliches Zutun in kinoreife Hörspiele zu orchestrieren.
 

knilch

Hä? Was heißt das?
Also nachdem ich das Hörbeispiel gehört habe.... Mache ich mir noch nicht so viel sorgen 😆

Und selbst wenn das in 2 Jahren dann richtig gut ist, mir egal, ich mach es trotzdem weiter. Wie gesagt, bloß gut ist das ein Hobby bei uns.
 

soundjob

HÖRSPIEL MUSIK AUDIO
Teammitglied
Sprechprobe
Link
Ja, das hatte ich schon mal irgendwo gesehen, aber das dauert dann auch nicht mehr lang, dann hat das auch irgendwann Top-Qualität :mad:
Jetzt kann ich als All in One Producer (bis auf Stimmen) auch hier bald einpacken.
Entweder geb ich mir jetzt die Kugel- oder nachher den Grünkohl vom letzten Weihnachten... kommt aufs Gleiche raus.

Wird Zeit sich ein anderes Betätigungsfeld zu suchen, was die KI (noch) nicht kann.... Nasepopeln oder Däumchendrehen... vlt. fang ich heute mit den Daumen an und stell `n Weltrekord auf ? 🤷‍♂️
(Gibbet da eigentlich einen Weltrekord beim Drehen ? Ha... gerade nachgeschaut... nö, sowas gibbet noch nicht... also... aaaab jetzt:los)
 

Telliminator

Sample-Collector
Sprechprobe
Link
@soundjob

Der inoffizielle Weltrekord im kontinuierlichen Däumchen drehen liegt bei über 20 Stunden.

Ein offizieller, vom Guinness-Buch der Rekorde anerkannter Rekord existiert für das reine Däumchendrehen allerdings nicht, da die Aktivität von der Redaktion als zu unbedeutend oder schwer messbar eingestuft wurde.

Der 20-Stunden-Marathon wurde Ende der 1970er Jahre von US-amerikanischen Studenten im Rahmen eines Wettbewerbs aufgestellt.

*sagt das Internt - Also mein Internet erklärt weiter...

Der fragliche Wettbewerb war eine Fraternities-Mutprobe bzw. ein rituelles Aufnahmeverfahren (Pledging) einer Studentenverbindung in den USA.

Konkret handelte es sich im Februar 1979 um zwei 19-jährige Studenten namens Ben Sheeran und Brian Fewell. Sie waren sogenannten „Pledges“ (Anwärter) der Studentenverbindung Sigma Chi Delta am Dallas Baptist College in Texas.
Der Ablauf dieses bizarren Marathons gestaltete sich wie folgt:
  • Die Aufgabe: Um ihre Ausdauer und Leidensfähigkeit für die Verbindung zu beweisen, mussten die beiden nonstop die Daumen umeinander kreisen lassen.
  • Keine Pausen: Sie durften die Bewegung zu keinem Zeitpunkt stoppen. Das bedeutete: Essen, Trinken und sogar der Gang zur Toilette mussten parallel mit kreisenden Daumen absolviert werden.
  • Das Ziel: Die Aktion war von Anfang an als bewusster Versuch angelegt, einen absurden Marathon-Rekord aufzustellen, den „zuvor noch nie jemand dokumentiert hatte“.
Am Ende hielten sie etwas über 20 Stunden durch und sicherten sich damit ihren Platz in den studentischen Chroniken und lokalen Zeitungen jener Zeit.
 

soundjob

HÖRSPIEL MUSIK AUDIO
Teammitglied
Sprechprobe
Link
@soundjob

Der inoffizielle Weltrekord im kontinuierlichen Däumchen drehen liegt bei über 20 Stunden.

Ein offizieller, vom Guinness-Buch der Rekorde anerkannter Rekord existiert für das reine Däumchendrehen allerdings nicht, da die Aktivität von der Redaktion als zu unbedeutend oder schwer messbar eingestuft wurde.

Der 20-Stunden-Marathon wurde Ende der 1970er Jahre von US-amerikanischen Studenten im Rahmen eines Wettbewerbs aufgestellt.
Was du alles immer findest... 😊
Und wie sieht es mit der Nase aus ? 🤭
 

Telliminator

Sample-Collector
Sprechprobe
Link
@soundjob... Moment ...

Nasenpopeln lehnt die Redaktion von Guinness World Records als Kategorie strikt ab. Der Grund hierfür ist eine feste Richtlinie des Komitees: Rekorde, die als unhygienisch, gesundheitsgefährdend oder unästhetisch eingestuft werden, erhalten keine offizielle Plattform und werden nicht dokumentiert.

Es gibt jedoch skurrile, offizielle Guinness-Weltrekorde, die stattdessen mit der Nase zu tun haben:

Offizielle Weltrekorde rund um die Nase
  • Die meisten Streichhölzer in der Nase: Der Tscheche Petr Matějka schaffte es, sich unglaubliche 97 Streichhölzer gleichzeitig in die Nasenlöcher zu stecken.
  • Schnelligkeitstippen mit der Nase: Der Inder Harsh Khokhar schaffte es, das komplette Alphabet auf einer Tastatur in nur 16,97 Sekunden ausschließlich mit seiner Nasenspitze zu tippen.
  • Ballons aufpusten: Der Amerikaner David Rush brach einen Rekord, indem er innerhalb von 60 Sekunden 10 Luftballons allein mit der Kraft seiner Nasenatmung aufblies.
  • Die längste Nase der Welt: Der historische Rekord liegt bei dem Engländer Thomas Wedders aus dem 18. Jahrhundert, dessen Nase phänomenale 19 Zentimeter lang war. Bei den lebenden Menschen hielt der 2023 verstorbene Mehmet Özyürek den Rekord mit 8,8 Zentimetern.
 
Nein, wir können und wir werden nicht einpacken! Ich will hier keine längere Abhandlung über KI schreiben (vielleicht tue ich das irgendwann, wenn ich mal nicht sprechen übe), deshalb nur die Grundzüge. Wenn man eine KI mit ihrem eigenen Output füttert, wird sie mit jeder Iteration dümmer (Modellkollaps). Sie frisst die Zusammenfassung der Zusammenfassung der Zusammenfassung. KI sind NICHT intelligent, sondern sie führen reine Mustervergleiche durch, berechnen Wahrscheinlichkeiten und Näherungen. Bei einer Zusammenfassung gehen aber die für den Fortschritt, für die Entwicklung zwingend notwendigen Hinweise und Gedanken sehr schnelle verloren. Anders gesagt -KI verarbeitet Mainstream, die Mitte. Die Abweichungen an den Rändern verschwinden. Bsp.: Einsteins allg. Relativitätstheorie wurde erbittert bekämpft, Ignatz Semmelweis von seinen eigenen Kollegen totgeprügelt. Fortschritt findet immer an den Rändern statt.
Deshalb können KI auch nur mit menschlichen Texten, Sprache, Musik und Bildern trainiert werden. Mittlerweile gibt es einen RUn der großen Firmen auf menschliche Literatur. Im Moment sind bereits ca. 30% des Internets bereits KI-generiert.
Für die Menschen hat das ebenfalls Folgen. Sie verlernen Denken und Kreativität, denn das Gehirn verhält sich auch da wie dein Muskel - es muss trainiert werden. Die Entwicklung ist eindeutig. Bitte schlagt mich nicht, aber die Masse der Menschen wird sich immer mehr von KI abnehmen lassen, dadurch sein Gehirn immer weniger trainieren und ....
Kunst wird wieder das werden, was sie einmal war vor ihrer totalen Kommerzialisierung: Leidenschaft, Herzblut, Tränen, Glück und ... Armut.
Aber nicht im Geist.
 

Telliminator

Sample-Collector
Sprechprobe
Link
Deswegen verweigert auch ChatGPT immer öfter den Dienst bei +18 Fragen, hab ich das Gefühl.
(Kann mit einer stumpfen Axt wirklich einen Menschen spalten ?)

Es gibt spezielle K.I.s für 18+ Content und Fragen....
  1. Spezialisierte Plattformen (Chat & Companions):
    Dienste wie Candy AI, Nastia AI oder NoLimitGPT sind gezielt darauf ausgelegt, virtuelle Begleiter, Rollenspiele (Roleplay) oder kreatives Schreiben für Erwachsene ohne Zensur oder plötzliche Gesprächsabbrüche anzubieten.
  2. Ungefilterte Allzweck-KIs (Uncensored Text & Privacy):
    Plattformen wie Venice AI setzen auf Open-Source-Modelle ohne künstliche moralische Einschränkungen. Sie beantworten Fragen zu sensiblen Themen, verweigern Antworten seltener und legen oft großen Wert auf Datendiskretion.
  3. Open-Source-Modelle zum Selbsthosten:
    In der Community (z. B. auf Hugging Face) gibt es sogenannte Uncensored Models (oft Feinabstimmungen von Modellen wie Llama oder Mistral). Wer über die nötige Hardware verfügt, kann sich solche KIs komplett lokal und offline auf dem eigenen PC laufen lassen, sodass absolut keine Daten auf externen Servern landen.

Wichtige Einschränkungen
Auch bei „ungefilterten“ KIs für Erwachsene gelten rechtliche Grenzen: Inhalte, die Minderjährige betreffen oder gegen geltendes Strafrecht verstoßen, werden von seriösen Plattformen ausnahmslos blockiert und sind strikt untersagt.

1788367611402.png
 
Zuletzt bearbeitet:
Ergänzung von KI Gemini:
  • Synthetische Stimmen scheitern im Langformat nicht an der Klangfarbe, sondern an der Abwesenheit eines Körpers.
  • Ein Algorithmus ringt nicht um Luft. Er hat keinen Puls, keine Lunge, keinen Kehlkopf, der unter dem Gewicht eines Gedankens enger wird, und keine Lebenserfahrung, die einer Pause echtes Gewicht verleiht.
  • Das menschliche Gehör ist evolutionär darauf trainiert, biologische Stress- und Authentizitätssignale wahrzunehmen. Nach zehn Minuten makelloser KI-Synthese schaltet das Gehirn auf Durchzug, weil keine echte Existenz dahintersteht.
Die Gegenbewegung zeichnet sich bereits ab: Je mehr synthetischer Datenmüll das Netz flutet, desto höher wird der Wert des physischen, fehlerhaften und echten Handwerks. Ein Buch, das von der Person gesprochen wird, die jede Zeile selbst durchlitten und durchdacht hat, wird vom Massenprodukt wieder zum Unikat.
 

soundjob

HÖRSPIEL MUSIK AUDIO
Teammitglied
Sprechprobe
Link
Hallo SoundJob, lege dir ein Autorenprofil an und erkläre, das du einen Kriminalroman schreibst. Dann kommst du mit allem durch.
Wieso Krimi-Autorenprofil ?
Ich frag für einen Freund 🤭
(Nee, hab ich, aber auch da hat er mich schon bei Recherchen abgewürgt und irgendwie froh bin, nicht in den USA zu leben... sonst stünde CIA, FBI und der 1.FC Köln vor der Tür 😄)
 

Telliminator

Sample-Collector
Sprechprobe
Link
@Rainer Sonnberg

Das Cloning von Stimmen wird weiter verbessert werden und das kommt bei oben angesprochener Webseite auch zum Einsatz. Text rein Hörbuch raus... und ja die Stimmen klingen alle noch zu künstlich und unecht. Beim Cloning gehen Emotionen und Betonungen leicht daneben. Aber auch das kriegen die in den Griff. Es wird vermutlich nicht mehr lange dauern bis man einen K.I. intonierten Text mit ener Clonestimme von der realen sprechenden Person fast nicht mehr unterscheiden kann. Selbst sowas wie Atmer und seufzer und andere Sprechnebengeräusche wird man dann simulieren können um es möglich echt klingen zu lassen. Es wird Formeln geben mit der die Clonestimme so gezerrt und gezogen wird, dass sie Emotionen transferieren kann oder es gibt Trainingsdaten anhand die Stimmung intoniert werden kann. Schwierig werden dann vermutlich die überlagerten Emotionen, wie traurig und weinen gleichzeitig schluchzend - heulend reden oder schreien. Aber auch das ist vermutlich nur eine Frage der Zeit und der Regieanweisung.
 
Lieber Telliminator, ein Streit darüber wäre im luftleeren Raum. Ich denke, es läuft darauf hinaus, dass jeder für sich eine Position dazu finden muss. So ist es überall. Es gibt Menschen, die lehnen moderne Medizin ab und sind damit glücklich, es gibt Menschen, die ...
Aber ist es nicht das, worauf es ankommt? Glücklich zu sein? Und das findet man nicht im "Außen". Nur in sich selbst ...
 

Telliminator

Sample-Collector
Sprechprobe
Link
Wahre Worte @Rainer Sonnberg

Das erkennen aber auch nur Menschen mit einer gewissen Lebenserfahrung. Unsere neue influenzierenden Dumpfbackengeneration, die nur noch durch, ich sag mal, betreutes Video gucken zum Umdenken, Mitdenken oder Meinungsmache gerade am heranwachsen sind, hat keine Chance mehr diese Weisheit für sich zu finden, da TikTok Scrollen und ähnliches ales nur noch Fake und Unecht zu sein scheint.
 

Mr_Kubi

Der auf den Bus wartet
Teammitglied
Sprechprobe
Link
Die K.II. ist keine Person
Naja noch nicht, ein irgendwie gearteter Personenstatus wird aber immer wieder für autonome KI diskutiert.

Schon 2017 hatte die EU die e-Person vorgeschlagen. Ist damals aber nicht gekommen. Aber aktuell gibt es Entwicklungen hin zu einer Konstellation, in der die menschliche Entscheidungsfähigkeit an KI übertragen oder delegiert wird (z. B. Medizin, Selbstfahrende Autos, Pflege, Krieg etc pp). Klar entscheidet aktuell zumeist noch der Mensch. Sofern die KI nicht ausbüxt und ... siehe Pressemitteilungen ....

Warum ist ein wie auch immer gearteter Personenstatus überhaupt von Belang?
Soweit ich das verstehe, geht es vor allem juristisch darum, wer haftet bei einem Fehlverhalten einer autonom handelnden KI bei Schäden? Nach aktuellem Recht kann nur derjenige haften, dem per Gesetz eine Rechtspersönlichkeit zugesprochen wird. Da hilft auch der KI Act nicht.

Um zum Ausgangsbeitrag zurückzukommen: Wenn nun also die fiktive Ploing Audio KI vom User Hans Muster den Prompt bekommt: "Ey, mach mir mal ein Hörporno!" (Sabbergeräusch einfügen).
Ja nun...Die KI schiebt Algorithmen, entscheidet autonom und geht dann los ins Internet, findet Eure Sprechproben, lernt an diesen und erstellt das Hörspiel mit Euren simulierten Stimmen.

Kann man schon doof finden als Sprecher:in.

Wer ist nun Schuld?

Der Betreiber (juristische Person) der Ploing Audio KI?
Die sagen, können wir doch nix für die doofen Useranfragen. Die KI ist eine Black Box. Wie die Ploing KI zu Ihrer Entscheidungsfindung gelangt ist, können wir nicht nachvollziehen. Aber es liegt definitiv nicht an unserer Programmierung!

Der User Hans Muster (natürliche Person)?
Was kann ich dafür was die KI ausspuckt? Habe mich an die AGB der Ploing Audio KI gehalten. Wenn die KI Stimmen klaut, kann ich nix dafür.

Die autonome Ploing Audio KI (Personenstatus ungeklärt)?
Die KI entschuldigt sich höflich und erstellt einen zweiten Hörporno mit anderen Stimmen aus dem Internet.


Und hier dann den Blade Runner Soundtrack einfügen ... PLOING ;)
 
Zuletzt bearbeitet:
Oben