Bilderthread AI Musik

Maikel_elBlanco

Bronze Member
Ersteller
Mitglied seit
07.04.2025
Beiträge
263
Likes erhalten
1.497
Travel Guide
Ich möchte hier einen Thread eröffnen, wo es um AI Musik geht.

Vor einiger Zeit tauchten bei mir in FB Videos auf, in denen Sängerinnen alte Jazz Balladen sangen.
Basierend waren die Videos auf alten S/W Fotos der Sängerinnen.

Hier etwas ziemlich Gutes, was die Person betrifft.
Die Jungs im Hintergrund spielen wie Roboter.




Hier Beispiele, dass AI noch viel "lernen" muss bzgl. der Synchronisation.



Tja, und dann kommt hier AI generierte Musik auf uns zu.
Angemerkt: dieser Song hier ist eine AI-Komposition, gespielt von Menschen.....


Die Story dahinter:
 
Schon erstaunlich, was KI alles möglich macht, und das ist erst der Anfang.



 
  • Like
Reactions: 1 user
:dog:

Ein bisschen Spaß muss sein, nicht ganz ernst zu nehmen.










 
  • Like
Reactions: 1 user
Wie macht man so etwas?
 
  • Like
Reactions: 1 user
Es gibt verschiedene APPS dafür
Zum Beispiel gibt es so Videos von einem US-Uber Fahrer.
Der weis ja den Namen vom Fahrgast, wo er ihn abholen soll und wohin die fahrtgeht.
Das tippt er in eine App ein und auch wie der Gast aussieht, verrückte Brille, Footballshirt oder Sprüche t-Shirt, Rastahaare oder 70er Jahre Qoutfit etc.
Auch fragt er was der Fahrgast von Beruf ist oder ähnliches. Fragt nach Musikrichtung.
Tippt das gleichzeitig (während der Fahrt) ein und es wird über die App ein Lied aus den Informationen erstellt.
Die meisten Gäste sind überrascht, lachen, aber einige sind voll sauer, lassen das Auto stoppen und steigen sofort aus
 
Wie macht man so etwas?

Ich weiß es (noch) nicht. Aber ich bin irgendwie fasziniert darüber, wie KI hier die Zukunft künstlerischen Schaffens beeinflusst, und wir stehen erst am Anfang. Ich bin allerdings auch der Meinung, dass hier eine strikte Trennung stattfinden muss, eine Trennung zwischen echter, menschlicher Performance und künstlich geschaffener Performance. Noch kann man es mit einem etwas geübten Ohr auseinanderhalten, jedenfalls mein subjektives Empfinden. Wenn du mal genau hinhörst, ähneln sich die Stimmen doch recht stark und ich vermute, dass da die Modelle ähnlich oder gleich waren, die verwendet wurden. Ein LLM erzeugt den Text nach einer Vorgabe, ein Text to Sound das Lied, über Image to Video oder Text to Video wird wird über einen Sampler das Video erzeugt und parallel dazu passiert mit dem Audio das gleiche. Audio bestimmt das Video und die Kombination ist das, was du letztendlich siehst und hörst.







 

Ähnliche Threads

Menü
Zurück
Oben Unten