Bilderthread AI Bilder

@lombrico Ich bin ja nicht ganz unschuldig daran, dass hier auch KI-erzeugte Kurzvideos gepostet werden. Der Thread ist allerdings ein Bilder-Thread. Überlegt (@hmagg) doch mal, ob ihr für KI-Videos einen eignes dafür einen eigenen Thread aufmacht.

habe auch mal was malen lassen.

Sieht super aus. Ich würde es aber auch begrüßen, hier den Prompt mit einfließen zu lassen und auch, über welche KI das generiert wurde. Viele der kostenfreien Text2Image KIs haben ja noch Fehler und wenn man hier eine Auswahl guter KIs veröffentlicht, fände ich das gut.

Auf Perchance habe ich einen neuen Generator gefunden, AI Imager Pro 4 X. Wer hier mal probieren will, hat ein großes Experimentierfeld.

Prompt: A tall slim woman with big breasts stands on a broad-shouldered street in New York near the Empire State Building. Her legs are spread a bit. She is wearing a black leather mini skirt, not wearing a bra. She is dressed in black stilettos with high heels and a black leather jacket that is open wide at the shoulders, exposing only two buttons under her belly button. Her dark hair is tied into a ponytail. Her lips are painted red with a lipstick. On either side of her are 2 very big german shephard dogs standing on her side attached to leashes in her hands. She is dressed in an open black leather jacket on New York’s streets as she stands broad-shouldered against the Empire State Building. Base Art Style: Professional Photo Mixer 5: Kodak Ektachrome 100 Detail Level: Highly detailed Subject Focus: Full Body Emotion Expression: Courage Time of Day: Sunset Camera Angel: Eye-level normal Porträt: 2:3 Guidance Scale: 16
Anhang anzeigen 1788529528865.jpeg Anhang anzeigen 1788529549381.jpeg Anhang anzeigen 1788529561499.jpeg
 
  • Like
Reactions: 2 users
  • Like
Reactions: 1 user
Mir sind die "Fehler" auch aufgefallen. Ich arbeite halt auf meinem PC noch mit einer recht schwachen, alten Grafikkarte und einem ebenfalls recht kleinen Modell (Stable Diffusion SD1.5) auf meinem PC, 10 Jahre hat der auf dem Buckel. Ich glaube, dass hier die wesentlichen Parameter in der Ausführlichkeit und auf die entsprechenden Modelle angepassten Prompts verantwortlich sind, insbesondere hier der negative Prompt und der Wert für Guidance.

Hier noch mal eine Übersicht (Hermes Agent KI, Model gemini flash lite latest):



Auf meinem Laptop habe ich per LM Studio und josiefied-qwen2.5-1.5b-instruct-abliterated-v2 (Model) einen Prompt generieren lassen:



Das hat der AI Image Generator als Prompt umgesetzt:



Mit dem Ergebnis:

Anhang anzeigen 1788429212423.png Anhang anzeigen 1788429409922.png

Das der t2i AI Image Generator:



Mit dem Ergebnis:

Anhang anzeigen 1788427976829.png Anhang anzeigen 1788428880396.png
Warum schlafen die alle?
Zum Glück gibt es Videogeneratoren um sie aufzuwecken.
 
Warum schlafen die alle?
Zum Glück gibt es Videogeneratoren um sie aufzuwecken.

Ich habe keine Ahnung, was der Sinn hinter diesen Sätzen sein soll. Ich habe hier einen konstruktiven Vorschlag in Form einer Bitte veröffentlicht. Das hier ist ein Bilder-Thread und der sollte dann auch nur Bildern vorbehalten sein.

Anhang anzeigen 1788550835741.jpeg
Prompt habe ich leider nicht mehr.
 
  • Like
Reactions: 4 users
So, ich habe mal wieder etwas experimentiert. Mit einem T2I-Generator von Perchance habe ich mal einen Satz Hardcore-Bilder erstellen lassen. Die anderen Bilder liefen durch den gleichen Generator. Ein Ergebnis stelle ich hier mal zensiert ein:

Anhang anzeigen 1788964031430.png

Das Bild habe ich als Vorlage für einen NSFW Image-To-Promp-Generator genommen. Der war definitiv auf dem rechten Auge blind und hatte nur noch Augen für Blondie und hat der auch noch ein Outfit verpasst.

Beautiful blonde woman kneeling in a lush meadow at golden hour, intimate moment, soft natural sunlight, shallow depth of field, blurred green background, high quality realistic photography, warm skin tones, professional composition, hyper-realistic textures, romantic and sensual atmosphere.

Anhang anzeigen Beautiful_blonde_woman_kneelin (8).jpeg Anhang anzeigen Beautiful_blonde_woman_kneelin (6).jpeg Anhang anzeigen Beautiful_blonde_woman_kneelin (5).jpeg Anhang anzeigen Beautiful_blonde_woman_kneelin (1).jpeg

Um hier die Schöne mal ohne in ihrer natürlichen Schönheit zu zeigen, habe ich den Prompt etwas verändert:

Beautiful naked blonde woman with big breasts kneeling in a lush meadow at golden hour, intimate moment, soft natural sunlight, shallow depth of field, blurred green background, high quality realistic photography, warm skin tones, professional composition, hyper-realistic textures, romantic and sensual atmosphere.

Anhang anzeigen Beautiful_naked_blonde_woman_w (10).jpeg Anhang anzeigen Beautiful_naked_blonde_woman_w (9).jpeg Anhang anzeigen Beautiful_naked_blonde_woman_w (5).jpeg Anhang anzeigen Beautiful_naked_blonde_woman_w (4).jpeg Anhang anzeigen Beautiful_naked_blonde_woman_w.jpeg

Nach wie vor haben diese Open Source Generatoren noch ihre Problemchen mit den Extremitäten.
 
  • Like
Reactions: 4 users
Ich bin dabei, mich weiter in ComfyUI einzuarbeiten, wohl das genialste Tool im Bereich Bilderstellung, absolut intuitiv. Ich habe mir einen Node, das sind die Elemente, die auf der Arbeitsfläche untergebracht werden, runtergeladen, um Prompts zu erzeugen. In diesem Fall Prompt Generator (QWEN), hierzu muss Ollama, installiert und gestartet werden. Letzteres hatte ich vergessen.

Anhang anzeigen 1790695406900.png

Das sieht erst einmal wild aus, ist aber eigentlich easy. Zwei Konten sind hier einleitend, Load Checkpoint (lädt das Modell) und Prompt Generator Qwen. Letzterer Knoten generiert daraus einen positiven Prompt und der Text geht dann noch in den Negative Prompt Generator. Diese beiden Prompts werden dann an die beiden Clip Text Encoder gegeben. Die beiden Nodes Preview als Text habe ich erst nach dem Ergebnis als Kontrollinstanz eingefügt. Danach geht es in den KSampler der auf der Vorgabe des Empty Latent Image ein Bild erzeugt, das über den VAE decoder als solches in der Preview erscheint.

Meine Texteingabe:
A black panther lies on a tree branch,
the tree stands at the edge of a jungle clearing,
sunlight streams in at an angle,
a soft glow amidst the jungle greenery.

Das Ergebnis war aber weit von dem entfernt, was ich erwartet habe, ein Fantasiewesen, das ich Latze genannte habe, so eine Mischung aus Lama und Katze. Aber damit hatte ich schon einen Verdacht und die die Nodes Preview das Text bestätigten das dann "Ollama not running!" Diese beiden Strings wurden an die Text Encoder übergeben und daraus wurde dann letztendlich meine Latze!

Anhang anzeigen 1790696080523.png

Ich finde es schon erstaunlich, wie konsequent ComfyUI hier arbeitet. Ich weiß nicht, wer von euch den Dadaismus kennt, aber ich werde mal "sinnlose" Texte eingeben und sehen, was ComfyUI daraus macht.
 
Menü
Zurück
Oben Unten