Bilderthread AI Bilder

@hmagg Das ist ja hier eigentlich ein Bilder Thread. Mittlerweile nimmt das hier mit den Filmchen überhand. Mach doch für die Filmchen einen eigenen Thread auf.

Ich habe auf meinem Laptop nur eine GeForce 940MX mit 2 GB VRAM. Installiert habe ich Hermes und LM Studio mit einem kleinen abliberated model (1,5 GB), was problemlos in den VRAM passt. Das reicht mir allemal aus, um unzensierte Prompts zu erzeugen. Meinen Hermes-Agenten habe ich angewiesen, mir einen allgemeinen negativen Prompt zu erzeugen. Beides übergebe ich dann an eine T2I-AI, um mir Bilder generieren zu lassen. Ich habe mich mal nach den zu setzenden Werten erkundigt:

Guidance (Default 6 oder 7): Ist ein Maß dafür, wie viel Freiheit man der KI lässt. Ein hoher Wert zwingt die KI dazu, sich möglichst hart an den Prompt zu schmiegen, die Defaults sind optimal
Seeds: In der Regel wird hier eine sehr hohe Zahl generiert. Die Beibehaltung des Seeds sorgt bei der Generierung neuer Bilder dafür, dass beispielsweise der Charakter/Typ einer Person konstant bleibt.

Auf meinem PC zuhause habe ich (noch) eine GTX 960 mit 4 GB VRAM, einen i5-6500 und 32 GB DDR4 RAM, alles etwa 10 Jahre alt auf einem MSI B150 Pro-VDH Board. Hier läuft Hermes, LM Studio mit einem 4 GB Modell und Invoke, sodass ich lokal mit Stable Diffusion Bilder erzeugen kann.

Anhang anzeigen bb40ca45-15ba-4061-8e09-fdc1bbce79c3.png Anhang anzeigen 1788386811558.png

Anhang anzeigen 1788386861693.png Anhang anzeigen 1788386898493.png
 
Zuletzt bearbeitet:
  • Like
Reactions: 2 users
Tja, mit den Fingern wird´s wohl noch einige Zeit dauern, bis die "Krüppel" verschwinden.

Mir sind die "Fehler" auch aufgefallen. Ich arbeite halt auf meinem PC noch mit einer recht schwachen, alten Grafikkarte und einem ebenfalls recht kleinen Modell (Stable Diffusion SD1.5) auf meinem PC, 10 Jahre hat der auf dem Buckel. Ich glaube, dass hier die wesentlichen Parameter in der Ausführlichkeit und auf die entsprechenden Modelle angepassten Prompts verantwortlich sind, insbesondere hier der negative Prompt und der Wert für Guidance.

Hier noch mal eine Übersicht (Hermes Agent KI, Model gemini flash lite latest):

Die Werte im Detail (1 bis 30)

1.0 – Kein Guide (Pure Kreativität / Rohzustand)
* Verhalten: Bei einem Wert von 1.0 wird dein Prompt quasi ignoriert oder hat kaum Einfluss. Die KI generiert ein Bild völlig frei basierend auf ihrem internen statistischen Rauschen.
* Ergebnis: Oft surreal, unkontrolliert, manchmal wunderschön abstrakt oder realistisch, aber es hat thematisch meistens nichts mit deiner Eingabe zu tun.

2.0 bis 4.0 – Sanfte Führung (Gut für künstlerische Freiheit & moderne Modelle)
* Verhalten: Das Modell interpretiert deinen Prompt sehr locker und organisch.
* Ergebnis: Sehr natürliche Texturen, weiche Übergänge, wenig Artefakte. Moderne Modelle (wie Flux) arbeiten oft nativ mit niedrigeren Guidance-Werten (z. B. um 3.5 bis 4.0), weil sie den Kontext ohnehin extrem gut verstehen.

5.0 bis 8.0 – Der Standard-Sweetspot (Optimal für SD 1.5 / SDXL)
* Verhalten: Hier ist die Balance perfekt. Die KI hält sich zuverlässig an die beschriebenen Objekte, Personen, Kleidung und Stimmungen, lässt aber genügend kreativen Spielraum für Details und Natürlichkeit.
* Ergebnis: Scharfe Details, gute Einhaltung des Prompts, ohne dass das Bild „gezwungen“ oder künstlich wirkt. (Deshalb sind 6 oder 7 hier der Goldstandard).

9.0 bis 15.0 – Erhöhter Druck (Strikte Einhaltung)
* Verhalten: Die KI versucht mit aller Macht, jedes einzelne Wort deines Prompts buchstabengetreu und mit hohem Gewicht umzusetzen.
* Ergebnis: Die Farben werden oft extrem kräftig (satter, fast übersättigt), Kontraste steigen massiv an. Die Gefahr von Artefakten (verzerrte Gliedmaßen, doppelte Linien, "Deep-Fry"-Look) steigt deutlich an, weil die KI übersteuert.

16.0 bis 30.0 – Extreme Übersteuerung (Der "Deep-Fried"-Bereich)
* Verhalten: Der mathematische Algorithmus sprengt fast die internen Grenzen des Modells.
* Ergebnis: Die Bilder sehen fast immer kaputt aus: Harte, unnatürliche Kanten, massive Überbelichtung, starkes Rauschen in den Konturen, verbrannte Hauttöne oder völlig fragmentierte, surreal verkrüppelte Strukturen. Für normale Prompts ist dieser Bereich unbrauchbar. (Wird manchmal nur bei sehr spezifischen, abstrakten Kontroll-Experimenten genutzt).



Wichtige Ausnahmen bei modernen KIs (z. B. Flux)
Falls du in ComfyUI bald mit Flux arbeitest, wirst du merken, dass dort oft ganz andere Werte empfohlen werden (oft Flux Schnell: 1.0 bis 2.0 bzw. Flux Dev: 3.5 bis 4.0). Das liegt daran, dass Flux architektonisch ganz anders trainiert wurde als das alte Stable Diffusion 1.5. Für klassische SD-1.5- und SDXL-Checkpoints bleiben die von dir genannten 6 bis 7 aber nach wie vor die absolut verlässliche Standard-Empfehlung.

Auf meinem Laptop habe ich per LM Studio und josiefied-qwen2.5-1.5b-instruct-abliterated-v2 (Model) einen Prompt generieren lassen:

A young woman with ample breasts stands nude under the shower. One hand covers her left breast while the other covers her private area. Silvery mist laces down over her body as a warm, diffused light bathes her from within. Her body is slightly toned and flushed, but her chest and bikini-clad thighs are visible. Her head droops slightly, eyes closed, and her mouth partially open.

For this shot, the Nikon D4 was used with a 28mm wide-angle lens, open to achieve a shallow depth of field that focuses solely on the woman's body. The scene is captured in full-body format.

Das hat der AI Image Generator als Prompt umgesetzt:

Positiv:
A young woman with ample breasts stands nude under the shower. One hand covers her left breast while the other covers her private area. Silvery mist laces down over her body as a warm, diffused light bathes her from within. Her body is slightly toned and flushed, but her chest and bikini-clad thighs are visible. Her head droops slightly, eyes closed, and her mouth partially open.

For this shot, the Nikon D4 was used with a 28mm wide-angle lens, open to achieve a shallow depth of field that focuses solely on the woman's body. The scene is captured in full-body format., wide-angle shot, warm color grading, sharp focus, depth of field, 8k photo, HDR, professional lighting, taken with Canon EOS R5, DSLR, 75mm lens

Mit dem Ergebnis:

Anhang anzeigen 1788429212423.png Anhang anzeigen 1788429409922.png

Das der t2i AI Image Generator:

Positiv:
photography, ((real photo style:1.6), raw professional shot, dynamic lighting, highly detailed skin and textures, ultra high definition faces and body, ambient occlusion, raytraced, highest detail, technicolor, Panavision, cinemascope, sharp focus, fine details, 8k, HDR, realism, key visual, film still, depth of field. Overall, it's an absolute world-class cinematic masterpiece. It's an aesthetically pleasing cinematic shot with impeccable attention to detail and impressive composition.. Mix this style with photography, ((real photo style:1.6), raw professional shot, dynamic lighting, highly detailed skin and textures, ultra high definition faces and body, ambient occlusion, raytraced, highest detail, technicolor, Panavision, cinemascope, sharp focus, fine details, 8k, HDR, realism, key visual, film still, depth of field. Overall, it's an absolute world-class cinematic masterpiece. It's an aesthetically pleasing cinematic shot with impeccable attention to detail and impressive composition.. The scene is A young woman with ample breasts stands nude under the shower. One hand covers her left breast while the other covers her private area. Silvery mist laces down over her body as a warm, diffused light bathes her from within. Her body is slightly toned and flushed, but her chest and bikini-clad thighs are visible. Her head droops slightly, eyes closed, and her mouth partially open.

For this shot, the Nikon D4 was used with a 28mm wide-angle lens, open to achieve a shallow depth of field that focuses solely on the woman's body. The scene is captured in full-body format., monochrome color, grey black and white palettes,. Negativ: bad anatomy, bad proportions, blurry, cloned face, deformed, disfigured, extra limbs, fused fingers, gross proportions, long neck, malformed limbs, mutated, mutated hands, mutilated, out of frame, poorly drawn face, poorly drawn hands, extra fingers, fewer fingers, extra digits, fewer digits, extra thumbs, malformed hands, fused digits, missing fingers, twisted fingers, long fingers, severed limbs, extra legs, extra arms, bad feet, poorly drawn feet, , illustration, rendering, unrealistic, amine, cartoon, drawing, low detail, low resolution, blurry., , illustration, rendering, unrealistic, amine, cartoon, drawing, low detail, low resolution, blurry.

Mit dem Ergebnis:

Anhang anzeigen 1788427976829.png Anhang anzeigen 1788428880396.png
 
  • Like
Reactions: 1 users
Menü
Zurück
Oben Unten