Künstliche Intelligenz (KI,AI) Neuigkeiten und Diskussion

Also ich habe meinen ollen PC, etwa 8 Jahre alt, i5-6500, 32 GB DDR4-RAM, ursprünglich mit einer GTX 960 mit 4 GB VRAM ausgestattet, jetzt mit einer RTX 4060 TI mit 16 GB VRAM ausgestattet.

Ich arbeite mich ganz langsam ein, bin halt absoluter Newbie auf dem Gebiet.

Aktuell habe ich folgende Software installiert um lokal zu arbeiten

Zum Training

onsluth mit Docker Desktop

Text 2 Image

ComfyUI und Invoke

Ich denke, ich werde mich in ComfyUI einarbeiten.

Dann habe ich von runpod gehört, eine Plattform, wo man sich eine Grafikkarte für einen Job anmieten kann, hier mal der Ausschnitt des Screenshots:

Anhang anzeigen 1790111452859.png


Link

Abliterated und Uncensored Modelle gibt es auf Hugging Face und Civitai
 
Nicht schlecht wenn das auf deiner lokalen HW gemacht wurde. Und an einen Spruch von mir als ich noch Kurse zum Thema IT Netzwerke gegeben habe. "Warum ist das Internet so populär und braucht ständig mehr Resourcen?", "Pornographie!"

Habe das kleine Bonsai Modell jetzt mal auf meinem alten MacBook M2 Pro getestet und bin genau an den Punkt gestoßen den ich vorher angesprochen habe, RAM. Es reicht eben nicht nur ein Model in den Speicher laden zu können, gerade bei größeren Aufgaben muss man auch noch genug Platz für den Context haben oder man muss das ganze in kleinere Aufgaben splitten, was aber nicht immer Möglich ist. Sonst bleibt nur den Context zu komprimieren und dann gehen Informationen verloren.
 
Nicht schlecht wenn das auf deiner lokalen HW gemacht wurde. Und an einen Spruch von mir als ich noch Kurse zum Thema IT Netzwerke gegeben habe. "Warum ist das Internet so populär und braucht ständig mehr Resourcen?", "Pornographie!"

Ich habe halt die nach der Installation vorhanden Vorlage genommen, die 3 fehlenden Modelle runtergeladen und dann nur den Prompt verändert. Die Ergebnisse waren nach Sekunden da. Wenn ich das auf Invoke laufen lasse, dauert es deutlich länger.

Gibt es hier jemanden, der mit ComfyUI arbeitet?
 
So, ich habe meinen ersten Workflow mal selbst zusammengestellt. Es mag zwar ungewohnt sein, aber ich glaube, dass der Umgang mit ComfyUI intuitiv gut erlernbar ist. Mein erstes Ergebnis:

Anhang anzeigen 1790197377529.png

Das Bild war nach 40 Sekunden fertig.

Anhang anzeigen 1790197579188.png
Mein Workflow, ich glaube, dass das sehr schnell intuitiv erlernbar ist. Mein Modell oben basiert auf jaggernout.

Anhang anzeigen 1790197934149.png
Leicht veränderter Prompt anderer Seed und als Modell pony_realism, 34 Sekunden

Anhang anzeigen 1790198137238.png
Modell anteros_xxxl, 35 Sekunden

Klar, das ist noch nicht nach meinen Vorstellungen, aber ich gehe davon aus, dass ich hier zügig Fortschritte machen werde. Wer Interesse an gemeinsamer Arbeit hat, der kann sich gerne bei mir melden. Ich bin jedenfalls lernbereit und teile meine Erfahrungen auch gerne.

Anhang anzeigen 1790198861778.png
Eine Mutantin vom Bikini Atoll. :dog: Es gibt also auch Fehlschüsse.
 
Ich habe ComfyUI mal auf meinem ollen Laptop installiert.
Systemmodell: Aspire E5-774G
Prozessor: Intel(R) Core(TM) i5-7200U CPU @ 2.50GHz, 2701 MHz, 2 Kern(e), 4 logische(r) Prozessor(en) mit 8 GB RAM
Grafik: NVIDIA GeForce 940M mit 2 GB VRAM

Ich habe ein kleines Modell geladen, cyberrealistic_classicV50Final_pruned_fp16.safetensors, mit 1,99 GB, was so gerade in meinen VRAM passt. Mit kleinen Anpassungen in den Start-up Argumenten lief das Modell durch.

Anhang anzeigen 1790333741033.png
Der Workflow.

Anhang anzeigen 1790333769591.png
Das Ergebnis. Zeit etwa 220 Sekunden.

Also ich bin begeistert von diesem ComfyUI und muss an dieser Stelle mal ein riesiges Kompliment an die Entwickler aussprechen. Was da an Arbeit geleistet wurde und welche Sorgfalt hier umgesetzt wurde, das fällt für mich unter Referenzklasse.

Unterstützend hier waren ChatGPT und Claude beteiligt, um die paar Handicaps zu beseitigen. Gemini sollte für solche Arbeiten absolut gemieden werden. ChatGPT ist in Bezug auf Fragen bezüglich NSFW deutlich offener als Claude, die sich hier eher wie eine Nonne verhält.

Next Job:

Anhang anzeigen 1790334474435.png
Workflow.

Anhang anzeigen ComfyUI_temp_uqzzc_00002_.png
Ergebnis. Laufzeit 197 Sekunden.
 
Was genau soll man dann mit den Bildern machen ?

Ich gehe zwar nicht davon aus, dass dich hier eine Antwort ernsthaft interessiert, aber es geht hier um das Ausleben von Kreativität auf dem Anwendungsgebiet künstlicher Intelligenz. KI wird hier demnächst zwar nicht die konventionelle Fotografie ersetzen, aber in wesentlichen Bereichen Mode, Produktpräsentation und Kunst Raum gewinnen.
 
Was genau soll man dann mit den Bildern machen ?
Alles ... andere Gesichter drüber montieren zum Beispiel ... ich teste das gerade um DeepFake Angriffe besser abwehren zu können ... im Moment arbeite ich an Live Deep Fakes wie sie zum Teil schon eingesetzt werden ... heisst während eines live Videocalls die Stimme und das Gesicht zu ersetzen gegen die, zum Beispiel eines Geschäftsführers. Um Angestellte zu Überweisungen etc zu überreden ... ist teil von vielen Audits mittlerweile

Hardware Bedarf ist dafür erstaunlich niedrig ... ab 3090TI aufwärts
 
  • Like
Reactions: 1 user
Menü
Zurück
Oben Unten