Du verwendest einen veralteten Browser. Es ist möglich, dass diese oder andere Websites nicht korrekt angezeigt werden. Du solltest ein Upgrade durchführen oder einen alternativen Browser verwenden.
[Sammelthread] AI - Bildgenerierung (Stable Diffusion, Midjourney & Co)
Es gibt übrigens vom Fox-Fur-Seedhunter WF ein Update und von Minimax H3 Easy (siehe dort auch die Workflows im entsprechenden Ordner der Custom Node). Beide haben jetzt Verlängerung und Upscale Optionen.
Ah interessant, ist das bereits ganz verwendbar oder braucht man noch einen bestimmten PR? Grade dazu gelesen, es sei evtl besser als Turbo LORA, aber (erwartbar) schlechter als volle Stepzahl. Zuerst dachte ich an das hier (Minimax MAX by FAL), davon hatte ich was mitbekommen, aber es ist (noch) API only. Muss morgen nochmal genauer schauen, Modell ist schonmal runtergeladen
Hat jemand fundierte Ahnung von Ostris AI-Toolkit zum LoRa Training?
Mit Krea2 Model scheint es jetz erstmal keine großen Probleme zu geben. Aber jedes mal wenn ich zb Qwen Image trainieren will "CUDA error: out of memory"
ChatGPT scheint da auch keine lösung zu finden.
Mit ner 5070TI und 32GB RAM sollte doch eigentlich das einfache Modell klappen oder?
Generell oder nur auf Qwen bezogen? Mit Krea2 scheint es zu laufen.
Welches bessere Image edit Modell würdest mir empfehlen um mit AI-Toolkit zu experimentieren?
Naja, bei Videos ist LoRa und Edit nochmal ein ganz anderes Thema.
Mit mehren LoRas könnte man sich praktisch sowas wie ein konsistentes virtuelles Filmset bauen. Location, Requisiten, Hauptcast, Statisten usw.
Videodit wäre dann sehr gut um Fehler zu bereinigen oder nahtlose übergänge an schnittstellen neu zu generieren usw...
Bei Bildern sehe ich das Hauptproblem bei mir derzeit das man keine Mehrpersonen Bilder generieren kann ohne das "Klone" dabei rauskommen. Hier muss man sich dann in nem zweiten Workflow mit Image Edit auseinandersetzen.
Bei größeren "Projekten" mit dutzenden Bildern eine Sisyphusarbeit.
Mit Mehrpersonen LoRas hab ich mich übrigens noch nicht befasst!
Keine Ahnung, für mich haben Lora im Videobereich mit H3 komplett an Bedeutung verloren. Character Sheets, set location als Bild oder Video... das funktioniert so krass gut...
Wie gesagt, Video und Bilder sind zwei verschiedene Bereiche. Mein Schwerpunkt/Ziel sind Storytelling via Graphic Novels zb...
Leider lasse ich mich von all den Möglichkeiten und Spielereien mit KI zu leicht ablenken.🙄
Joo, da bin ich bei Dir. Mir hilft es, ein Projekt zu machen. So richtig "was will ich" und dann gucken, wie ich da am einfachsten hin komme. Habe ja ein Metal Film Projekt laufen... jetzt mit H3 ist es fast lächerlich einfach geworden. Davor mit Start- und Endframes etc... da war ich auch kurz davor, ein Lora Training zu machen für die Heldin. Ich bin drumrum gekommen Editieren war bislang auch noch nicht dabei, das mache ich immer über Videoschnitt bisher. Wenn ein Snippet so gar nicht geht fällt der unter den Tisch. Seit LTX Director und nun H3 aber auch Geschichte.
Charakter Sheets sind ein guter Tipp an das ich nicht gedacht habe.🤔
Aber wie soll ich das in einem Projekt anwenden mit 30 Seiten und zwei dutzend Charakteren?
Man muss ja auch Nebencharaktere und Statisten immer gleich aussehen lassen wenn zb ein Szene den Blickwinkel ändert oder ein Hauptcharakter später eine Location erneut betritt wo zb im Hintergrund der Klempner immer noch werkelt usw...
Mit einer Seite und mehr oder weniger Zufallsergebnissen und genügend anläufen bekommt man schon unglaubliche Ergebnisse. Doch die Euphorie lässt schnell nach wenn man merkt das sich die Ergebnisse nicht konstant und verlässlich reproduzieren lassen.
Ich hab sogar schon daran gedacht stattdessen sowas wie Bilderbücher mit viel Text und Bilder nur zur Untermalung. Vielleicht auch Multimedialer mix mit Text, Bildern, Musik und Hörspielelementen!
Wie darf man sich das konkret vorstellen? Meinst du ein Hintergrundlayer in einem herkömmlichen Grafikprogramm?
Dabei fällt mir ein, ist es machbar die Bilder direkt mit Layern zu erzeugen in ComfyUI, also direkt in einem Layerfähigen Format?
Oder den Hintergrund als Referenzimage einbinden!?