home.social

#bildgenerator — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #bildgenerator, aggregated by home.social.

fetched live
  1. #Google hat letzte Woche eine neue #KI-Funktion für #GoogleEarth vorgestellt, die User mit dem #Bildgenerator #NanoBanana2 virtuelle, manipulierte #Satellitenbilder erstellen ließ. Das Ziel: kreative Möglichkeiten mit #Geografie erkunden. Doch die Begeisterung währte nur kurz, schnell formierte sich Widerstand. Nun hat Google das umstrittene Feature wieder entfernt, da User Screenshots generierter Bilder teilten, die gegen die Richtlinien verstießen.

    Alle Infos: appgefahren.de/?p=403273

    #appgefahren #Apple #AppleBlog #Tech #TechBlog #iPhone #iPad #Mac

  2. Algebraische Flächen visualisieren mit SURFER

    In diesem Artikel geht es um das Programm SURFER, welches es ermöglicht algebraische Flächen zu visualisieren.

    #Math #Mathematik #Bildgenerator #Algebra #SURFER #Unterrichtsmaterialien #Schule #Hochschule #Universität #Linux

    gnulinux.ch/surfer

  3. Nö!

    Ich habe also einen Bildgenerator gebeten, mir eine ganz normale, schöne Durchschnittsfrau Mitte 50 zu erzeugen. Mit Lächeln. Mit Brille. Ohne überbetonte sekundäre Geschlechtsmerkmale. Ohne Glamour-Filter. Ohne „Fantasie der Trainingsdaten“.

    Was ich wollte, war Normalität. Was ich bekam, war erst Kunstgalerie-Ernst. Und dann – nach Nachjustierung – immerhin Lächeln und Brille.

    Und genau das macht mich wütend.

    Warum ist „Durchschnitt“ so schwer? Warum ist „nicht sexualisiert“ eine Herausforderung? Warum muss ich explizit betonen, dass ich keine überzeichnete Körperform will?

    Es ist nicht die Technik, die nervt. Es ist das Echo der Trainingsdaten.

    Diese Modelle sind gefüttert worden mit Millionen von Bildern, die eine implizite Erzählung tragen: Frau = ästhetisches Objekt. Alter = entweder unsichtbar oder „würdevoll ernst“. Brille = optionales Accessoire, aber bitte nicht im „Schönheitsmodus“.

    Und wenn ich sage: „Durchschnittsdame, Mitte 50, funktionale Kleidung, natürliche Haut“, dann kämpfe ich gegen eine statistische Lawine aus Stockfotografie, Werbeästhetik und implizitem Bias.

    Das System kann Realismus. Aber Realismus ist nicht sein Default.

    Default ist Optimierung. Optimierung ist Markt. Markt ist Verzerrung.

    Was mich daran ärgert: Wir reden ständig über KI als Spiegel. Aber es ist kein neutraler Spiegel. Es ist ein Verstärker.

    Wenn Normalität nicht selbstverständlich generiert wird, sondern erst erkämpft werden muss, dann zeigt das, wie verschoben unser visueller Datenraum ist.

    Und ja – es ist nur ein Bildgenerator. Aber Bildgeneratoren formen visuelle Erwartung. Erwartung formt Wahrnehmung. Wahrnehmung formt Gesellschaft.

    Wenn selbst ein Prompt mit klaren Grenzen erst einmal ins Ästhetik-Klischee kippt, dann ist das kein technischer Zufall. Das ist Trainingskultur.

    Und genau deshalb nervt es.

    Ich wollte keine Heldin. Kein Model. Kein Kunstobjekt.

    Ich wollte eine Frau. Einfach eine Frau. Mit Brille. Mit Lächeln. Mit Normalität.

    Dass das kein Selbstläufer ist, sagt mehr über unsere Datensätze aus als über meine Prompts.

    #KI #Bias #Sexismus #Ableismus #Trainingsdaten #GenerativeAI #AlgorithmicBias #Bildgenerator #Medienkritik #DigitaleKultur #InfologischeRestwärme

  4. KI-Schrott ist Überleben

    Der Begriff »KI-Schrott« (englisch: AI Slop) wird inflationär verwendet, und viele haben keine Ahnung, was Generative KI eigentlich ist. Dabei ist die Antwort ganz einfach: Generative KI ist ein Werkzeug, genau wie Photoshop und Spiegelreflexkameras zu Beginn ihrer Markteinführung. kantel.github.io/posts/2026011 #KünstlicheIntelligenz #AIslop #Bildgenerator #GenerativeArt #OpenArtAI

  5. Durch die aktuellen Image-Generatoren fühle ich mich wie in den Film "Karate Kid" versetzt. Sie vermitteln eine essentielle Lektion: Geduld ("Auftragen und Polieren").

    Die Geduld ist in mehrere Richtungen notwendig:

    1.
    Immer wieder wird die Generation mit Fehlermeldungen abgebrochen:
    Gemini: "Tut mir leid, ich kann keine Bilder für unsichere Anfragen generieren." Oder auch: "Ich lerne noch, bestimmte Arten von Bildern zu erstellen, deshalb kann ich möglicherweise noch nicht genau das bereitstellen, wonach du suchst. Manche Anfragen verstoßen eventuell auch gegen meine Richtlinien." Öffnet man einen neuen Chat und startet die gleiche Anfrage, ist die Chance hoch, dass die dann durchläuft und nicht abgebrochen wird.
    ChatGPT: "Deine Anfrage verstößt gegen unsere Inhaltsrichtlinien, daher kann ich das Bild in der gewünschten Form leider nicht erstellen." Im Gegensatz zu Gemini ist man hier sehr viel restriktiver, eine Chance auf Umsetzung gibt es auch mit Neustarts nicht.

    Immerhin kann man beide fragen, was denn so verwerflich war. Die Antwort von ChatGPT ist dabei erstaunlich präzise: "Damit ein Prompt unseren Inhaltsrichtlinien entspricht, muss sichergestellt sein, dass die dargestellte Figur **nicht wie ein Kind in aufreizender oder unangemessener Weise** erscheint – selbst wenn es sich um Fantasiefiguren wie Feen oder Chibi-Charaktere handelt. Kombiniert man z. B. kindlich wirkende Figuren mit Badekleidung, wird das schnell problematisch, auch wenn es künstlerisch gemeint ist." --> Anlage 1: ChatGPT sollte das Bild, generiert von Gemini, auf ein goldene Rose setzen. Nicht mehr und nicht weniger: "Die Figur aus dem Bild soll auf einer goldenen Rose stehen. Ein Hintergrund ist nicht notwendig."

    2.
    Wer auch immer von KI bei den Generatoren spricht, die Generatoren sind NICHT intelligent, nicht einmal ansatzweise. Denn sie VERSTEHEN nicht, was man wirklich will.
    Klassisches Beispiel: der Hintergrund soll weiß sein. Oft ist er es, aber oft wird irgend ein Muster hineingelegt oder ein Farbverlauf oder oder oder. Für einen menschlichen Künstler ist völlig klar: "Mein Auftraggeber will keinen Hintergrund, Yay, spart Arbeit."
    Oder die Augenfarbe. Es passt sehr oft, aber insbesondere bei Grau glaubt er, dass GRÜN das neue Grau ist.
    Oder: ich möchte, dass die Figur frontal vor mir steht und den Betrachter direkt zum Betrachter schaut. Einem Menschen ist klar, der Körper kann leicht seitlich sein, der Kopf muss aber direkt zum Betrachter gedreht sein. Die Generatoren haben massive Schwierigkeiten damit.

    3.
    Sehr oft haben die Generatoren mit den (für uns Menschen) simpelsten Dingen Probleme. Meine Figur sollte auf einem Pilz sitzen. Aber Gemini generierte ununterbrochen nur Sitzkissen. Das es geht, seh ich an anderen mit dem Google-Generator erzeugten Bildern. Dann entstanden so lustige Dialoge wie: "Du hast ein Sitzkissen generiert, ich möchte aber einen Pilz" Antwort: "In Ordnung, ich habe einen Pilz generiert", es war aber eine Gewehrpatrone, ein Teppich, ein Sitzkissen, gar nichts, ein Block, eine Kugel...
    Auch hier sieht man: die Generatoren können nicht denken, nicht mitdenken, nicht interpretieren etc.

    4.
    Vermeintlich simple Kleidung, z.B. ein übergroßes Schlabber-T-Shirt, dass immer mal über die Schulter rutscht, keine Chance, gibt's nicht und wenn doch, ist es ein Zufallstreffer. Oder Alltagssituation: Ein Bahnsteig mit einfahrendem Zug: Gleise? ja, 2 oder drei Schienen, oder statt auf dem Bahnsteig stehen die Menschen auf den Gleisen. Oder der Zug fährt auf dem Bahnsteig.

    5.
    Die Generatoren merken sich zwar grundsätzlich, was man ein zwei Sätze vorher gesagt hat, aber sie merken sich nicht, was sie selbst generiert haben. Das neue Bild wird also komplett neu generiert. Natürlich können dann alle Fehler erneut auftreten. ChatGPT ist hier eine Ausnahme, das behält tatsächlich generierte Ergebnisse bei und man kann durch Prompt-Ergänzungen Punktuelle Korrekturen vornehmen, es sei denn, es kommt nach der dritten oder vierten Korrektur "Deine Anfrage verstößt gegen unsere Inhaltsrichtlinien, daher kann ich das Bild in der gewünschten Form leider nicht erstellen." Dann ist Schluss.

    Fazit: Die Generierung ist ein Kraftakt. Unzählige Versuche, Try and Error. Und zwischendurch immer mal wieder solche Meldungen: "Du hast am Prompt keine Änderungen vorgenommen, hier ist das Bild noch mal"
    Mittlerweile habe ich es mir so angewöhnt: ich versuche noch zwei, maximal drei Prompts lang eine Korrektur und wenn es dann immer noch nichts ist, starte ich einen neuen Chat. Bei Bildern scheint es beim Bezahltarif keine Begrenzungen zu geben.
    Aber: Warum erstellen die Generatoren nicht erst ein grobe Skize, oder einen niedrig aufgelösten Entwurf? und wenn der OK ist rendern sie die Finale Version?
    Antwort: Weil es keine KI ist. So würde ein Mensch vorgehen. Und erst wenn die KI auch so vorgehen kann, sind wir der intelligenten Maschine ein großes Stück näher gekommen. Ob wir das am Ende nicht bereuen werden, steht aber auf einem anderen Papier (welches hoffentlich keine KI generiert hat)

    Aber was mich richtig ankotzt: Die moralische Gängelei. Dadurch, dass die Generatoren nicht wissen (!!) was sie machen, lehnen sie viele Anfragen schon beim Hauch einer Andeutung einer Vermutung einer Ahnung ab, dass Bild könnte für prüde Amerikaner schwer verdaulich sein, eine Generation ab.

    Aktuell kostet es richtig Zeit, Ideen umzusetzen. Klar, kann man jetzt sagen, engagiere einen Künstler, der macht das dann viel schneller für dich. Jaaaahaaaaaa, aber *ich* muss mich selbst nicht bezahlen, mit mir kann ich Selbstausbeutung betreiben, mit einem externen Künstler geht das, zurecht nicht.

    Aber weil es richtig aufwendig ist, muss der Gesetzgeber einschreiten und generierte Bilder mit einem Urheberrechtschutz versehen. Bei Künstlern ist es doch auch egal, welches Werkzeug sie für ihre Werke verwenden: Kreide, Tusche, Computer. Und Computer haben mittlerweile Funktionen, für die früher ein Künstler unzählige Stunden und Versuche benötigte. Und nur, weil das Ergebnis beim Generieren nicht vorhersehbar ist, sollen die Ergebnisse keinen Schutz bekommen? Hallo? Die Bilder unten haben STUNDEN benötigt, eher ich zufrieden war. Was also unterscheidet einen Photoshop-Künstler von einem KI-Künstler? NICHTS, GAR NICHTS!

    #gemini #chatgpt #ki #bildgenerator #prompt #urheberrecht #copyright #Kreative #google #openai

  6. Reve AI: Neuen Gratis KI-Bildgenerator entdecken!

    Bilder in Sekunden erstellt
    Ein Tool, unendliche Styles
    Ideal für Content-Creator

    #ai #ki #artificialintelligence #kuenstlicheintelligenz #reveai #bildgenerator

    Jetzt lesen und folgen!

    kinews24.de/reve-ai/

  7. Viele Einhörner und eine Frau mit falschen Haaren

    Stable Diffusion ist ein freies KI-Modell zur Bildgenerierung. Hier gibt es nützliche Anleitungen zur Nutzung des Bildgenerators.

    #KI #stable_diffusion #Python #Bildgenerator #Linux

    gnulinux.ch/viele-einhoerner-m

  8. Viele Einhörner und eine Frau mit falschen Haaren

    Stable Diffusion ist ein freies KI-Modell zur Bildgenerierung. Hier gibt es nützliche Anleitungen zur Nutzung des Bildgenerators.

    #KI #stable_diffusion #Python #Bildgenerator #Linux

    gnulinux.ch/viele-einhoerner-m

  9. Breaking News: Flux1.1 Pro Ultra auf Scenario

    Black Forest Labs (BFL) hat vor wenigen Tagen, am 6. November 2024, einen brandneuen Ultra-Modus für das Flux1.1 Pro AI-Bildmodell veröffentlicht. Dieser neue Modus kann bis zu viermal höhere Bildauflösungen als der Standardmodus erzeugen. Und seit heute ist dieses Modell auch auf Scenario verfügbar. kantel.github.io/posts/2024111 #Scenario #Flux1 #Bildgenerator #InteractiveFiction #GameDev

  10. Konsistente Charaktere mit KI (und mehr) – Video-Tutorials zum Wochenende

    Noch immer hält mich das Thema »Konsistente Charaktere mit bildgenerierender, gekünstelter Intelligenzia« fest in seine Krallen. Um mich hier noch weiter einzuarbeiten, habe ich für dieses Wochenende wieder in paar Video-Tutorials herausgesucht, die Euch und mir die Erkundung erleichtern sollen. kantel.github.io/posts/2024111 #Bildgenerator #KünstlicheIntelligenz #InteractiveFiction #GameDev

  11. New KIs on the Blog: OpenArt.ai

    OpenArt.ai ist ein relativ neuer, leistungsfähiger Bildgenerator, der in der Hauptsache auf die KI-Modelle Stable Diffusion XL und Flux.1 [dev] setzt. Der Dienst ist nach einer einmaligen, 40 Credits bereitstellenden Startphase kostenpflichtig. kantel.github.io/posts/2024110 #OpenArt #Bildgenerator #StableDiffusion #Flux1 #InteractiveFiction #GameDev

  12. Nein, Stable Diffusion 3.5 ist nicht der Flux-Killer

    Vor etwas mehr als einer Woche hat Stability.AI die Freigabe von Stable Diffusion 3.5 verkündet, einem KI-Bildgenerator, der das bisherige Stable Diffusion XL bei weitem übertreffen soll. Und schnell (oder eher vorschnell?) wurde in einigen YouTube-Videos Stable Diffusion 3.5 als der Flux-Killer und Midjourney-Überwinder angepriesen. kantel.github.io/posts/2024110 #Bildgenerator #StableDiffusion #Flux #Scenario #KünstlicheIntelligenz

  13. Red Panda AI: Ein neuer Star unter den KI-Bildgeneratoren! 🐼✨

    - Beeindruckend realistische Bilder

    - Rätselhafte Entwickler-Infos

    - Konkurrenz für bekannte KI-Tools

    Was steckt wirklich hinter Red Panda AI?

    #AI, #KI, #ArtificialIntelligence , #Bildgenerator, #Innovation

    kinews24.de/red-panda-ai-der-n

  14. Zurück ins Wunderland: Little Girl Alice

    Inspiriert durch das Flux-Fieber, das mich gepackt hatte, habe ich mich gestern abend hingesetzt, und in Scenario meine erste Flux-LoRA trainiert. Ziel war es, aus dem Modell »Expressive Comic Characters« ein Character Model zu generieren, das möglichst konsistente Bilder eines kleinen Mädchens erzeugt, das von Lewis Carrolls »Alice im Wunderland« inspiriert ist. kantel.github.io/posts/2024102 #Scenario #Bildgenerator #Flux1 #InteractiveFiction #Twine #GameDev

  15. Konsistente Charactere mit Scenario

    Wer meinem Stream auf Flickr folgt, hat sicher mitbekommen, daß ich momentan sehr viel Zeit damit zubringe, Scenario, der derzeitigen gekünstelten Intelligenzia meines Vertrauens, beizubringen, konsistente Charaktere zu erzeugen, die in Spielen und interaktiven Geschichten verwendet werden könnten. kantel.github.io/posts/2024100 #Bildgenerator #KünstlicheIntelligenz #InteractiveFiction #GameDev #Scenario #StableDiffusion #Flux1

  16. Milch macht müde Männer munter? Flux.1 bei Scenario

    Flux.1 ist ja so etwas wie ein neuer Stern am Himmel der bildgenerierenden gekünstelten Intelligenzia. Die Software soll nicht nur mit den Boliden MidJourney, Googles Imagegen oder DALL-E 3 mithalten können, sondern sie ist in der Grundversion Flux.1[schnell] auch noch Open Source (Apache 2.0 Lizenz). kantel.github.io/posts/2024092 #Bildgenerator #KünstlicheIntelligenz #InteractiveFiction #GameDev #Scenario #Flux1

  17. 🕵️‍♀️ In unserer #DeusExMachina #KITool Testreihe haben wir einen Neuzugang: unsere Studentische Redaktion hat den
    #Bildgenerator #Ideogram AI näher unter die Lupe genommen

    Wie Ideogram auf #Prompts reagiert und was das mit #Wisskomm zu tun hat, erfahrt ihr hier:
    👉 rhet.ai/2024/08/26/ki-tools-im

    Alle weiteren Tool-Tests im Überblick und weitere Infos zur Reihe gibt es hier: rhet.ai/2023/09/05/deus-ex-mac

  18. Horror Clowns – Galerie des gepflegten Grauens

    Für heute nacht habe ich mir vorgenommen, Stephen Kings Es hereinzuziehen. Und aus Vorfreude darauf, habe ich die derzeitige gekünstelte Intelligenzia meines Vertrauens gebeten, mir ein paar Bilder eines Horrorclowns in einer nächtlichen Vorstadt mit dem Prompt »Horror clown in a nighttime suburban street« herbeizuphantasieren. kantel.github.io/posts/2024071 #Bildgenerator #KünstlicheIntelligenz #StableDiffusion #Scenario

  19. Hugo auf Drogen – Halluzinierende Gekünstelte Intelligenzia

    Offensichtlich kann Stable Diffusion aber kein deutsch und so passierte das, was mit den gekünstelten Intelligenzien immer passiert, wenn sie nicht weiterwissen: Sie halluzinieren munter darauf los und produzieren Bilder, die von dem gewünschten Ergebnis weiter kaum entfernt sein können: kantel.github.io/posts/2024061 #Bildgenerator #KünstlicheIntelligenz #StableDiffusion

  20. Mit Midjourney zum perfekten Bild: Alle wichtigen Prompts und Parameter im Überblick

    Midjourney verwandelt einfache Text-Prompts in faszinierende Bilder. Um aber wirklich alles aus dem KI-Bildgenerator herauszuholen, solltet ihr auch die wichtigsten Befehle und Parameter kennen. Wir zeigen sie euch.
    👉 👀 t3n.de/news/midjourney-ki-bild
    #Midjourney #KI #Bildgenerator