you are viewing a single comment's thread
view the rest of the comments
[–] [S] 3 points 1 day ago (2 children)

Probiere es mal aus, was passiert, wenn du eine KI auf !ich_iel loslässt.

  • source
  • parent
  • hideshow 4 child comments
  • [–] 3 points 1 day ago* (3 children)

    Ist durchaus brauchbar:

    Das Bild zeigt eine humorvoll gestaltete Werbe- bzw. Meme-Grafik: Im Mittelpunkt steht eine grüne Trinkflasche mit schwarzem Deckel und Trageband. In der Flasche schwimmt eine Gurke bzw. Gurkenscheiben. Oben steht groß in Grün: „Gurkolade“, darunter: „nicht nur so da“. Links befindet sich eine Sprechblase mit dem vertikalen Text „Trinksalat“. Rechts wird die Zusammensetzung humorvoll dargestellt: „95% reines Wasser“ und „5% reine Gurke“. Eine kleine Gurken-Illustration ist oben rechts zu sehen. Auf der Flasche liegen eine Sonnenbrille und ein kleines rot-weiß-pinkes rundes Motiv, wodurch das Bild einen bewusst absurden, sommerlich-lässigen Charakter bekommt. Unten links steht klein: „kaum steuern agrarsubventioniert“. Der Hintergrund ist eine helle Holzoberfläche. Insgesamt wirkt das Motiv wie eine satirische Verpackungs- oder Produktwerbung für ein erfundenes Getränk aus Wasser und Gurke.

  • source
  • parent
  • hideshow 6 child comments
  • Hier mein menschlicher Versuch ohne die KI-Variante gelesen zu haben:

    Selbstgemachte Meme-Werbegrafik für "Gurkolade": Das Bild zeigt eine transparente Wasserflasche mit Gesicht in der mehrere Gurkenscheiben schwimmen. Der Werbespruch oben lautet: "Gurkolade - nicht nur so da". Eine Sprechblase aus der Flasche kommend sagt "Trinksalat". Daneben befinden sich Label mit Aufschriften "95% reines Wasser" sowie "5% reine Gurke". Im Kleingedruckten steht unten: "kaum steuern agrarsubventioniert".

    Ein paar Sachen habe ich bewusst ausgelassen - Die genauen Farben der Flasche, des Hintergrunds usw. finde ich bspw. ein wenig irrelevant für den Witz.

  • source
  • parent
  • [–] 2 points 1 day ago (1 child)

    ein kleines rot-weiß-pinkes rundes Motiv

  • source
  • parent
  • hideshow 2 child comments
  • [–] 2 points 1 day ago (1 child)

    So what? Es ist eine brauchbare Beschreibung mit einem kleinen, irrelevanten Fehler, die ausführlicher ist als alles, was jemand anderes schreiben würde. Wenn du blind bist, bekommst du so trotzdem einen sehr guten Eindruck über das Bild.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 2 points 23 hours ago (1 child)

    Diese Stelle demonstriert halt sehr schön das Problem, nämlich dass die KI Bilder nicht versteht. Ich halte es mitnichten für irrelevant, dass die KI den Mund der Flasche nicht erkennt. Hinzu kommt die Brille, die angeblich auf der Flasche "liegt". Die Beschreibung des tatsächlich irrelevanten Untergrunds ist Audio-Spam. Und die Reihenfolge der einzelnen Elemente halte ich persönlich für mehr verwirrend als informativ. Klar, das ist schon besser, als so einiges, was ich bisher an KI-generierten Beschreibungen gesen habe. Aber hier ist das Bild auch relativ simpel, die einzelnen Elemente sind klar erkennbar.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 23 hours ago (1 child)

    Was ich sagen will: KI-Modelle können dir sehr ausführliche und brauchbare Bildbeschreibungen geben und daher ist es hart sinnfrei, wenn man großflächig rummosert, dass Bildbeschreibungen fehlen und versuchen zu erzwingen, dass Millionen Menschen ihr Verhalten ändern, wenn es auch eine technische und nutzbare Lösung gibt.

    Ich hab jetzt eben ChatGPT genutzt, Gemini erkennt z.B. den Mund:

    Das Bild ist eine humorvolle Fotomontage oder ein Meme, das im Stil einer satirischen Werbeanzeige gestaltet ist. Der Hintergrund besteht aus einer hellbraunen Holzoberfläche.

    Hauptmotiv Im Zentrum liegt schräg eine matte, halbtransparente Trinkflasche mit einem schwarzen Deckel und einer schwarzen Trageschlaufe. In der Flasche befinden sich Wasser und mehrere grüne Gurkenscheiben. Der Flasche wurde digital ein Gesicht verpasst: Sie „trägt“ eine dunkle Sonnenbrille und hat einen weit aufgerissenen, stilisierten Mund (ähnlich einem Emoji, mit roten, weißen und pinken Flächen).

    Texte und grafische Elemente Rund um die Flasche sind verschiedene ironische Slogans und Grafiken platziert:

    Titel: Oben steht groß in weißer Schrift mit dickem grünen Rand das erfundene Wort „Gurkolade“. Direkt darunter steht in kleinerer weißer Schrift der Slogan „nicht nur so da“. Oben rechts in der Ecke schwebt zudem ein kleines Gurken-Clipart.

    Linke Seite: Eine große weiße Sprechblase zeigt auf die Flasche. Darin steht um 90 Grad gedreht in grüner Schrift das Wort „Trinksalat“.

    Rechte Seite: Hier werden die „Inhaltsstoffe“ in zwei Badges hervorgehoben. Ein blauer Wassertropfen enthält den weißen Text „95% reines Wasser“. Darunter liegt ein grüner Kreis mit dem weißen Text „5% reine Gurke“.

    Unten links: Als eine Art „Kleingedrucktes“ steht dort in weißer Schrift: „kaum steuern agrarsubventioniert“.

    Insgesamt parodiert das Bild typische, moderne Marketing-Kampagnen für hippe Lifestyle-Getränke oder Ersatzprodukte (wie beispielsweise Hafermilch), indem es völlig gewöhnliches Gurkenwasser völlig überzogen als innovatives Produkt darstellt.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 2 points 20 hours ago (1 child)

    Ich hab diese Wand aus Text nicht gelesen und ich würde sie mir auch nicht anhören. Mehr Details sind nicht immer besser.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 2 points 20 hours ago (1 child)

    Schönes Beispiel, warum mich diese Diskussion so abfuckt: Der Gemini-Text ist 1281 Zeichen lang. Das Beispiel für "den perfekten Alt-Text" aus dem Artikel hat 794 Zeichen. Du landest da bei einem Textlängenunterschied von etwas über 2 SMS. Abgesehen davon kannst du natürlich dein Modell auf eine Wunschlänge prompten.

    Wenn man nicht wahrhaben will, dass man mit technischen Lösungen das Gewünschte erreichen kann, dann sollte man auch keine Diskussion anfangen oder ständig die Baseline verschieben. Oder um es anders zu sagen: Ja, KI kann dir eine brauchbare Bildbeschreibung erstellen. Das muss niemand anderes machen. Wenn du eine kurze Bildbeschreibung willst, dann stell deine Software so ein, dass sie dir eine kurze Beschreibung gibt.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 20 hours ago (1 child)

    Das Beispiel für "den perfekten Alt-Text"

    Welches? Da sind mehrere Beispiele. Die längeren sind länger, weil sie detaillierte Informationen aus Schaubildern vermitteln. Deswegen sagt der Text auch nicht, wie lang oder kurz Alt-Texte genau sein müssen, sondern dass sie so lang wie nötig und so kurz wie möglich sein sollen - weil es nämlich drauf ankommt. Das kann bisher nur ein Mensch beurteilen.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 2 points 20 hours ago (1 child)

    Und deswegen ist es ja cool, wenn jeder Mensch sich den Alt-Text in der gewünschten Länge selbst erstellen kann! Oder wenn man je nach Bild den Alt-Text auch verlängern kann.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 20 hours ago (2 children)

    Dein Idealismus ist lobenswert, aber die Leute, die heute nicht einmal in der Lage sind, wenigstens den Namen des abgebildeten Charakters in den Alt-Text zu schreiben, werden sicher nicht mehrere Versionen einer generierten Bildbeschreibung durchprobieren und womöglich auch noch auf Fehler probelesen, sondern den ersten Text nehmen, der ihnen vorgesetzt wird (vermutlich auch mit dem Gedanken "viel hilft viel"), und so mehr Spam generieren anstatt für Barrierefreiheit zu sorgen. Das ist alles nicht realistisch.

  • source
  • parent
  • hideshow 4 child comments
  • [–] 1 point 9 hours ago (1 child)

    du unterstellst den menschen dass sie wahrscheinlich auch nicht mal die schriftgröße auf ihrem e-reader einstellen können weil sie das erste nehmen was ihnen vorgesetzt wird ...

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 9 hours ago (1 child)

    Ich hab ganz ehrlich keine Ahnung, was du mir sagen willst.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 9 hours ago (1 child)

    naja die länge von KI-generiertem text einstellen ist nicht viel schwieriger als ne schriftgröße einzustellen.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 9 hours ago (1 child)
  • [–] 1 point 9 hours ago (1 child)

    Dein Idealismus ist lobenswert, aber die Leute, die heute nicht einmal in der Lage sind, wenigstens den Namen des abgebildeten Charakters in den Alt-Text zu schreiben, werden sicher nicht mehrere Versionen einer generierten Bildbeschreibung durchprobieren und womöglich auch noch auf Fehler probelesen, sondern den ersten Text nehmen, der ihnen vorgesetzt wird (vermutlich auch mit dem Gedanken “viel hilft viel”), und so mehr Spam generieren anstatt für Barrierefreiheit zu sorgen. Das ist alles nicht realistisch.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 19 hours ago (1 child)

    Da hast du mich falsch verstanden: Was ich meinte, ist, dass jeder, der eine Bildbeschreibung möchte, sie sich selbst auf dem eigenen Rechner erstellen lassen kann. In der gewünschten Länge und mit dem KI-Modell, das ihm/ihr am besten gefällt. Das ist dann eine Lösung, die auf allen Webseiten funktioniert und bei allen Usern, völlig egal, ob die Webseite selbst oder die User Bildbeschreibungen erstellen oder nicht.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 19 hours ago (1 child)

    Wer die Beschreibung braucht, kann nicht beurteilen, ob sie das Bild akkurat beschreibt. Du wälzst das Problem auf die ab, die Hilfe benötigen, und lieferst sie der Gnade der Maschine aus.

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 18 hours ago (1 child)

    Verschiebst du hier nicht gnadenlos die Ziellinie? Du bist aktuell als Blinder halt auch jedem einzelnen User ausgeliefert, dass dieser korrekte Bildbeschreibungen erstellt. Oder überhaupt welche. Und das wird halt schon alleine aufgrund des gewaltigen Aufwandes nicht jeder User machen und damit hast du dann eine absolut bescheuerte Realität, in der keiner eine Bildbeschreibung postet, User dafür dann beschimpft und angegangen werden, Blinde trotzdem nicht wissen, was auf dem Bild ist und irgendwie alles Kacke ist

  • source
  • parent
  • hideshow 2 child comments
  • [–] 1 point 17 hours ago

    Einzelne Nutzys kann man direkt ansprechen (Wie gesagt, ich habe nicht die Erfahrung gemacht, dass das derart ausartet, wie du das beschreibst, da kommen wir nicht weiter). Sobald es die von außen scheinbar einfache Lösung gibt, einen Knopf zu drücken, wird sich nur noch eine Minderheit die Mühe machen, vernünftige Alttexte zu schreiben und dann sollen die Blinden sich mal nich so anstellen, sie haben doch diese extra für sie entwickelte tolle Technologie. Nichts davon führt zu mehr Barrierefreiheit.

    Kennst du das Bild aus dem Avengers Trailer, das Dr Doom zeigt, der laut Untertitel "denn ich bin dumm" sagt? YouTube hat aufgehört, Nutzy-generierte Untertitel zu akzeptieren, und setzt stattdessen auf KI-generierte. Die meisten Kanäle kümmern sich nicht darum, ob die Untertitel gut sind - macht ja die KI. Und Gehörlose und -geschädigte und andere auf Untertitel angewiesene Menschen werden damit allein gelassen.

  • source
  • parent