Dieser Artikel befasst sich mit den restlichen 41 %. Wir haben dieselben PDFs erneut untersucht und die schwierigere Frage gestellt: Wenn Alternativtext vorhanden ist, was sagt er eigentlich aus?
Was wir gemessen haben und wie
Das Korpus besteht aus denselben 111 digital erstellten, öffentlich zugänglichen PDFs, die durch einen Crawl ungarischer Gemeindewebsites heruntergeladen wurden – eines pro Website, damit keine Gewohnheiten einer einzelnen Behörde dominieren. Der oben genannte Wert von 59 % ergibt sich aus der Anwendung von veraPDF auf Klausel 7.3-1 bei den 59 Dateien, die validiert werden konnten. Aber für das Vorhandensein oder Fehlen von Alternativtext ist kein Validator erforderlich – nur ein Strukturbaum –, daher haben wir für diesen Artikel alle 111 Dateien direkt gelesen.
Wir haben jedes PDF mit pikepdf geöffnet, den Strukturbaum von /StructTreeRoot abwärts durchlaufen und den Wert /Alt für jedes Element mit dem Tag /Figure aufgezeichnet:
uv run --quiet python3 -c "
import pikepdf
def walk(elem):
if isinstance(elem, pikepdf.Dictionary) and elem.get('/S') == pikepdf.Name('/Figure'):
yield elem.get('/Alt')
kids = elem.get('/K') if isinstance(elem, pikepdf.Dictionary) else None
if kids is None:
return
kids = kids if isinstance(kids, pikepdf.Array) else [kids]
for child in kids:
if isinstance(child, pikepdf.Dictionary):
yield from walk(child)
pdf = pikepdf.open('document.pdf')
root = pdf.Root['/StructTreeRoot']['/K']
root = root if isinstance(root, pikepdf.Array) else [root]
for top in root:
for alt in walk(top):
print(repr(str(alt)) if alt is not None else None)
"
Wir haben auch /ActualText überprüft, das bei einer Abbildung als Ersatz für /Alt dienen kann, sowie die alternative Beschreibung bei annotationsbasierten Bildern. Nichts davon ändert etwas an den unten dargestellten Ergebnissen.
Was sich tatsächlich in /Alt befindet
Zweiundsechzig der 111 Dateien verfügen überhaupt über einen Strukturbaum; 24 davon kennzeichnen mindestens ein Bild als /Figure. In diesen 24 Dateien fanden wir 540 Abbildungselemente. Hier ist der Inhalt ihres Attributs /Alt:
Was wir in /Alt gefunden haben |
Abbildungen | Anteil |
|---|---|---|
Kein /Alt-Eintrag vorhanden |
240 | 44 % |
| Vorhanden, aber als leere Zeichenfolge | 235 | 44 % |
| Vorhanden, aber als Dateiname, URL oder lokaler Pfad | 6 | 1 % |
| Vorhanden, aber als einzelnes Zeichen oder Wort | 3 | 1 % |
| Vorhanden, unter 15 Zeichen | 2 | <1 % |
| Vorhanden, ein ganzer Satz oder mehr | 53 | 10 % |
| Gesamt | 540 |
- 44 %% Überhaupt kein
/Alt-Eintrag - 44 %% Vorhanden, aber leere Zeichenkette
- 2 %% Dateiname, ein Wort oder unter 15 Zeichen
- 10 %% Ein vollständiger Satz oder mehr
Raster aus 100 Quadraten, ein Quadrat entspricht einem Prozent der 540 gefundenen Abbildungselemente. 44 Prozent haben überhaupt keinen /Alt-Eintrag. 44 Prozent haben einen /Alt-Eintrag, der eine leere Zeichenkette ist. 2 Prozent enthalten einen Dateinamen, ein einzelnes Wort oder weniger als 15 Zeichen. 10 Prozent enthalten einen vollständigen Satz oder mehr.
Achtundachtzig Prozent der Abbildungen enthalten nichts Brauchbares – sie fehlen oder sind leer. Das deckt sich weitgehend mit dem Wert von 59 % auf Dateiebene aus der validierten Stichprobe; ein umfangreiches Dokument mit Dutzenden von Bildern lässt die meisten davon meist unberührt, selbst wenn einige wenige Aufmerksamkeit erhalten. Der interessante Teil ist die letzte Zeile: die 53 Abbildungen, die einen echten Satz erhielten.
Was tatsächlich geschrieben wird, wenn etwas vorhanden ist
Von den 53 wurde einer eindeutig von einer Person über das spezifische Bild geschrieben: eine kurze Bildunterschrift, die das Gemeindewappen nennt, übersetzt als „Wappen von [Stadt]“ – präzise, themenbezogen, einundzwanzig Zeichen. Ein zweiter, kürzerer Fall im selben Dokument lautet „Wappen von [Andere Stadt]“, vierzehn Zeichen, separat als „kurz“ statt als „ganzer Satz“ markiert – die zwei besten Bildunterschriften in unserer gesamten Stichprobe befinden sich im selben 59-seitigen Regionalbericht. Wir nennen die Städte nicht; bei nur 39 sauberen Websites von den 1.215, die überhaupt PDFs veröffentlichen, ist dies keine Geschichte darüber, welche Behörde versagt hat.
Die anderen 51 wurden nicht von jemandem geschrieben, der das Bild betrachtet hat.
| Woher der Satz tatsächlich stammte | Abbildungen |
|---|---|
| Eine automatische Bilderkennungs-Unterschrift, bei der der KI-Haftungsausschluss stehen blieb | 36 |
| Eine automatische Diagramm-Unterschrift, die nur den Fragetitel und die Antwortanzahl wiederholt | 15 |
Nehmen wir eine Datei: ein einseitiger Aushang mit drei Bildern, bei denen kein Alternativtext fehlt. Die veraPDF-Klausel 7.3-1 – Abbildungen müssen einen Alternativtext haben – meldet null Verstöße. Hier ist der erste /Alt-Wert, aus dem Ungarischen übersetzt:
„Das Bild zeigt Außenbereich, Pflanze, Gras, Himmel. KI-generierte Inhalte können fehlerhaft sein.“
Dieser Haftungsausschluss ist das Markenzeichen einer automatischen Beschriftungsfunktion, nicht einer Person. Word und PowerPoint können für ein eingefügtes Bild mithilfe eines Bilderkennungsmodells Alternativtext generieren, und die Funktion weist jedes Mal im Text selbst darauf hin. Niemand hat es vor der Veröffentlichung der Datei bearbeitet, und niemand hat die Warnung gelöscht. Ein längerer Gemeinde-Newsletter wiederholt das Muster neunmal – „Außenbereich, Baum, Pflanze, Himmel“, „Außenbereich, Text, Baum, Schild“ – generische Szenen-Tags, niemals das, was auf dem Foto tatsächlich zu sehen ist.
Die Diagramm-Unterschriften aus demselben 59-seitigen Bericht haben eine andere, aber ebenso hohle Form:
„Formular-Antwortdiagramm. Fragetitel: Was ist Ihr Geschlecht? Anzahl der Antworten: 573 Antworten.“
Dieser Satz teilt einem Screenreader-Nutzer mit, dass ein Diagramm existiert und wie viele Personen geantwortet haben. Er sagt nie, was sie geantwortet haben – das Einzige, wofür das Diagramm erstellt wurde. Ein sehender Leser wirft einen Blick auf die Balken und erkennt die Verteilung in einer Sekunde; ein Screenreader-Nutzer erhält die Metadaten und sonst nichts.
Zwei kleinere Absurditäten sind erwähnenswert: Der Alternativtext einer Abbildung besteht nur aus einem vollständigen lokalen Dateipfad – C:\Users\...\Desktop\...\[town]_crest.jpg –, der aus einer Copy-Paste-Aktion stammt. Ein anderer enthält die Bildunterschrift, die eine Google-Bilder-Ergebnisseite unter einem Vorschaubild anzeigt: „Image result for: '[company] logo'“ (so steht es wörtlich in der Datei) – es wird beschrieben, wie das Bild gefunden wurde, nicht was es zeigt. Beides sind echte, unbearbeitete Werte aus veröffentlichten Regierungsdokumenten.
Die Länge ist kein Indikator
Wenn Sie dazu neigen, Alternativtext nach Länge zu prüfen – etwa alles unter zwanzig Zeichen zu markieren –, würde dieses Korpus diese Prüfung zunichtemachen. Die 53 ausgefüllten Werte haben eine mittlere Länge von 102 Zeichen, was nicht kurz ist. Es ist genau so lang wie der Standardtext, der den Großteil davon ausmacht: Die Sätze der automatischen Beschriftung und der Diagramm-Metadaten sind beide komfortabel wortreich, sagen aber nichts über das spezifische Bild aus. Eine Zeichenzählung kann Prosa nicht von einer Vorlage unterscheiden.
Die Lücke, die ein Validator nicht schließen kann
Dies ist die Asymmetrie, über die man nachdenken sollte. Die veraPDF-Klausel 7.3-1 stellt eine Frage: Hat diese Abbildung einen /Alt-Eintrag oder einen Ersatz, der nicht leer ist? Sie muss genau das fragen, denn „nicht leer“ ist das Einzige, was eine Maschine prüfen kann, ohne sowohl das Bild als auch den Satz zu verstehen. Ob der Satz über das Bild ist – ob er jemandem, der das Bild nicht sehen kann, mitteilt, was ein sehender Leser weiß –, ist eine Ermessensentscheidung, und keine automatisierte Prüfung trifft Ermessensentscheidungen.
Die obige Datei besteht die Klausel 7.3-1 problemlos: Jede Abbildung hat ein nicht leeres /Alt. Eine Beschaffungs-Checkliste, die fragt: „Hat dieses PDF Alternativtext?“, würde das Kästchen abhaken. Ein Screenreader-Nutzer, der dieses Bild erreicht, hört „Außenbereich, Pflanze, Gras, Himmel“ und eine Warnung, dass es falsch sein könnte – er weiß nicht besser, was das Bild tatsächlich ist, als wenn das Feld leer gewesen wäre, und es ist möglicherweise sogar schlimmer, weil der Satz wie eine Antwort klingt.
Was Alternativtext-Best-Practice im Einzelfall wirklich bedeutet
Der Entscheidungsbaum der W3C Web Accessibility Initiative zum Schreiben von Alternativtext beginnt mit der Frage, um welche Art von Bild es sich handelt, da die Antwort ändert, was in das Feld gehört – und jeder oben genannte Fehlermodus lässt sich auf einen Zweig dieses Baums abbilden.
Dekorative Bilder
Eine Linie, ein Rahmen, ein Symbolfoto, das Platz füllt, sollte überhaupt keinen Alternativtext haben, und in PDF-Begriffen bedeutet das, als Artefakt statt als getaggter Inhalt markiert zu sein, nicht als /Figure mit einer leeren Zeichenfolge. Der Unterschied ist für einen Screenreader wichtig: Ein Artefakt wird stillschweigend übersprungen, während eine Abbildung mit leerer Zeichenfolge immer noch als Bild angekündigt wird, das nichts zu sagen hat. Ein Drittel der Abbildungen in unserer Stichprobe enthält diese leere Zeichenfolge, und die Datei allein kann uns nicht sagen, wie viele davon so gemeint waren und wie viele einfach leer gelassen wurden – PDF/UA erlaubt beides, und nur das Öffnen jedes Bildes würde Klarheit schaffen. Wir haben nicht alle 540 Bilder mit dem Auge geöffnet; das ist eine echte Lücke in dieser Messung, kein Rundungsfehler.
Diagramme und Schaubilder
Diese enthalten eine Erkenntnis, und der Alternativtext muss diese ebenfalls enthalten. Die W3C-Richtlinien für komplexe Bilder fordern eine kurze Zusammenfassung dessen, was das Bild zeigt, wobei die vollständigen Details in der Nähe verfügbar sein sollten – keine Wiederholung des Titels und der Stichprobengröße des Diagramms, was genau das ist, was unsere sechzehn Antwortdiagramm-Unterschriften stattdessen taten. „Zwei Drittel der Befragten gaben an, regelmäßig Sport zu treiben“ verdient seinen Platz. „Diagramm, 573 Antworten“ nicht.
Logos
Ein Logo wird zu einem funktionalen Bild und nicht zu einem dekorativen, sobald es gleichzeitig als Link dient: Der Alternativtext sollte benennen, wohin der Link führt, nicht das Kunstwerk beschreiben. Ein Dateiname oder eine Suchmaschinen-Unterschrift leistet beides nicht.
Text innerhalb eines Bildes
Ein Briefkopf, ein Abzeichen mit einem in die Grafik eingebetteten Wort, hat eine spezifische Regel: die Alternative muss denselben Text enthalten, der im Bild steht. Wir haben einen echten Fall dieses Versagens dokumentiert – ein DSGVO-Abzeichen mit dem darauf gedruckten Wort, ohne dass etwas anderes es beschreibt – in unserem Artikel darüber, was sich tatsächlich in einem getaggten PDF befindet.
Eine ehrliche Grenze dessen, was wir gemessen haben
Wir können nur Abbildungen innerhalb eines Strukturbaums sehen. Neunundvierzig der 111 Dateien haben überhaupt keinen, daher ist jedes Bild darin für diese Methode unsichtbar – unsere 540 Abbildungen stammen aus der Minderheit der Dateien, die überhaupt getaggt wurden. Das tatsächliche Bild bei allem, was eine Gemeinde veröffentlicht, ist sehr wahrscheinlich schlechter als die obigen Zahlen, nicht besser. Wir konnten auch anhand der Datei allein nicht feststellen, welche der 235 Abbildungen mit leerer Zeichenfolge eine bewusste Entscheidung („das fügt nichts hinzu“) waren und welche einfach übersprungen wurden – PDF/UA erlaubt beides, und nur das Öffnen jedes Bildes würde dies klären. Wir haben nicht alle 540 von Hand geöffnet; das ist eine echte Lücke in dieser Messung, kein Rundungsfehler.
Überprüfung Ihrer eigenen Dokumente
Wo man suchen kann, ohne ein Terminal zu benutzen
Microsoft Word
Klicken Sie mit der rechten Maustaste auf ein Bild und wählen Sie Alternativtext anzeigen. Wenn Word die Beschreibung automatisch generiert hat, wird dies angegeben, und – gemäß Microsofts eigenen Anweisungen – werden Sie aufgefordert, sie zu überprüfen und zu genehmigen, bevor sie veröffentlicht wird, anstatt sie ungelesen zu akzeptieren. Aktivieren Sie für ein wirklich dekoratives Bild Als dekorativ markieren, anstatt das Feld leer zu lassen.
Adobe Acrobat Pro
Barrierefreiheit → Lesereihenfolge, dann doppelklicken Sie auf eine Abbildung auf der Seite, um ihren Alternativtext zu bearbeiten, während das Bild selbst neben dem Feld sichtbar ist – der schnellste Weg, um zu prüfen, ob eine Beschreibung tatsächlich mit dem übereinstimmt, was auf dem Bildschirm zu sehen ist.
Keine Installation
Unser PDF-Barrierefreiheits-Checker meldet jede Abbildung, bei der der Alternativtext fehlt, gemäß derselben Klausel wie veraPDF; die PDF/UA-Fehlerreferenz erklärt, was die Klausel erfordert und was ein Validator Ihnen darüber sagen kann und was nicht.
Nichts davon erfordert einen Spezialisten. Es erfordert jemanden, der sich das Bild ansieht und einen Satz darüber schreibt, was es tatsächlich zeigt – was der eine Schritt ist, der bei 540 echten Abbildungen in echten veröffentlichten Dokumenten im Grunde nie passiert ist.