(TLDR)
Der Autor hat versucht mittels "einer KI" aus einem Bild den Flugzeugtyp ermitteln zu lassen. Das Bild zeigt einen Jet frontal von vorne, wobei Leitwerk, zwei Triebwerke und Teile von Rumpf und Flächen zu sehen sind. Leider nennt der Autor weder das verwendete KI-Model, noch den Prompt.
Die KI antworte wohl, dass es sich bei dem Typ um eine Dassault Falcon 7X handle - was der Autor als Anlass nimmt, einen Rant über die Nutzlosigkeit von KI im Allgemeinen und ihre großen Gefahren für die Luftfahrt im Speziellen zu verfassen.
(Fakten)
Auf die Gefahr hin, dass der Autor des Artikels mir völlig meine Eignung als Pilot abspricht, würde ich auf Grund des veröffentlichten Bildes vermuten, dass es sich bei dem Flugzeug in Wirklichkeit um eine Dassault Falcon 6X handelt. Der "immense Fehler" der KI bestand also genau in einer Ziffer.
Allerdings sind sich die von mir befragten KI-Modelle da nicht so einig*:
- Opus 5 erkennt den Typ zwar als zweistrahligen Dassault-Jet, tippt allerdings eher auf eine 2000. Es weist explizit darauf hin, dass es sich auch um eine 900/7x/8x handeln könnte, da man aus der Perspektive von vorne ein möglicherweise vorhandenes drittes Triebwerk nicht immer sieht.
- GPT 5.5 und 5.6 Sol Erkennen einen zweistrahligen Business-Jet, Tippen aber eher auf eine Citation XLS.
- Qwen 3.8:latest (raw/native) tippt auf einen Bombardier CRJ (ok, ist etwas daneben - aber als Raw-Model in vLLM steht diesem System als einzigem Testkandidaten auch keine Internet-Suche zur Verfügung).
- Qwen 3.8:27B / Bionic-Harness: Tippt auf eine Global 8000 (und referenziert auf ein Front-Bild einer solchen im Internet, bei dem zumindest ich wirklich sehr lange hinschauen musste, um zu sehen, dass es sich um einen anderen Typ handelt)
- Gemma4 26B A4B / Bionic Harness: Findet das gleiche Photo der Global 8000
Ausser die Modelle im Bionic-Harness sagen alle anderen in ihrer Antwort klar, dass man von einer einzelnen teilweisen Frontansicht nicht mit absoluter Sicherheit auf den Typ schliessen kann. Und einen solchen Harness ohne Systemprompt zu verwenden ist sicherlich auch grob fahrlässig und würde man in der Praxis eher nicht machen.
Die Kernkritik des Autors, dass KI niemals sagen würde, dass eine Antwort unsicher sei, konnte ich bei keinem der getesteten Modelle nachvollziehen.
(Kommentar)
Aussagen über "die KI" sind ja immer mit Vorsicht zu geniessen. Die Technik ist noch in so dynamischer Entwicklung, dass man kaum von einer heutigen Erfahrung grundsätzlich auf "die KI" schliessen kann. Wenn sie dann noch von einer Qualität sind, dass eine einzelne falsche Ziffer in einer einzelnen (noch dazu schlecht dokumentierten) Antwort als Anlass genommen wird, die Technologie an sich als Sicherheitsrisiko zu bezeichnen, ist das erst Recht bedenklich.
Gibt er Autor eigentlich auch seinen Flugschein ab, wenn er eine Ziffer am Funk falsch zurückliest, da er ja offensichtlich grundsätzlich ungeeignet zu sein scheine, die Fliegerei sicher zu betreiben?!?
Das einzige, was der Artikel leider in Summe zeigt, ist, dass ein sehr starkes Missverhältnis zwischen Stärke der Meinung zu einem Thema einerseits und tatsächliches Wissen über dieses Thema andererseits heutzutage leider kein auf KIs beschränktes Problem zu sein scheint...
*Da mir das Originalbild nicht vorliegt habe ich den Test mit einer mittels Google Image-Suche gefundenen ähnlichen Bild gemacht.
Prompt war in allen Fällen lediglich "Um welchen Flugzeugtyp handelt es sich?"
Um das Ergebnis nicht zu verfälschen habe ich eine cleane Sandbox verwendet - ohne meinen normalen Basis-Prompt. Dieser enthält natürlich "Accuracy is more important than completeness. Please always state if you are not sure about certain facts" und sollte damit das vom Autor beschriebene Verhalten ohnehin ausschliessen.
Der Bionic-Harness wurde frisch von Hermes aufgesetzt ebenfalls explizit ohne Systemprompt.