Turbulenzen und andere Unglücke - SQ321 und weitere Unglücksflieger

Wenn das ChatGPT analysiert hat, dann muss es ja stimmen.

Ein Werkzeug ist nur so gut, wie die Hand, die es führt. Solche Werkzeuge sind aber auch nichts für Menschen mit 2 linken Händen und an jeder Hand 5 rechte Daumen. ;-)

Aktuelle wissenschaftliche Untersuchungen und Benchmarks zeigen, dass ChatGPT je nach Komplexität und Fachbereich bei ca. 15 % bis über 50 % seiner Analysen und Antworten danebenliegt.

Verlinke diese Studien mal und differenziere nach Komplexität und Fachbereich. Hast du dir das Video überhaupt angesehen, das Transkript gelesen und mit der Antwort von ChatGPT abgeglichen? Das ist eine andere Qualität als Tik Tok. Es ist eine reine Textanalyse, also von der Komplexität auf niedrigem Level. Du reißt hier wieder einen Text aus dem Kontext, ohne auch nur einmal darüber nachzudenken, wie diese Werte zustande kommen. Ein Benchmarkwert für eine bestimmte Aufgabe ist kein allgemeiner Qualitätsfaktor für jede beliebige Analyseleistung eines LLM. Entscheidend ist immer, was genau getestet wurde.

Aktueller Stand vom 18. August:


 
Captain Steve hat ein neues YT-Video online gestellt:



Captain Steve ist ein Fachmann, der uns hier Dinge aus der Cockpitsicht nahebringt. Allerdings trennt er in seinem Erzählstil aus meiner Sicht nicht deutlich genug, wann er Fachwissen von Interpretation trennt. Ich habe das Transkript mal entsprechend von ChatGPT analysieren lassen und stelle das Ergebnis hier zur Verfügung, damit das Video besser einzuschätzen ist.

AussageStatus
787-9, München → HanoiFakt
sehr späte RotationFakt
TailstrikeFakt
mehrere beschädigte ReifenFakt
ungewöhnliche Verzögerung während des Startlaufslaut Besatzung berichtet
Bremsen wurden betätigtnoch zu klärender Untersuchungsgegenstand
technische Fehlfunktion der BremsanlageHypothese
RTO-/Bremslogik als mögliche UrsacheHypothese
Piloten hätten keine Trainingsgrundlage gehabtInterpretation
Piloten seien "Helden"persönliche Bewertung

Was Captain Steve berichtet, sind sehr interessante, fachliche Hypothesen und meine Sichtweise ist es halt, hier erst einmal den vorläufigen Bericht abzuwarten, aber letztendlich wird wohl erst der Final Report Klarheit schaffen.




Zum vorletzten Punkt:

Hier spricht er aus seiner eigenen Erfahrung als ehemaliger (recht frisch retired) Linienpilot für American Airlines .... dass so etwas nicht zum Trainingsumfang der Linienpiloten gehört. Es mag einzelne Unterschiede in den procedures zwischen den Airlines geben ... aber eine derart kritische Situation ist meiner Ansicht nach entweder überall im Training enthalten, oder nirgendwo. Offensichtlich hat es einen solchen Fall bisher nicht gegeben und jede derartige Situation wurde unter der Richtlinie "nach Erreichen von v1 gibt es keinen RTO mehr" abgearbeitet. Daher möchte ich hier die "Interpretation" sehr in Frage stellen.

Und - mit dem Begriff "Hero" gehen unsere Freunde auf der anderen Seite des Atlantiks von jeher eher inflationär um. Zumindest im Vergleich zu uns.
 
Menü
Zurück
Oben Unten