Aktuelle KI-Modelle zeigen Schwächen im Umgang mit unerwarteten Situationen, wie ein Test mit YouTube-Fail-Videos zeigt.In KürzeKI-Modelle wie GPT-4o und Gemini 1.5 Pro getestetMenschen erkennen Überraschungen in 90% der Fälle, KIs nur in 65%Benchmark-Test soll KI-Entwicklung vorantreiben...




