Post #2442389
2025-01-23 03:12 UTC
"Die getesteten Varianten von GPT-4, Gemini und Llama beantworteten nur 33 bis 46 Prozent der Fragen korrekt – zu wenig für echtes Expertenwissen. Besonders schlecht schnitten die KI-Modelle in der Geschichte der Neuzeit ab, aber auch in einigen Regionen wie Afrika und Ozeanien."
https://www.scinexx.de/news/technik/wie-gut-ist-ki-in-geschichte/
Replies (0)
No replies.