wird geladen
C³PO-Benchmark enthüllt: Beste MLLMs erreichen nur 73 % bei Cross-Modal-Reasoning · Lumeric