PerceptionBench
PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models
Über
PerceptionBench ist ein Benchmark, der entwickelt wurde, um die atomaren visuellen Wahrnehmungsfähigkeiten von multimodalen großen Sprachmodellen (MLLMs) zu bewerten. Es adressiert die Einschränkungen bestehender Benchmarks, indem es Wahrnehmungsfehler von Fehlern in der Argumentation oder im Fachwissen isoliert. Der Benchmark umfasst 3.000 verifizierte Fragen, die zehn atomare Wahrnehmungsfähigkeiten ansprechen und einen strukturierten Ansatz bieten, um die Grenzen der visuellen Wahrnehmung von MLLMs zu bewerten und zu diagnostizieren.
Open Source Health
- Stars
- 206
- Forks
- 11
- License
- Apache-2.0
- Last commit
- 2 months ago
Alternativen zu PerceptionBench
The Algorithmvon TwitterQuellcode für den X Recommendation Algorithm.
Recommendersvon TensorFlowTensorFlow Recommenders ist eine Bibliothek zum Erstellen von Empfehlungsmodell-Systemen mit TensorFlow.- RPG_KDD2025von FacebookresearchDieses Repository bietet den Code zur Implementierung von RPG, wie in unserem KDD'25-Paper "Generierung von langen semantischen IDs in Parallel für Empfehlungen" beschrieben.
- Pairecvon AlibabaEin Go-Web-Framework zum schnellen Aufbau von Empfehlungsdiensten basierend auf JSON-Konfiguration.
Textrankvon Summa NLPTextRank-Implementierung für Python 3.
Ressourcen & Links
Verwandte Kategorien
Nutzt du PerceptionBench?
Behalte die Kosten neben dem Rest deines Stacks im Blick und lass dich vor der Verlängerung erinnern.
Zu meinem Stack hinzufügenAnbieter
Moonshot AI
Open-source projects on GitHub: Kimi-Dev, MoonEP and Checkpoint Engine