【[11星]OCR-Reasoning:一个用于评估多模态大语言模型在复杂文本丰富图像推理任务上的能力的基准。亮点:1. 包含1069个人工标注的示例,覆盖6种核心推理能力;2. 不仅标注了最终答案,还标注了推理过程;3. 现有最先进模型在该基准上准确率均未超过50%,挑战性十足】
'OCR-Reasoning Benchmark: Unveiling the True Capabilities of MLLMs in Complex Text-Rich Image Reasoning'
GitHub: github.com/SCUT-DLVCLab/OCR-Reasoning
#文本图像推理# #多模态大语言模型# #基准测试# #AI创造营#
发布于 北京
