一个非常棒的3D室内场景带语义数据集,感觉很适合用来训练空间计算和3D跨模态相关的大模型~!😮
3D-GRAND - A Million-Scale Dataset for 3D-LLMs with Better Grounding and Less Hallucination
🧐3D-GRAND提供了一个包含40,087个家庭场景和620万条密集场景语言指令的大规模数据集,通过3D-POPE基准评估系统,有效减少了3D-LLMs中的幻觉现象,显著提升了模型的基础能力。
➡️链接:http://t.cn/A6QzKcsF
✨重点
●🏠**3D-GRAND数据集**:包含40,087个家庭场景和620万条场景语言指令,为3D-LLMs提供了丰富的训练数据。
●💡**关键技术**:通过指令调优,3D-GRAND显著减少了3D-LLMs中的幻觉现象,并增强了模型的基础能力。
●📊**3D-POPE基准**:提供了系统的评估机制,能够公平比较不同模型的幻觉现象,并展示了数据集规模与模型性能之间的缩放效应。
●🔍**实验结果**:显示大规模3D文本数据集在推动具身AI研究方面的重要性,并展示了有效的模拟到现实的迁移信号。
●🎓**研究贡献**:通过3D-GRAND和3D-POPE,为具身AI社区提供了重要的资源和见解,为更可靠和更好基础的3D-LLMs奠定了基础。
⬆️⬆️以上分享内容精选自我每周更新的AIGC百宝箱—知识星球:AI白日梦想家([抱一抱]可以向我提问/信息分类查找/72小时无理由退款),加入方法请见置顶帖图9:http://t.cn/A6jz8QLy(WX扫才能享受6折优惠哦) ,感谢大家打赏支持 [爱你]
发布于 奥地利
