您好,我在vlmevalkit上评估的性能和paper里面的都存在差距,请问基于推理结果,评估的准则或者相关代码可以开源供用户自己本地测试吗,非常感谢!
您好,我在vlmevalkit上评估的性能和paper里面的都存在差距,请问基于推理结果,评估的准则或者相关代码可以开源供用户自己本地测试吗,非常感谢!