近日,华中科技大学软件学院教授白翔领衔的VLRLab团队发布了多模态大模型——“…
近日,华中科技大学软件学院教授白翔领衔的VLRLab团队发布了多模态大模型——“Monkey”,该模型能够对图片进行深入的问答交流和精确描述。该模型在18个数据集上的实验中表现出色,特别是在图像描述和视觉问答任务方面。此外,在文本密集的问答任务中也有显著优势。该模型的显著特点是:出色的“看图说话”能力。在详细描述任务中,能够察觉到很多多模态大模型所忽略的内容。这样惊人的描述能力是怎么做到的?Monkey巧妙利用现有的工具构建了一种多层级的描述生成方法,即通过五个步骤依次对图片进行整体简述、空间定位、模块化识别、描述赋分选取和最终总结,此举可以充分结合不同工具的特性,打出一套 “组合拳”,因而,大幅度提升了描述的准确性和丰富程度。 这段文字论述了“Monkey”的:
A. 独特功能及其应用场景B. 突出优势及其实现途径C. 科研价值及其描述方法D. 理论基础及其生成方式先想一想,再看答案与解析 ▸
正确答案:B
【正确率 86%|考点:关联词-并列】
文段开篇引出多模态大模型——“Monkey”的话题,并论述该模型在图像描述、视觉问答和文本密集的问答任务中表现出色,其显著特点就是出色的“看图说话”能力。接着提出问题,即该模型惊人的描述能力是怎么做到的,尾句进行回答,指出”Monkey“巧妙利用现有的工具构建了一种多层级的描述生成方法,大幅度提升了描述的准确性和丰富程度。故文段前后分别论述了“Monkey”的突出优势及其实现途径,对应B项。
A项“应用场景”、C项“科研价值”及D项“理论基础”文段均未提及,无中生有,排除。
故正确答案为B。
【文段出处】《以多层级描述生成法提升图像识别准确性丰富性》
考点关联词-并列