PANews 7月29日消息,Kimi宣布开源多模态大模型视觉感知评测基准PerceptionBench,旨在将视觉感知能力拆解为10项原子级能力进行独立评估,涵盖视觉关系、计数、属性、深度与3D、定位、比较、细粒度识别、上下文整合、OCR及幻觉识别等维度。该基准基于42个现有评测集中的模型失败案例构建,共包含3000道经人工验证的问题,每题仅考察单一视觉能力,无需推理或外部知识。 评测结果显示,在16款前沿多模态大模型中,没有任何模型整体准确率超过60%。
币安注册直达:https://accounts.maxweb.black/register?ref=859494115&utm_medium=web_share_copy · 邀请码 859494115
转载来源:PANews(panewslab.com),版权归原作者所有,仅供资讯参考。