Zevo

作者主页

Zevo

这个作者还没有填写简介。
个人主页
MMBench MMBench 是由 OpenCompass 提供的多模态大模型评测基准与排行榜平台,面向图像理解、视觉问答、推理等多模态任务,展示不同模型在统一评测集上的性能表现。网站提供模型排名、评测结果和相关指标信息,便于研究人员、开发者和用户了解多模态模型能力差异,跟踪模型评测进展,并为模型选型、学术研究和应用参考提供客观数据支持。
FlagEval FlagEval 是由北京智源人工智能研究院推出的大模型评测平台,面向人工智能模型能力评估与对比分析。网站提供模型榜单、评测任务、趋势数据等信息,覆盖语言理解、推理、代码、知识问答等多个维度,帮助用户了解不同大模型在公开基准和综合能力测试中的表现。平台适合研究人员、开发者及 AI 从业者用于模型选型参考、评测结果查询和行业趋势观察。