8月26日消息,SuperCLUE Image放出8月份中文文生图测评榜单。
这次一共测了14款国内外主流模型,还新增复杂信息布局这个考核维度,专门看模型做信息图、分镜、UI界面的能力。
这次榜单最大看点,商汤SenseNova U1 Pro拿到93.81分,以0.58分的微弱优势超过OpenAI GPT Image 2,直接拿下全球总榜第一。
字节跳动Doubao Seedream 5.0 pro、阿里Qwen Image 3.0 Pro紧随其后。总榜前五里面,国内模型占了3个。
从得分情况能看出来,现在不少模型做画面还原、创意生成已经很成熟,这两项平均分接近90分。
真正拉开差距的是图文一致性,还有刚新增的复杂信息布局,两项平均分只有72分出头。特别是复杂信息布局,最高分和最低分差74.2分,是分化最厉害的一项。
简单说,生成好看图片的大模型很多,但能在一张图里搞定大量文字、表格、流程图的模型很少。
榜单也能看出明显两极分化。排名前2的商汤、OpenAI模型,六大测评维度全部站在第一梯队,属于全能选手。
但很多中尾部模型偏科很严重,某一项能力很强,别的维度直接拉胯,只靠单个亮点已经冲不上高排名。
国产模型不是所有项目都占优。汉字生成、现实复现这两块国内表现更好,可在图文一致性上,和海外模型还有16.56分的不小差距。
总的来说,国产头部文生图已经站上全球第一的位置,但不是整体全部领先。能不能处理复杂图文信息,已经变成判断文生图模型好不好用的核心标准。
【本文来源:快•科技】
