罗马假日
书名:生死狙击|作者:笑无语|本书类别:古言|更新时间:19:24:06|字数:3896字
一 | 11月24日,绥中县范家满族乡邱家村一个塑料大棚处,里里外外一派火热的劳动场面,村民把刺嫩芽杆运进大棚,摆放整齐,用水培育。 8月26日消息,SuperCLUE Image放出8月份中文文生图测评榜单。今年冬天,绥中县秋子沟乡腰岭子村与范家满族乡邱家村携手培育10万株反季刺嫩芽,一个月后即可上市,产品将销往全国各地。 这次一共测了14款国内外主流模型,还新增复杂信息布局这个考核维度,专门看模型做信息图、分镜、UI界面的能力。 这次榜单最大看点,商汤SenseNova U1 Pro拿到93.81分,以0.58分的微弱优势超过OpenAI GPT Image 2,直接拿下全球总榜第一。 字节跳动Doubao Seedream 5.0 pro、阿里Qwen Image 3.0 Pro紧随其后。此举对调整当地产业结构、拉动村民就业、促进农业增效农民增收都起到了积极作用。 图为村民在搬运刺嫩芽杆。总榜前五里面,国内模型占了3个。 从得分情况能看出来,现在不少模型做画面还原、创意生成已经很成熟,这两项平均分接近90分。 《日报》全媒体记者 赵丽杰 摄。 真正拉开差距的是图文一致性,还有刚新增的复杂信息布局,两项平均分只有72分出头。特别是复杂信息布局,最高分和最低分差74.2分,是分化最厉害的一项。

二 | 简单说,生成好看图片的大模型很多,但能在一张图里搞定大量文字、表格、流程图的模型很少。 榜单也能看出明显两极分化。排名前2的商汤、OpenAI模型,六大测评维度全部站在第一梯队,属于全能选手。 但很多中尾部模型偏科很严重,某一项能力很强,别的维度直接拉胯,只靠单个亮点已经冲不上高排名。 国产模型不是所有项目都占优。汉字生成、现实复现这两块国内表现更好,可在图文一致性上,和海外模型还有16.56分的不小差距。 总的来说,国产头部文生图已经站上全球第一的位置,但不是整体全部领先。

三 | 能不能处理复杂图文信息,已经变成判断文生图模型好不好用的核心标准。

四 |



