2月10日,阿里巴巴正式发布新一代图像生成及编辑模型Qwen-Image-2.0,以"准多齐美真"五字概括核心能力——准确渲染、多轮编辑、整齐排版、美观文字、真实质感。该模型支持高达1K tokens的文字输出,在汉字渲染上优势明显,能生成包含数百字古文的复杂图像。AI Arena评测得分1029,超越Midjourney v7、Stable Diffusion 3.5等主流模型。

技术亮点:中文场景的"降维打击"
Qwen-Image-2.0针对中文语境深度优化:
古籍生成:可准确渲染《兰亭集序》等复杂书法,笔画连贯性达97%
商业海报:支持中英文混排,自动适配版式,实测可用率超90%
长文本嵌入:单图可嵌入1000字以上,解决AI图像"文字乱码"顽疾
字节同日反击:Seedream 5.0上线
就在阿里发布前3小时,字节跳动图像模型Seedream 5.0已在剪映、CapCut、小云雀全量上线,即梦AI开启灰度测试。Seedream 5.0支持2K/4K分辨率直出,在摄影级真实感上略胜一筹。两大巨头同日亮剑,标志着中文图像生成市场从"蓝洞探索"进入"贴身肉搏"阶段。

商业格局重构
阿里依托阿里云B端优势,主攻电商海报、广告设计等企业场景;字节依托抖音生态,聚焦短视频封面、直播背景等C端应用。2026年,中文图像生成市场规模预计达80亿元,双寡头格局初现。