可灵AI重磅推出可图2.1模型:图像生成能力全面升级,支持180余种创作风格

7.11 该模型在指令理解人像美感电影质感及文字生成等方面均有显著提升,同时支持超过180种不同艺术风格的响应,为创作者提供了前所未有的创意表达空间

北京,2025年7月11日——快手旗下全球领先的视觉生成大模型可灵AI今日正式发布可图2.1模型,标志着AI图像生成技术在多维度实现重大突破。该模型在指令理解、人像美感、电影质感及文字生成等方面均有显著提升,同时支持超过180种不同艺术风格的响应,为创作者提供了前所未有的创意表达空间。


20250711094221

 

技术突破:多维能力全面跃升

 

可图2.1模型最突出的进步在于其强大的指令遵循能力。测试表明,该模型能够精准捕捉提示词中的多元元素、复杂指令及颜色位置等细节要求。例如,当输入"3D微缩沙盘模型,展示其独特的横截面剖面,海底火山爆发的剧烈瞬间,史诗级灾难场景,CG特效,光影对比,冷暖对比"时,生成的图像不仅清晰呈现了宏大的灾难场景,更通过精细的光影对比和冷暖色调运用,在微缩景观中细腻还原了火山爆发的震撼瞬间。

 

在画面质量方面,新模型实现了质的飞跃。无论是清晰度、元素丰富度还是细节真实感都达到了新高度,特别是在人像生成上表现尤为出色。测试案例显示,无论是"水下摄影,一位欧洲少女,梦幻光影,水透明肌理反光"的提示,还是"黑白照片,复古风格的摄影棚照片,一位时尚女性斜倚在天鹅绒贵妃椅上"的要求,生成的人物图像都呈现出细腻的肌肤纹理、自然的光影效果和栩栩如生的细节。

 

特别值得一提的是,可图2.1带来了显著的**电影质感**提升。该模型能够生成具有电影大片氛围和层次感的图像,通过高级构图和独特光影色彩为画面赋予独特的美学调性。例如输入"电影质感,东京空荡荡的车站月台的广角镜头,一个亚洲男子坐在长椅上等车,风格酷似韦斯·安德森"的提示词,生成的图像完美复现了电影般的场景,仿佛是一部电影的精彩瞬间。

 

功能增强:文字生成与多风格支持

 

可图2.1在文字生成方面也取得重要进展,能够生成清晰、准确且充满设计感的中英文文字。这一功能的增强使得用户在进行海报设计、电影宣传、唱片封面等创意工作时,能够更便捷地将文字与图像融合,提升整体创作效率。

 

在风格多样性方面,新模型支持超过180种不同风格的响应,涵盖特殊材质、数字艺术和绘画技法等多种类型。这意味着创作者可以根据自己的创意需求,选择从复古摄影棚风格到未来感数字艺术等多种表达方式,极大地拓宽了创作的可能性边界。

 

用户体验:会员限时免费体验

 

为了让更多创作者体验新模型的强大功能,可灵AI宣布从即日起至7月17日,面向所有会员用户限时免费开放所有图片生成功能,包括文生图、单图参考、多图参考等。这一举措将为创作者提供充分的尝试机会,帮助他们在创作过程中探索新的可能性。

 

可灵AI运营负责人曾雨珅表示:"可图2.1的推出是我们持续技术创新的一部分。我们希望通过限免活动,让更多创作者能够第一时间体验到技术进步带来的创作便利,并从中获得灵感。"

 

平台发展与行业影响

 

作为快手旗下的全球领先视觉生成大模型,可灵AI自上线一年多以来已迭代超过20次,发展成为集AI图片、AI视频和AI音频能力于一体的多模态创意生产力平台。数据显示,可灵AI用户规模已突破2200万,累计生成3.44亿张图片和1.68亿个视频,年度经常性收入(ARR)超1亿美元,成为国产大模型飞速发展的标杆案例。

 

在近期举办的2025全球数字经济大会上,可灵AI作为"北京数字经济十大标杆应用"之一入选,集中展现了北京建设全球数字经济标杆城市的示范成果。快手副总裁、可灵AI技术负责人张迪在会上表示:"以可灵AI为代表的大模型技术正在构建全新的视觉表达基建。AI让视觉表达的能力边界进一步扩展,能够以更低的成本创造出更具想象力的内容,让每个人都能用AI讲出好故事。"

 

行业观察人士指出,可图2.1模型的推出不仅巩固了可灵AI在图像生成领域的技术领先地位,也为整个AIGC(人工智能生成内容)行业树立了新的技术标杆。随着AI生成内容质量的持续提升和应用场景的不断拓展,可灵AI等平台正在重塑数字内容创作生态,为创作者赋能,推动创意产业进入新纪元。


体验:https://app.klingai.com/cn/