中国又一图像模型HiDream-I1推出,开源即登顶!

4.18 该模型在发布后迅速登顶ArtificialAnalysis权威榜单,成为首个跻身全球第一梯队的中国自研生成式AI模型,并在图像质量语义理解和艺术表现等方面刷新行业纪录

20250418095306


HiDream-I1 是由中国团队智象未来自主研发的开源图像生成大模型,采用MIT 许可证,允许自由商用。该模型在发布后迅速登顶 Artificial Analysis权威榜单,成为首个跻身全球第一梯队的中国自研生成式 AI 模型,并在图像质量、语义理解和艺术表现等方面刷新行业纪录。

 

20250418100619


核心特性

1. 卓越的图像生成质量  

在HPS v2.1评测中,平均得分33.82,超越SDXL、DALL·E 3等主流模型。  

支持多种风格(写实、动漫、科幻、肖像等),能精准还原复杂文本描述的细节,如“赛博朋克风格的未来城市中,机械臂在星空下焊接漂浮的桥梁”。  

 

2. 强大的语义理解能力  

在GenEval和DPG-Bench评测中表现优异,能准确执行复杂提示词,如“中世纪城堡的石砌城墙,身披铠甲的战士面向镜头,跃动的火焰勾勒出粗犷的面部轮廓”。  

 

3. 高效的推理性能  

提供Full(170亿参数)、Dev(平衡版)、Fast(极速版)三个版本,最快5秒/张出图。  

采用GAN 辅助的扩散蒸馏技术,在降低计算成本的同时保持高质量细节。  

 

4. 开源且商业友好  

采用MIT 协议,允许商用,但部分依赖组件(如 LLaMA3 编码器)需遵守各自协议。  

 

技术架构

基于扩散变换器(DiT)架构,结合稀疏混合专家(Sparse MoE)技术,优化计算资源分配。  

集成OpenCLIP ViT-bigG、T5-XXL、Llama-3.1-8B-Instruct等多模态文本编码器,增强语义理解。  

采用Flash Attention等优化机制,提升推理速度。  

 

应用场景

艺术创作(插画、概念设计)  

商业设计(广告、产品包装)  

科研教育(AI 教学、数据可视化)  

娱乐媒体(游戏、影视场景生成)。  

 

社区影响

开源24 小时内登顶Hugging Face 趋势榜(图像类第一)。  

国际设计工具 Recraft 已集成该模型,支持“一键出图 + 智能编辑”。  

配套HiDream-E1(交互式编辑模型),可通过自然语言指令修改图像,类似 GPT-4o 的“言出法随”体验。  

 

HiDream-I1 的推出标志着中国在 AI 图像生成领域的重大突破,为全球开发者提供了高质量、可商用的开源选择。


试用链接:https://hidreamai.com/explore 

GitHub:https://github.com/HiDream-ai/HiDream-I1 

HuggingFace:https://huggingface.co/HiDream-ai/HiDream-I1-Full