
HiDream-I1 是由中国团队智象未来自主研发的开源图像生成大模型,采用MIT 许可证,允许自由商用。该模型在发布后迅速登顶 Artificial Analysis权威榜单,成为首个跻身全球第一梯队的中国自研生成式 AI 模型,并在图像质量、语义理解和艺术表现等方面刷新行业纪录。

核心特性
1. 卓越的图像生成质量
在HPS v2.1评测中,平均得分33.82,超越SDXL、DALL·E 3等主流模型。
支持多种风格(写实、动漫、科幻、肖像等),能精准还原复杂文本描述的细节,如“赛博朋克风格的未来城市中,机械臂在星空下焊接漂浮的桥梁”。
2. 强大的语义理解能力
在GenEval和DPG-Bench评测中表现优异,能准确执行复杂提示词,如“中世纪城堡的石砌城墙,身披铠甲的战士面向镜头,跃动的火焰勾勒出粗犷的面部轮廓”。
3. 高效的推理性能
提供Full(170亿参数)、Dev(平衡版)、Fast(极速版)三个版本,最快5秒/张出图。
采用GAN 辅助的扩散蒸馏技术,在降低计算成本的同时保持高质量细节。
4. 开源且商业友好
采用MIT 协议,允许商用,但部分依赖组件(如 LLaMA3 编码器)需遵守各自协议。
技术架构
基于扩散变换器(DiT)架构,结合稀疏混合专家(Sparse MoE)技术,优化计算资源分配。
集成OpenCLIP ViT-bigG、T5-XXL、Llama-3.1-8B-Instruct等多模态文本编码器,增强语义理解。
采用Flash Attention等优化机制,提升推理速度。
应用场景
艺术创作(插画、概念设计)
商业设计(广告、产品包装)
科研教育(AI 教学、数据可视化)
娱乐媒体(游戏、影视场景生成)。
社区影响
开源24 小时内登顶Hugging Face 趋势榜(图像类第一)。
国际设计工具 Recraft 已集成该模型,支持“一键出图 + 智能编辑”。
配套HiDream-E1(交互式编辑模型),可通过自然语言指令修改图像,类似 GPT-4o 的“言出法随”体验。
HiDream-I1 的推出标志着中国在 AI 图像生成领域的重大突破,为全球开发者提供了高质量、可商用的开源选择。
试用链接:https://hidreamai.com/explore
GitHub:https://github.com/HiDream-ai/HiDream-I1
HuggingFace:https://huggingface.co/HiDream-ai/HiDream-I1-Full