首页财产ai正文 会写字、懂排版、能分镜:HiDream-O1-Image-1.5 万能图象天生能力解析 智象将来全新推出的HiDream-O1-Image-1.5实现SOTA,于全世界知名平台登上中国图象天生模子第一,揭示万能图象天生能力,推进原生全模态架构成长。 2026-06-10 20:36 ·投资界综合 AI投资人解读· 智象将来全新推出的商用邦畿像天生模子HiDream-O1-Image-1.5于全世界知名评测平台登上中国图象天生模子第一,评分仅次在OpenAI。该模子揭示出万能图象天生能力,将底层架构上风转化为视觉出产力东西。 · 行业竞争激烈,其他年夜模子公司可能迎头追逐模子于真实内容出产使命中的体现有待不雅察。 总结:智象将来的HiDream-O1-Image-1.5模子实力强劲,具备投资潜力。但需存眷行业竞争动态和模子于现实出产中的体现,建议连续跟踪其技能迭代与市场运用环境。内容由AI天生,仅供参考
近日,智象将来(HiDream.ai) 全新推出的商用邦畿像天生模子 HiDream-O1-Image-1.5 再次实现 SOTA,于全世界知名自力 AI 模子评测与阐发平台 Artificial Analysis的文生图榜单(Text to Image Leaderboard)上,一举登上中国图象天生模子第 一,成为评分仅次在OpenAI的中国年夜模子公司,逾越Google Nano Banana 2(Gemini 3.1 Flash Image Preview)、NVIDIA Cosmos3-Super-Text2Image 及字节跳动的Seedream 4.0等海内外年夜厂的主流图象天生模子。


半个月前,智象将来HiDream-O1 系列的开源模子 HiDream-O1-Image-Dev-2604 方才登顶文生图榜单开源模子全世界第 一。数周以后,HiDream-O1-Image-1.5再次进入全世界文生图年夜模子榜单前三,持续登顶不仅印证了智象将来于图象天生年夜模子上的硬核实力,更标记着其已经于视觉天生年夜模子的比赛中稳居全世界第 一梯队阵营。
Artificial Analysis 的 Text to Image Leaderboard 采用匿名对于比、用户投票及ELO动态排名机制,只管即便削减品牌认知对于评测成果的影响,更靠近真实用户于开放天生场景中的偏好判定,于这一专业评测系统下,HiDream-O1-Image-1.5于跨越4000 个样本对于比中取患上1265 ELO。HiDream-O1-Image-1.5 的体现不仅表现了模子于图象质量上的竞争力,也反应出其于语义遵照、繁杂画面天生、文字衬着及多主体节制等综合能力上的晋升。
HiDream-O1-Image-1.5 的再度 SOTA, 不只是中国领 先年夜模子公司的又一次全世界榜单领 先,它更标记着智象将来于业内率先把立异的原生全模态架构Unified Transformer (UiT)从“技能验证”推进到“出产验证”,是 HiDream将底层架构上风转化为视觉出产力东西的要害一步:开源版本证实了像素级原生全模态架构可以于开放评测及开发者社区中跑通,HiDream-O1-Image-1.5 商用版本则进一步面向告白营销、品牌设计、电商视觉、游戏内容、影视分镜、IP 创作等更高要求的贸易场景,周全展示了强化的图象质量、文字衬着、繁杂排版、多主体一致性及视觉叙事能力。
。接下来,真正值患上存眷的,是它于真实内容出产使命中的体现。
01 会写字、懂排版、能分镜,HiDream-O1-Image-1.5 揭示万能图象天生能力
1. 人像摄影生图实例:摄影级画质与多气势派头表达
于人像生图场景中,HiDream-O1-Image-1.5 揭示出不变的摄影级画质及多气势派头适配能力。从魔幻光影、双人互动到人物特写,模子于皮肤质感、衣饰纹理、肢体瓜葛及情况虚化等细节上体现天然;纵然面临广角、低机位、室内暖光等繁杂构图,也能连结人物比例、空间透视与画面叙事的协调。表现出头具名向贸易人像、品牌视觉及影视分镜等高要求场景的强交付能力。

2. 动物生图实例:运动形态与天然情况的邃密建模
于动物生图场景中,HiDream-O1-Image-1.5 揭示出对于主体形态、运动状况与天然情况的邃密建模能力,于动物布局、外相质感、动态体现和繁杂光照、水下折射等高难度画面中连结真实感与视觉打击力,表现出头具名向天然影像、品牌视觉、游戏资产及创意内容出产等场景的出产级交付能力。

3. 天然风景生图实例:空间与光影变化的邃密捕获
于天然生图场景中,HiDream-O1-Image-1.5 揭示出对于年夜场景空间条理、光影变化与情况气氛的精准节制能力,于雪山湖泊、戈壁驼队、晶体洞窟等繁杂地貌与多光源场景中连结纵深感、影戏感及细节体现,表现出头具名向游览视觉、影视观点图、游戏场景及品牌流传等繁杂商用处景的不变交付能力。

4. 多种艺术气势派头:切确的气势派头理解与视觉表达
于多气势派头艺术天生场景中,HiDream-O1-Image-1.5 揭示出优异的气势派头理解、语义遵照与视觉表达能力,可于日系插画、动漫战斗、卡通海报及国风武侠等气势派头间正确切换,并连结脚色造型、构图瓜葛、动作节拍与画面气氛同一,同时于繁杂姿态、动态特 效及基础文字衬着上具有较强不变性。可为IP 创作、漫画分镜、游戏美术、品牌创意视觉提供高效的出产撑持。

5. 电商海报生图实例:繁杂画面与文字信息无缝交融
于电商海报天生场景中,HiDream-O1-Image-1.5 揭示出对于商品主体、版式布局与文字信息的综合把控能力,可针对于差别品类快速匹配视觉气势派头,并天然交融商品、场景、装饰元素与营销案牍;于中英文混排、多层级卖点及繁杂排版使命中,仍能连结较高的文字可读性、画面完备度与贸易质感,显著晋升告白营销、电商上新、社媒种草及品牌物料建造效率。

6. IP形象设计:多视角天生与脚色一致性
于IP 形象设计场景中,HiDream-O1-Image-1.5 揭示出对于脚色设定、心情变化与多视角一致性的不变节制能力,可缭绕统一脚色天生多角度视图及多种情绪心情,并连结五官、发型、衣饰与总体气势派头同一,出现富厚的性格与体现力,可显著晋升IP 设定、脚色三视图、动画前期、美术资产及品牌吉利物开发的效率。

7. 多宫格/分镜设计图:不变叙事理解与持续画面天生
于多宫格与分镜设计场景中,HiDream-O1-Image-1.5 揭示出对于持续叙事、画面挨次与信息层级的理解能力,可于东西流程、使命推进、儿童绘本及冒险故事等多画面内容中天生逻辑联贯的分镜画面,并连结脚色、场景与视觉气势派头同一;同时对于宫格结构、编号、标题及要害文字具有较强构造能力,可为影视分镜、漫画创作、告白剧本、教诲内容及短视频剧本视觉化提供高效撑持。

8. 多条理繁杂文字衬着能力:多语言,多布局的综合天生能力
于多条理繁杂文字衬着使命中,HiDream-O1-Image-1.5 揭示出对于多语言文本、信息布局与视觉场景的综合天生能力,可将海报、规划书、布局拆解图、讲堂白板、直播界面及数据看板等内容天然嵌入对于应场景,并统筹排版秩序、图文瓜葛与总体美感;面临中英文混排、数字公式、图表信息及多级标题等繁杂需求,仍能连结较好的可读性与版面不变性,拓展了其于告白设计、办公协作、电商详情页及教诲培训等场景的实用价值。

02 原生全模态进入出产验证阶段,HiDream-O1-Image-1.5连续放年夜UiT 架构上风
HiDream-O1-Image-1.5 的体现,进一步证实了智象将来于原生全模态线路上的架构立异上风及快速迭代能力,HiDream-O1 系列(8B 开源版、Pro 版到 1.5 商用版)已经经形成清楚而高效的能力演进曲线。
传统文生图模子凡是采用“文本编码器 + VAE + DiT / 扩散模子”的模块化路径,其形态更像一棵不停分叉生长的树:文本有本身的 tokenizer,图象及视频有各自的 encoder / decoder,音频、动作、空间瓜葛也往往沿着差别路径被处置惩罚,模块之间需要屡次转换信息。于文字密集排版、UI 页面、多主体天生、多参考图节制、多分镜叙事等繁杂使命中,也更易带来细节损耗、语义错位及布局不不变。
HiDream-O1 原生全模态架构走的是另外一条线路:真实的“原生全模态”,不是各个模态长年夜以后二次拼接,而是从原生初始阶段就像“两小无猜”一般于模子底层水乳相融。HiDream-O1 的 Image系列模子剔除了了传统路径中的 VAE 及自力文本编码器,将图象像素、文本 Token、视频体素以和音频、动作、空间瓜葛等原始旌旗灯号映照进统一个同享 Token 空间,直接与统一套 UiT——像素级同一的 Unified Transformer 交互,于同一表征体系中完成理解、天生及推理。
如下为X平台Artificial Analysis 官方账号发布的一组对于比效果图:

这也是HiDream-O1 可以或许于繁杂图文交融、文字衬着、多主体一致性及分镜叙事等使命中连续进阶的要害。当所有模态于底层被真正买通,模子才有可能走向真实的“Any to Any”:肆意输入撑持肆意输出。这不仅是图象天生模子的能力进级,也是世界模子所需要的基础能力——于同一架构中理解、天生并猜测实际世界的差别状况。HiDream-O1-Image-1.5 的快速进阶,恰是对于原生全模态这一起线可扩大性的坚试验证。
03 连续架构立异,构建原生全模态世界模子
智象将来始终认为,图象是通向视频天生及全模态世界建模的主要进口。一张图象承载着实际世界某一时刻的主体、空间、材质、光影、文字及瓜葛;只有不变理解并天生这些状况,模子才有可能进一步处置惩罚持续时间中的运动、因果、镜头及叙事。
HiDream-O1-Image-1.5强势体现申明,基在像素级原生同一架构的线路,正于把图象天生模子的竞争从“更年夜参数”及“更都雅画面”,推进到由架构能力、出产效率及事情流价值配合决议高度的新阶段。它不仅晋升了单图天生效果,也为多图一致性、分镜天生、视频首帧、图象编纂以致将来长视频天生提供了更不变的底层能力,进一步证实了中国年夜模子企业介入全世界顶 级打模子竞争的实力,也验证了 UiT 原生同一架构作为下一代多模态模子坚实底座的可行性。
面向将来,智象将继承沿着原生全模态技能线路推进模子迭代,加快图象、视频、动作等多模态能力的交融,鞭策天生式人工智能技能深切落地到内容创作、贸易营销、影视创作、游戏出产等全模态智能体的真实运用场景。从单张图象天生的进口到持续世界建模,智象将来正于以连续的底层架构立异,构建下一代内容出产与智能交互的人工智能基础举措措施。
【本文经授权发布,不代表投资界态度。本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。-雷火·竞技