泡泡资讯网

商汤旗舰级大模型SenseNova U1 Pro发布,多模态AI走向系统级交付

大模型之家讯 7月18日,在2026世界人工智能大会(WAIC)“基座大模型架构创新与生态合作论坛”上,商汤科技正式发布

大模型之家讯 7月18日,在2026世界人工智能大会(WAIC)“基座大模型架构创新与生态合作论坛”上,商汤科技正式发布了大模型家族旗舰新品——日日新SenseNova U1 Pro(以下简称U1 Pro),定位为业界首个以“理解·生成·行动”原生统一为内核的多模态智能体基座,对标全球顶尖模型GPT-Image 2,并率先支持原生8K分辨率输出。

U1 Pro是“日日新 SenseNova U”系列的旗舰版本,其核心技术突破在于通过内生的图文交错思维链,打破传统多模态模型“先理解、再生成”的模块化拼接方式,在底层实现视觉理解与图像生成的深度统一,从而具备闭环完成复杂长程任务的能力。

U1 Pro具备四大核心交付能力:一是巅峰设计美感,图像生成从“细节逼真”推进到“专业设计美学”的新阶段,作品具备极强的构图、色彩与排版美学,直接实现专业交付品质;二是原生8K超清输出,最高可支持8K原生分辨率输出,轻松驾驭高信息密度的超长、超大图创作,经得起印刷、展览级细节检验。

三是极致的图文与细节控制,在极高信息密度下仍能维持整体版式与内容表达,文字渲染出错率极低;四是长程Agentic闭环思维,基于统一基座内生的理解、生成和行动能力,围绕复杂目标进行数十轮智能体生成循环,并在最新版本中实现了整体风格与局部文本的同步精准可控编辑。

在考验其“系统级交付”实力的高难度场景中,U1 Pro交出了惊艳答卷。在美学叙事方面,U1 Pro交付了一幅4:1超宽画幅的宣纸水墨风东方美学长卷,自然连接起2018至2026年跨越九年的世界人工智能大会发展历程,远看具备统一视觉叙事,放大后文字、图标等细节完美支撑。

在复杂视频创作中,模型自主规划并生成了包含剧情世界观、主角人设、环境色调的整体视觉蓝图,一次性输出22个逻辑一致的连续分镜,配合商汤视频工具实现了人物、剧情和视觉语言的高度可控交付。在数据向视觉转化方面,U1 Pro能将世界杯决赛的晋级路径、核心球员对位、战术体系等高密度推理结果融会贯通,自主生成高清可视化图表,闭环“信息搜集-分析推理-复杂视觉交付”全流程。

行业分析人士指出,U1 Pro的发布标志着多模态大模型正式从传统的“单点式内容生成”迈向“系统级内容交付”新阶段。此前,多模态产品普遍面临“生成结果不可控、需反复抽卡”的痛点,U1 Pro通过原生理解生成一体架构,从根本上解决了这一困境。目前U1 Pro的预览版本已正式邀请测试,正式版本将在今年8月上线对公众开放服务,相应定价和API服务也将同步推出。