7月18日,在2026世界人工智能大會(WAIC)上,商湯科技正式發布了大模型家族的重量級旗艦新品——SenseNova U1 Pro(以下簡稱U1 Pro)。
作為“日日新 SenseNova U”系列的旗艦版本,U1 Pro 定位為面向長程任務的交付級原生多模態智能體基座,實現理解、生成和行動的深度統一。在原生統一架構的基礎上,通過在視覺創作領域的深度迭代,U1 Pro 具備了媲美全球頂尖模型的“交付級”復雜圖片創作能力,擁有廣闊的應用空間
U1 Pro的問世,標志著多模態 AI 正在迎來一場深刻的“長程演進”:行業正式告別傳統的“單點式內容生成(Generation)”,全面邁向能夠閉環完成復雜、長程任務的“系統級內容交付(Delivery)”新時代。
多模態演進第三階段:攻克“抽卡”痛點,定義“交付級”新標準
正如代碼產品已率先走通了“從 Copilot 工具輔助,到 Vibe Coding 意圖驅動,再到 Agentic Coding 系統級任務交付”的路徑,多模態產品也正在經歷相同的長程演進:第一階段解決“真實感生成”的問題,到第二階段能夠以自然語言交互,并持續修改,實現多模態創作進階,再到第三階段能在真實場景中,直接完成“交付級”創作,完美兼顧設計美感和內容精準,解決反復抽卡的困境。
然而能交互,不等于能交付。 旗艦版 SenseNova U1 Pro 圍繞“一個復雜目標,持續理解、規劃、執行、檢查和修正”,帶來了四大核心交付能力:
?巔峰設計美感,告別“AI味”:圖像生成從“細節逼真”推進到“專業設計美感”的全新階段,作品具備極強的構圖、色彩與排版美學,直接實現專業交付品質。
?原生 8K 超清輸出:最高可支持 8K 原生分辨率輸出,輕松駕馭高信息密度的超長、超大圖創作。畫幅放大后,文字、線條、圖標和模塊關系仍然清晰穩定,經得起印刷、展覽級細節檢驗。
?極致的圖文與細節控制:大幅加強了圖文信息整合分析能力。在極高信息密度下,U1 Pro 仍能維持整體版式與內容表達,文字渲染出錯率極低。
?長程 Agentic 閉環思維:基于統一基座內生的理解、生成和行動能力,支持長程圖文交錯思維,能夠圍繞復雜目標進行數十輪的 Agentic Generation Loop(智能體生成循環)。并在最新版本中,進一步實現了整體風格與局部文本的同步精準可控編輯,讓交付結果可被持續修改與使用。
技術基石:NEO-unify 架構與原生視覺底座的深度融合
SenseNova U1 Pro 之所以能夠突破“生成”邊界、走向“穩定交付”,其底層核心得益于 NEO-unify 內核架構在原生多模態體系中實現語言和視覺的統一表征,打破了理解與生成的割裂壁壘。
商湯今年4月開源了基礎模型 SenseNova U1。開源兩個多月以來,在真實高強度工作流實踐中,U1 迎來了爆發式增長。今年6月,U1的用戶人均日生圖量相比5月提升近3倍,表明模型已深度切入真實應用工作流。截至7月中旬,SenseNova U1以及集成了U1能力的SenseNova-Skills代碼庫在GitHub的總 Star 數突破8000。
同時,商湯開源的 SenseNova-Vision 統一視覺大模型,基于原生統一架構,讓經典視覺任務如實例分割、目標檢測等,直接成為通用大模型的原生能力,告別了傳統“多專家模型拼湊”的局限。商湯在視覺 AI 領域十余年的技術沉淀,也為多模態長程智能體提供了堅實的世界理解底座。
![]()
真實物理世界大考:高難度場景實戰檢驗
在考驗其面向復雜多模態任務的“系統級交付”實力中,SenseNova U1 Pro 在美學敘事、邏輯控制以及硬核數據推理三大高難度場景,交出了驚艷的答卷:
高信息密度視覺敘事:WAIC九周年《智會世圖》東方山水長卷
U1 Pro 最終交付了一幅 4:1 超寬畫幅 的宣紙水墨風東方美學長卷,圖中包含豐富的河流、山脈、城市地標與高密度小字信息,遠看具備“統一視覺敘事”,放大后看大量文字、圖標等設計細節完美支撐,自然連接起 2018 至 2026 年 跨越九年的世界人工智能大會發展歷程。
![]()
可控視頻創作:《沙影之刃》世界觀設定與 22 鏡分鏡
在復雜視頻創作任務中,模型不再只是依靠隨機抽卡拼湊鏡頭,而是率先自主規劃并生成了包含劇情世界觀、主角與敵人人設、服裝武器、沙漠環境色調在內的整體視覺藍圖,并一次性輸出多達 22 個邏輯一致的連續分鏡。在此基礎上,配合商湯視頻工具,實現了人物、劇情和視覺語言的高度可控交付。
![]()
硬核邏輯推理與復雜交付:世界杯黑馬預測與決賽全景復盤
商湯“小浣熊”依托專屬 Skills 進行持續分析,在2026年世界杯開賽前一個月,成功預測本屆最大黑馬——佛得角出線,在 12 家參與預測的大模型中高居第二。
同時,U1 Pro 展現了極強的“數據向視覺轉化”能力。它能將復雜的體育戰術及數據——如世界杯決賽雙方的晉級路徑、核心球員對位、戰術體系、傳球網絡及觸球熱力圖等高密度推理結果融會貫通,自主生成一張高清的可視化圖表報告,完整閉環了“信息搜集-分析推理-復雜視覺交付”的全流程。
![]()
賦能生產力底座:重塑個人、組織與企業單元
作為一個極具通用性的多模態基座,SenseNova U1 Pro 正在重塑辦公、電商、教育等每一個生產單元:
?商業與辦公:企業信息圖、高品質商業演示文稿(PPT)的自動化與精準交付。
?品牌與電商:商業海報、產品宣傳視覺的專業級美學輸出。
?教育與出版:高精度科學圖解、教學用圖像的無錯漏繪制。
?創意內容創作:電影影視概念設計、動漫分鏡腳本等數字藝術創作,大幅縮短創意與專業制作之間的距離。
同時,該能力在商湯旗下的產業級AI “小浣熊” 及視頻創作工具 “Seko” 中已得到深度驗證,幫助數以千萬計的個人用戶、接近一萬家企業用戶以及大批AI原生組織,將自身經驗、興趣和創意轉化為可規模化復用的真實交付成果。
即日起,商湯科技 SenseNova U1 Pro 的預覽版本已正式邀請測試,并將隨著推理服務資源擴大逐步放開邀測范圍。模型的正式版本將在今年 8 月份正式上線對公眾開放服務,屆時相應的定價和 API 服務也將同步推出。
我們相信在“理解、生成、行動”原生統一架構下,“視覺和語言的聯合涌現”將加速實現,最終為物理世界的 AGI 構建全新的通用智能底座。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.