![]()
AI 生圖最擅長的事情,已經從「畫一只貓」變成了「畫一只穿著宇航服站在月球,背后還有地球的貓」。只要描述得足夠明確,它總能給我們幾張看上去很不錯的圖片。
但把任務換成一張真正要用的海報,麻煩很快就來了。
![]()
▲這張由其他模型生成的高濃度產品排期圖,超過 20 個文字渲染 Bug
標題、日期和地點這些關鍵的信息不能漏,展示產品的名字、配料和價格要一一對應,Logo 得放在正確的位置,畫面還要有明確的閱讀順序。到了學術海報和工業圖解場景,模型還得處理數據、圖例、單位、結構編號和密密麻麻的小字。
對普通生圖模型來說,100 個字錯一個字是 99 分;對交付級生成來說,錯一個字,這張圖就是 0 分。
設計師依然離不開 Photoshop、Illustrator 和 Figma 等工具,原因就在這里。生成一張好看的圖片,與完成一份設計任務,中間還隔著信息整理、視覺規劃和成品排版。
![]()
前幾天,商湯在 WAIC 上正式發布了日日新 SenseNova U1 Pro,是業內首個將「理解·生成·行動」原生統一的多模態智能體基座模型。
商湯首席科學家林達華曾形象地形容它:「U1 Pro 它不只是一個生圖模型,它是在數字空間里打造出來的一個設計師,它會沿著思考去創造一個具有美學感的成品,一步一步去完成這個工作。」
不同于常規的娛樂級 AI 生圖,U1 Pro 支持原生 8K 輸出,面向復雜中文、信息圖、商業海報、學術設計和工業圖解等高密度專業「設計」場景,主打面向復雜的長程任務,能直接提供可投入生產使用的「交付級」高精度視覺內容。
![]()
▲ 提示詞:生成一張 21:9 橫版、原生 8K 的中文體育報紙號外,報紙名稱《終場 WHISTLE》,主標題必須逐字寫為:《西班牙,2026 世界杯冠軍!》副標題必須逐字寫為:「1–0(加時賽)擊敗阿根廷,在紐約新澤西捧起冠軍獎杯」。整體采用高級體育報紙、紀實攝影和現代信息圖結合的風格。頂部使用超大黑體呈現冠軍標題,主標題必須醒目、清晰、完整,不得改變球隊名稱、年份或標點。(省略部分提示詞)
APPSO 提前拿到了 U1 Pro 的測試資格,從模型的各項能力到具體的應用場景,這次,我們不讓它畫一些任由它自己發揮的簡單信息圖。
我們準備了十多份接近真實項目的設計 Brief:世界杯賽況長圖、城市暴雨避險圖、AI 創作工具全景圖、科技活動海報、咖啡菜單、SaaS UI/UX 界面、學術海報、建筑競賽展板和工業機器人圖解。
每份提示詞都長得讓人想先開個會,U1 Pro 能不能把它們直接變成一份像樣的設計成品?
8K、中文和排版,這些才是設計剛需
2026 FIFA 世界杯剛剛落下帷幕,我們先用一張長圖來測試一下 U1 Pro 能生成的極限比例。
提示詞要求 U1 Pro 輸出精確 8:1 的單幅設計,優先尺寸為 8192×1024。畫面上方是一條從 6 月 11 日開幕延伸到 7 月 19 日決賽的標題帶,中部要連續排列 104 個比賽節點,下方還要放入 48 支球隊、3 個主辦國家和 16 座主辦城市等規模數據。
![]()
光是這些內容要求一個文字模型輸出,可能都容易出錯,比賽的數據、球隊的信息,稍微不仔細可能就錯了。現在要求一個圖像模型來創作,不僅要準確還要美觀好看。
模型要完成的是一屆世界杯的結構:小組賽 M01—M72、32 強賽 M73—M88、16 強賽 M89—M96、四分之一決賽 M97—M100、半決賽 M101—M102、季軍賽 M103,以及決賽 M104。
![]()
![]()
![]()
![]()
U1 Pro 實際數據比例和像素尺寸與我們的提示詞要求完全一致,同時 104 個編號、16 座城市,小字在 100% 放大時清晰度,全部做到了完整齊全。
最近,WAIC 在上海舉行,我們就順勢要求 U1 Pro 生成一張 City Walk 的路線圖,把 AI 帶進石庫門、酒吧、音樂廳、影視基地和機器人訓練場。
![]()
我們讓 U1 Pro 把 8 個重點體驗地點畫成一張了 8192×2048 的 4:1 上海長圖:機器人在張園做咖啡,在 AGI Bar 調酒,在上海影視樂園舉起場記板。
![]()
![]()
![]()
![]()
OPC 同樣是今年的熱點,一個一人公司成了未來科技的重點方向。
我們索性為一個人畫了一棟 10 層辦公樓:樓里有產品、研究、設計、開發、內容、市場、銷售、客服、財務法務和運營十個部門,每層 10 個 AI Agent,總共 100 個。
這張圖要求原生輸出 7680×4320。遠看是一棟透明的未來辦公樓,放大后應該能數清每層機器人,讀懂中文部門名稱,還能看見設計機器人爭論兩種藍色、開發機器人圍著 Bug 排錯之類的小故事。
![]()
U1 Pro 的超寬比例和 8K 都非常實用,而且上面的測試,我們都是零抽卡,一次性生成。即便是各種微小的漢字,U1 Pro 都能做到準確地渲染。
而一張信息圖只能證明模型會處理很多字。設計師真正難替代的地方,還在于他知道不同場合該長什么樣。
所以第二組測試,我們給了 U1 Pro 兩份內容密度相近、氣質完全不同的任務。
一張是《暴雨來襲,城市居民應急避險指南》。畫面要讓居民迅速看懂四級預警、居家避險、外出避險和被困后的行動步驟,視覺必須克制、可信,警示信息要一眼可見。
![]()
另一張是《2026 AI 創作工具全景圖》。它要把文字、圖片、視頻、聲音和 3D 工具放進同一條創作流程,使用深色科技編輯風格,既有產業地圖的密度,又不能寫成企業發布會 PPT。
![]()
兩張圖片的色彩、網格和閱讀順序,都有根據傳播對象今天調整設計,并不是用一套模板套在了不同的內容上。
接下來換到商業設計上,U1 Pro 通用能根據品牌、行業和受眾切換視覺語言。
我們準備了一張科技沙龍海報、一份日落海邊風格的精品咖啡菜單,以及一張融合蘇繡、竹編和桃花塢木版年畫的非遺夜游節主視覺。
![]()
科技活動需要冷靜和銳利,咖啡菜單要讓六杯飲料看起來足夠可口,非遺海報又要避開文旅紀念品常見的元素堆砌。
![]()
三張圖放在一起,提示詞里面的固定文案、菜單名字、價格和活動信息都準確的呈現出來,三張圖的字體、構圖和顏色也有明顯的差異。
![]()
平面設計之外,我們又讓 U1 Pro 生成了一套個人知識管理應用界面。
頁面里有導航欄、全局搜索、數據卡片、任務列表、桑基圖、最近筆記和 AI 助手輸入框。它需要像產品設計師一樣考慮信息密度、組件對齊和用戶視線等元素。
![]()
接著我們還讓 U1 Pro 做了一些比單純的設計更加專業的工作,學術海報和工業機器人圖解。
![]()
學術海報包含作者、研究單位、研究方法、三張數據圖表和項目統計。工業機器人圖解則要求模型畫出盾構機的爆炸結構,用 01—12 標記刀盤、管片、皮帶等運輸系統,同時放入刀盤局部爆炸圖、100% 細節放大窗和隧道是怎么形成的。
這類圖最容易出現的尷尬是遠看很專業,近看每個數字都在自由發揮。
![]()
我們核對了圖標數據和單位,U1 Pro 基本上都沒有胡編亂造,并且再小的內容我們都能看清,整張圖的大小來到了 12MB。
這大概也是原生 8K 最大的意義,一張普通風景圖變得更大,讀者很難感受到它對工作有什么幫助。
建筑展板、學術海報和工業圖解卻需要在同一畫面中容納總平面圖、剖面、圖表、說明文字和工程標注。分辨率決定了這些細節能否被看清,也決定了圖片能否進入大屏、印刷和專業展示。
從生成圖片到接下一整份設計需求
看完這些案例,U1 Pro 所說的「交付級設計」就容易理解了。
它首先交付的是信息。AI 產品發布作戰圖和暴雨避險圖都塞進了大量中文、數字和行動步驟。
畫面好看只占一半,另一半是模型有沒有理解內容之間的關系:哪些任務存在先后依賴,比例數據該放進什么圖表,警告信息應該出現在哪個位置。
![]()
過去,內容創作者可以讓 AI 幫忙寫文案、找配圖,最終仍要把文字一塊塊搬進設計軟件;如果模型能直接完成信息組織,省下的是從資料到版面的整段工作。
有時候在社交媒體上搜索各種旅游攻略,旅行社的廣告很快就會聯系上來,然后發一份預制的 PDF 過來,內容全是文字難閱讀不說,讀完也很難對整趟旅程有一個清晰的大致印象。
U1 Pro 的可交付在這個時候就顯得尤為重要。無論是導游還是我們自己,都可以用一句提示詞就生成一張包含地圖信息、路線信息、熱門景點以及預算等內容的導游圖。
![]()
▲ 提示詞:我有 7 天時間,8.21 07:15 抵達伊斯坦布爾,8.30 05:05 抵達廣州白云機場,我可以怎么安排我的行程,我不會開車,你可以幫我做一張地圖導游圖嗎,同時還要加上開支預算這些預計花費的計算,幫我看看大概要多少錢。
這張導游圖還可以作為一個模板,針對不同的客戶,不同出發地點時間,停留時間進行修改。對導游來說,每一個客戶都可以直接快速給他們做一套同樣視覺的方案。
而如果已經有明確的旅游方案,U1 Pro 的交付級設計功能,也能將下面一段超過 2000 字的「吐魯番汽車一日游產品說明」做成一張準確、精美、有設計感的旅游路線圖。
![]()
第二類交付的是商業,活動海報、咖啡菜單和非遺主視覺面對的是不同生意。
這些內容需要遵守品牌氣質,也要準確放入時間、地點、價格和活動內容。結果如果穩定,適用場景會從公眾號封面擴展到活動物料、社交媒體廣告、電商素材、門店菜單和文旅宣傳。
![]()
對這類用戶來說,最有吸引力的除了「AI 會不會畫」,更多的是一個人能否獨立完成過去需要文案、設計和插畫配合的輕量項目。
第三類是專業交付,UI、學術海報、建筑展板和工業圖解的門檻明顯更高。
模型需要懂網格與組件,也要處理圖表、單位、結構和空間關系。它們未必會立刻取代專業軟件,但可以先承擔方案草擬、匯報展示、內部溝通和視覺化說明。
![]()
U1 Pro 現階段的「交付級」,主要體現在它能否理解一份復雜需求,自行組織信息與視覺,并一次生成高完成度成品。
至于后續修改、源文件和完整設計工作流,商湯表示 U1 Pro 已經把編輯能力放進模型內部的創作循環,但首發版本暫時只向用戶開放生成。
![]()
可直接操作的交互式編輯功能仍在打磨,預計在 2026 年內上線。
商湯把 U1 Pro 的底層方向概括為「理解、生成、行動」的原生統一。放在這次實測里,「理解」對應各類長短提示詞和復雜內容,「生成」對應視覺結果;「行動」具體包含模型在設計流程中自主規劃和修改。
雖然目前出圖的時間還是比較久,針對一些超長提示詞,U1 Pro 需要十幾分鐘甚至半個小時的時間,但就像林達華說的一樣,「它當前出一張圖可能要十分鐘的時間,但確實十分鐘之后,你就真能拿出去用了。」
未來的圖像模型,是一座印刷廠
過去幾年,AI 生圖模型一直在卷幾個維度:分辨率、風格多樣性、圖像質量、文本理解能力。GPT-Image-2 把這些維度都推到了相當高的水平,但如果圖像模型只是繼續在這些維度上堆參數,邊際收益會越來越小。
U1 Pro 指向了一個不同的方向,要畫更好的圖,但更需要畫出能用的圖。
![]()
這個「能用」在這次的實測里,也很容易能概括為這些層面:
- 分辨率夠用:能直接印刷、能直接用于后期流程,不需要放大和重繪
- 內容精準:中文不糊字、排版不錯亂、信息不丟失
- 可修改:能聽懂修改意見、能局部調整、不需要每次重抽
- 可成套:能保持一致性、能批量產出統一風格的物料
這些能力加在一起,大概才構成了商湯所說的「交付級」。
![]()
內容創作者可以直接嘗試信息圖、封面和活動物料;小團隊能更快制作菜單、宣傳圖和匯報材料;專業設計師也可以用它探索版式與方向,把時間留給判斷、篩選和真正需要經驗的部分。
![]()
▲官網鏈接:https://www.sensenova.cn/u1-pro
SenseNova U1 Pro 目前面向開發者和企業用戶提供 MaaS 服務,采用異步圖像生成 API:提交提示詞與生成參數后,平臺會返回任務 ID,再通過結果接口獲取圖片。
需要調用模型的用戶,可以進入商湯日日新官網,登錄開發者控制臺,查看模型服務的開通狀態與最新接口文檔。
在商湯日日新官網和商湯小浣熊平臺,我們也能體驗到 U1 Pro,并結合商湯其他產品,實現更多任務的可交付。
體驗地址:https://www.sensenova.cn/u1-pro
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.