商湯要的是交付成品,不是靠抽卡

問問任何在工作中使用影像模型的人,實際工作起來是什麼樣子,你都會聽到同樣的摩擦。你得到一張喜歡的圖。接著有人要你改裡面的某個字,你就得重來。試了十次之後,結果比你原本那張還糟,而二十分鐘前的那個檔案已經沒了。
商湯科技在 9 月 21 日把正式生產用的 SenseNova U1 Pro 模型放上自家 Raccoon 應用程式,並推出 SenseNova API,而這套說法正是衝著那個摩擦而來。該公司稱它是交付級的多模態代理,而不是影像模型。它想畫出的區別,在於生成一張圖和完成一項任務。
從抽卡到交付
U1 Pro 所描述的工作流程比單純下提示詞更長。它先理解需求,接著搜尋並補齊缺少的資訊,處理手邊素材,生成與編輯,檢查自己的輸出,修正發現的問題,並在交出去之前驗證結果。其主張是,檢查與修正發生在交付之前,而不是在你發現哪裡不對之後。
那是與文字生圖端點不同的產品類別。文字生圖模型回答一則提示詞,然後就停了。U1 Pro 試著回答的是一份需求簡報,而這是更混亂的一件事。一份需求簡報通常意味著一組相關輸出,例如一張海報加上相符的橫幅,再加上一個直式螢幕版本,而且通常會附帶一些必須完全照字面出現的文字要求。
模型的技術做法也由此而來。商湯描述了一種交錯式圖文思維鏈,讓推理步驟與影像成形交替進行,而不是當成彼此分離的階段。版面層級、字體排版位置與圖形元素,都要在生成過程中保持對齊,而不是事後再修補。商湯也列出最高 8K 的輸出解析度與自訂長寬比,瞄準的是大尺寸成品,而不是方形社群裁切圖。
目標工作負載是資訊圖表、海報與建築視覺化。它們有一個共同特性:都承載結構化資訊,而把結構做錯,比畫素稍微偏掉更糟。
它宣稱的基準成績
商湯有排行榜名次可以拿出來說。在 2026 年 8 月的 SuperCLUE 圖像文字生圖排行榜上,SenseNova U1 Pro 以 93.81 位居第一,領先 GPT Image 2 的 93.23,位元組跳動的 Doubao Seedream 5.0 Pro 與阿里巴巴的 Qwen Image 3.0 Pro 緊追在後。中國模型在中國基準測試拿下榜首,是預料中的結果,但它仍然透露了一件事:中國實驗室與美國前沿之間的差距如今已經小到排名會取決於用哪個基準測試。
商湯沒有公布的事更有意思。沒有附上參數量的模型卡,沒有授權條款,也沒有獨立基準測試表。8K 上限與版面配置方面的說法,在第三方重現之前都只是公司自己講的。對一款透過商業 API 出貨的中國企業模型來說,這並不罕見,而這也確實意味著買方是在相信供應商的數字,而不是親自測試。
API 同樣設有門檻。SenseNova U1 Pro 以白名單模型形式提供給企業客戶,必須寄電子郵件申請,無法自助開通。許多中國企業 AI 就是這樣進入市場,而這也形塑了誰能評估它。你沒辦法在週五下午把它開起來自己看。
通往同一個模型的兩道門
商湯透過兩種性格截然不同的管道推出 U1 Pro。消費端是它的辦公套件 Raccoon,模型在其中以「一圖說明」模式出現:貼上一份文件或一組產品照片,要求做出一張海報或說明圖,就能拿回一個完成版畫面。今天任何人都能試用。
企業端則是 SenseNova API,而且只限白名單。公司寄電子郵件申請存取權,商湯再逐一導入。這種把關在中國企業 AI 供應商之間很常見,也形塑了誰能評估這個模型。一家新創公司沒辦法在週五把它開起來,看看它是否適合某條管線。有採購關係的大型客戶可以,而那正是商湯設計來服務的客戶。
這種分流告訴你,這家公司認為產品是什麼。消費端那道門是展示,也是漏斗。企業端那道門才是營收所在,而那道門上的摩擦是特色,不是缺陷:它讓商湯能依客戶而不是依 token 定價,也讓模型不會落到任何會公開壓力測試那些說法的人手上。
為什麼重新定位很重要
U1 Pro 有意思的地方不是解析度或基準成績。而是它主張輸出的單位應該是一份完成的可交付成品,而不是一張生成出來的影像。如果這個主張成立,設計師的工作樣貌就會改變。
今天,要好好使用影像模型,很大一部分在於懂得怎麼抽卡。你要學會哪些提示詞能產出可用結果、編輯該怎麼措辭才不會讓模型毀掉圖片其他部分,以及什麼時候該放棄並手動修。這項技能是真的,但它同時也是一種變通做法。它之所以存在,是因為模型很不擅長把東西完成。
一個會檢查並修正自己工作的模型,會把這項技能從人身上移到機器上。設計師的工作會轉向明確指定成品必須滿足哪些條件,而不是把一次生成引導到可用狀態。這比基準分數跳升是更大的改變,而這也是好幾家實驗室同時推動的方向。阿里巴巴的 Qwen-Image-2.1 把生成、編輯與透明輸出合併進同一個模型,也是出於同樣理由。Ant 的 Ming-Image-Layer 把完成後的設計拆回可編輯元件,也是出於同樣理由。
影像生成領域的競爭,已經不再是哪個模型畫出最漂亮的圖。而是哪個模型留給必須把它交付出去的人最少收尾工作。
信任它之前該檢查什麼
如果你正在評估 U1 Pro,有三件事很重要。8K 輸出在完整尺寸下是否仍保持一致,因為大型畫布正是文字與版面通常會崩掉的地方。模型是否處理你實際發布所用的語言文字,因為資訊圖表的好壞取決於它最小那行可辨識文字。以及自我檢查迴圈是真的抓到錯誤,還是只是把錯誤抹平;後者你只能餵給它帶有已知錯誤細節的需求簡報,看它會不會標出來才知道。
這些是供應商基準測試無法回答的問題。它們也是決定一個模型會進入生產管線,還是留在展示資料夾裡的問題。