Nanosaur 2 與無人能解的開放權重難題

一篇標題為「全新未審查圖像模型!Nanosaur 2 正式發布!」的貼文,成為本週 r/StableDiffusion 中獲得最多讚數的投稿,短時間內累積 336 個讚與 98 則留言。這次發布本身只是這條長長隊伍中的一員:那些移除託管服務強制安全篩選器的開放圖像模型。讓這一刻值得落筆的並不是模型本身,而是每次有模型發布時就會爆發的爭論——因為社群從未解決它,而且大概也解決不了。
本地社群內部的分裂
在 r/StableDiffusion 待上一段時間,你會發現兩種文化共用同一個 subreddit。一派把未審查權重視為原則:模型跑在我的硬體上,訓練資料是我能檢視、至少能稽核的,而我生成的內容是我的責任,就像我工作室裡任何其他工具一樣。另一派則把同樣的發布視為負債:這些模型的存在就是為了產出託管平台禁止的內容,產出結果會落到真實的人身上,而每一次未審查發布,都讓所有其他在本地跑模型的人所處的法律環境更糟。
兩派都在 Nanosaur 2 的討論串中現身。讚數顯示這次發布吸引了廣泛的受眾。留言一如往常地分成兩類:技術討論,以及關於後果的老調重彈。雙方都沒有說服對方,而這些討論串向來就是這樣收場。
認真看待責任論
原則派的立場確實有實質內容。本地生成意味著沒有 API 紀錄、沒有服務條款的反覆變動、沒有突如其來的模型下架——就像八月 DALL·E 獨立產品被退場、併入 ChatGPT Images 那樣。託管服務的使用者眼睜睜看著功能在訂閱期間被抽走。開放權重是對抗這種波動的唯一持久解方,而那個為 Qwen Image 2.1 能在筆電上跑而歡呼的社群,歡呼的是發布機制,不是任何特定產出。
反方論點同樣有實質內容。一個移除篩選器的模型,把製作未經同意的肖像以及其他類別傷害的成本降到近乎為零,而 r/StableDiffusion 上那則詢問大家如何生成某位特定演員的逼真肖像的討論串——在 Nanosaur 發布前幾天貼出——正顯示這種做法已經多麼稀鬆平常。傷害並非假設;人們在公開場合問的問題,只是私底下所發生之事最溫和的版本。
這個模式有歷史可循
這套動態並不新鮮,這也是為什麼社群裡的爭論聽起來如此像背好的台詞。加密技術經歷過一模一樣的循環:一項政府想要控制的技術能力,最終仍由開源專案散布出去,接著是數十年關於責任的爭論,最後的落點正是開放權重之爭現在走向的地方——技術被當成既成事實,爭議轉向行為層面。檔案分享、3D 列印槍枝、越獄手機都演過類似的變奏。每一次的教訓都一致:數位產物的存取控制一定會徹底外洩,而可持續的政策攻防發生在邊緣——散布管道與可證實的傷害——而不是在產物本身。
圖像生成版本演進得比前幾代更快,因為產物很小。一個 7B 量化圖像模型只有幾 GB,一個種子檔、一支 USB 隨身碟就能裝。微控制器實驗讓「小到極限」變成字面上的事實:如果壓縮流程最終能把可用的生成能力放進一顆兩美元的晶片,那麼圍堵從來就不在選項裡。
審核紀錄顯示了什麼、又沒顯示什麼
託管服務把自家的審核當成替代方案,而實際紀錄確實好壞參半。平台攔截了很多,關鍵字過濾與提示分類器擋下明顯的嘗試,而中國法院審理的超人力霸王(Ultraman)相關案件則顯示,平台會因其過濾器未能攔阻的產出而被追究責任,責任歸屬取決於服務提供者是否有完善的申訴機制與警示。這些判決對這場爭論是把雙面刃:它們顯示託管式審核在法律上具有意義,也顯示它是千瘡百孔的。
開放權重這一邊沒有可比的紀錄可以拿出來,這就是誠實的缺口。志願社群管理的是討論與禮儀,不是產出,因為產出在本質上就是不可觀測的。Nanosaur 討論串的留言區,是那個生態系裡最接近治理的東西:人們公開爭論社群會祝福什麼、不會祝福什麼。它很單薄,但這種每週都在調整的單薄治理,具備某些緩慢的制度流程所沒有的特性。
發布數據透露的需求
Nanosaur 2 周遭的互動模式,值得比標題數字更仔細地解讀。在一個對炒作記憶長久的 subreddit 上拿到 336 個讚,代表廣泛的被動關注,但真正做工的地方在 98 則留言裡。過去的未審查發布都遵循同樣的弧線:一波關於架構與記憶體占用的技術討論、一波憂慮,以及一條長尾的使用者詢問硬體需求的實務問題。這裡測量到的需求不是針對任何特定內容,而是對掌控權的需求——能夠執行一個行為不由託管平台政策團隊決定的模型。
這種解讀與這個月其他證據一致。AI Horde——這個自 2022 年運作至今的志願推論網路——本月推出了新的介面與後端,依然找到受眾。EasyAI 為初學者打包了 ComfyUI。Qwen Image 2.1 的移植版本大量湧現。這些專案每一個之所以成長,都是因為人們想要能向自己負責的生成能力,而每一個也都繼承了 Nanosaur 發布所暴露出的同一個治理真空。
為什麼這場爭論永遠無解
僵局持續,是因為雙方在不同的層次上都對。在工具層,開放權重已成定局;量化模型現在能在微控制器上跑,那麼在筆電上當然也跑得動,沒有任何政策能讓一個種子檔倒轉。在規範層,社群正在做真正的工作:r/StableDiffusion 的使用者比外人更嚴厲地監督未揭露的擬真內容,創作者爭論該如何揭露,而關於肖像與風格的禮儀正一個討論串一個討論串地成形。在法律層,法院才剛開始理清,而目前的結果都獎勵那些留下流程紀錄的人——這個標準完全跨越了審查之爭。
還有一個社群很少點名的經濟層面。託管平台負擔得起審核預算;發布權重的志願維護者負擔不起,這意味著開放生態系把安全工作量外包給終端使用者與論壇文化。這行得通,直到行不通為止。到目前為止,最接近制度化答案的做法在散布層:模型中心把授權與使用政策附在權重上,藉此形塑誘因,而不假裝能阻止任何事。
一個有幫助的區分
一個有用的框架會區分能力、取用與使用。開放權重改變的是取用;它們不改變底層能力是什麼,因為同樣的內容只要花足夠力氣,在託管服務上也能生成,只是會被記錄並計價。把爭論框成「這東西該不該存在」,是在打能力層——那是沒人控制得了的一層。真正能推動任何事情的爭論發生在取用與使用層:模型如何散布、預期要有什麼揭露、製造傷害的人會面臨什麼。那也是社群自身能量早已投注的地方,無論它有沒有把這個框架說出來。
讀者能從這波發布週期帶走什麼
如果你使用本地模型,這個月討論串給出的實務指引相當一致。為你的作品保留來源紀錄,因為一旦產出所有權受到質疑,保護你的是流程紀錄;到目前為止在中國與其他地方的法院案件,關鍵更多在於文件紀錄,而不是圖像本身。在受眾可能合理假設並非合成的地方揭露合成內容;最能妥善處理反 AI 反彈的創作者,就是那些從來不必被逮到的人。並且要假設你生成的每一張圖,任何擁有相同權重的人都能重新生成——這才是開放的實際意義。
Nanosaur 2 在幾週內就會被下一款發布取代。但它所代表的難題不會,因為這從來不是技術問題。這是一個關於社群要如何處置一項人人都能掌握的能力的問題,而社群正在像那樣的討論串裡寫下答案,一次一個論點。