DeepSeek sta raccogliendo 12 miliardi di dollari e costruendo un cluster Huawei da 160.000 chip

--- title: DeepSeek sta raccogliendo 12 miliardi di dollari e costruendo un cluster Huawei da 160.000 chip meta_title: Il round da 12 miliardi di DeepSeek e la scommessa su Huawei meta_description: Secondo quanto riportato, DeepSeek sta raccogliendo fino a 12 miliardi di dollari con il sostegno di Tencent e CATL e prevede almeno 160.000 acceleratori Huawei in un data center in Mongolia Interna. ---
DeepSeek era alla ricerca di circa 7,4 miliardi di dollari e ha ricevuto un interesse che non si aspettava. Secondo Bloomberg, il round è cresciuto fino a circa 12 miliardi di dollari dopo il successo del lancio del modello V4 Flash, e le term sheet firmate finora suggeriscono che la cifra finale potrebbe avvicinarsi a 14,9 miliardi di dollari.
Tencent e il produttore di batterie CATL sono indicati come i maggiori partecipanti. L'obiettivo di valutazione riportato è di circa 74,6 miliardi di dollari.
I numeri dietro il round
La parte più interessante della storia non è il totale, ma a cosa servono i soldi.
Bloomberg riporta che DeepSeek prevede di installare almeno 160.000 dei migliori acceleratori Huawei in un grande data center che sta costruendo in Mongolia Interna. Sarebbe uno dei più grandi cluster conosciuti di chip AI Huawei.
Letto insieme alla cifra del finanziamento, il piano è specifico. Questo round esiste per acquistare capacità di calcolo su una piattaforma particolare, a una scala che rende la piattaforma sostenibile a prescindere da ciò che fanno gli altri.
Perché l'impegno con Huawei conta più della cifra in dollari
L'industria cinese dell'IA ha passato anni a aggirare i controlli sulle esportazioni di hardware Nvidia avanzato, e la domanda standard è sempre stata se i chip nazionali possano sostituirli. Un ordine da 160.000 acceleratori risponde a una domanda diversa: se qualcuno è disposto a impegnarsi a una scala che costringa l'ecosistema software a maturare.
La dimensione del cluster cambia il lavoro di ingegneria. Le piccole implementazioni possono assorbire imperfezioni; con 160.000 acceleratori, librerie di comunicazione, compilatori e scheduling devono tutti funzionare bene, perché l'inefficienza si moltiplica. DeepSeek in precedenza ha reso open source componenti infrastrutturali mirati alla piattaforma Ascend di Huawei: strumenti per linguaggi di programmazione a livello di tile, librerie di calcolo e librerie di comunicazione distribuita, tutti ottimizzati per la linea Ascend 950.
Il quadro è coerente. DeepSeek usa chip Huawei, sviluppa software per essi e lo pubblica, abbassando il costo di migrazione per tutti gli altri. È una posizione diversa dall'adattamento.
Il confronto che conta è con il fossato software di Nvidia. Il vantaggio di CUDA non è mai stato solo il silicio, ma il decennio di strumenti che ha reso il silicio facile da usare. Qualsiasi alternativa credibile ha bisogno della stessa cosa, e uno stack di librerie open source più un cluster di riferimento di queste dimensioni è il modo in cui si costruisce.
La storia degli investitori
La crescita del round è di per sé informativa. DeepSeek inizialmente cercava circa 7,4 miliardi di dollari, e la domanda l'ha spinta verso i 12 miliardi sulla scia del lancio di un modello. È un forte segnale di come gli investitori valutano i laboratori di IA cinesi, e suggerisce che il bacino di acquirenti ora tratta i lanci di modelli come eventi di valutazione a breve termine.
Bloomberg riporta anche che il fondatore Liang Wenfeng ha promesso in almeno una riunione quest'anno che continuerà a sviluppare modelli aperti mentre persegue l'AGI, e ha descritto il suo obiettivo principale come spingere la tecnologia piuttosto che la monetizzazione. Si dice che il suo patrimonio netto sia aumentato di oltre il 200%, arrivando a circa 36 miliardi di dollari, da quando la società ha chiuso il suo primo round esterno quest'estate.
L'impegno sui modelli aperti vale la pena di essere tenuto a mente, perché spiega la posizione strategica dell'azienda. L'influenza di DeepSeek deriva in gran parte dalla pubblicazione di modelli forti che altri sviluppatori possono eseguire. Questo riduce il valore di qualsiasi singolo contratto API, ma costruisce una base di utenti e contributori, e rende la ricerca dell'azienda un input standard di fatto per altri laboratori. Diversi modelli concorrenti rilasciati quest'anno sono basati su architetture di base cinesi, che è il tipo di posizione difficile da comprare e facile da mantenere una volta stabilita.
Il prossimo passo dopo la chiusura del round sarebbe una ristrutturazione in vista di una IPO. Questo introduce una tensione da tenere d'occhio. Gli investitori dei mercati pubblici generalmente premiano un potere di prezzo difendibile, e regalare modelli di frontiera mina la difendibilità. Come DeepSeek concilierà i pesi aperti con le aspettative del mercato pubblico plasmerà la sua strategia per anni.
Il quadro più ampio del capitale
Questo round si colloca all'interno di un'onda più ampia di finanziamenti all'IA che quest'anno è diventata strutturalmente insolita.
Sul fronte occidentale, l'idea organizzatrice è che la capacità di calcolo è finanziabile. Nvidia ha dichiarato in agosto di lavorare con Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs e KKR su piattaforme progettate per mobilitare oltre 500 miliardi di dollari di capitale di terzi per l'infrastruttura AI, posizionando esplicitamente la capacità di calcolo come una classe di attività. Amazon avrebbe mosso verso una struttura che consente a investitori esterni di finanziare circa 8 miliardi di dollari di chip Nvidia Grace Blackwell tramite un veicolo a scopo specifico, con Amazon che noleggia l'attrezzatura.
Sul fronte cinese, il finanziamento assomiglia di più a un round strategico con partner industriali. Tencent e CATL non sono investitori finanziari passivi. Uno porta distribuzione attraverso i suoi prodotti consumer e enterprise, l'altro porta competenze nella produzione e nell'energia. Un cluster di chip in Mongolia Interna ha requisiti di alimentazione e raffreddamento che un'azienda di batterie comprende bene.
I due modelli hanno profili di rischio diversi. Le strutture garantite da attività dipendono dal fatto che le GPU mantengano valore residuo con l'invecchiamento, una questione aperta data la rapidità con cui l'hardware viene sostituito. Un edificio convenzionale conserva gran parte del suo valore dopo un decennio; un acceleratore specializzato ha un mercato dell'usato molto meno prevedibile. I round strategici dipendono dalla tenuta dei rapporti con i partner, che è una questione di governance oltre che finanziaria.
C'è una tensione correlata nelle strutture occidentali che ha iniziato ad attirare attenzione. La piattaforma di finanziamento AI di Broadcom, che copre l'espansione della capacità di calcolo di Anthropic, ha spinto gli analisti del credito a chiedersi quanta esposizione si accumuli nel tempo, con una stima che colloca l'esposizione massima nell'ordine delle centinaia di miliardi entro il 2029. Bank of America ha abbassato il suo rating su Broadcom in parte per l'incertezza derivante da quella piattaforma. È un promemoria del fatto che finanziare la capacità di calcolo fa sembrare la spesa più leggera oggi e la concentra da qualche altra parte più avanti.
Il round cinese appare diverso nel carattere ma non nel tipo. Raccogliere 12 miliardi di dollari contro i ricavi futuri dei modelli è una scommessa sul continuo miglioramento delle capacità, proprio come un prestito garantito da attività è una scommessa sul fatto che le GPU rimangano produttive.
Cosa tenere d'occhio
Se il cluster verrà effettivamente costruito alla scala dichiarata. Un'implementazione da 160.000 acceleratori è un progetto di costruzione pluriennale, e il piano riportato è un piano.
Se lo stack software Huawei diventerà abbastanza facile da adottare per altri. Le librerie pubblicate da DeepSeek sono l'inizio di ciò. L'adozione da parte di altri laboratori sarebbe la prova.
Se il round si chiuderà nella parte alta della forchetta. La differenza tra i 7,4 miliardi cercati e i 14,9 miliardi suggeriti è ampia, e il numero finale dirà molto su quanto gli investitori siano fiduciosi nell'IA cinese in generale piuttosto che in DeepSeek nello specifico.
L'elemento da trarre da questa storia sta sotto la cifra del titolo. La più grande scommessa singola nell'IA cinese in questo momento è sul silicio nazionale, fatta dall'azienda con la maggiore credibilità nei modelli aperti, finanziata da partner che hanno da guadagnare se la scommessa funziona. È un impegno più rilevante di una valutazione.
Articoli correlati
Primo caso a Shanghai di violazione del diritto alla voce con AI: sentenza d'appello stabilisce l'identificabilità come criterio, la piattaforma risarcisce 50.000 yuan
Quando scomporre una voce costa meno che ottenerla, la perizia che dimostra a che livello arriva la somiglianza diventa il punto di partenza di ogni controversia.
Il denaro si sposta verso l'IA fisica: i 1,45 miliardi di SiMa.ai e gli agenti che progettano hardware
Il capitale arriva prima delle prove. Le implementazioni del prossimo anno diranno se la scommessa era giusta.
Un tribunale dell'Arizona ha annullato una condanna perché un video AI ha parlato per la vittima
Riprodurre ciò che una persona ha fatto è una cosa. Parlare al posto suo è un'altra, e la linea tra le due è ora scritta in un fascicolo giudiziario.
OpenAI applicherà un watermark al testo di ChatGPT nell'UE. I suoi stessi numeri mostrano quanto sia fragile
Un marcatore che la parafrasi di routine può rimuovere può soddisfare la lettera dell'articolo 50 ma fallire il compito per cui l'articolo è stato scritto.