久操免费资源,久久伦理一区,国产又黄又爽视频,情草av网,日本久久久在线免费,精品人妻互换一区三区,熟妇女一区二区三区,亚洲AV三区视频免费,老司机在线精品

本文梳理了黃仁勛2026臺(tái)北GTC演講核心,圍繞Agentic AI時(shí)代,英偉達(dá)推出全棧產(chǎn)品布局,強(qiáng)調(diào)智能體時(shí)代**算力即收入**。 ## 1. 行業(yè)定調(diào):AI跨入智能體時(shí)代,算力直接等同于收入 AI已從生成式大語(yǔ)言模型階段,正式進(jìn)入可自主觀察、推理、規(guī)劃、調(diào)用工具的Agentic AI(智能體AI)時(shí)代,開(kāi)啟實(shí)用AI新階段。 智能體是全新分布式計(jì)算模式,徹底重構(gòu)了全行業(yè)軟硬件架構(gòu),當(dāng)前Token就是盈利單位,算力越高、每瓦吞吐量越高,可生成的Token越多,收入就越高,因此智能體時(shí)代**算力即收入**。 ## 2. 數(shù)據(jù)中心端:發(fā)布Vera Rubin全棧系統(tǒng)與Vera CPU,打造高效AI工廠 Vera Rubin是英偉達(dá)專(zhuān)為智能體打造的多機(jī)架級(jí)端到端系統(tǒng),已全面量產(chǎn),供應(yīng)鏈規(guī)模是前代Grace Blackwell的兩倍,單機(jī)架組裝僅需5分鐘。 Vera CPU是全球首款專(zhuān)為低延遲需求的智能體打造的處理器,采用88個(gè)定制Olympus核心,單核可10條指令提取,總帶寬為傳統(tǒng)x86的3倍,智能體沙盒性能是x86的1.8倍,SQL數(shù)據(jù)庫(kù)查詢(xún)速度提升3倍,可解決GPU閑置等待CPU的行業(yè)瓶頸,幫助云廠商構(gòu)建最低Token生產(chǎn)成本護(hù)城河。 英偉達(dá)同步推出全棧AI工廠參考設(shè)計(jì)DSX,可通過(guò)數(shù)字孿生完成預(yù)設(shè)計(jì),通過(guò)動(dòng)態(tài)功率分配、高溫液冷等技術(shù),解決傳統(tǒng)數(shù)據(jù)中心電力過(guò)度預(yù)留40%的問(wèn)題,同等電力預(yù)算可增加數(shù)十億美元年收入。 ## 3. 端側(cè):聯(lián)合微軟推出RTX Spark平臺(tái),重構(gòu)PC開(kāi)啟端側(cè)智能體時(shí)代 英偉達(dá)聯(lián)合微軟推出兼容Windows與CUDA的RTX Spark全新PC產(chǎn)品線,覆蓋筆記本、臺(tái)式機(jī)、工作站,可作為24小時(shí)在線的私人端側(cè)智能中樞。 驅(qū)動(dòng)平臺(tái)的是英偉達(dá)與聯(lián)發(fā)科合作打造的N1X芯片,采用臺(tái)積電3nm工藝,集成6144個(gè)CUDA核心Blackwell GPU(1 Petaflop AI算力)、20核定制Grace CPU與128GB統(tǒng)一內(nèi)存,可同時(shí)支撐重度游戲與毫秒級(jí)本地智能體推理,在保護(hù)隱私的前提下整合跨應(yīng)用工作流。 ## 4. 企業(yè)端:推出開(kāi)源Neotron 3 Ultra模型與Agent Toolkit,賦能企業(yè)私有化部署 英偉達(dá)發(fā)布業(yè)內(nèi)首個(gè)采用SSM+MoE復(fù)合架構(gòu)的開(kāi)源基礎(chǔ)模型Neotron 3 Ultra,運(yùn)行速度比傳統(tǒng)大模型提升5倍,推理成本降低30%,且完全開(kāi)放訓(xùn)練數(shù)據(jù)與腳本,方便企業(yè)定制修改。 配套推出企業(yè)級(jí)NVIDIA Agent Toolkit,包含模型、編排框架、CUDA-X工具集與安全運(yùn)行時(shí),企業(yè)可在保護(hù)核心數(shù)據(jù)的前提下,低成本私有化部署適配自身業(yè)務(wù)的智能體矩陣,讓AI下沉到日常商業(yè)流水線中。例如芯片設(shè)計(jì)領(lǐng)域,原本數(shù)周的芯片驗(yàn)證工作可壓縮到數(shù)小時(shí),周期縮短至四十分之一以下。 ## 5. 物理AI:發(fā)布Cosmos 3世界模型與人形機(jī)器人參考平臺(tái),鋪就物理AI應(yīng)用基石 Cosmos 3是混合Transformer架構(gòu)的物理AI基礎(chǔ)模型,可將合成視頻、動(dòng)作、語(yǔ)言轉(zhuǎn)化為機(jī)器人可學(xué)習(xí)的第一人稱(chēng)物理規(guī)律,解決物理AI規(guī)?;瘮?shù)據(jù)不足的痛點(diǎn),支持開(kāi)發(fā)者針對(duì)不同場(chǎng)景定制微調(diào)。 同步推出Isaac Groot人形機(jī)器人參考設(shè)計(jì),由Jetson Thor平臺(tái)驅(qū)動(dòng),共擁有31個(gè)軀干自由度、雙手各25個(gè)自由度,集成全套數(shù)據(jù)生成、仿真、部署工具鏈,開(kāi)箱即可供研究使用,為人形機(jī)器人走出實(shí)驗(yàn)室實(shí)現(xiàn)大規(guī)模應(yīng)用奠定工程基礎(chǔ)。
算力即收入:黃仁勛2026臺(tái)北GTC演講,完整版來(lái)了
2026-06-01 18:02

算力即收入:黃仁勛2026臺(tái)北GTC演講,完整版來(lái)了

本文來(lái)自微信公眾號(hào):劃重點(diǎn)KeyPoints,作者:林易,題圖來(lái)自:視覺(jué)中國(guó)


6月1日,在2026年的英偉達(dá)GTC臺(tái)北大會(huì)上,黃仁勛用一句話(huà)定調(diào)了AI行業(yè)的新范式:


AI已經(jīng)從單純回答問(wèn)題的大語(yǔ)言模型階段,正式跨入能夠自主觀察、推理、規(guī)劃并調(diào)用工具的Agentic AI時(shí)代。


在黃仁勛看來(lái),智能體正在徹底改變傳統(tǒng)的計(jì)算模式。過(guò)去我們習(xí)慣于運(yùn)行傳統(tǒng)操作系統(tǒng)中的軟件,而現(xiàn)在的應(yīng)用形態(tài)已經(jīng)變成了由大模型、控制外殼、工具和運(yùn)行時(shí)共同構(gòu)成的分布式系統(tǒng)。


這種全新計(jì)算模式的出現(xiàn),意味著從底層的云端數(shù)據(jù)中心,到用戶(hù)每天面對(duì)的PC電腦,再到企業(yè)級(jí)軟件和物理世界的機(jī)器人,整個(gè)科技行業(yè)的軟硬件架構(gòu)都需要迎來(lái)一場(chǎng)深度重構(gòu)。


這場(chǎng)發(fā)布會(huì)中,英偉達(dá)的所有新品,都在為一個(gè)目標(biāo)服務(wù):讓海量的智能體在云端、個(gè)人電腦、企業(yè)服務(wù)器以及機(jī)器人體內(nèi),以更低的延遲、更低的成本高效運(yùn)行。


因?yàn)樵谥悄荏w時(shí)代,算力即收入(Compute is Revenue)。


(我們整理了本次發(fā)布會(huì)四大核心產(chǎn)品矩陣的關(guān)鍵信息,以下是重點(diǎn)內(nèi)容)


1. RTX Spark平臺(tái)與N1X芯片:重構(gòu)PC,開(kāi)啟端側(cè)智能體時(shí)代


在端側(cè),英偉達(dá)與微軟聯(lián)手打造RTX Spark平臺(tái),重構(gòu)PC形態(tài)。


RTX Spark是兼容Windows與CUDA的全新產(chǎn)品線,涵蓋筆記本、臺(tái)式機(jī)以及工作站。對(duì)于普通用戶(hù),它將成為一臺(tái)24小時(shí)在線、免調(diào)用費(fèi)的私人智能中樞,隨時(shí)接管人們的數(shù)字生活。


驅(qū)動(dòng)這一平臺(tái)的是英偉達(dá)與聯(lián)發(fā)科合作打造的N1X芯片。它采用臺(tái)積電3nm工藝,單芯片封裝了具備6144個(gè)CUDA核心的Blackwell RTX GPU(AI算力達(dá)1 Petaflop),集成了20核定制版Grace CPU,并配備了高達(dá)128GB的統(tǒng)一內(nèi)存。


RTX Spark與N1X芯片打通了高負(fù)載端側(cè)AI的最后一公里。無(wú)論是高幀率完美支撐快節(jié)奏的FPS與重度開(kāi)放世界生存游戲,還是在游戲后臺(tái)以毫秒級(jí)響應(yīng)本地Agent的推理請(qǐng)求(如實(shí)時(shí)自動(dòng)代碼檢查、自動(dòng)三維建模渲染等),它都能輕松勝任。


未來(lái)的PC不再是點(diǎn)擊運(yùn)行軟件的機(jī)器,而是私人專(zhuān)屬的數(shù)字機(jī)器人,在保護(hù)用戶(hù)隱私的前提下,深度整合跨應(yīng)用的數(shù)據(jù)和工作流程。


2. Vera CPU:為智能體打造的超算工廠大腦


傳統(tǒng)的CPU是為人類(lèi)的指令習(xí)慣設(shè)計(jì)的,而Vera CPU則是首款專(zhuān)為缺乏耐心、要求極低延遲的智能體打造的處理核心。


Vera CPU配備了88個(gè)Olympus核心,單核具備驚人的10條指令提取性能。搭配LPDDR5X內(nèi)存(1.2 TB/s帶寬),且芯片內(nèi)部實(shí)現(xiàn)了3.6 TB/s的無(wú)損互聯(lián)網(wǎng)絡(luò),徹底解決了AI數(shù)據(jù)中心里GPU高頻閑置等待CPU處理邏輯的嚴(yán)重瓶頸。


包含Vera CPU的Vera Rubin多機(jī)架級(jí)(pod-scale)智能體超算平臺(tái)目前已全面進(jìn)入量產(chǎn)階段。


極低延遲換來(lái)的極高吞吐量,直接拉高了單瓦特能夠生成的Token數(shù)量。在真實(shí)業(yè)務(wù)中,Vera CPU的智能體沙盒性能是傳統(tǒng)x86的1.8倍,SQL數(shù)據(jù)庫(kù)查詢(xún)速度提升3倍。這不僅是技術(shù)的勝利,更是為云廠商和AI企業(yè)構(gòu)建的最低Token生產(chǎn)成本的護(hù)城河。正如黃仁勛所強(qiáng)調(diào)的,在未來(lái),數(shù)據(jù)中心將成為生產(chǎn)Token的AI工廠。


3. Neotron 3 Ultra模型與NVIDIA Agent Toolkit工具包:企業(yè)級(jí)AI的操作系統(tǒng)


為了讓企業(yè)能夠安全、高效地部署智能體,英偉達(dá)發(fā)布了全新開(kāi)源基礎(chǔ)模型Neotron 3 Ultra。


Neotron 3 Ultra在業(yè)內(nèi)率先采用了SSM(狀態(tài)空間模型)與MoE(混合專(zhuān)家模型)的復(fù)合架構(gòu)。在性能上,運(yùn)行速度相比傳統(tǒng)大模型直接飆升5倍,推理成本大幅壓縮30%。


同時(shí),英偉達(dá)還推出了企業(yè)級(jí)AI工具包NVIDIA Agent Toolkit。這套工具包是英偉達(dá)向企業(yè)端拋出的商業(yè)變現(xiàn)殺手锏。高度依賴(lài)內(nèi)容分發(fā)、精準(zhǔn)廣告產(chǎn)運(yùn)以及復(fù)雜業(yè)務(wù)流自動(dòng)化的企業(yè),現(xiàn)在可以在保護(hù)核心商業(yè)數(shù)據(jù)的前提下,低成本私有化部署完全懂內(nèi)部業(yè)務(wù)的超級(jí)智能體矩陣。AI將真正下沉到每天的商業(yè)流水線中干活。


4. Cosmos 3模型與Isaac Groot機(jī)器人:物理AI的新突破


Cosmos 3世界模型是一款混合Transformer架構(gòu)模型,能夠?qū)⒂?jì)算機(jī)合成的視頻、動(dòng)作和語(yǔ)言轉(zhuǎn)化為機(jī)器人能直接學(xué)習(xí)的第一人稱(chēng)物理規(guī)律。


Isaac Groot參考設(shè)計(jì)由Jetson Thor平臺(tái)驅(qū)動(dòng),擁有31個(gè)軀干自由度和雙側(cè)各25個(gè)自由度的高精度Sharpa機(jī)械手,為研究人員提供了一個(gè)開(kāi)箱即用的強(qiáng)大平臺(tái)。


通過(guò)Cosmos 3和虛擬孿生平臺(tái)的大規(guī)模合成數(shù)據(jù)喂養(yǎng)實(shí)體軀干,人形機(jī)器人走出實(shí)驗(yàn)室,進(jìn)入大規(guī)模應(yīng)用的理論與工程基石正式成型。這將改變工業(yè)制造、物流甚至家庭服務(wù)等領(lǐng)域的未來(lái)圖景。


從底層的Vera CPU,到端側(cè)的N1X芯片,再到企業(yè)級(jí)的Agent Toolkit和物理世界的Cosmos 3,英偉達(dá)的2026年全線產(chǎn)品發(fā)布,清晰地勾勒出了一幅以Agentic AI為核心的未來(lái)藍(lán)圖。在這場(chǎng)算力與智能的革命中,那些能夠最高效地生成和利用Token的企業(yè),將掌握通向未來(lái)的鑰匙。



以下是黃仁勛2026臺(tái)北GTC演講實(shí)錄:


1. 實(shí)用AI時(shí)代開(kāi)啟,智能體AI重塑生產(chǎn)力


歡迎來(lái)到GTC Taiwan。很高興見(jiàn)到大家,回家真好。我這次把父母也接回了家,請(qǐng)大家為我的父母,以及我們賽前表演的臺(tái)灣超級(jí)巨星們鼓掌。今天現(xiàn)場(chǎng)座無(wú)虛席,我們同時(shí)正向全臺(tái)灣其他70個(gè)觀影派對(duì)同步直播這場(chǎng)主題演講。


今天有許多內(nèi)容要與大家分享,也有許多合作伙伴需要感謝。我們?cè)谂_(tái)灣的生態(tài)系統(tǒng)規(guī)模已經(jīng)發(fā)展得極其龐大,令人難以置信。人們通常認(rèn)為生態(tài)系統(tǒng)就是我們的軟件棧,或是構(gòu)建在NVIDIA計(jì)算系統(tǒng)之上的開(kāi)發(fā)者生態(tài)系統(tǒng)。但NVIDIA的生態(tài)系統(tǒng)其實(shí)向上延伸到了我們?cè)谂_(tái)灣的所有供應(yīng)鏈,那是萬(wàn)物起始之地,向下則一直延伸到數(shù)據(jù)中心并最終觸達(dá)終端用戶(hù)。


今天我們將討論這整個(gè)生態(tài)系統(tǒng)。臺(tái)灣擁有世界上最豐富、最頂尖的供應(yīng)鏈生態(tài)系統(tǒng)。這里有非常多優(yōu)秀的公司和我最喜歡的生態(tài)合作伙伴,有太多人需要感謝。非常感謝大家的光臨。


今年我們的業(yè)務(wù)正在以驚人的速度共同增長(zhǎng),據(jù)說(shuō)臺(tái)灣的年度GDP也將增長(zhǎng)近10%,這簡(jiǎn)直不可思議。兩年前我在這里談到AI將從生成式AI演進(jìn)到其他形態(tài)。如今下一波浪潮智能體AI(Agentic AI)已經(jīng)到來(lái),這也標(biāo)志著實(shí)用AI時(shí)代的正式開(kāi)啟。


這意味著什么?以GitHub為例,軟件編程是智能體AI首批落地的應(yīng)用領(lǐng)域之一。這是一個(gè)極具價(jià)值的職業(yè),全球有三四千萬(wàn)名專(zhuān)業(yè)軟件開(kāi)發(fā)人員以此謀生。在GitHub上,開(kāi)發(fā)者下載軟件并進(jìn)行修改,然后將代碼推送回去(commit)。2023年的commit數(shù)量是3億次,2024年是4億次,2025年是5億次。而在2026年的前幾個(gè)月里,這個(gè)數(shù)字幾乎增長(zhǎng)了三倍。


這三千萬(wàn)軟件開(kāi)發(fā)人員每年約有3萬(wàn)億美元的薪資支出,支撐起了全球100萬(wàn)億美元規(guī)模的產(chǎn)業(yè)。如今這3萬(wàn)億美元的薪資創(chuàng)造了近三倍的產(chǎn)出,相當(dāng)于實(shí)現(xiàn)了9萬(wàn)億美元的生產(chǎn)力,這種差距是驚人的,這正是AI的潛力與承諾。


有人說(shuō)AI會(huì)減少工作崗位,這完全是一派胡言。實(shí)際上軟件工程師的數(shù)量正在增加。原因很簡(jiǎn)單,如果聘請(qǐng)一名軟件工程師能產(chǎn)生價(jià)值9萬(wàn)億美元的生產(chǎn)力,企業(yè)當(dāng)然會(huì)想要雇傭更多人。這種驚人的產(chǎn)出很快就會(huì)在經(jīng)濟(jì)中體現(xiàn)出來(lái)。從行業(yè)角度來(lái)看,實(shí)用AI的到來(lái)意味著當(dāng)前對(duì)Token的需求量極大。因?yàn)門(mén)oken現(xiàn)在已經(jīng)成為了盈利和收入的單位,AI公司渴望生成更多的Token并建設(shè)更多的AI工廠。這正是臺(tái)灣算力需求飆升的原因,也是各位業(yè)務(wù)繁榮、股價(jià)上漲的動(dòng)力。


計(jì)算模式已經(jīng)徹底改變。實(shí)用的AI已經(jīng)到來(lái),它現(xiàn)在是利潤(rùn)與GDP的生成器。其背后是一種全新的計(jì)算模式,不再僅僅是大語(yǔ)言模型,更是智能體(Agent)。


傳統(tǒng)意義上我們?cè)诓僮飨到y(tǒng)中運(yùn)行應(yīng)用程序和代碼。而今天的新模式是運(yùn)行在容器框架(Harness)中的智能體,它由一個(gè)或多個(gè)大語(yǔ)言模型組成。這個(gè)框架機(jī)制負(fù)責(zé)引導(dǎo)和編排AI開(kāi)展高效的工作。


當(dāng)接收到輸入時(shí),智能體必須進(jìn)行理解、觀察、推理和行動(dòng),并調(diào)用諸如電子表格、Web瀏覽器或數(shù)據(jù)處理引擎等工具。整個(gè)過(guò)程是受軟件編排的,框架負(fù)責(zé)路由信息,處理上下文,理解現(xiàn)狀,進(jìn)行推理并制定執(zhí)行計(jì)劃。本質(zhì)上這就是智能體的工作原理。它像人類(lèi)一樣處理短期工作記憶和長(zhǎng)期記憶,因此內(nèi)存管理系統(tǒng)變得極其重要。在這個(gè)新模型中,大語(yǔ)言模型負(fù)責(zé)思考,而外殼程序則像操作系統(tǒng)一樣將一切連接起來(lái)。


這是一個(gè)重大的突破,大語(yǔ)言模型現(xiàn)在已經(jīng)能夠非常出色地進(jìn)行思考、推理、規(guī)劃和使用工具。結(jié)合內(nèi)存管理框架和工具編排,我們現(xiàn)在可以成就非凡。例如給出一句提示詞,AI就能生成完整的代碼。我們現(xiàn)在使用的是Claude Code,但Codex的表現(xiàn)也同樣出色。再比如輸入“創(chuàng)建一個(gè)GIF在黑色散點(diǎn)圖上顯示NVIDIA綠色的點(diǎn)從臺(tái)北101大樓變形為GTC Taipei 2026再變形為NVIDIA眼睛圖標(biāo)然后散射重復(fù)”,AI就能直接生成動(dòng)態(tài)圖。甚至當(dāng)你弄丟遙控器電池蓋時(shí),只需提供圖片并讓AI創(chuàng)建一個(gè)準(zhǔn)備好進(jìn)行3D打印的CAD文件,它就能調(diào)用工具完成制作。這就是全新的計(jì)算模式。


過(guò)去我們需要啟動(dòng)應(yīng)用程序進(jìn)行點(diǎn)擊和輸入,現(xiàn)在只需向AI解釋我們的意圖和需求,AI就會(huì)自動(dòng)生成代碼或使用工具產(chǎn)生必要的輸出。這是未來(lái)計(jì)算機(jī)的工作方式,即智能體AI。我們?yōu)榇伺α藘赡?,如今它終于化為現(xiàn)實(shí)。


現(xiàn)在的重大突破之一在于工具的使用。有人認(rèn)為AI時(shí)代和智能體AI的到來(lái)會(huì)讓所有軟件公司倒閉,但事實(shí)恰恰相反。未來(lái)世界將充滿(mǎn)智能體,不再受限于人口數(shù)量,這些智能體將比以往任何時(shí)候都更頻繁地使用工具。對(duì)軟件公司而言這其實(shí)是一個(gè)絕佳的時(shí)代,前提是軟件必須以智能體能夠調(diào)用的方式呈現(xiàn)。


作為NVIDIA的瑰寶,CUDA-X庫(kù)正經(jīng)歷著屬于它的美好時(shí)代。今天我們能夠?qū)⑦@些庫(kù)提供給智能體,它們的使用效率甚至超越了人類(lèi)。20年前我們構(gòu)建了用于加速計(jì)算的單一架構(gòu)CUDA,重新發(fā)明了計(jì)算。如今上千個(gè)CUDA-X庫(kù)已經(jīng)成為智能體的工具,助力科學(xué)和工程領(lǐng)域的突破。比如用于計(jì)算光刻的cuLitho、用于決策優(yōu)化的cuOpt、用于直接稀疏求解器的cuDSS、用于跨結(jié)構(gòu)化和非結(jié)構(gòu)化文檔深度研究的AIQ、用于AI RAN的Aerial、用于可微物理的Warp,以及用于基因組學(xué)的Parabricks。這些精妙算法的基石是美麗的數(shù)學(xué)。



2. 全新計(jì)算模式:大語(yǔ)言模型與工具的協(xié)同編排


軟件的計(jì)算模式即將改變,智能體代表著終極的解耦式分布式計(jì)算模型。為了運(yùn)行智能體,數(shù)據(jù)中心內(nèi)各個(gè)位置的眾多計(jì)算機(jī)將被激活。智能體由模型、框架、工具、技能和運(yùn)行時(shí)組成。你可以把模型想象成大腦,把框架和運(yùn)行時(shí)的工具想象成身體和工作車(chē)間。這是一個(gè)在車(chē)間里熟練使用工具的工人,這一切都在極大規(guī)模下進(jìn)行,分布在計(jì)算機(jī)的不同部分。大語(yǔ)言模型負(fù)責(zé)思考、處理上下文、觀察環(huán)境、推理并制定執(zhí)行計(jì)劃。每當(dāng)模型進(jìn)行思考時(shí),整架Grace Blackwell NVLink-72就會(huì)被激活。而每當(dāng)它使用諸如C編譯器、Python、JavaScript或加速計(jì)算等工具時(shí),就會(huì)消耗CPU資源。


今天的智能體還是簡(jiǎn)單的工具使用者,但明天它們將變得非常成熟。這正是CUDA-X庫(kù)備受智能體青睞的原因。我們的所有CUDA-X庫(kù)現(xiàn)在都具備了AI可以學(xué)習(xí)并使用的技能手冊(cè)。AI閱讀后便能領(lǐng)會(huì)使用方法,其操作這些庫(kù)的能力將令人驚嘆。這些工具運(yùn)行在CPU、GPU和大語(yǔ)言模型之上,而安全框架則運(yùn)行在CPU和NVIDIA BlueField DPU等安全處理器上。整個(gè)工作流程的編排都由CPU完成。


其中最困難的環(huán)節(jié)之一是內(nèi)存管理。工作記憶可以被簡(jiǎn)單理解為KV緩存(KV Caching)。系統(tǒng)不僅需要進(jìn)行數(shù)據(jù)壓縮,還要解決復(fù)雜的檢索問(wèn)題,即如何檢索結(jié)構(gòu)化和非結(jié)構(gòu)化數(shù)據(jù),以及如何梳理不同數(shù)據(jù)間的本體關(guān)系。這個(gè)處理過(guò)程極其復(fù)雜,AI的內(nèi)存系統(tǒng)必將引發(fā)存儲(chǔ)系統(tǒng)的徹底變革。


這種全新的智能體應(yīng)用和計(jì)算模式與傳統(tǒng)的應(yīng)用程序運(yùn)行方式截然不同。過(guò)去軟件通常封裝在單一二進(jìn)制文件中并運(yùn)行于操作系統(tǒng)內(nèi)。而現(xiàn)在面對(duì)這種解耦的、分布式的異構(gòu)計(jì)算需求,我們構(gòu)建了下一代產(chǎn)品Vera Rubin。


Vera Rubin不僅是一顆芯片或一個(gè)GPU,它是一個(gè)令人驚嘆的端到端系統(tǒng)。它配備了GPU和Vera Rubin NVLink-72,由Vera CPU進(jìn)行編排,并擁有革命性的存儲(chǔ)系統(tǒng)。結(jié)合CX9和DOCA軟件棧,系統(tǒng)內(nèi)置的安全處理器確保所有靜態(tài)、傳輸中及使用中的數(shù)據(jù)都經(jīng)過(guò)加密。由于AI模型極其珍貴,整個(gè)系統(tǒng)嚴(yán)格遵循機(jī)密計(jì)算(Confidential Computing)的標(biāo)準(zhǔn)。


Vera Rubin是我們公司歷史上最宏大的事業(yè),全公司眾多部門(mén)的工程師都為此傾注了心血,在座的許多合作伙伴也參與了整個(gè)系統(tǒng)的創(chuàng)建。Vera Rubin是一個(gè)超越芯片概念的奇跡。NVIDIA早已從一家GPU公司演變成一家系統(tǒng)公司,設(shè)計(jì)出了史上最復(fù)雜、最徹底的系統(tǒng)。


但歸根結(jié)底,我們的客戶(hù)不僅想購(gòu)買(mǎi)計(jì)算機(jī),他們更想要建造AI工廠,這也是NVIDIA再次自我轉(zhuǎn)型的核心原因。如今我們的技術(shù)和合作伙伴都已擴(kuò)展到了基礎(chǔ)設(shè)施層面。發(fā)電機(jī)、冷卻系統(tǒng)和電網(wǎng)供應(yīng)商等眾多工業(yè)公司成為了我們生態(tài)系統(tǒng)的一部分。我們正在構(gòu)建一個(gè)全棧系統(tǒng),助力客戶(hù)打造卓越的AI基礎(chǔ)設(shè)施。


當(dāng)前全球正競(jìng)相建設(shè)AI工廠,這是人類(lèi)歷史上規(guī)模最大的基礎(chǔ)設(shè)施建設(shè)。AI工廠的每一層包括芯片、機(jī)架、網(wǎng)絡(luò)、電力、冷卻和電網(wǎng),都必須進(jìn)行端到端的協(xié)同設(shè)計(jì),因?yàn)樵谶@里算力就等于營(yíng)收。


NVIDIA DSX正是用于高效、盈利地構(gòu)建和運(yùn)營(yíng)AI工廠的藍(lán)圖與參考設(shè)計(jì)。一切從DSX SIM開(kāi)始。借助DSX SIM Omniverse藍(lán)圖,合作伙伴在首個(gè)機(jī)架落地前,就能在數(shù)字孿生中規(guī)劃布局、模擬電力與冷卻系統(tǒng)、設(shè)計(jì)網(wǎng)絡(luò)并驗(yàn)證所有變更,從而完成Vera Rubin AI工廠的設(shè)計(jì)與驗(yàn)證。


工廠啟動(dòng)后,DSX OS將接管并負(fù)責(zé)配置、運(yùn)行、監(jiān)控和修復(fù)基礎(chǔ)設(shè)施,將硬件轉(zhuǎn)化為可信、彈性且AI就緒的多租戶(hù)算力資源。當(dāng)前的AI工廠在電力配置上往往過(guò)度預(yù)留高達(dá)40%,而DSX Max LPS讓運(yùn)營(yíng)商能夠在同等電力預(yù)算內(nèi)安全部署更多GPU,每年可增加數(shù)十億美元的收入。突破性的45攝氏度高溫液冷技術(shù)降低了水電消耗,將更多電力用于產(chǎn)生收入的計(jì)算。動(dòng)態(tài)功率分配技術(shù)在機(jī)架間調(diào)度電力,回收閑置功率并輸送至高負(fù)載區(qū)域,同時(shí)平滑技術(shù)能有效抑制峰值電流尖峰和功率浪涌。


在整個(gè)工廠中,AI智能體團(tuán)隊(duì)與DSX Max LPS協(xié)同工作,實(shí)時(shí)平衡冷卻與功耗。此外,DSX AI工廠是能夠與電網(wǎng)協(xié)同運(yùn)行的靈活能源資產(chǎn),DSX Flex可以讀取實(shí)時(shí)電網(wǎng)信號(hào),在電網(wǎng)承壓時(shí)動(dòng)態(tài)調(diào)整工廠功率。未來(lái)十年內(nèi),將有數(shù)百吉瓦(GW)規(guī)模的AI工廠投入運(yùn)行,NVIDIA DSX AI工廠將以最高效率生成成本極低的Token,同時(shí)增強(qiáng)電網(wǎng)的穩(wěn)定性。


過(guò)去的計(jì)算生態(tài)系統(tǒng)中,NVIDIA的軟硬件計(jì)算層被集成到第三方平臺(tái)中服務(wù)終端市場(chǎng)。但如今我們面對(duì)的是一個(gè)AI工廠生態(tài)系統(tǒng)。NVIDIA的業(yè)務(wù)向下游延伸到了整個(gè)基礎(chǔ)設(shè)施生態(tài),不僅制造GPU和系統(tǒng),更致力于幫助客戶(hù)建設(shè)極其復(fù)雜的AI基礎(chǔ)設(shè)施。


一座一吉瓦(GW)規(guī)模的AI工廠,造價(jià)曾是兩三百億美元,現(xiàn)在已達(dá)五六百億美元,很快就會(huì)攀升至一千億美元。上千億美元投入的工廠必須在初次運(yùn)行就取得成功并立即見(jiàn)效。


面對(duì)如此高昂的資本成本和極端的復(fù)雜性,我們利用Omniverse完成了這一切。過(guò)去我們是在計(jì)算機(jī)里設(shè)計(jì)芯片和模擬系統(tǒng),而現(xiàn)在在破土動(dòng)工投入真金白銀之前,我們就能在Omniverse的數(shù)字世界里構(gòu)建任意規(guī)模的龐大系統(tǒng)。


這就是我們被稱(chēng)為DSX的生態(tài)系統(tǒng),RTX代表GPU,DGX代表系統(tǒng),而DSX則代表基礎(chǔ)設(shè)施。憑借涵蓋軟硬件的全棧技術(shù)能力,我們幫助許多曾經(jīng)的小公司成長(zhǎng)為了世界級(jí)的AI云。


例如CoreWeave現(xiàn)在的估值已高達(dá)數(shù)百億美元且增長(zhǎng)迅猛,Nebius也同樣保持著驚人的增速。這些云服務(wù)商擁有許多杰出的客戶(hù),如編程工具Cursor、圖像生成公司Black Mountain Labs、World Labs、Revolut以及Shopify。其他區(qū)域如英國(guó)的Nscale正在服務(wù)英國(guó)電信和Google,韓國(guó)的Naver Cloud在服務(wù)韓國(guó)銀行和現(xiàn)代汽車(chē),印度的Yotta、新加坡的AI Singapore、印尼的Indosat,以及臺(tái)灣的GMI都在為區(qū)域乃至全球客戶(hù)提供卓越的AI服務(wù)。


AI將無(wú)處不在,每個(gè)地區(qū)、每家公司都將由其驅(qū)動(dòng)。建立AI云不僅需要NVIDIA底層的硬件、軟件、庫(kù)以及全球開(kāi)發(fā)者生態(tài),更需要應(yīng)對(duì)AI工廠基礎(chǔ)設(shè)施在資金和資產(chǎn)層面的龐大復(fù)雜性。正因如此,NVIDIA成功轉(zhuǎn)型為AI基礎(chǔ)設(shè)施公司。



3. 構(gòu)建AI工廠生態(tài):推出端到端Vera Rubin系統(tǒng)


幫助客戶(hù)構(gòu)建和部署AI工廠至關(guān)重要,因?yàn)?strong>在今天算力就是收入,算力就是利潤(rùn)。一座斥資數(shù)百億乃至上千億美元的基礎(chǔ)設(shè)施,其上線速度、吞吐量、可靠性和使用壽命直接決定了企業(yè)的生死存亡。


NVIDIA之所以是卓越的合作伙伴,是因?yàn)槲覀兙邆淙傻哪芰?。我們并非紙上談兵,而是親自投入數(shù)十億美元構(gòu)建并連接了整個(gè)基礎(chǔ)設(shè)施,確保一切運(yùn)轉(zhuǎn)良好。通過(guò)極致的協(xié)同設(shè)計(jì)與全系統(tǒng)模擬,我們?cè)谑讉€(gè)Token生成時(shí)間(Time to First Token)、首次推理時(shí)間以及訓(xùn)練啟動(dòng)速度上都處于世界領(lǐng)先水平。


更重要的是我們的每瓦吞吐量和每瓦Token數(shù)絕對(duì)是世界一流的。如果你的數(shù)據(jù)中心只有一吉瓦的容量,那么在功率上限鎖定的情況下,每瓦特的吞吐量就等于你的直接收入,因?yàn)槊恳粋€(gè)Token都是盈利的。未來(lái)算力即收入,每瓦性能即收入。僅僅因?yàn)樾酒瑑r(jià)格便宜就選擇錯(cuò)誤的架構(gòu)是毫無(wú)意義的。必須確保每瓦特營(yíng)收的最大化,買(mǎi)得越多賺得越多。


第三是可靠性。參觀數(shù)據(jù)中心會(huì)發(fā)現(xiàn)其中有數(shù)百萬(wàn)根電纜和活動(dòng)部件,讓這些計(jì)算機(jī)和諧運(yùn)轉(zhuǎn)且保持極高可靠性的概率極低,這極其困難。我們已在大規(guī)模環(huán)境下運(yùn)行多時(shí),積累了至關(guān)重要的經(jīng)驗(yàn),尤其是拉長(zhǎng)中斷間的平均時(shí)間。


此外系統(tǒng)壽命面臨巨大挑戰(zhàn),因?yàn)檐浖诓粩嗟?。四年前的Hopper架構(gòu)時(shí)代和六年前的Ampere架構(gòu)時(shí)期,AI已經(jīng)發(fā)生翻天覆地變化。從最初的CNN到Transformer,再到混合專(zhuān)家模型,如今我們步入了智能體系統(tǒng)時(shí)代。


軟件行業(yè)每隔幾個(gè)月就會(huì)涌現(xiàn)新技術(shù)。如果架構(gòu)不夠靈活生態(tài)不夠豐富,就無(wú)法持久應(yīng)對(duì)這種發(fā)展曲線,難以預(yù)測(cè)系統(tǒng)壽命。但NVIDIA的系統(tǒng)遍布全球,開(kāi)發(fā)者從CUDA起步,使得系統(tǒng)生命周期和生態(tài)資產(chǎn)能夠持續(xù)更久。長(zhǎng)壽命資產(chǎn)意味著極低的總體擁有成本,這就是我們的核心優(yōu)勢(shì)。由于大家對(duì)盈利性AI的需求極其旺盛,算力成為目前的瓶頸。因此我們將全力以赴,幫助世界各地建立AI工廠。


我非常高興地宣布,Vera Rubin現(xiàn)已全面投入量產(chǎn)。我們?yōu)閂era Rubin建立的供應(yīng)鏈規(guī)模是Grace Blackwell的兩倍。過(guò)去組裝一個(gè)Grace Blackwell機(jī)架需要兩小時(shí),現(xiàn)在只需五分鐘。這不僅大幅提升了產(chǎn)能,吞吐量也顯著加快,以滿(mǎn)足龐大的市場(chǎng)需求。


大語(yǔ)言模型用于生成答案,而智能體AI處理的則是完全不同的問(wèn)題。智能體需要觀察推理規(guī)劃并使用工具,管理海量上下文和長(zhǎng)短期記憶,甚至能按需啟動(dòng)子代理。NVIDIA Vera Rubin正是專(zhuān)為處理智能體AI打造的多機(jī)架級(jí)系統(tǒng)。從第一代DGX-1到如今的Vera Rubin,我們不斷挑戰(zhàn)芯片和系統(tǒng)的極限。構(gòu)成Vera Rubin的七顆全新芯片由TSMC采用3納米工藝、CoWoS封裝技術(shù)以及HBM4內(nèi)存制造。單塊計(jì)算板集成六萬(wàn)億個(gè)晶體管。Vera Rubin MVL72負(fù)責(zé)推理規(guī)劃和上下文理解,采用無(wú)電纜原位制造和液冷技術(shù),實(shí)現(xiàn)AI工廠規(guī)模下的極高韌性。


同時(shí)推出的Vera CPU機(jī)架集成了256顆液冷CPU,專(zhuān)責(zé)模型編排與工具啟動(dòng)。在Foxconn和Quanta,具備極低延遲的Grok 3 LPX正在成型。如果說(shuō)MVL72旨在實(shí)現(xiàn)最高吞吐量,那么Grok LPX則致力于最低延遲生成。加上處理AI存儲(chǔ)與安全的Vera BlueField-4,以及全球首款配備共封裝光學(xué)器件的以太網(wǎng)交換機(jī)Spectrum-X,我們與臺(tái)灣供應(yīng)鏈共同為AI時(shí)代重新定義計(jì)算。


Vera Rubin不僅僅是為運(yùn)行AI而生,更是專(zhuān)為運(yùn)行智能體系統(tǒng)設(shè)計(jì)的超級(jí)計(jì)算機(jī)。過(guò)去我們打造Hopper主要是為了預(yù)訓(xùn)練,那時(shí)人們認(rèn)為推理很簡(jiǎn)單。但混合專(zhuān)家模型極其復(fù)雜,要在實(shí)現(xiàn)高吞吐量的同時(shí)保持極快響應(yīng)非常困難。這就是我們創(chuàng)造NVLINK-72的原因,它讓NVIDIA的Token生成成本降到全球最低。如今Vera Rubin超越了單純推理,主導(dǎo)智能體系統(tǒng)中的推理任務(wù)。整個(gè)系統(tǒng)摒棄了繁雜電纜,可靠性達(dá)到前所未有的高度。除了強(qiáng)大的計(jì)算和存儲(chǔ)托盤(pán),Vera Rubin還配備了革命性的NVLINK交換機(jī)和橫向擴(kuò)展的以太網(wǎng)交換機(jī),如今NVIDIA已經(jīng)成為全球最大的網(wǎng)絡(luò)公司。



4.專(zhuān)為智能體設(shè)計(jì):顛覆性處理器Vera CPU


接下來(lái)我們要談?wù)剬?zhuān)為AI時(shí)代打造的Vera CPU。迄今為止的所有CPU都是為人類(lèi)設(shè)計(jì)的,按秒計(jì)費(fèi)按核心出租。但智能體不同于人類(lèi),它們?nèi)狈δ托?,生活在以納秒為單位的世界里。智能體在調(diào)用工具或訪問(wèn)數(shù)據(jù)庫(kù)時(shí),任何等待都會(huì)阻礙下一步行動(dòng),因此極低的CPU延遲至關(guān)重要。


為實(shí)現(xiàn)極致交互,我們創(chuàng)造了Vera CPU。在Vera Rubin機(jī)架中,CPU負(fù)責(zé)編排GPU管理緩存以及處理安全隔離。智能體正以驚人速度訪問(wèn)內(nèi)存,存儲(chǔ)服務(wù)器和CPU已成為數(shù)據(jù)中心性能的關(guān)鍵瓶頸。AI工廠的核心經(jīng)濟(jì)價(jià)值在于不斷生成Token,絕不能讓CPU成為阻礙。因此我們從零開(kāi)始,專(zhuān)為智能體構(gòu)建了全新架構(gòu)。Vera CPU不僅具備絕對(duì)頂尖的單線程性能,每時(shí)鐘周期可執(zhí)行十條指令,其數(shù)據(jù)吞吐帶寬也達(dá)到世界頂級(jí)水平。


智能體系統(tǒng)本質(zhì)上是解構(gòu)且分布式的,核心與存儲(chǔ)、GPU之間的數(shù)據(jù)傳輸速度是關(guān)鍵。Vera CPU的連接織網(wǎng)傳輸速度達(dá)到光速級(jí),是首款支持PCIe Gen 6和LPDDR5X內(nèi)存的處理器,總帶寬3倍于傳統(tǒng)CPU。未來(lái)將有數(shù)十億智能體高頻調(diào)用資源,為了不搶占生成Token所需的電力,Vera CPU在保持高性能的同時(shí)實(shí)現(xiàn)極高能效比。這四大屬性使其在真實(shí)單線程性能上遠(yuǎn)超現(xiàn)有最高性能的x86處理器,實(shí)現(xiàn)史無(wú)前例的性能飛躍。


智能體時(shí)代徹底改變了CPU的角色。如果把GPU比作管弦樂(lè)隊(duì),CPU就是指揮家。傳統(tǒng)的按核心切片虛擬化模式已成為限制GPU利用率的瓶頸。Vera采用NVIDIA定制的Olympus核心和可擴(kuò)展一致性架構(gòu),專(zhuān)門(mén)針對(duì)數(shù)據(jù)中心工作負(fù)載、分支密集型Python運(yùn)行和沙箱代碼執(zhí)行進(jìn)行優(yōu)化。通過(guò)神經(jīng)分支預(yù)測(cè)器和大型亂序執(zhí)行引擎,Vera確保指令持續(xù)高效流動(dòng)。它還能在不犧牲帶寬的前提下糾正多個(gè)內(nèi)存錯(cuò)誤,大幅降低延遲。


借助第二代可擴(kuò)展一致性結(jié)構(gòu),Vera的核間通信速度比傳統(tǒng)CPU快50%。它通過(guò)NVLink將GPU直接連接到網(wǎng)絡(luò)架構(gòu),提供了近兩倍于x86的智能體沙箱性能。每一家開(kāi)展AI業(yè)務(wù)的公司都已對(duì)Grace進(jìn)行認(rèn)證并優(yōu)化了軟件棧,而Vera將無(wú)縫繼承這一龐大生態(tài),成為全球優(yōu)化程度最高的智能體CPU。在實(shí)際性能評(píng)測(cè)中,Vera將通用數(shù)據(jù)庫(kù)引擎SQL的運(yùn)行速度提升了驚人的三倍。這款專(zhuān)為智能體時(shí)代打造的CPU,必將成為我們新增長(zhǎng)引擎。


下一個(gè)是實(shí)時(shí)流處理。記住你的AI將不僅僅是閱讀文檔,它還會(huì)監(jiān)測(cè)遙測(cè)數(shù)據(jù),特別是在工廠或證券交易所內(nèi)部。涌入的數(shù)據(jù)脈沖會(huì)進(jìn)入CPU。


Vera CPU正在為New York Stock Exchange運(yùn)行實(shí)時(shí)流處理。其主席Lynn Martin一直非常慷慨地與我們合作。Vera CPU提升了六倍的性能,全是因?yàn)閱尉€程指令執(zhí)行帶寬以及核心內(nèi)部和外部的帶寬。Vera是徹底的革命性產(chǎn)品。通常X因子是討論GPU時(shí)才會(huì)談?wù)摰臇|西,很少有人會(huì)在與CPU相關(guān)的真實(shí)負(fù)載上談?wù)撍?。我為團(tuán)隊(duì)感到自豪,你們做得太棒了。我們即將推出一份非凡的路線圖,幾乎所有人都在興奮地支持Vera。


這是Vera開(kāi)放的開(kāi)端,它開(kāi)辟了一個(gè)全新的市場(chǎng)。智能體是一種全新的工作負(fù)載。過(guò)去我們?yōu)槿祟?lèi)構(gòu)建CPU,現(xiàn)在我們需要為智能體系統(tǒng)構(gòu)建CPU。它們的特性截然不同,所以舊的CPU無(wú)法勝任。我們正在構(gòu)建數(shù)以百萬(wàn)計(jì)的Era系統(tǒng)。臺(tái)灣的ODM、所有OEM以及代理型公司等早期采用者已與我們一同進(jìn)入這個(gè)以前從未存在過(guò)的新市場(chǎng)。它不會(huì)取代舊市場(chǎng),而是一個(gè)全新的面向智能體的CPU市場(chǎng)。因?yàn)橹悄荏w的數(shù)量將遠(yuǎn)超人類(lèi),且它們非常不耐煩,所以這個(gè)市場(chǎng)肯定會(huì)比上一個(gè)更大。這就是NVIDIA Vera CPU。



5. 賦能企業(yè)AI平臺(tái):Agent Toolkit與開(kāi)源模型Nemotron


核心要點(diǎn)在于這是未來(lái)十年的計(jì)算模式。智能體和控制框架編排著大型語(yǔ)言模型,每家公司都將運(yùn)行這種模式并成為智能體公司。每家公司內(nèi)部都將有智能體在運(yùn)行,他們會(huì)意識(shí)到智能體將需要自己的操作系統(tǒng)。企業(yè)都在問(wèn)該如何安全運(yùn)行并針對(duì)自身工作負(fù)載構(gòu)建智能體,因此我們推出了面向企業(yè)級(jí)AI的NVIDIA Agent Toolkit。


回看我過(guò)去五年或十年的GTC演講就能看到今天,因?yàn)槲覀円恢痹跒檫@一刻做準(zhǔn)備。企業(yè)要構(gòu)建代理即服務(wù)或運(yùn)行代理需要具備四樣?xùn)|西。首先是越聰明、越快、越便宜越好的大語(yǔ)言模型。


其次你需要一套框架來(lái)編排整個(gè)流程。第三是自帶技能并供模型使用的工具,比如我展示的CUDA-X庫(kù),它們將成為未來(lái)智能體的神級(jí)工具。


最后你需要一個(gè)能將一切整合在一起的操作系統(tǒng)或運(yùn)行時(shí)。這就是NVIDIA Toolkit for Agents。它包含你可以修改的世界級(jí)開(kāi)源模型,并能運(yùn)行來(lái)自任何人的驚人代碼和智能體。你可以在名為Open Shell的容器中高度安全地運(yùn)行它。該Shell保護(hù)智能體遵循安全策略,同時(shí)保護(hù)隱私、權(quán)利和身份。開(kāi)源的NVIDIA Open Shell正被Red Hat、Canonical和Microsoft等廣泛采用。


Open Shell運(yùn)行時(shí)已針對(duì)無(wú)處不在的NVIDIA AI平臺(tái)進(jìn)行全面優(yōu)化,因此你可以在任何云端、本地甚至設(shè)備端運(yùn)行Open Shell。你擁有了工具、庫(kù)、可修改的模型以及像Open Claw和Hermes這樣的智能體框架,現(xiàn)在可以在任何地方本地運(yùn)行。這四點(diǎn)代表了現(xiàn)代企業(yè)的操作系統(tǒng)。


我最喜歡的智能體用例之一是芯片設(shè)計(jì)師,這是NVIDIA所做的最重要的事情。我們理所當(dāng)然地與Cadence合作,由Codex或Cloud Code編排構(gòu)建了一個(gè)芯片設(shè)計(jì)超級(jí)智能體。它將RTL、架構(gòu)圖和規(guī)格說(shuō)明作為輸入。我們共同創(chuàng)建了針對(duì)NVIDIA運(yùn)行時(shí)環(huán)境并使用Nemotron優(yōu)化的超級(jí)代理。


設(shè)計(jì)芯片及其運(yùn)行系統(tǒng)是極其艱巨的工程挑戰(zhàn),包含數(shù)萬(wàn)億個(gè)微觀三維晶體管。每一個(gè)柵極和導(dǎo)線必須同步至皮秒級(jí)完美協(xié)同工作。因物理原型速度慢且成本高,工程師在數(shù)字領(lǐng)域工作。每顆芯片始于架構(gòu)規(guī)范,隨后翻譯成芯片設(shè)計(jì)語(yǔ)言RTL并在仿真中驗(yàn)證。單一bug能讓芯片推遲數(shù)月,NVIDIA的數(shù)千名工程師每年花費(fèi)數(shù)十億計(jì)算小時(shí)運(yùn)行和調(diào)試數(shù)百萬(wàn)個(gè)測(cè)試,該周期通常需數(shù)周。為壓縮此周期雙方構(gòu)建了設(shè)計(jì)驗(yàn)證代理。Codex編排流程,Cadence Chip Stack啟動(dòng)RTL驗(yàn)證循環(huán),由Nemotron提供動(dòng)力并由NVIDIA Open Shell確保安全。它調(diào)用RTL生成、測(cè)試平臺(tái)創(chuàng)建、回歸測(cè)試及調(diào)試等專(zhuān)家級(jí)子代理。


系統(tǒng)自動(dòng)運(yùn)行,使用Cadence Excellium進(jìn)行數(shù)百次仿真并用Jasper進(jìn)行形式驗(yàn)證。揭示設(shè)計(jì)缺陷并修復(fù)代碼bug后,原本數(shù)周的工作現(xiàn)在只需數(shù)小時(shí)即可完成,驗(yàn)證周期縮短至四十分之一以下。NVIDIA與Cadence正利用AI Agents重塑芯片設(shè)計(jì)。我們將聘請(qǐng)成千上萬(wàn)個(gè)Cadence超級(jí)代理協(xié)同工作,加速公司發(fā)展并以更快的速度創(chuàng)造驚人事物。包含模型的工具包利用了Cadence仿真器和形式驗(yàn)證系統(tǒng)等工具。我們正與其緊密合作在CUDA上加速所有工具,因?yàn)榇硇枰⒓吹玫酱鸢浮?/p>


模型、框架、CUDA加速庫(kù)、工具及運(yùn)行時(shí)環(huán)境融合在一起。Cadence從卓越的模型出發(fā),利用其專(zhuān)有知識(shí)進(jìn)行修改和微調(diào),創(chuàng)建出精通其工作流的超級(jí)代理。這個(gè)卓越的模型就是Nemotron。


NVIDIA致力于為世界構(gòu)建開(kāi)放模型以供大家創(chuàng)建專(zhuān)屬智能體,今天我們正式發(fā)布Nemotron 3 Ultra。這款極其聰明的下一代開(kāi)源模型不僅提供模型本身,還提供所有的訓(xùn)練數(shù)據(jù)。得益于優(yōu)秀合作伙伴聯(lián)盟的相互貢獻(xiàn),Nemotron基于全球最大規(guī)模之一的長(zhǎng)期推理、任務(wù)解決及工具使用數(shù)據(jù)集訓(xùn)練而成。


訓(xùn)練腳本和數(shù)據(jù)已完全向您開(kāi)放。作為開(kāi)源模型的巔峰之作和全球領(lǐng)先的開(kāi)源模型系統(tǒng)策略,我們的目標(biāo)是讓您全盤(pán)接收并讓它為您所用。Nemotron 3 Ultra的速度快了五倍。這是全球首款基于SSM狀態(tài)空間模型與混合專(zhuān)家模型(MoE)的混合架構(gòu)模型。其極快的速度讓您能快速思考,在相同成本下思考得更久。與全球最頂尖、最具性?xún)r(jià)比的開(kāi)源模型相比,它價(jià)格便宜30%,總算力和總推理時(shí)間成本也低30%。它擁有前沿智能且完全開(kāi)源。目前我們已在開(kāi)發(fā)Nemotron 4.0。


從模型到框架、工具、技能和運(yùn)行時(shí)環(huán)境的整個(gè)工具包,讓全球每家企業(yè)現(xiàn)在都有能力創(chuàng)建屬于自己的智能體。我們正與Cadence、CrowdStrike、Solon、Palantir、SAP及ServiceNow等眾多公司合作。人們?cè)f(shuō)智能體將顛覆這些市場(chǎng),但我認(rèn)為恰恰相反,Agents將為合作伙伴創(chuàng)造有史以來(lái)最大的機(jī)遇。我們擁有NVIDIA Agentic Toolkit for Enterprise AI來(lái)幫助他們。


總結(jié)來(lái)說(shuō)Vera Rubin已全面投產(chǎn),專(zhuān)為新一代Agent打造的Vera CPU也已問(wèn)世。NVIDIA的企業(yè)級(jí)AI工具包將讓每家企業(yè)和軟件公司都能構(gòu)建Agent。



6. 重塑個(gè)人電腦:搭載RTX Spark的PC新紀(jì)元


我在臺(tái)灣的許多朋友和合作伙伴的公司都是從這里起步的,在很多方面這是現(xiàn)代計(jì)算機(jī)行業(yè)40年來(lái)的開(kāi)端。NVIDIA成立33年,我們出現(xiàn)時(shí)PC行業(yè)正處于Windows 3.1時(shí)代。Windows 95將PC從企業(yè)帶出,打造成人人擁有的消費(fèi)電子設(shè)備。該計(jì)算平臺(tái)的架構(gòu)設(shè)計(jì)恰到好處,系統(tǒng)BIOS、開(kāi)放芯片組、可連接安裝的驅(qū)動(dòng)程序以及帶有多媒體API的抽象層,開(kāi)啟了PC時(shí)代,每個(gè)元素對(duì)PC普及都至關(guān)重要。40年后的今天,Microsoft和NVIDIA將重新發(fā)明新PC。


明晚我將與Satya深入探討我們共同開(kāi)展的工作。過(guò)去三年我們重塑PC工作方式就是為迎接這一時(shí)刻。智能體不僅在AI云和企業(yè)內(nèi)部運(yùn)行,也將運(yùn)行在你的PC上。當(dāng)PC擁有自主智能體時(shí),它能幫助和理解你,你可以與它對(duì)話(huà)、讓它注視你、讀取文件并做研究。這個(gè)全新操作系統(tǒng)是舊操作系統(tǒng)加上大語(yǔ)言模型。大語(yǔ)言模型是現(xiàn)代版DirectX,它理解提示詞和計(jì)算機(jī)視覺(jué),并能生成音視頻。作為PC和智能化的延伸,現(xiàn)代應(yīng)用程序已成為一個(gè)智能體運(yùn)行時(shí)。


在AI時(shí)代重構(gòu)PC的想法引發(fā)了個(gè)人計(jì)算革命。我們的個(gè)人AI在安全沙箱中持續(xù)運(yùn)行并完成工作,芯片和操作系統(tǒng)必須隨之進(jìn)化。隆重推出NVIDIA RTX Spark,我們將33年經(jīng)驗(yàn)濃縮于這顆芯片中。它配備6144個(gè)CUDA核心的Blackwell RTX GPU、1Petaflop的AI性能和定制化20核Grace CPU。該芯片采用TSMC 3納米工藝和700億個(gè)晶體管,通過(guò)NVLINK與MediaTek合作打造,擁有128GB統(tǒng)一內(nèi)存。結(jié)合面向智能體的Windows平臺(tái),我們正重新定義用于創(chuàng)作、游戲及智能體的個(gè)人電腦。游戲是我們最心系的部分,將迎來(lái)全新的《極限競(jìng)速》和007游戲,同時(shí)NVIDIA推出RTX Spark筆記本電腦。


這是世界上最驚人的芯片,也是我們與MediaTek合作打造的精美芯片N1X,需耗費(fèi)33年才能打造出來(lái)。因?yàn)?00%的NVIDIA軟件棧都運(yùn)行在這里,無(wú)論是數(shù)字生物學(xué)、地震處理、天體物理還是所有CUDA相關(guān)的物理、基因組學(xué)、AI和計(jì)算機(jī)圖形處理都不成問(wèn)題。Microsoft和NVIDIA的細(xì)致優(yōu)化使得這臺(tái)電腦能運(yùn)行幾乎所有已創(chuàng)造出的程序以及智能體。


想象一下,這里的一切都將在PC上本地運(yùn)行Nemotron 3 Ultra或連接云端Claude等模型,創(chuàng)造出驚人效果。每座房子的設(shè)計(jì)都需要大量工具和時(shí)間,現(xiàn)在運(yùn)行在本地RTX Spark上的智能體能通過(guò)開(kāi)放式Shell沙箱幫我設(shè)計(jì)。它運(yùn)行Hermes框架并連接云端的Claude Sonnet。我分享概念草圖、風(fēng)格情緒板和提示詞后,智能體便打開(kāi)Rhino進(jìn)行場(chǎng)地建模、塑造地形和建筑體量。它提出方案并針對(duì)成本與舒適度進(jìn)行優(yōu)化,隨后生成內(nèi)部布局、墻壁和動(dòng)線。


我隨時(shí)可介入調(diào)整,門(mén)窗和結(jié)構(gòu)元素會(huì)自動(dòng)放置,智能體還能檢測(cè)并修復(fù)自身錯(cuò)誤。批準(zhǔn)后智能體將模型完整導(dǎo)出到Blender,并在傳輸中保持設(shè)計(jì)上下文完整。我微調(diào)材質(zhì)后,代理使用帶有Flux.1的生成式AI模型在多種光照和視角下將其渲染至照片級(jí)真實(shí)感。曾經(jīng)復(fù)雜的流程在智能體引導(dǎo)下變得極其簡(jiǎn)單高效。在RTX Spark上進(jìn)行創(chuàng)作,設(shè)計(jì)速度緊隨想象力,這將為所有開(kāi)發(fā)者打造出色的PC智能體體驗(yàn)。


下一個(gè)是Adobe。這是一套全球數(shù)千萬(wàn)人正在使用的令人驚嘆的工具套件。他們重新設(shè)計(jì)了Adobe Photoshop和Premiere的核心架構(gòu),并將針對(duì)RTX Spark發(fā)布。它的速度提升了兩倍,本身就已經(jīng)很快了,現(xiàn)在速度將再提升兩倍。它的設(shè)計(jì)對(duì)智能體非常友好,通過(guò)MCP服務(wù)器現(xiàn)在可以與筆記本電腦上的智能體交互。


眾多客戶(hù)和合作伙伴對(duì)將RTX Spark推向市場(chǎng)感到非常興奮。這是40年來(lái)首次全產(chǎn)品線的PC變革,每個(gè)人都將支持RTX Spark,共同打造極其智能、強(qiáng)大且美觀的筆記本電腦。


但這還不是全部,RTX Spark是對(duì)筆記本電腦的重塑。Microsoft和NVIDIA正在重塑整個(gè)PC領(lǐng)域,今天我們將發(fā)布一個(gè)涵蓋臺(tái)式機(jī)、筆記本電腦和工作站的全新系列,它們100%兼容Windows,100%支持CUDA,并且100%搭載NVIDIA AI Tensor Core。全球所有在NVIDIA上運(yùn)行的一切都可以在這里運(yùn)行,這是40年來(lái)首個(gè)完全重新設(shè)計(jì)的PC系列。


令人驚嘆的還有RTX Spark筆記本電腦和臺(tái)式機(jī)產(chǎn)品。這個(gè)智能體可以全天候免費(fèi)運(yùn)行,你可以下載自己的智能體并讓它一直運(yùn)行。它沒(méi)有電量焦慮,放在家里連接著整個(gè)房屋的設(shè)備,包括筆記本電腦、顯示器、攝像頭、烘干機(jī)、飲水機(jī)、熱水器以及安保系統(tǒng)等。這成為了你的個(gè)人AI代理,隨著時(shí)間推移它會(huì)變得越來(lái)越聰明。今天我們有Nemotron 3 Ultra,未來(lái)會(huì)有Nemotron 4、Nemotron 5甚至6。它在家?guī)湍闾幚砀鞣N事務(wù),比如預(yù)訂旅行。


如果你想要一個(gè)極其強(qiáng)大的系統(tǒng),這里有適用于Windows的DGX station。它能運(yùn)行Windows中的一切,擁有768GB內(nèi)存,可以運(yùn)行萬(wàn)億參數(shù)模型。它具備20 petaflops算力和每秒8TB的顯存帶寬,就放在你的辦公桌旁。如果你是大語(yǔ)言模型或智能體開(kāi)發(fā)者,把它放在桌邊就能提供所需的所有算力,部署時(shí)再放入云端。


回顧過(guò)去,15到20年前我們有電話(huà)的概念,今天我們有PC的概念。如今你想到手機(jī)時(shí),幾乎會(huì)用它做任何事情,唯一不會(huì)用它做的就是打電話(huà)。因此手機(jī)對(duì)你的意義與過(guò)去的電話(huà)截然不同。我敢肯定,十年后的PC與你今天所認(rèn)為的PC將會(huì)發(fā)生巨大變化,它將不再僅僅是啟動(dòng)應(yīng)用或打字的工具。


我完全可以想象,就像現(xiàn)在許多家庭擁有家庭影院、大電視、割草機(jī)或洗碗機(jī)一樣,總有一天你的家里實(shí)際上會(huì)有一臺(tái)AI超級(jí)計(jì)算機(jī)。它運(yùn)行著你所有的代理和助手,一直為你處理各種事情。你會(huì)在家里配備輔助AI智能體計(jì)算機(jī),隨著時(shí)間推移,它們對(duì)你來(lái)說(shuō)會(huì)變得更像R2D2或C-3PO,而不是一臺(tái)傳統(tǒng)PC。這次對(duì)計(jì)算機(jī)的重塑意義不亞于將電話(huà)重塑為智能手機(jī),這是一個(gè)全新產(chǎn)品系列的開(kāi)端。全球100%的PC行業(yè)都已加入我們共同重塑PC。



7. 邁向物理AI世界:Cosmos-3模型與人形機(jī)器人


Agentic AI就像數(shù)字機(jī)器人,能夠理解、推理、規(guī)劃、采取行動(dòng)并使用工具,它們將在所有計(jì)算機(jī)上運(yùn)行。


我們正在研發(fā)人形機(jī)器人、各種類(lèi)型的機(jī)器人、自動(dòng)駕駛汽車(chē)以及衛(wèi)星。農(nóng)業(yè)、制造和重工業(yè)設(shè)備都將實(shí)現(xiàn)代理化,你甚至?xí)碛凶约旱拇碇?。未?lái)的基站和無(wú)線電臺(tái)也將是代理化的,它們能了解流量并與其他基站協(xié)調(diào)以減少能耗,從而提高頻譜效率。未來(lái)一切都將運(yùn)行智能體,將會(huì)有數(shù)千億個(gè)智能體計(jì)算機(jī)運(yùn)行在世界各地。


最大的挑戰(zhàn)是數(shù)據(jù),語(yǔ)言模型可以使用互聯(lián)網(wǎng)上的文本,但物理AI必須具備機(jī)器人的第一人稱(chēng)視角,而世界上大部分視頻數(shù)據(jù)是第三人稱(chēng)的。我們通過(guò)遙操作人類(lèi)演示開(kāi)始,利用Omniverse進(jìn)行模擬,并結(jié)合強(qiáng)化學(xué)習(xí)的可驗(yàn)證獎(jiǎng)勵(lì)來(lái)引導(dǎo)物理AI模型。這樣我們能從第三人稱(chēng)視角學(xué)習(xí)并重新投影到第一人稱(chēng)視角,最終擁有一個(gè)世界基礎(chǔ)模型。


今天我們正式發(fā)布Cosmos-3,這是物理AI的前沿基礎(chǔ)模型。當(dāng)你想要?jiǎng)?chuàng)建任何涉及物理世界的機(jī)器人時(shí),Cosmos-3可以作為伴侶。它能夠理解、推理并生成動(dòng)作,可以在循環(huán)中進(jìn)行模擬甚至作為策略本身。


現(xiàn)實(shí)世界是無(wú)限且不可預(yù)測(cè)的,物理AI需要數(shù)據(jù)但現(xiàn)實(shí)數(shù)據(jù)無(wú)法實(shí)現(xiàn)規(guī)?;?,因此對(duì)于物理AI而言算力即數(shù)據(jù)。Cosmos是一個(gè)面向物理AI的開(kāi)放前沿全能模型,基于全新的混合Transformer架構(gòu)構(gòu)建。像素、動(dòng)作、聲音和語(yǔ)言流入自回歸Transformer,它對(duì)擴(kuò)散Transformer進(jìn)行推理、規(guī)劃和指令引導(dǎo)。開(kāi)發(fā)者可以針對(duì)不同具身形態(tài)和場(chǎng)景對(duì)Cosmos進(jìn)行后期訓(xùn)練。


作為視覺(jué)語(yǔ)言模型,Cosmos觀察物理世界并理解場(chǎng)景;作為世界模型,它能生成符合物理規(guī)律的合成視頻;作為模擬器,它為策略訓(xùn)練和評(píng)估實(shí)現(xiàn)閉環(huán)。對(duì)Cosmos進(jìn)行后訓(xùn)練后,它便進(jìn)化為世界動(dòng)作模型,能為各類(lèi)機(jī)器人進(jìn)行感知、推理、規(guī)劃并生成動(dòng)作。我們開(kāi)放了模型、數(shù)據(jù)甚至訓(xùn)練方式,讓你可以自行增強(qiáng)并將其轉(zhuǎn)化為專(zhuān)有模型。


AI技術(shù)棧非常復(fù)雜,包含生成器、模型、模擬器和運(yùn)行時(shí)。自動(dòng)駕駛汽車(chē)本質(zhì)上是一個(gè)物理AI智能體機(jī)器人,今天我們宣布推出AlphaGo 2開(kāi)源模型。目前正在制造NVIDIA Hyperion汽車(chē)的廠商占據(jù)了全球汽車(chē)份額的80%。


我們也已經(jīng)接入了移動(dòng)出行服務(wù),世界上大約97%的移動(dòng)出行服務(wù)正在與我們建立連接。當(dāng)我們基于Kalos操作系統(tǒng)在Hyperion運(yùn)行時(shí)上部署AlphaGo時(shí),將能夠連接全球的所有這些服務(wù)。AlphaGo是全球首款具備推理能力的自動(dòng)駕駛汽車(chē)。它在行駛中會(huì)不斷思考,實(shí)時(shí)規(guī)劃路線,微調(diào)避讓靜止車(chē)輛,在交叉路口和停車(chē)標(biāo)志前停車(chē),并且主動(dòng)禮讓行人與橫向車(chē)流。


我們創(chuàng)造的技術(shù)同樣適用于人形機(jī)器人。NVIDIA ISAAC GROOT是我們的人形機(jī)器人技術(shù)棧,涵蓋了模型、數(shù)據(jù)生成、仿真、運(yùn)行時(shí)以及操作系統(tǒng)。無(wú)論是云端或PC端的智能體系統(tǒng),還是自動(dòng)駕駛汽車(chē)與機(jī)器人的協(xié)作系統(tǒng),它們的計(jì)算模式完全相同。我們垂直且完整地構(gòu)建了一切,并與共同設(shè)計(jì)相集成,然后將其完全開(kāi)放供每個(gè)人使用。為了交付這些參考平臺(tái),就像我們對(duì)待PC和自動(dòng)駕駛汽車(chē)那樣,我們現(xiàn)在也要為機(jī)器人打造參考平臺(tái)。


今天我們宣布推出NVIDIA ISAAC GROOT參考人形機(jī)器人。該機(jī)器人擁有31個(gè)自由度,每只手擁有25個(gè)自由度,身高6英尺,體重150磅。


這個(gè)平臺(tái)運(yùn)行著新的Thor芯片以及我們整個(gè)數(shù)據(jù)生成和仿真軟件棧,全部集成在一個(gè)專(zhuān)為開(kāi)發(fā)者設(shè)計(jì)的機(jī)器人中。它為高等教育和大學(xué)研究人員構(gòu)建,解決了他們從零開(kāi)始拼湊仿真器、遙操作和數(shù)據(jù)流水線的難題。


ISAAC GROOT提供了開(kāi)放模型、仿真與訓(xùn)練庫(kù)、數(shù)據(jù)生成器和機(jī)器人計(jì)算機(jī),全流程數(shù)小時(shí)內(nèi)即可就緒。你可以使用Isaac Lab設(shè)置仿真環(huán)境,利用Omniverse和Cosmos生成合成數(shù)據(jù),在Isaac Arena中評(píng)估策略并在Jetson Thor上部署。


在過(guò)去的六個(gè)月里,計(jì)算機(jī)行業(yè)發(fā)生了徹底的改變,智能體與最新前沿模型相融合,使得AI現(xiàn)在能夠從事有用的工作。這種由模型構(gòu)成的智能體計(jì)算模式利用技能調(diào)用工具并在運(yùn)行時(shí)中執(zhí)行,無(wú)論在哪種設(shè)備上模式都是相同的。關(guān)于這種智能體平臺(tái),NVIDIA擁有一套Enterprise AI Toolkit,是與AI互動(dòng)的絕佳方式。


目前Vera Rubin正在全力生產(chǎn)中。Grace Blackwell是專(zhuān)門(mén)為處理AI推理而創(chuàng)造的,而Vera Rubin則是為了運(yùn)行智能體而創(chuàng)造的完整解耦式、分布式智能體處理系統(tǒng)。


NVIDIA已經(jīng)成為一家基礎(chǔ)設(shè)施公司,致力于幫助客戶(hù)實(shí)現(xiàn)利潤(rùn)最大化。用于智能體的CPU有其特殊需求,革命性的NVIDIA Vera正處于產(chǎn)能爬坡階段,目前的訂單量將使其成為公司歷史上最快、最成功的產(chǎn)品發(fā)布。


NVIDIA和Microsoft創(chuàng)建了一個(gè)全新的PC產(chǎn)品線,這種代理式計(jì)算模式將在全球各地的機(jī)器人、衛(wèi)星、基站、工廠以及云端和邊緣設(shè)備中得到復(fù)制。


AI技術(shù)就像一塊五層蛋糕,全球AI云已經(jīng)構(gòu)建了數(shù)吉瓦的容量,DSX保持低功耗運(yùn)行以連接每一個(gè)關(guān)鍵節(jié)點(diǎn)。RTX 4終于到來(lái),這是40年來(lái)PC領(lǐng)域最重大的時(shí)刻,智能體將助力所有工作流。模型在GPU上飛速運(yùn)行,Cosmos構(gòu)建機(jī)器人所需的世界,實(shí)用的AI時(shí)代已經(jīng)到來(lái),智能體正與你并肩協(xié)作。


本文來(lái)自微信公眾號(hào):劃重點(diǎn)KeyPoints,作者:林易

AI原生產(chǎn)品日?qǐng)?bào)頻道: 前沿科技
本內(nèi)容由作者授權(quán)發(fā)布,觀點(diǎn)僅代表作者本人,不代表虎嗅立場(chǎng)。
如對(duì)本稿件有異議或投訴,請(qǐng)聯(lián)系 tougao@huxiu.com。
正在改變與想要改變世界的人,都在 虎嗅APP
蒙阴县| 桐城市| 泰安市| 泾阳县| 同德县| 合山市| 法库县| 新晃| 汤原县| 华阴市| 屏东市| 保德县| 博罗县| 女性| 府谷县| 临泉县| 高碑店市| 白银市| 罗甸县| 辽宁省| 小金县| 镇赉县| 安陆市| 平乡县| 宣城市| 中方县| 许昌县| 榆林市| 海门市| 嘉峪关市| 赤峰市| 清丰县| 海伦市| 清水河县| 鄂托克旗| 河西区| 建宁县| 同心县| 陆川县| 黄大仙区| 分宜县|