久操免费资源,久久伦理一区,国产又黄又爽视频,情草av网,日本久久久在线免费,精品人妻互换一区三区,熟妇女一区二区三区,亚洲AV三区视频免费,老司机在线精品

美國(guó)OpenAI前CTO創(chuàng)辦的Thinking Machines推出的Inkling沿用中國(guó)大模型架構(gòu),借地緣合規(guī)需求開(kāi)辟出自己的市場(chǎng),卻推高了美國(guó)企業(yè)AI成本。 ## 1. 明星團(tuán)隊(duì)的首秀:沿用中國(guó)大模型技術(shù) OpenAI前CTO穆拉蒂創(chuàng)辦的Thinking Machines聚集了約20名OpenAI前員工,融資20億美元,估值達(dá)120億美元,其發(fā)布的首款模型Inkling總參數(shù)9750億,激活參數(shù)410億,支持100萬(wàn)Token上下文,采用寬松Apache 2.0許可證開(kāi)放權(quán)重。該模型的混合專家架構(gòu)主要沿用中國(guó)DeepSeek-V3,后訓(xùn)練冷啟動(dòng)階段使用了中國(guó)Kimi K2.5生成的合成數(shù)據(jù)。 ## 2. 性能價(jià)格對(duì)比:不及中國(guó)頭部模型的“貴替” 多項(xiàng)基準(zhǔn)評(píng)測(cè)顯示,Inkling綜合性能落后于中國(guó)頭部開(kāi)放模型:純文本評(píng)測(cè)得分29.7%,低于Kimi K2.6的35.9%和GLM 5.2的40.1%;SWE-Bench Pro軟件工程評(píng)測(cè)得54.3%,低于Kimi K2.6的58.6%和GLM 5.2的62.1%,僅在部分特定任務(wù)上有優(yōu)勢(shì),未進(jìn)入開(kāi)放模型第一梯隊(duì)。價(jià)格方面,即使是限時(shí)五折后,Inkling 64K版本預(yù)填充Token單價(jià)已是Kimi K2.6的近兩倍,生成價(jià)格也高于Kimi K2.6和GLM 5.2,無(wú)價(jià)格優(yōu)勢(shì)。 ## 3. 技術(shù)選擇的邏輯:開(kāi)放領(lǐng)域中國(guó)模型已成核心參考 OpenAI最新模型均為閉源,核心技術(shù)不對(duì)外公開(kāi),穆拉蒂無(wú)法直接帶出使用前東家商業(yè)機(jī)密;而DeepSeek、Kimi公開(kāi)了架構(gòu)、權(quán)重和技術(shù)方案,Inkling作為開(kāi)放權(quán)重模型,借鑒這些成熟公開(kāi)成果屬于合法合理選擇,可以降低試錯(cuò)成本。這件事釋放了明確信號(hào):在開(kāi)放權(quán)重大模型領(lǐng)域,中國(guó)模型已經(jīng)成為美國(guó)AI研發(fā)團(tuán)隊(duì)的核心參考系。 ## 4. 商業(yè)定位:瞄準(zhǔn)合規(guī)空白的錯(cuò)位競(jìng)爭(zhēng) 此前美國(guó)閉源模型收縮開(kāi)放路線,中國(guó)開(kāi)放大模型憑借高性能、低價(jià)格獲得美國(guó)企業(yè)青睞,2026年2月后中國(guó)模型在美國(guó)企業(yè)平臺(tái)調(diào)用占比每周超30%,最高達(dá)46%,遠(yuǎn)高于2025年上半年的平均4.5%。當(dāng)前美國(guó)對(duì)中國(guó)AI模型監(jiān)管收緊,美國(guó)企業(yè)使用中國(guó)模型面臨越來(lái)越高的合規(guī)不確定性,尤其是涉及敏感業(yè)務(wù)和政府訂單的企業(yè)需求無(wú)法被滿足。Inkling是美國(guó)本土開(kāi)發(fā)的開(kāi)放可定制模型,恰好填補(bǔ)了這一合規(guī)空白,不需要性能超越中國(guó)模型,只要能被美國(guó)企業(yè)接受就能打開(kāi)市場(chǎng),“性能一般”的定位本身就是經(jīng)過(guò)計(jì)算的商業(yè)選擇。 ## 5. 最終結(jié)果:保護(hù)政策反而削弱美國(guó)AI競(jìng)爭(zhēng)力 對(duì)穆拉蒂和Thinking Machines來(lái)說(shuō),性能夠用、價(jià)格更高的Inkling已經(jīng)可以依靠合規(guī)優(yōu)勢(shì)獲得穩(wěn)定市場(chǎng),是成功的商業(yè)布局。對(duì)于美國(guó)AI產(chǎn)業(yè)而言,美國(guó)企業(yè)被迫放棄更便宜更強(qiáng)的中國(guó)模型,只能選擇性能更差價(jià)格更高的本土替代品,基礎(chǔ)模型的差距會(huì)傳導(dǎo)到下游產(chǎn)品,最終推高全行業(yè)成本,削弱美國(guó)AI產(chǎn)業(yè)的整體競(jìng)爭(zhēng)力。
沿用DeepSeek架構(gòu),美國(guó)大模型開(kāi)始抄中國(guó)作業(yè)
2026-07-21 12:48

沿用DeepSeek架構(gòu),美國(guó)大模型開(kāi)始抄中國(guó)作業(yè)

本文來(lái)自微信公眾號(hào): 字母AI ,作者:小金牙


OpenAI前首席技術(shù)官穆拉蒂,做出了一款中國(guó)模型的“貴替”。


Thinking Machines發(fā)布的首款模型Inkling,混合專家架構(gòu)主要沿用DeepSeek-V3,后訓(xùn)練冷啟動(dòng)還使用了Kimi K2.5等開(kāi)放模型生成的數(shù)據(jù)。然而在多項(xiàng)基準(zhǔn)評(píng)測(cè)中,Inkling落后于Kimi和GLM,調(diào)用價(jià)格反而更高。


對(duì)于一家融資20億美元、估值120億美元,團(tuán)隊(duì)中聚集了大量OpenAI前員工的明星公司來(lái)說(shuō),這個(gè)結(jié)果多少有些低于預(yù)期。


但穆拉蒂可能從一開(kāi)始就沒(méi)打算靠Inkling爭(zhēng)奪第一。隨著美國(guó)企業(yè)使用中國(guó)模型面臨越來(lái)越多不確定性,一款性能尚可、支持定制、合規(guī)風(fēng)險(xiǎn)更低的本土開(kāi)放模型,已經(jīng)擁有自己的市場(chǎng)。“貴替”沒(méi)有那么強(qiáng),也不愁“市場(chǎng)”。


穆拉蒂的首款模型,就這?


當(dāng)?shù)貢r(shí)間7月15日,Thinking Machines Lab發(fā)布了成立以來(lái)的首款模型Inkling。


單看配置,這款模型很符合一家明星AI實(shí)驗(yàn)室應(yīng)有的排場(chǎng)。


Inkling采用混合專家架構(gòu),總參數(shù)量達(dá)到9750億,每處理一個(gè)Token會(huì)激活410億參數(shù);預(yù)訓(xùn)練使用了45萬(wàn)億個(gè)Token,數(shù)據(jù)涵蓋文本、圖像、音頻和視頻,最長(zhǎng)支持100萬(wàn)個(gè)Token的上下文。它可以理解文字、圖片和音頻,再以文字形式輸出結(jié)果,還支持通過(guò)調(diào)節(jié)“思考強(qiáng)度”,在性能、速度和成本之間進(jìn)行取舍。


Inkling同時(shí)開(kāi)放了模型權(quán)重,采用相當(dāng)寬松的Apache 2.0許可證。開(kāi)發(fā)者可以下載權(quán)重、自行部署,也可以通過(guò)Thinking Machines旗下的Tinker平臺(tái)對(duì)模型進(jìn)行微調(diào)。


公司給它的定位很明確:與其直接和ChatGPT爭(zhēng)奪普通用戶,Inkling更適合充當(dāng)企業(yè)開(kāi)發(fā)AI應(yīng)用的底座。


不過(guò),Inkling最引人注意的部分,藏在技術(shù)報(bào)告后半段。


Thinking Machines在介紹模型架構(gòu)時(shí)直接寫(xiě)道,Inkling的混合專家設(shè)計(jì)“主要沿用了DeepSeek-V3”。它同樣設(shè)置了大量專家模塊,每個(gè)Token只調(diào)用其中一小部分,并采用了DeepSeek-V3的無(wú)輔助損失負(fù)載均衡等設(shè)計(jì)。


中國(guó)模型對(duì)Inkling的影響還延伸到了訓(xùn)練階段。


Thinking Machines表示,為了啟動(dòng)后訓(xùn)練,公司先用開(kāi)放權(quán)重模型生成的合成數(shù)據(jù)做了一輪監(jiān)督微調(diào),其中明確提到了月之暗面的Kimi K2.5。


整條技術(shù)路線已經(jīng)足夠清楚:一家由OpenAI前首席技術(shù)官創(chuàng)辦的美國(guó)實(shí)驗(yàn)室,首款模型沿用了DeepSeek的架構(gòu),又借助Kimi生成的數(shù)據(jù)完成后訓(xùn)練起步。


借鑒開(kāi)放模型本身沒(méi)有問(wèn)題。DeepSeek和Kimi公開(kāi)權(quán)重并允許開(kāi)發(fā)者使用,科學(xué)研究和工程開(kāi)發(fā)原本就建立在公開(kāi)成果的積累之上。更尷尬的地方在于,Inkling吸收了中國(guó)模型的技術(shù)之后,性能依然沒(méi)有壓過(guò)這些“老師”。


Thinking Machines對(duì)此也沒(méi)有粉飾。公司在發(fā)布文章中直接承認(rèn):“Inkling并非目前表現(xiàn)最強(qiáng)的模型,無(wú)論開(kāi)放模型還是閉源模型?!?/p>


從Thinking Machines公布的結(jié)果看,


.在“人類(lèi)最后的考試”純文本評(píng)測(cè)中,Inkling得分29.7%,Kimi K2.6和GLM 5.2分別達(dá)到35.9%和40.1%;


.加入工具后,Inkling升至46%,依然低于Kimi K2.6的54%和GLM 5.2的54.7%。


.在考察真實(shí)軟件工程能力的SWE-Bench Pro中,Inkling得分54.3%,Kimi K2.6為58.6%,GLM 5.2達(dá)到62.1%;


.Terminal Bench 2.1上的差距更加明顯,Inkling只有63.8%,Kimi K2.6和GLM 5.2分別達(dá)到71.3%和82.7%。


當(dāng)然,Inkling也有自己的長(zhǎng)項(xiàng)。它在網(wǎng)頁(yè)應(yīng)用設(shè)計(jì)、音頻理解和安全性評(píng)測(cè)中表現(xiàn)不錯(cuò),在部分?jǐn)?shù)學(xué)任務(wù)上也能超過(guò)Kimi和DeepSeek。


只是從綜合推理、編程和智能體能力來(lái)看,它目前很難被歸入開(kāi)放模型的第一梯隊(duì)。


性能沒(méi)有沖到最前面,價(jià)格同樣沒(méi)給出驚喜。


在Tinker平臺(tái)上,64K版本Inkling每100萬(wàn)Prefill Token收費(fèi)1.87美元,每100萬(wàn)Sample Token收費(fèi)4.68美元。前者可以粗略理解為輸入成本,后者接近生成成本,而且這已經(jīng)是“限時(shí)五折價(jià)”。256K版本的價(jià)格更高,分別達(dá)到3.74美元和9.36美元。


作為對(duì)比,Kimi K2.6官方API每100萬(wàn)輸入和輸出Token分別收費(fèi)0.95美元和4美元,GLM5.2分別為1.4美元和4.4美元。


Tinker同時(shí)提供訓(xùn)練和采樣服務(wù),與普通模型API并非完全相同的計(jì)費(fèi)口徑。但按照上述價(jià)格粗略比較,Inkling的預(yù)填充價(jià)格接近Kimi K2.6的兩倍,生成價(jià)格也高于Kimi K2.6和GLM5.2,暫時(shí)沒(méi)有體現(xiàn)出價(jià)格優(yōu)勢(shì)。


于是,Thinking Machines的首款模型呈現(xiàn)出一種有些微妙的局面:架構(gòu)參考DeepSeek,后訓(xùn)練借力Kimi,綜合性能沒(méi)有超過(guò)中國(guó)頭部開(kāi)放模型,調(diào)用價(jià)格反而更貴。


穆拉蒂的選擇


考慮到穆拉蒂和Thinking Machines的背景,這樣的選擇便更加耐人尋味。


如果Inkling來(lái)自一家普通的AI創(chuàng)業(yè)公司,借鑒DeepSeek、借助Kimi訓(xùn)練,或許還沒(méi)有這么耐人尋味。偏偏它來(lái)自Thinking Machines——一家?guī)缀蹩梢苑Q為“OpenAI校友會(huì)”的公司。


2025年2月,Thinking Machines正式亮相時(shí),團(tuán)隊(duì)只有約30人,其中大約三分之二來(lái)自O(shè)penAI,其余成員主要來(lái)自Meta和Mistral。


創(chuàng)始團(tuán)隊(duì)一度包括OpenAI聯(lián)合創(chuàng)始人John Schulman、OpenAI前研究副總裁Barret Zoph,以及Lilian Weng、Andrew Tulloch和Luke Metz等研究人員。


這些人分別參與過(guò)OpenAI的強(qiáng)化學(xué)習(xí)、后訓(xùn)練、預(yù)訓(xùn)練、安全和推理研究。路透社當(dāng)時(shí)甚至直接形容,穆拉蒂?gòu)那皷|家挖走了至少20名研究人員。


站在這群OpenAI校友中間的穆拉蒂,當(dāng)然是最特殊的一個(gè)。


她于2018年加入OpenAI,先后參與DALL-E、Codex、ChatGPT和Sora等產(chǎn)品,2022年升任首席技術(shù)官,負(fù)責(zé)協(xié)調(diào)研究、模型訓(xùn)練、安全和產(chǎn)品落地。


2023年11月,OpenAI董事會(huì)突然罷免Sam Altman后,穆拉蒂還曾短暫擔(dān)任臨時(shí)首席執(zhí)行官。她的角色更接近技術(shù)和產(chǎn)品的總負(fù)責(zé)人,對(duì)OpenAI的模型研發(fā)流程和產(chǎn)品化路徑有著完整了解。


換句話說(shuō),Thinking Machines從成立之初就不缺O(jiān)penAI經(jīng)驗(yàn)。


穆拉蒂和她的團(tuán)隊(duì)知道一家頂級(jí)閉源實(shí)驗(yàn)室如何開(kāi)發(fā)模型,也親歷了ChatGPT從研究成果變成全球產(chǎn)品的全過(guò)程。當(dāng)這群人離開(kāi)OpenAI,從零搭建自己的技術(shù)體系時(shí),外界自然會(huì)期待他們拿出一條帶有OpenAI印記的路線。


結(jié)果,Inkling最明確的技術(shù)來(lái)源卻指向了中國(guó)。這很容易被理解成一個(gè)戲劇性的信號(hào)——最了解OpenAI的一群人離開(kāi)OpenAI后,最終選擇了中國(guó)模型的技術(shù)藍(lán)圖。


不過(guò),這個(gè)結(jié)論還需要拆開(kāi)來(lái)看。


OpenAI近年來(lái)的前沿模型全部采用閉源路線,外界拿不到模型權(quán)重,也不了解完整的架構(gòu)、訓(xùn)練數(shù)據(jù)和后訓(xùn)練方案。穆拉蒂即使熟悉OpenAI內(nèi)部技術(shù),也不能把前東家的商業(yè)機(jī)密直接搬進(jìn)新公司。DeepSeek和Kimi則公開(kāi)了權(quán)重或技術(shù)報(bào)告,架構(gòu)、訓(xùn)練方法和工具鏈都可以合法研究和復(fù)用。


Inkling本身也是一款開(kāi)放權(quán)重模型。對(duì)于一家想要建設(shè)開(kāi)放模型生態(tài)的公司來(lái)說(shuō),從DeepSeek、Kimi等開(kāi)放模型中吸收成熟方案,屬于順理成章的工程選擇。


今天開(kāi)發(fā)一款開(kāi)放模型,完全避開(kāi)中國(guó)團(tuán)隊(duì)已經(jīng)公開(kāi)的成果,反而要付出更高的試錯(cuò)成本。


因此,Inkling借鑒中國(guó)模型,并不能直接證明穆拉蒂認(rèn)為DeepSeek的技術(shù)全面領(lǐng)先OpenAI。雙方公開(kāi)程度不同,可供借鑒的條件也完全不同。


但這件事依然釋放了一個(gè)清晰的信號(hào):至少在開(kāi)放權(quán)重領(lǐng)域,中國(guó)模型已經(jīng)成了美國(guó)AI團(tuán)隊(duì)的重要參考系。


所以,借鑒中國(guó)模型并不難解釋。真正需要回答的問(wèn)題是:Thinking Machines吸收了現(xiàn)成的架構(gòu)和訓(xùn)練經(jīng)驗(yàn),為什么最終做出的Inkling性能更弱、價(jià)格更高?


穆拉蒂擁有頂尖團(tuán)隊(duì)、充足資金和英偉達(dá)最新的訓(xùn)練系統(tǒng)。她沒(méi)有理由看不到Inkling與中國(guó)模型之間的性能和價(jià)格差距。


既然如此,“貴替”很可能就是一個(gè)經(jīng)過(guò)計(jì)算的選擇。


“一般般”,就夠了


按照Thinking Machines獲得的待遇,Inkling原本不該只是一款“夠用”的模型。


2025年7月,公司尚未推出任何產(chǎn)品,就完成了20億美元種子輪融資,估值達(dá)到120億美元,投資方包括安德森·霍洛維茨、英偉達(dá)、AMD和簡(jiǎn)街等。四個(gè)月后,Thinking Machines又傳出新一輪融資談判,目標(biāo)估值高達(dá)500億美元,盡管交易最終沒(méi)有官宣完成,外界已經(jīng)將它視為OpenAI和Anthropic的潛在對(duì)手。


因此,當(dāng)Inkling以一款性能不如中國(guó)模型、價(jià)格還更貴的產(chǎn)品亮相時(shí),難免顯得低于預(yù)期。


可從商業(yè)角度看,穆拉蒂可能從一開(kāi)始就沒(méi)打算用它爭(zhēng)奪基準(zhǔn)評(píng)測(cè)第一名。


Thinking Machines公司強(qiáng)調(diào)的是開(kāi)放權(quán)重、多模態(tài)能力和可定制性,希望企業(yè)通過(guò)Tinker對(duì)它進(jìn)行微調(diào),把Inkling改造成客服、編程助手、行業(yè)智能體等專用模型。穆拉蒂押注的市場(chǎng),對(duì)基準(zhǔn)評(píng)測(cè)第一名沒(méi)有那么執(zhí)著。企業(yè)更在意模型能否私有部署、能否掌握數(shù)據(jù)、能否按照自己的業(yè)務(wù)繼續(xù)訓(xùn)練。


此前,這類(lèi)需求很大一部分被中國(guó)開(kāi)放模型接住了。


美國(guó)的OpenAI和Anthropic長(zhǎng)期堅(jiān)持閉源,Meta的Llama 4表現(xiàn)不及預(yù)期后,也逐漸收縮開(kāi)放路線。與此同時(shí),DeepSeek、Kimi、Qwen和GLM持續(xù)開(kāi)放權(quán)重,性能越來(lái)越接近美國(guó)閉源模型,價(jià)格卻低得多。


美國(guó)企業(yè)很快用腳投了票。


根據(jù)OpenRouter向CNBC提供的數(shù)據(jù),2026年2月以來(lái),中國(guó)模型在美國(guó)企業(yè)經(jīng)由該平臺(tái)調(diào)用的Token中,每周占比都超過(guò)30%,最高一度達(dá)到46%。2025年上半年的平均占比還只有4.5%。


Cursor開(kāi)發(fā)Composer 2時(shí)測(cè)試了多款基礎(chǔ)模型,最終選擇Kimi K2.5,理由也很直接——它在評(píng)測(cè)中表現(xiàn)最強(qiáng)。橋水基金則通過(guò)Tinker微調(diào)阿里的Qwen,得到的定制模型以更低成本超過(guò)了部分頂級(jí)閉源模型。


中國(guó)開(kāi)放模型由此成了美國(guó)企業(yè)降低AI成本的一條捷徑。只不過(guò),這條路正在承壓。


與此同時(shí),美國(guó)對(duì)中國(guó)AI模型的監(jiān)管氛圍正在收緊。相關(guān)部門(mén)已經(jīng)圍繞數(shù)據(jù)安全、模型來(lái)源和供應(yīng)鏈風(fēng)險(xiǎn)發(fā)出警告,部分使用中國(guó)模型的企業(yè)也受到調(diào)查。即便尚未形成統(tǒng)一限制,政策上的不確定性已經(jīng)足以影響企業(yè)選擇,尤其是涉及政府業(yè)務(wù)和敏感數(shù)據(jù)的公司。


這正是Inkling的市場(chǎng)空間。


它是一款美國(guó)公司開(kāi)發(fā)、采用Apache 2.0許可證、支持私有部署和定制的開(kāi)放權(quán)重模型。美國(guó)企業(yè)選擇它,不必?fù)?dān)心使用中國(guó)模型引發(fā)的政治爭(zhēng)議,也更容易通過(guò)政府客戶和大型公司的合規(guī)審查。


Inkling真正的價(jià)值,來(lái)自這種合規(guī)確定性。


穆拉蒂顯然看到了這個(gè)正在形成的空缺。


Thinking Machines吸收DeepSeek和Kimi的公開(kāi)成果,再把它們轉(zhuǎn)化成一款由美國(guó)公司提供的模型。Inkling不需要在所有基準(zhǔn)評(píng)測(cè)中擊敗中國(guó)模型,只需要成為那些不敢繼續(xù)使用中國(guó)模型的美國(guó)企業(yè)可以接受的選擇。


這也解釋了它為什么敢于更貴。政策替Inkling縮小了競(jìng)爭(zhēng)范圍,性能和價(jià)格上的差距便沒(méi)那么致命。對(duì)于一些美國(guó)企業(yè)來(lái)說(shuō),一款稍弱、稍貴但風(fēng)險(xiǎn)較低的模型,已經(jīng)足夠。


從這個(gè)角度看,Inkling更能證明穆拉蒂懂得做生意。


不過(guò),這套生意成立的代價(jià),可能由美國(guó)企業(yè)承擔(dān)。


美國(guó)之外的公司仍然可以自由選擇GLM、Kimi和DeepSeek,在更強(qiáng)、更便宜的基礎(chǔ)模型上開(kāi)發(fā)產(chǎn)品;美國(guó)企業(yè)卻可能被迫采用性能稍弱、價(jià)格更高的本土替代品?;A(chǔ)模型的能力差距會(huì)繼續(xù)傳遞到微調(diào)后的產(chǎn)品中,最終形成結(jié)構(gòu)性的競(jìng)爭(zhēng)劣勢(shì)。


華盛頓原本希望用限制保護(hù)美國(guó)AI公司,結(jié)果可能先替Inkling這樣的“貴替”創(chuàng)造了市場(chǎng)。對(duì)穆拉蒂來(lái)說(shuō),“一般般”已經(jīng)夠了。對(duì)美國(guó)AI產(chǎn)業(yè)來(lái)說(shuō),這份“夠用”則意味著成本的升高和競(jìng)爭(zhēng)力的下降。

AI創(chuàng)投日?qǐng)?bào)頻道: 前沿科技
本內(nèi)容由作者授權(quán)發(fā)布,觀點(diǎn)僅代表作者本人,不代表虎嗅立場(chǎng)。
如對(duì)本稿件有異議或投訴,請(qǐng)聯(lián)系 tougao@huxiu.com。
正在改變與想要改變世界的人,都在 虎嗅APP
漳浦县| 裕民县| 突泉县| 安图县| 永福县| 广丰县| 敦煌市| 垦利县| 简阳市| 乐山市| 上栗县| 柳河县| 祁连县| 章丘市| 永宁县| 诸城市| 鄢陵县| 南丹县| 门头沟区| 兴宁市| 万源市| 三台县| 刚察县| 岳阳县| 桓台县| 全椒县| 读书| 昌吉市| 江达县| 贵德县| 武平县| 久治县| 平塘县| 博湖县| 景宁| 隆安县| 西藏| 澄迈县| 昌邑市| 株洲县| 长春市|