本文來自微信公眾號: caoz的夢囈 ,作者:caoz,題圖來自:AI生成
時(shí)代變化太快了。
最近我身邊認(rèn)識的老板們,我也不敢說100%,但直覺99%都沉迷于vibe coding,去年我還經(jīng)常和他們得瑟我用AI做的小游戲,今年我都不敢吹牛了,每個(gè)老板在這個(gè)領(lǐng)域投入的時(shí)間精力和預(yù)算都比我多,不管是功成名就的上市公司董事長,還是仍然在一線打拼的創(chuàng)業(yè)者,沒有例外你敢信!而且各個(gè)來勸我,別用cursor了,太落伍了。
然后就有一個(gè)更加有意思的事情,就是很多老板都會(huì)吐槽一個(gè)事情,現(xiàn)在公司token開銷太狠了,每月賬單開始讓人心疼了。不管是上市公司,還是創(chuàng)業(yè)公司。
另一個(gè)最近從職場從業(yè)者那里聽到的消息也很有意思,就是很多巨頭為了提升開發(fā)效率,已經(jīng)不那么顧及所謂的代碼安全了,claude code幾乎無差別地在多個(gè)全球頂級互聯(lián)網(wǎng)巨頭內(nèi)部使用,除了極少數(shù)特別涉密的部門,基本上沒限制了,我們以前以為這些巨頭內(nèi)部會(huì)用自己的模型,或者會(huì)基于安全考慮不使用外部大模型,其實(shí)不是的。
這也是anthropic最近財(cái)務(wù)數(shù)據(jù)非常耀眼的原因吧,一個(gè)季度營收上百億美金,已經(jīng)比肩巨頭了。
但巨頭們的token開銷也是相當(dāng)驚人的,他們以為減員增效,可以用token獲得更高的性價(jià)比,最后賬算下來,好像,好像情況開始失控了。
正好最近網(wǎng)上看到一些新聞,美國幾個(gè)巨頭也開始意識到這個(gè)問題,并開始著手限制第三方token的消耗了。uber總裁也抱怨短短4個(gè)月時(shí)間,2026年的token預(yù)算已經(jīng)用完了。
這才多久,前兩年還是努力敦促程序員擁抱AI,以消耗token為先進(jìn)生產(chǎn)力的象征,現(xiàn)在,預(yù)算全面失控,估計(jì)很快,token消耗逐步收緊將成為越來越多企業(yè)的選擇。
當(dāng)然,這個(gè)世界不是平的,有些地方,有些企業(yè),還在努力鼓勵(lì)員工擁抱AI呢,這怎么說,沒法說。
幾個(gè)原因
1、AI編程技術(shù)的成熟化,很多老板說,去年AI編程其實(shí)還是很多問題的,是呀,去年我磕磕絆絆,真的是因?yàn)橛卸嗄昃幊痰鬃硬拍苊銖?qiáng)hold住項(xiàng)目,今年不一樣了,困在bug里鬼打墻的情況越來越罕見了。今年小白用AI編程更友好了,所以大家也更愿意去嘗試了。
2、openclaw的崛起,ai agent對token的消耗是指數(shù)級增加,上周一個(gè)海外上市的云算力廠商負(fù)責(zé)人跟我說過,在openclaw之前他們還是要宣傳推銷自己的算力資源,openclaw之后,基本上是有多少算力就賣掉多少,根本不愁客戶,現(xiàn)在是大量詢單吃不下來。
3、一些企業(yè)畸形的獎(jiǎng)勵(lì)和考核體系,用的越多越證明自己,但其實(shí)產(chǎn)出效率未必那么好。特別是員工習(xí)慣把各種無聊的問題也都扔給最貴的模型的時(shí)候。
4、試錯(cuò)成本變低,偽需求更容易泛濫,以前提出需求需要排期,需要資源對齊,那么產(chǎn)品經(jīng)理也好,項(xiàng)目負(fù)責(zé)人也好,需要評估優(yōu)先級,需要做出取舍,然后很多需求自己就砍掉了,只保留最關(guān)鍵最核心的?,F(xiàn)在,反正兩天就能搞定,試試看唄。越來越多腦洞想法都可以試試看,token消耗就爆表了,特別是一些大廠,根本不設(shè)限制。
5、做私活的也多起來了,大廠token不受限,公司開發(fā)任務(wù)交給AI一會(huì)就搞定了,然后大把時(shí)間,用公司配給的AI自己做點(diǎn)東西,這種據(jù)說也挺多的,我昨天開直播,評論區(qū)很多人說也會(huì)這么做。
6、最關(guān)鍵的是,員工沒有成本意識。
其實(shí)好幾個(gè)老板跟我吐槽,他們自己用AI都摳摳索索的,最好的模型當(dāng)然也要用,但是普通的任務(wù)國產(chǎn)模型可以解決,而且成本只有1/n,只有困難任務(wù)才交給最好的模型對不對。我現(xiàn)在也是,我大部分開發(fā)其實(shí)是cursor的auto模式,說白了這底層就是kimi對不對。只有特別關(guān)鍵或者遇到卡殼的時(shí)候才會(huì)換比較貴的頂級模型。老板們很多都是切換混用,什么模型做設(shè)計(jì),什么模型寫代碼,什么模型做簡單任務(wù),什么模型跑復(fù)雜分析。但他們員工可沒這個(gè)意識,最貴的模型全搞定不香么,反正買單的是老板,自己何必給老板省錢。
美國巨頭已經(jīng)集體行動(dòng)了,財(cái)務(wù)壓力讓他們開始反思曾經(jīng)的tokenmaxxing政策并且開始著手改變,你隨便搜索一下這樣的新聞已經(jīng)很多。
國內(nèi)越來越多企業(yè)也開始意識到,并且開始重視這個(gè)事情,其實(shí)國內(nèi)目前情況看上去沒那么嚴(yán)重,說實(shí)話,國內(nèi)真正實(shí)現(xiàn)token自由的公司沒那么多,很多公司無障礙使用海外大模型這件事上依然困難重重。我身邊的老板都是比較前衛(wèi)的,他們的案例可能并不是那么有代表性,但是,之前在這方面走的最激進(jìn),最開放的公司,可能會(huì)重新調(diào)整政策,比如進(jìn)行必要的限額,鼓勵(lì)和引導(dǎo)程序員通過不同模型切換來控制整體成本,并基于實(shí)際產(chǎn)出表現(xiàn)給與必要的額外token成本激勵(lì)。
當(dāng)然,今天飯桌上還聽到老板們的一個(gè)推測,他們認(rèn)為,今年后半年頂尖編程模型還會(huì)有一個(gè)巨大的躍升,而國產(chǎn)大模型也會(huì)隨之快速跟進(jìn),那么年底,國產(chǎn)大模型的可用性將很可能超越今天最好的美國大模型的編程能力,并且成本是對方的1/10,如果這個(gè)推測屬實(shí),他們會(huì)敦促團(tuán)隊(duì)全面擁抱國產(chǎn)大模型。所以這些老板的想法是,先不過度控制,熬過這半年過渡期看看。
前幾年講降本增效是用token換人,這才多久,token本身也需要降本增效了。
如果你所在的企業(yè)仍然實(shí)行token自由策略,隨便你使用最新最好的大模型,珍惜這段時(shí)間吧。
