7月21日消息,據(jù)The Information援引兩名知情人士報(bào)道,谷歌正在研發(fā)一款內(nèi)部代號(hào)為“Frozen v2”的全新服務(wù)器芯片,計(jì)劃將Gemini大模型的底層運(yùn)算架構(gòu)直接固化進(jìn)硬件層面。參與項(xiàng)目的工程師測算,該芯片落地后,按單位功耗可處理的詞元(Token)數(shù)量計(jì)算,能效將達(dá)到谷歌現(xiàn)有最新一代自研AI芯片的6至10倍,最早于2028年部署。

“凍結(jié)”的設(shè)計(jì)哲學(xué)
“Frozen”(凍結(jié))這一代號(hào)精準(zhǔn)概括了其設(shè)計(jì)思路:將大模型的部分運(yùn)算邏輯永久蝕刻在硅片硬件中。
當(dāng)前應(yīng)用最廣泛的AI芯片——英偉達(dá)GPU和谷歌TPU——均為通用型芯片,可適配多種大模型,但運(yùn)行任何模型時(shí)都需要實(shí)時(shí)執(zhí)行大量耗時(shí)的邏輯判斷。Frozen v2則專為Gemini系列模型量身打造,通過內(nèi)置Gemini的底層運(yùn)算邏輯,大幅減少運(yùn)算步驟和數(shù)據(jù)搬運(yùn)量,從而縮短AI問答的響應(yīng)時(shí)延,并有望支撐谷歌落地一批全新的AI應(yīng)用場景。

驅(qū)動(dòng)這一項(xiàng)目的現(xiàn)實(shí)壓力,是谷歌嚴(yán)峻的AI算力短缺。知情人士稱,算力缺口已加劇谷歌內(nèi)部資源分配矛盾,甚至導(dǎo)致谷歌云不得不回絕部分外部客戶的合作訂單。
初代教訓(xùn):從“固化權(quán)重”到“固化架構(gòu)”
Frozen v2并非谷歌首次嘗試把AI模型“寫入”硬件。初代方案由谷歌DeepMind首席科學(xué)家杰夫·迪恩(Jeff Dean)牽頭,計(jì)劃將完整的模型權(quán)重直接蝕刻進(jìn)芯片。但該方案存在致命缺陷:芯片只能適配單一版本的Gemini模型,硬件生命周期極短,項(xiàng)目因此被擱置多年。
Frozen v2在初代基礎(chǔ)上做了關(guān)鍵調(diào)整:不再固化完整模型權(quán)重,而是僅將底層架構(gòu)邏輯固化進(jìn)芯片,同時(shí)保留通過更新內(nèi)置模型權(quán)重(決定模型回答質(zhì)量的核心參數(shù))進(jìn)行迭代的能力。
不過,這也意味著一場押注:只有后續(xù)迭代的Gemini模型沿用與芯片設(shè)計(jì)時(shí)一致的基礎(chǔ)架構(gòu),才能在該芯片上正常運(yùn)行。一旦谷歌未來轉(zhuǎn)向全新模型架構(gòu),這批專用芯片的價(jià)值將大打折扣。目前工程師團(tuán)隊(duì)仍在敲定核心功能模塊及各組件的協(xié)同方案,并權(quán)衡固化模型信息的深度,以求在硬件靈活性與運(yùn)行能效之間取得最佳平衡。
不取代TPU,而是開辟第二條芯片產(chǎn)品線
在谷歌的芯片版圖中,F(xiàn)rozen v2將與現(xiàn)有TPU形成互補(bǔ)關(guān)系,而非取而代之。谷歌今年已推出第八代TPU,并直接面向云客戶銷售,正面挑戰(zhàn)英偉達(dá)在AI芯片市場的壟斷地位;谷歌已與Meta簽署數(shù)十億美元大單,向其出租TPU算力,同時(shí)積極向英偉達(dá)的核心云廠商客戶推銷TPU產(chǎn)品。
事實(shí)上,谷歌的自研芯片戰(zhàn)略已初見成效——通過在設(shè)計(jì)TPU時(shí)圍繞Gemini進(jìn)行適配,其運(yùn)行自家大模型的硬件成本已經(jīng)下降,只是TPU內(nèi)置的模型信息遠(yuǎn)少于Frozen系列芯片。
值得注意的是,谷歌目前并無大規(guī)模量產(chǎn)Frozen v2的計(jì)劃,其產(chǎn)能規(guī)模將遠(yuǎn)低于TPU。有限的量產(chǎn)規(guī)模意味著谷歌可以延后引入外部設(shè)計(jì)和代工合作伙伴;更重要的是,谷歌將這一代產(chǎn)品視為技術(shù)試驗(yàn)平臺(tái),待大模型底層架構(gòu)趨于穩(wěn)定后,為研發(fā)更高專用化芯片積累工程經(jīng)驗(yàn)。
推理芯片賽道日益擁擠
Frozen v2折射出一個(gè)更大的行業(yè)趨勢(shì),那就是AI推理芯片正成為巨頭和初創(chuàng)公司共同競逐的熱點(diǎn)。
從SambaNova、d-Matrix等初創(chuàng)企業(yè),到OpenAI、微軟等科技巨頭,各方都在試圖打造比英偉達(dá)GPU能效更高的推理芯片,以緩解全球算力緊缺和成本高企的痛點(diǎn);英偉達(dá)自身也在去年12月斥資200億美元獲得推理芯片初創(chuàng)企業(yè)Groq的技術(shù)授權(quán)。
各家技術(shù)路線與谷歌的Frozen方案不盡相同,但與加拿大芯片初創(chuàng)公司Taalas的思路相近——二者均將特定AI模型的運(yùn)算邏輯硬編碼至芯片硬件。Taalas已完成超2億美元融資,投資方包括Quiet Capital和富達(dá)投資。
對(duì)于上述報(bào)道,谷歌官方發(fā)言人回應(yīng)稱,公司各團(tuán)隊(duì)“持續(xù)研發(fā)、測試各類創(chuàng)新技術(shù),力求為用戶與企業(yè)客戶實(shí)現(xiàn)極致性能與能效”,并強(qiáng)調(diào)“并非所有研發(fā)項(xiàng)目都會(huì)落地量產(chǎn),但這種全方位技術(shù)探索,是我們?nèi)珬W匝屑夹g(shù)路線的核心一環(huán)”。
結(jié)語
如果通用GPU時(shí)代的關(guān)鍵詞是“靈活”,那么Frozen v2代表的方向則是“極致專用”——用硬件的確定性換取能效的飛躍。6至10倍的能效提升若能兌現(xiàn),對(duì)深受算力成本之困的AI行業(yè)而言意義重大。但這一路線的前提是模型架構(gòu)的長期穩(wěn)定,在Transformer架構(gòu)仍在快速演進(jìn)的當(dāng)下,谷歌的這場押注能否成功,2028年才能見分曉。

受上述消息提振,谷歌股價(jià)周一盤中一度上漲3.7%,最終收漲1.52%。