谷歌研发Frozen v2芯片,将Gemini架构固化至硅片能效提升10倍
谷歌将Gemini架构焊进芯片,能效碾压TPU十倍,但在赌模型架构不剧烈变化。
谷歌正在研发一款代号Frozen v2的服务器芯片,把Gemini模型的部分底层架构永久蚀刻进硅片,而非运行在芯片上。这相当于为Gemini单独定制硬件,省去了通用芯片实时决策的开销,按每瓦特处理的Token算,能效比最新TPU高6到10倍。部署时间最快2028年,但风险是灵活性下降,Gemini架构大改则芯片报废。
正文摘录
 新智元报道  一觉醒来,谷歌突然就掏出了一张王炸! 据 The Information 独家爆料, 谷歌正在研发一款代号「Frozen v2」的神秘服务器芯片——把 Gemini 模型的部分底层架构, 永久蚀刻进硅片 。 不是跑在芯片上,是长在芯片里。  参与项目的谷歌员工预计,按每瓦特能处理的 Token 数量算,这款芯片将比谷歌最新一代 TPU 高效 6 到 10 倍 。部署时间,最快 2028 年。 消息一出,Alphabet 股价周一应声上涨 3.7%,一扫前几周的阴霾。  「冻结」一个模型 Frozen 这个名字,就是字面意思:把模型「冻」进硅片。 这事有多激进?不管是英伟达 GPU 还是谷歌 TPU,本质上都是通用芯片——什么模型都能跑。 这听起来很灵活,但代价也很大: 芯片在运行时必须做海量的实时决策,不停地搬运数据,反复查询该往哪走、该怎么算。 就像一个什么菜都能做的后厨,每做一道菜都得现翻菜谱、现找工具、现调火候。效率可想而知。 Frozen v2 则 只为 Gemini 一个模型而生 。