谷歌研发全新“Frozen”专用芯片 大幅提升AI模型运行效率
14 小时前

据知情人士透露,谷歌正研发代号Frozen v2的全新服务器芯片,通过将Gemini大模型底层运算架构固化至硬件层,实现AI推理能耗与延迟的大幅降低。该芯片单位功耗处理的词元数量预计达现有自研芯片的6至10倍,计划最早于2028年部署。此举旨在破解谷歌当前AI算力短缺困境——内部资源紧张已导致谷歌云拒绝部分外部订单。Frozen v2并非通用芯片,而是专为Gemini模型设计的专用芯片,通过内置底层运算逻辑减少运算步骤与数据搬运量。与初代方案不同,Frozen v2仅固化架构逻辑而非完整模型权重,保留通过更新模型权重进行迭代的能力。该芯片将作为现有TPU的补充,形成互补关系,谷歌目前并无大规模量产计划,而是将其视为技术试验平台,为研发更高专用化芯片积累经验。

简体中文 English