谷歌正在研发代号为Frozen v2的AI推理芯片,该芯片将Gemini模型的部分底层架构直接固化进硬件,从而显著减少运行模型时的计算量和数据搬运。据内部评估,这款芯片每瓦可处理的Token数量将达到谷歌最新TPU的6至10倍,计划最早于2028年部署。
正文解读
Frozen v2的研发背景是谷歌面临的算力短缺问题,缺口已迫使Google Cloud拒绝部分外部客户订单。谷歌希望通过这款专用芯片缓解压力,同时与现有TPU形成互补:TPU可以灵活运行多种不同模型,而Frozen v2则通过牺牲通用性换取更高的能效和推理效率。
不过,这种深度绑定也意味着谷歌在进行一场架构押注。如果未来Gemini模型底层设计发生重大调整,这批芯片可能无法继续使用,面临提前报废的风险。但若Gemini架构保持稳定,Frozen v2带来的算力优势将十分显著。
原创文章,作者:admin,如若转载,请注明出处:https://www.23btc.com/202953/



