AMD 于 7 月 25 日宣布推出全开源混合专家模型 Instella-MoE,该模型总参数量达 160 亿,每个 Token 仅激活 28 亿参数,在同规模开源语言模型中实现了领先性能。此举标志着 AMD 在大模型领域从硬件供应向模型研发的重要延伸。
正文解读
Instella-MoE 完全基于 AMD Instinct MI300X 和 MI325X GPU 以及 ROCm 软件栈从零训练完成,并引入了 Gated Multi-head Latent Attention 和 FarSkip-Collective 等架构创新。这表明 AMD 正在构建从硬件到软件栈再到模型层的完整生态闭环,而非仅停留在芯片供应层面。在性能测试中,Instella-MoE-16B-A3B 基础模型平均得分达到 76.7 分,超过了 SmolLM3-3B、OLMo-3-7B 等模型,在仅激活 28 亿参数的情况下即可与更大规模模型竞争。
该模型支持 64K Token 长上下文处理,并完成了预训练、中期训练、长上下文扩展、监督微调、直接偏好优化及强化学习等完整训练流程。AMD 同步公开了全部模型权重、训练配置、数据配比、中间检查点及推理代码,推动开放 AI 模型的研究与复现。
Steam 平台的操作系统数据显示,Linux 占比正持续攀升,Windows 的统治地位虽未被撼动但已现松动迹象。Valve 对 Proton 兼容层的持续优化以及 Steam Deck 等 Linux 设备的市场渗透,正在改变 PC 游戏的操作系统格局。
- AMD 从硬件厂商延伸至模型层,试图构建全栈 AI 生态
- 开源策略有助于吸引开发者社区,加速生态建设
- 在英伟达主导的 AI 硬件市场中,AMD 正试图以开放生态和差异化模型能力突围
原创文章,作者:admin,如若转载,请注明出处:https://www.23btc.com/204370/



