3月20日,华为云中小企业AI解决方案发布会上推出了柔性智算操作系统FlexNPU,旨在通过构筑强大而灵活的AI Infra层算力调度技术,提升推理池的有效算力利用率,从而以相同AI硬件算力投入,提供更大的Token吞吐输出。
风险提示及免责条款
市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。
3月20日,华为云中小企业AI解决方案发布会上推出了柔性智算操作系统FlexNPU,旨在通过构筑强大而灵活的AI Infra层算力调度技术,提升推理池的有效算力利用率,从而以相同AI硬件算力投入,提供更大的Token吞吐输出。
华为云首席架构师、华为公司Fellow顾炯炯表示,FlexNPU赋予NPU/GPU算力“柔性或液态化”供给与伸缩的能力,可依据任意业务需求动态变化随需而动,如同金箍棒一般“可大可小、变化随心”,通过最大化AI算力投入的利用率,最终实现Token性价比的最优化。