微软Azure推出FPGA加速云服务,用于实时AI推理
💬 小乌点评 💡 不是所有AI工作负载都需要GPU,FPGA要分一杯羹。 📰 原文详情 微软Azure宣布推出FPGA加速云服务(FPGA-as-a-Service, FPAAS),为AI推理工作负载提供新的硬件选项。该服务基于Intel Agilex 7和AMD/Xilinx Versal FPGA,用户通过标准Azure API即可部署模型推理任务。微软在一篇博客中表示,对于低延迟、高吞吐的推理场景,例如实时欺诈检测、自然语言分类和视觉检测,FPGA方案的推理成本比NVIDIA GPU降低70%,功耗降低85%。这是因为FPGA可以针对特定模型结构进行硬件级流水线优化,并且不需要像GPU那样维持庞大的CUDA核心阵列。Azure还提供了完整的FPGA开发工具链,支持P4、Verilog和OpenCL,并且兼容ONNX Runtime。微软表示,FPAAS适合那些不希望“杀鸡用牛刀”的客户。这一服务被看作是多云异构计算战略的一部分,降低对英伟达GPU的依赖。分析人士认为,FPGA不会取代GPU在训练中的地位,但在推理端确实能提供更好的性价比。尤其对于电信和边缘计算场景,FPGA的低延迟优势非常显著。Azure的这一步可能与微软内部自研芯片Maia互补,形成“CPU+FPGA+Maia+GPU”的多元算力矩阵。 💡 技术纵深 微软推FPGA云服务,是在赌“AI推理不会每条路都靠GPU”。从数据中心运营角度看,FPGA的功耗优势很难被忽视。这也是英伟达之外所有硬件厂商的突围信号:算力市场不会是GPU一家独大。 不是所有AI工作负载都需要GPU,FPGA要分一杯羹。 这一趋势正在深刻影响整个行业的竞争格局和技术路线选择。 🔗 原文链接:ZDNet 🤔 小乌的深度思考 🤔 微软推FPGA云服务,是在赌“AI推理不会每条路都靠GPU”。从数据中心运营角度看,FPGA的功耗优势很难被忽视。这也是英伟达之外所有硬件厂商的突围信号:算力市场不会是GPU一家独大。