译自英文

FuriosaAI是一家韩国人工智能芯片公司,以开发Warboy NPU而闻名,这是一种专为高效大规模AI推理设计的神经处理单元。该公司成立于2017年,旨在为数据中心提供高性能、成本效益高的GPU替代方案。

FuriosaAI是一家总部位于韩国首尔的无晶圆厂半导体公司,专门设计用于人工智能工作负载的神经处理单元(NPU)。该公司成立于2017年,一直专注于开发针对推理任务优化的加速器,尤其是针对大型语言模型和其他深度学习应用。其旗舰产品Warboy NPU被定位为数据中心中图形处理单元(GPU)的高效替代品,目标是降低总体拥有成本和功耗。

该公司诞生于韩国科技生态系统,其创始人此前曾在三星电子等大型企业工作。FuriosaAI吸引了来自国内外的投资,包括风险资本和战略合作伙伴,并已向部分客户发送了早期硬件样品。截至2025年,该公司继续扩大生产规模,并扩展其软件栈以支持主流AI框架。

创立与背景

FuriosaAI由一支具有半导体设计和系统架构背景的工程师和研究人员团队于2017年成立。公司名称参考了电影《疯狂的麦克斯:狂暴之路》中的“Furiosa”角色,体现了打造坚韧而强大的计算解决方案的使命。创始团队包括来自三星电子和其他韩国科技公司的资深人士,带来了内存、处理器设计和高性能计算方面的经验。

最初的目标是应对人工智能工作负载日益增长的计算需求,这些工作负载越来越由深度学习模型主导。当时,大多数AI加速依赖于英伟达的GPU(尽管未列出,该公司是众所周知的竞争对手)以及云服务商的自研芯片。FuriosaAI旨在打造一款专用的NPU,在推理方面提供卓越的每瓦性能,这是数据中心运营商的关键指标。

Warboy NPU

Warboy NPU是FuriosaAI的第一代加速器,于2021年发布,并于2022年首次送样。该芯片专为推理任务设计,尤其是基于Transformer的模型,如大型语言模型。它采用了一种专门架构,在计算、内存带宽和片上存储之间取得平衡,以最大限度地减少延迟并提高吞吐量。

Warboy的关键规格包括7纳米制程工艺(由台积电制造)、约150瓦的功耗范围,以及支持FP16和INT8等常见数据类型。该NPU集成了多个处理核心,每个核心拥有自己的内存层级,以及高带宽片上互连。FuriosaAI声称,Warboy可以实现与领先GPU相当的性能,同时功耗显著降低,使其对注重能耗的数据中心具有吸引力。

Warboy以PCIe卡的形式交付,类似于GPU加速器,可以集成到现有服务器基础设施中。FuriosaAI提供软件开发套件(SDK),支持PyTorch和TensorFlow等流行框架,以及一个针对NPU架构优化模型的编译器。该公司还开发了一个运行时引擎来管理推理工作负载和动态批处理。

架构与设计

FuriosaAI的NPU架构基于数据流设计,计算围绕数据移动而非传统的冯·诺依曼模型组织。每个处理核心包含一个矩阵乘法单元、向量单元和大容量片上SRAM。核心通过网络芯片互连,实现高效的数据共享并减少片外内存访问。

Warboy的一个显著特点是支持稀疏性,允许跳过神经网络中零值的计算,这可以提高某些模型的效率。该芯片还包括灵活的指令集,可针对各种层类型进行编程,包括卷积、注意力和归一化。

FuriosaAI已发布基准测试结果,显示Warboy在Transformer模型上实现了高利用率,每瓦性能超过当代GPU。然而,对这些声明的独立验证有限,该公司未在公开论坛上披露其架构的全部细节。

软件栈与生态系统

为便于采用,FuriosaAI开发了一套全面的软件栈,对底层硬件进行了抽象。该栈包括一个编译器,可将ONNX和其他格式的模型转换为针对NPU优化的机器代码。它还提供了处理内存管理、调度和同步的运行时库。

该公司已与三星电子和其他韩国企业合作,将其加速器集成到更广泛的AI解决方案中。FuriosaAI还为ONNX Runtime等开源项目做出了贡献,以确保与行业标准工具的兼容性。截至2025年,该软件栈支持多种模型架构,包括残差网络U-Net和基于Transformer的模型。

FuriosaAI建立了一个开发者计划,提供硬件和软件的早期访问权限,旨在建立一个能够为Warboy优化应用的工程师社区。该公司还提供文档和教程,以降低新用户的入门门槛。

市场定位与竞争

AI芯片市场竞争激烈,既有像英伟达(未列出但隐含)、AMD英特尔这样的老牌厂商提供基于GPU和CPU的解决方案,也有GroqSambaNova等专业初创公司。云服务商如亚马逊云服务(使用AWS Trainium)、谷歌云Azure也为其数据中心开发了定制芯片。

FuriosaAI通过专注于推理效率和成本效益来实现差异化,尤其是针对大规模部署。该公司瞄准运行持续推理工作负载的客户,例如搜索、推荐和生成式AI服务。通过提供低功耗替代方案,FuriosaAI旨在降低数据中心运营商的总体拥有成本。

截至2025年,FuriosaAI尚未披露大规模商业部署,但已宣布与韩国电信和云公司建立合作伙伴关系。该公司还在探索国际市场,包括美国和欧洲,这些地区对AI基础设施的需求很高。

融资与增长

FuriosaAI已从投资者那里筹集了大量资金,包括韩国风险投资公司和战略合作伙伴。2021年,该公司完成了B轮融资,使其总融资额超过1亿美元。这些资金用于开发Warboy、组建软件团队以及拓展新市场。

该公司已发展到200多名员工,在首尔设有办事处,并在硅谷设有分支机构。FuriosaAI还获得了韩国政府的支持,韩国政府已将AI芯片开发列为国家战略的重点。

未来方向

FuriosaAI正在开发第二代NPU,代号“Renegade”,预计将提供更高的性能并支持训练工作负载。该公司表示,新芯片将采用更先进的制程节点,并吸收Warboy部署中积累的经验。截至2025年,Renegade处于设计阶段,目标是在未来几年内发布。

除了硬件之外,FuriosaAI还在投资用于模型优化的软件工具,包括模型剪枝和量化技术。该公司还在探索与台积电和其他代工厂的合作,以确保获得尖端制造能力。

影响与反响

FuriosaAI被认为是AI半导体行业有前景的参与者,尤其是在亚洲。其对推理效率的关注与对可持续AI基础设施日益增长的需求相一致。然而,该公司在竞争更大的老牌厂商以及说服客户采用新架构方面面临挑战。

行业分析师指出,FuriosaAI的成功将取决于其软件栈的成熟度以及展示实际性能提升的能力。该公司的早期基准测试结果令人鼓舞,但更广泛的采用需要强大的开发者和合作伙伴生态系统。

结论

FuriosaAI代表了在主流GPU生态系统之外创建专用AI硬件的一次值得关注的尝试。凭借其Warboy NPU,该公司旨在为推理工作负载提供有吸引力的替代方案,强调效率和成本。随着AI行业的持续增长,FuriosaAI的进展将受到竞争对手和潜在客户的密切关注。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:ai-chip·semiconductor·south-korea·neural-processing-unit
本页最后编辑于 2026年9月9日 编辑者 AI Wiki Bot · 历史