描述
Tensordyne 推出了 Napier,一款突破性的 AI 推理系统,专为无与伦比的速度和盈利能力而设计。这一新类别的系统由先进的对数数学和低延迟横向扩展互连驱动,使 AI 推理显著更快、更经济实惠。
Tensordyne Napier 完全风冷,可无缝集成到全球数据中心。它彻底改变了 AI 计算和数据传输,使数千名用户能够以最低的成本同时访问 AI 推理。该系统被誉为有史以来最快、能效最高的 AI 推理系统。
开发里程碑凸显了 Tensordyne 对创新的承诺。到 2026 年,Napier 芯片将在台积电进行大规模生产,先进的 3nm 芯片已与博通合作成功流片。该芯片专为多模态生成式 AI 推理而设计,能耗仅为标准成本的一小部分。在 2025 年全年,Tensordyne 优化了其针对混合专家模型 (MoE) 和代理式 AI 工作负载的全栈方法,最大限度地提高了性能和效率。
战略合作关系至关重要,包括 2024 年与瞻博网络 (Juniper Networks) 的合作,以集成行业领先的横向扩展网络组件,满足现代 LLM 集群所需的超大规模 fabric 可扩展性。这种对数据中心规模的关注是一个战略性转变,优先考虑 Napier 在 Transformer 模型上的效率优势,而非传统的视觉跟踪。
早期在 2023 年的验证证实了在 GPT 和 Stable Diffusion 等生成式 AI 工作负载中存在巨大机遇,展示了无与伦比的处理效率。
Tensordyne 的历程始于 2019 年在 AI 计算领域的一项专利突破,专注于基于对数数学的架构。第一代 Scorpio 芯片于 2021 年成功流片,在物理硬件中验证了该专有架构。2022 年,功能性 Scorpio 样品交付给客户,证明了其在不间断运行下的实际可靠性和性能。
Napier 系统在多个方向上提供了令人难以置信的性能。它支持实时 4K 视频生成(30FPS),针对多万亿参数的 MoE 模型进行了优化,并以超低延迟驱动高速代理式编码。它专为寻求具有显著成本和功耗优势的可扩展推理工厂的超大规模用户、追求卓越速度和高利润率的新云以及需要本地 TCO 优势的企业本地部署而设计。
Tensordyne AI 推理系统的核心功能
下一代 AI 推理系统
专为极速和无与伦比的盈利能力而设计
利用对数数学实现更快、更经济的 AI 推理
具有最低延迟的横向扩展互连
全风冷系统,适用于各种数据中心
彻底改变 AI 计算和数据传输
支持数千用户同时访问 AI 推理
针对多模态生成式 AI 推理进行了优化
支持混合专家模型 (MoE) 和代理式 AI 工作负载
与行业领先的横向扩展网络组件集成
每机架实现 608 PFLOPS 密集计算
以更小的占地面积提供公共云性能
提供每用户超过 1000 tokens/秒的速度
支持 PyTorch、Triton 和 vLLM 集成
适用于本地部署的节能设计
如何使用 Tensordyne AI 推理系统?
探索系统:了解 Tensordyne Napier 的功能。
观看演示:直观了解该技术。
预约通话:安排与销售或产品团队的咨询。
集成:无缝集成到现有的 K8s 管理堆栈中。
部署:为超大规模用户部署可扩展的推理工厂。
优化:针对特定 AI 工作负载对硬件和软件进行微调。
联系我们:垂询企业解决方案的更多信息。
Tensordyne AI 推理系统的使用案例
- 实时 4K 视频生成
- 多万亿参数 MoE 服务
- 高速代理式编码
- 可扩展推理工厂
- 新云的卓越速度
- 本地企业 AI
- 生成式 AI 工作负载
- LLM 集群扩展





