当前位置: 首页 > news >正文

AI交换芯片走到聚光灯下:英伟达发布Spectrum-6 或推动Token生成能力倍增

AI交换芯片走到聚光灯下:英伟达发布Spectrum-6 或推动Token生成能力倍增

近日,英伟达正式发布新一代Spectrum-6以太网交换芯片,用于支持基于Vera Rubin平台的超大规模AI基础设施。

英伟达表示,Spectrum-6交换芯片将作为下一代Spectrum-X Ethernet交换机平台核心组件,通过高带宽、智能流量管理和故障恢复能力,提升AI工厂整体计算效率。包括CoreWeave 、微软、Nebius、SpaceXAI和特斯拉在内的AI基础设施建设者,将成为首批引入Spectrum-6来加速其AI工厂建设的公司。

产品性能方面,Spectrum-6单交换容量达102.4Tbps,是上一代产品的两倍,旨在连接数十万级GPU和CPU,为大规模AI训练、智能体应用及推理任务提供网络支持。基于此,Spectrum-X以太网交换机能够实现比普通以太网高1.6倍的AI网络性能,并且在超过10万个GPU的部署中保持高达95%的网络效率。

此外,Spectrum-6交换芯片同时支持可插拔式光模块和共封装光学(CPO),并支持液冷散热,可为整个AI工厂提供全面的端到端散热方案,同时提高网络电源效率。

截至目前,基于Spectrum-6的交换机已经进入全面生产阶段,且在全球千兆级AI工厂中普及。

Spectrum-X Ethernet Photonics是全球首款200G/lane大规模量产的CPO交换机。Vera Rubin量产Spectrum-X Ethernet Photonics进一步验证光互连在下一代AI数据中心中的价值。硅光子技术渗透率的提升也将同步带动上游光芯片需求的高速增长。

▌交换机成Token生成倍增器

交换机是一种用于电光信号转发的网络设备,而在英伟达看来,AI性能本质上是网络问题。

其指出,全球最先进的人工智能工厂汇集了数十万个GPU和CPU,用于训练前沿模型、驱动智能体人工智能,并以前所未有的规模生成智能。在这个层面上,网络成为推动Token生成的关键计算能力倍增器。

对交换机领域的重视,也让这家科技巨头收获了客户与收入增长。

作为Spectrum-6交换芯片的首批用户,CoreWeave表示:“将英伟达 Spectrum-6和液冷式Spectrum-X以太网基础设施引入AI工厂,有助于我们为客户提供训练前沿模型和更快部署推理所需的带宽、弹性和效率。”

据IDC最新数据,英伟达在2026财年第一季度首次成为全球数据中心以太网交换机市场的营收冠军。在过去,该领域由博通、思科等网络巨头主导。

从交换芯片和GPU配比来看,传统架构交换机与GPU配比约为3:64,而英伟达NVL72包含72颗GPU和9个交换托盘,GBNVL72柜内交换托盘各配备2颗交换芯片,交换芯片与GPU配比达1:4,最新VRNVL72柜内交换托盘配备交换芯片数翻倍,交换芯片与GPU配比进一步提升至1:2,随着Scaleout和Scaleup双线演进,交换网络在计算集群中所占权重或逐步提升。

交换网络正算力配套设施配角,跃升为集群核心主角。随着AI模型参数扩张,算力需求已从单纯GPU堆叠,转向全维度系统架构重构。受单芯片物理功耗密度、互连带宽及内存容量瓶颈制约,算力增长边际效益持续递减,交换网络成为制约算力的天花板,当前系统级协同架构(如高带宽域互联)是突破单芯片性能上限的主要技术路径。

(文章来源:https://www.moyubuhuang.com/caijing/202607/86356.html)

http://www.jsqmd.com/news/1242151/

相关文章:

  • 百考通:AI赋能期刊论文写作,全流程智能化支撑
  • 半导体国产 设计EDA · 技术VP 18维度高管级简历范本
  • Kafka单集群部署与生产环境优化指南
  • String 字符串不可变带来的好处是什么?
  • 选择器分类和权重计算,less 中的 解释
  • Tiva C系列MCU深度睡眠模式下的时钟门控与电源管理实战
  • HarmonyOS 6.1 实战:Navigation 路由组件全面解析
  • 麒麟信安“一云多芯”解决方案,助力传统IT架构变革转型
  • HDI综合效益优势-平衡小型化、迭代效率与长期量产成本
  • VirtualLab Fusion中的光学各向异性介质
  • Java面试之Linux和docker
  • TikTok广告投放多少钱?2026年最新投放成本与防关联指南
  • Instagram新功能倾向创作者,普通用户与创作者需求如何平衡?
  • [SPI]SPI接口简介
  • SARS-CoV-2病毒:从分子结构到全球大流行的全面解析
  • 嵌入式系统ROM代码执行与片上调试全解析:从启动到调试的底层实践
  • Cortex-M4系统控制与异常处理寄存器深度解析:从原理到实战
  • 绿幕发灰、边缘闪烁、头发丝丢失?Runway抠像失败的7个隐性参数陷阱,今天必须改!
  • 官宣,麒麟信安服务器操作系统V3.4-5正式发布
  • SATA控制器架构深度解析:从AHCI原理到嵌入式开发实践
  • PS5 NOR Modifier:终极方案解析,如何修复损坏的PS5 NOR闪存文件
  • 【AI副业口碑裂变公式】:3个被低估的传播杠杆,90%从业者从未用过
  • 大气湍流下的少模光纤耦合
  • HarmonyOS 6.1 实战:GridRow/GridCol 响应式栅格布局详解
  • 2026留学生找工作平台评测:靠谱平台推荐与选型攻略 - 极欧测评
  • torch.distributed的通信原语选择:all_reduce、all_gather与reduce_scatter
  • Orin 上开机自启跑检测docker容器(含完整脚本)
  • TMS320C6424 DSP外设实战:PWM、VLYNQ、GPIO与JTAG深度配置指南
  • 代码不是 AI 编程的最终资产,AI Coding 真正该存的是 Checkpoint
  • 深入解析C2000 SCI模块:中断、DMA与低功耗模式实战指南