AI 芯片架构全景:从 NVIDIA GPU 到 Cerebras 晶圆引擎与 Groq LPU
Jacob Peake 对已经赢得真实部署的六大 AI 加速器(NVIDIA GPU、Google TPU、AMD Instinct、Cerebras WSE、AWS Trainium、Groq LPU)的横向解剖:统一主线是内存墙,四条抓手是数据存哪/怎么搬/计算单元长啥样/怎么互联。
Jacob Peake 对已经赢得真实部署的六大 AI 加速器(NVIDIA GPU、Google TPU、AMD Instinct、Cerebras WSE、AWS Trainium、Groq LPU)的横向解剖:统一主线是内存墙,四条抓手是数据存哪/怎么搬/计算单元长啥样/怎么互联。
ServeTheHome 现场报道 SambaNova 第五代 RDU(SN50):以巨量片上 SRAM + 无全局同步的数据流架构把「模型带宽利用率(MBU)」做到 GPU 做不到的高位,并给出 H200 负责 prefill、SN50 负责 decode 的异构解聚部署。
ServeTheHome 现场报道 Broadcom Thor Ultra:5nm、2.4B 晶体管的 800GbE 网卡,强化 RoCE(分组喷射+乱序放置+超越 Go-Back-N 的可靠性和可编程拥塞控制),直指 AI scale-out 与 NVIDIA ConnectX-8、AMD Vulcano 正面对垒。
ServeTheHome 现场报道 XCENA MX1:一颗 Type 3 CXL 器件把 CXL 内存扩展、SSD 级字节寻址内存与 3072 个 RISC-V 近内存核熔于一炉,三星进一步给出机架级 CXL 内存池与 PNM 加速方案。
ServeTheHome 现场报道 NVIDIA Vera Rubin NVL72 机架:Agentic AI 重塑优化目标(tokens/MW、TTFT、MTBI)、自适应稀疏化、counted-write NVLink 同步与 45°C 液冷+800VDC 机架工程。
Spacechips CEO Rajan Bedi 横评六款多通道 RF 收发器:AMD RFSoC/Versal RF、Altera Agilex Direct RF、TI AFE80xx、Jariet Elektra、ADI AD9082,覆盖太空应用的选型逻辑与抗辐照现状。
ServeTheHome 现场报道 AMD MI400 架构:8 颗 N2 XCD + N3P fabric die、432GB HBM4、40 PFLOPS MXFP4,以及为 Helios 机架设计的内存层级与数据搬运革新。
Vik's Newsletter 逐家点评 Hot Chips 2026 存储三巨头:Micron 平淡、三星凭逻辑工艺 base die 讲出三阶段路线图、SK hynix 直面 MR-MUF 优势在混合键合时代终结的问题。
Crux Capital 把 NPO 拆解为可投资的公司版图:光引擎密度从 2.25 到 4.0 每 GPU 的测算,以及 dollars 流向哪些环节。
Irrational Analysis 以工程视角反击 CPO/NPO 谣言:TSMC COUPE 光栅耦合器受挫、NVIDIA 转向 Tower NPO、Lumentum 激光器规格优势,以及 Coherent 毛利率疑云。