Intel 取消 Falcon Shores 转向 Jaguar Shores:从单芯片对标到机柜级系统
2026 年 5 月 14 日,Intel 在 Q1 财报披露中正式取消 Falcon Shores 单芯片 GPU 计划,并确认新的机柜级 AI 系统项目 Jaguar Shores 将在 2027-2028 年推出。这是 Intel AI 战略的重大调整,本文深入分析其原因和未来。
2026 年 5 月 14 日,Intel 在 Q1 财报披露中正式取消 Falcon Shores 单芯片 GPU 计划,并确认新的机柜级 AI 系统项目 Jaguar Shores 将在 2027-2028 年推出。这是 Intel AI 战略的重大调整,本文深入分析其原因和未来。
LLM 推理性能 = 算法 + 软件 + 硬件。硬件(H100、B300、Rubin)只决定了理论上限。实际推理性能可以通过算法优化提升 5-30 倍。本文深度解析 PagedAttention、FlashAttention、Speculative Decoding 三大推理优化技术。
Apple Silicon 在 AI 时代正在经历逆袭。M3 Ultra 单台 Mac Studio 配备 192GB 统一内存(UMA) 和 80 核 GPU,可以本地运行 70B-200B 参数 LLM 而无需量化。这是消费级 / 工作站级 AI 推理的革命。本文深入分析 Apple Silicon 的 AI 优势、当前生态和未来。
2026 年 AMD 推出 MI400(CDNA Next) + Helios 72-GPU 机柜,这是 AMD 对标 NVIDIA NVL72 的旗舰方案。本文将分析 MI400 的关键规格、Helios 机柜的开放互联(UALoF)战略,以及与 Rubin R200 的对比。
2026 年 4 月 22 日,Google 在 Cloud Next 大会上公布了 TPU 8t + TPU 8i——首次将 TPU 拆分为训练/推理两条独立产品线。TPU 8t 专注训练,TPU 8i 专注推理。这是 Google 应对 AI 推理时代的关键产品调整。
NVIDIA Vera Rubin 平台是 Blackwell 之后 NVIDIA 推出的下一代旗舰计算平台。本文将从命名由来、6 芯片封装、内存子系统、算力矩阵、互联架构、机柜级方案、软件生态等角度对其进行深度解析。
2026 年 4 月 17 日,Cerebras Systems 正式向 SEC 提交 S-1 招股书,申请在 Nasdaq 上市,目标 2026 年 5 月。这是 AI 芯片行业 2026 年最重大的 IPO 之一。本文将深入分析 Cerebras 的财务、战略、客户和未来。
2026 年 Q1,AI 芯片行业最大的新闻之一:NVIDIA 以约 200 亿美元全资收购 Groq。这意味着 Groq 的 LPU 架构正式成为 NVIDIA 算力版图的一部分,与 GPU 形成互补。本文将详细分析这次收购的战略意义。
2025 年 12 月 2 日,AWS 在 re:Invent 2025 大会上正式 GA 第三代自研 AI 训练芯片 Trainium 3。这是 AWS 算力版图的关键升级:3nm 工艺、4.4× 算力提升、4× 能效提升、Trn3 UltraServer 144 颗芯片。本文详细解析。
Huawei Ascend 920(昇腾 920) 于 2025 H2 大规模量产,是中国国产 AI 芯片的重大突破。本文将分析其规格、与 NVIDIA H20 的对比、CloudMatrix 384 Ultra 系统,以及对中国 AI 产业的意义。