跳到正文
  1. NVIDIA Newsroom64

    OpenAI 发布 GPT-6 Astra Ultrafast,NVIDIA Blackwell GPU 加速下 token 生成速度最高提升 8 倍

    GPT-6 Astra Ultrafast 现已在 OpenAI API 及面向符合条件的 ChatGPT Work 与 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。

    AI 生成摘要 · 以原文为准

    关注理由:OpenAI 基于 NVIDIA Blackwell 推出 Ultrafast 推理模式,展示了模型厂商通过自研推理优化榨取 GPU 硬件性能的路径,对算力平台软件生态有意义。

  1. AMD Press Releases79

    AMD 在 Advancing AI 2026 发布 Helios 机架级 AI 方案与 MI400 系列 GPU

    AMD 在 Advancing AI 2026 上发布 6th Gen EPYC CPU、Instinct MI400 系列 GPU、Helios 机架级 AI 方案、Ryzen AI Embedded X100 处理器和 Kria AI SOM 机器人平台。

    AI 生成摘要 · 以原文为准

    关注理由:AMD 发布 Helios 机架级方案与 MI400 系列 GPU,并披露 OpenAI、Anthropic、Meta 等客户部署计划,为数据中心 GPU 竞争格局提供了关键产品节点。

  2. AMD Press Releases69

    AMD 与 Cerebras 合作发布超低延迟高吞吐 AI 推理解耦方案

    AMD 与 Cerebras 宣布技术合作,在 Advancing AI 2026 上发布解耦式 AI 推理方案:AMD Helios 机架级方案负责高吞吐 prompt 处理,Cerebras 晶圆级引擎负责超低延迟的 token 生成,双方建模显示组合方案每瓦 token 生成速率最高可达单用 Cerebras WSE 的 5 倍。

    AI 生成摘要 · 以原文为准

    关注理由:两家公司以解耦推理组合高吞吐 GPU 与低延迟晶圆级引擎,为推理基础设施按负载分层选型提供了新的架构方向,并明确部署时间点。

已经到底了