跳到正文
10月7日周三
  1. AMD67

    AMD 官方发布称,OpenAI 解释其团队选择 AMD EPYC "Turin" CPU 托管 Jalapeño AI ASIC 部署,理由包括平台实力、合作体验以及降低不必要风险的重要性。Tom's Hardware 相关报道链接见原文。

    AI 生成摘要 · 以原文为准

    关注理由:OpenAI 自研 AI ASIC 部署选择 AMD EPYC Turin CPU 作为主机平台,显示 EPYC 在 AI 加速器托管场景获得头部客户采用,可关注服务器 CPU 厂商在 ASIC 部署中的配套机会。

10月6日周二
10月5日周一
10月4日周日
10月3日周六
  1. AMD49

    周六早晨,我们一边享受咖啡☕、翻翻新闻📰,一边看着我们 AMD 向 vLLM 提交的代码。 开源万岁。

    AI 生成摘要 · 以原文为准

    引用Ramine Roane@roaner

    #1 company contributing code to @vllm_project right now? @AMD: 502 commits to core vLLM in 90 days. 13% of all org contributions, almost 4x Nvidia. Also grateful to Red Hat, IBM, Embedded LLM & Inferact for building it with us. Open source wins when hardware has a choice.

  2. Fabricated Knowledge33

    笑死,这渲染搞得我火大——兄弟,我们根本不是在 PCIE 上用显卡的

    AI 生成摘要 · 以原文为准

    引用Bearly AI@bearlyai

    Someone used Claude Opus 5.5 to make a 3D animation of Nvidia Blackwell GPUs (from server down to an atom). Took 1 hour and full animation “runs from single HTML file, directly in browser. No vid editor. No pre-rendered 3D sequence. Just browser-based experience.” Very cool.

  3. Dylan Patel61

    马斯克称 Tesla AI5 芯片内存减半至 72GB LP5,AI6 降至 144GB LP6,以获得足够产量支持 Optimus 生产并大幅降低成本。他认为这对 Optimus 性能影响可忽略,因为内存带宽比总容量更是瓶颈,且带宽保持不变。SemiAnalysis 的 Dylan Patel 转发并附上其关于 4-Hi HBM 的文章链接。

    AI 生成摘要 · 以原文为准

    引用Elon Musk@elonmusk

    We cut our RAM in half for the Tesla AI5 chip (now 72GB of LP5) and 1/3 for AI6 (now 144GB of LP6). This was the only way to get enough volume for Optimus production and greatly reduces cost. As it turns out, we think this will have a negligible effect on Optimus performance, as memory bandwidth is a bigger limiting factor than total memory storage (bandwidth was held constant).

10月2日周五
  1. NVIDIA Newsroom64

    OpenAI 发布 GPT-6 Astra Ultrafast,NVIDIA Blackwell GPU 加速下 token 生成速度最高提升 8 倍

    GPT-6 Astra Ultrafast 现已在 OpenAI API 及面向符合条件的 ChatGPT Work 与 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。

    AI 生成摘要 · 以原文为准

    关注理由:OpenAI 基于 NVIDIA Blackwell 推出 Ultrafast 推理模式,展示了模型厂商通过自研推理优化榨取 GPU 硬件性能的路径,对算力平台软件生态有意义。

10月1日周四