AI 芯片简报 07.21-07.24:NVIDIA Vera 亮剑、AMD 2nm GPU、Google 叛逃 CoWoS
每期覆盖 3-4 天的 AI 芯片动态。个人视角不追求面面俱到——只讲我认为重要的。周二、五更新。7 月 21 日到 24 日这四天AI 芯片行业发生的事放在任何一个正常的年份都够写一个季度的头条。NVIDIA、AMD、Intel 三巨头在 72 小时内密集出牌不是巧合——是所有人都看到了同一个信号CPU 在 AI 系统中的角色正在从配角变主角。NVIDIA 摊牌了Vera CPU 一年卖 130 万颗$5,000 一颗NVIDIA 选在 AMD Advancing AI 大会前一天放出 Vera CPU 的完整规格。这时间点摆明了就是要抢风头。Vera 的数据确实够硬88 核 ARM v9.2Olympus 核1.2 TB/s 内存带宽CXL 3.1 原生支持。在 AI Agent 任务中比 x86 快 50% 到 1.9 倍延迟只有 x86 的六分之一。6 月已经交付 OpenAI、Anthropic、SpaceX 做样品测试。更狠的一个数字CoreWeave 在 Vera Rubin NVL72 上跑 DeepSeek-R1每兆瓦产出 10 倍于 Grace Blackwell NVL72 的 token。10 倍。不是 10%。Wolfe Research 估 Vera 今年出货 130 万颗、单颗 $5,000。算一下这就是 $65 亿的年收入——而且这还只是 CPU 部分不算配套的 Rubin GPU 机架。NVIDIA 有超过 300 家合作伙伴在部署 Vera Rubin供应链铺到 30 个国家 350 多家工厂。我判断Vera 不是来「试试」服务器 CPU 市场的。$5,000 的 ASP、「300 家合作伙伴」的规模、「从芯片到机架到网络」的垂直整合——NVIDIA 是在用 GPU 市场赚来的钱建一座 CPU 市场的护城河。有一个细节值得单拎出来说Rubin 架构是全球第一个 100% 液冷、零水消耗的 AI 平台。冷却剂工作温度 45°C——这个数字意味着在加州、德州、中国的多数数据中心可以直接用室外干式冷却器散热不需要冷水机。一个 50MW 设施每年省 $400 万以上的冷却电费。能效比正在变成比绝对算力更硬的购买理由。AMD 掀桌了全球第一款 2nm GPU不是 NVIDIAAMD 在 7 月 23 日的 Advancing AI 大会上亮出了 MI455X。我坦白讲看到 2nm GPU 来自 AMD 而不是 NVIDIA我是意外的。MI455X 的核心数据TSMC 2nm 工艺比 NVIDIA Rubin 的 3nm 领先整整一代CDNA 5 架构3200 亿晶体管12 个计算 chiplet432GB HBM4Samsung 12 层堆叠2048-bit I/O 跑出 23.3 TB/s 带宽。同期发布的 Venice CPU 是 2nm 512 线程 PCIe 6.0Helios 机架方案单柜 72 颗 MI455X31TB 总 HBM41.7 PB/s 带宽。AMD 同步宣布了 Anthropic 2GW MI450 采购协议和 $50 亿投资。上一次 AMD 敢在发布会上同时对标 NVIDIA 的 GPU、CPU 和整机架方案——我没有印象。但那句话怎么说来着——硬件跑分是发布会的事生产部署是客户的事。AMD 的 ROCm 软件栈与 NVIDIA CUDA 之间的差距不是一个 MI455X 能填平的。上周 SemiAnalysis 发了篇报告讲 NVIDIA 的 vLLM Dynamo 在 MoE 模型 Kimi K2.5 上跑出 12,000 tok/s/GPUAMD 同样跑 vLLM 但缺少 MoE 专项优化。软件生态这个事三年前大家觉得可以慢慢追现在市场不给时间了。我还是看好 AMD 在推理侧吃掉一部分份额——尤其是那些不想把全部筹码压在 NVIDIA 一家身上的云厂商。但训练侧的主战场2026 年 AMD 还打不进去。IntelCPU 不够卖了Intel Q2 财报 7 月 24 日盘后发。$161 亿收入25% YoY——15 年来最快的季度增速。数据中心的数字更吓人DCAI 业务 $63 亿59% YoY。AI 相关业务增长 70%占总收入大概七成。CEO Lip-Bu Tan 原话CPU 需求「超过当前供给能力」。已经签了 10 份长期服务器 CPU 供货合同。2026 年资本支出拉到 $200 亿以上2027 年还要再往上加。盘后涨 11%。市场买账了。我的一个观察这三家同时在喊「CPU 不够卖」——不是营销话术。Agentic AI 在把 CPU:GPU 的配比从 1:8 往 1:1 推。Bernstein 预计 AI 工作负载中 CPU 的算力占比会从 14% 跳到 ~50%。SemiAnalysis 的 Dylan Patel 直接说「CPU 严重短缺4 倍需求暴增」。这是结构性的不是周期性的。Google 叛逃 CoWoS一个迟早会来的时刻SemiAnalysis 7 月报告爆了一个料Google 下一代 TPU代号 Humufish已经从 TSMC CoWoS 切换到了 Intel EMIB-T。怎么理解这件事TSMC 的 CoWoS 产能NVIDIA 自己就吃了 56%。剩下 44% 分给 AMD、Broadcom、Google、AWS、MediaTek……排期 52 到 78 周。Google 不是不想用 CoWoS——是用不起也等不起。Intel EMIB-T 的优势在纸面上很清楚硅用量只要 CoWoS 的三分之一到五分之一单颗成本低 30-50%支持 8 到 12 倍光罩尺寸CoWoS 才 3.3 倍后端良率已经超过 90%。Meta 在评估 EMIB 给 2028 年的 CPUNVIDIA 据传在考虑 Feynman 世代 GPU 用 EMIB——但这个 NVIDIA 内部的讨论还没定论先当传闻看。我说一个判断CoWoS 不会被打败但垄断结束了。2027 年 CoWoS 需求翻到 268 万片的时候Intel EMIB 可能有 5 万片月产能。不多但够撬动了。一句话速览Kimi K3 48 小时自主设计芯片Moonshot AI 用纯开源 EDA 工具让 Kimi K3 在两天内画了一颗 4mm² 45nm 芯片Cadence 和 Synopsys 股价当天跌 9%Needham 说别慌——45nm 和 3nm 之间的工程鸿沟 LLM 现在还跨不过去。CXMT $98 亿 IPO中国最大 DRAM 厂 7 月 27 日敲钟HBM 晶圆产能目标 2026-2027 年 3-5.5 万片/月逻辑芯片下饺子高带宽内存才是最粗的瓶颈。国产 AI 芯片出货占比破 60%600 万张等效算力卡华为昇腾单品牌接近 30%。超节点从 PPT 变成了产能——华为在 WAIC 展出了 1024 卡超节点1 EFLOPS FP8我好奇的是这么多卡的实际互联效率不是峰值算力。HBM 不再是唯一答案FMS 2026 的核心主题——HBM 太贵了大规模推理烧不起。LPDDR6 是第一个专门为数据中心设计的低功耗内存不是从手机端改的CXMT 已经出了 12.8 Gbps 工程样品。混合内存管理HBM LPDDR HBF CXL 分级编排会是个值得追的新方向。ASML 的 MATCH Act 威胁DUV 比 EUV 更危险——如果 MATCH Act 通过ASML 不仅要停止卖 DUV 给中国还得切断数百台已装设备的维保。中国占 ASML 2026 年收入约 20%大部分是 DUV。本周趋势基于 topic-index 累计数据反映各主题关注度变化。我的判断这是一轮 CPU 军备竞赛的开幕不是闭幕。NVIDIA Vera、AMD Venice、Intel Xeon 6 三家同时在拼 CPU——不是因为 CPU 本身的市场在扩大是因为 Agentic AI 在把 CPU 从「够用就行」变成「不够用就是瓶颈」。谁先拿出 Agent 场景下能效比最高的 CPU谁就拿走了下一轮 AI 基础设施采购的定价权。下周看两件事7 月 27 日 Kimi K3 技术报告发布如果它能证明 EDA 工具链不只是 45nm 玩具那 Cadence 和 Synopsys 的 9% 跌幅就不是恐慌而是先兆同一天 Cadence Q2 财报管理层怎么回应 Kimi K3 的竞争威胁比财报数字本身更值得听。AI 辅助调研人工视角解读。数据来源公开分析仅代表个人判断。每周二、五更新。

相关新闻

Unity 6 D3D11崩溃排查:8个方法解决图形驱动与设备丢失问题

Unity 6 D3D11崩溃排查:8个方法解决图形驱动与设备丢失问题

1. 项目概述:当Unity 6遇上D3D11的“水土不服”如果你最近把项目升级到了Unity 6,然后发现编辑器或者打包后的游戏在Windows平台上频繁闪退,尤其是在启动、场景切换或者运行一段时间后,屏幕一黑,程序就没了踪影&#x…

2026/7/24 23:23:08阅读更多 →
打破AI设计同质化僵局:Impeccable项目深度解析与前端UI优化实战指南

打破AI设计同质化僵局:Impeccable项目深度解析与前端UI优化实战指南

打破AI设计同质化僵局:Impeccable项目深度解析与前端UI优化实战指南 在人工智能辅助编程日益普及的今天,Claude等先进的大语言模型虽然具备了强大的代码生成能力,但在前端UI设计领域,往往容易陷入“通用模板”的怪圈。滥用特定的字…

2026/7/24 23:23:08阅读更多 →
终极macOS炉石助手:3分钟上手HSTracker完全指南

终极macOS炉石助手:3分钟上手HSTracker完全指南

终极macOS炉石助手:3分钟上手HSTracker完全指南 【免费下载链接】HSTracker A deck tracker and deck manager for Hearthstone on macOS 项目地址: https://gitcode.com/gh_mirrors/hs/HSTracker 你是否曾经在对战中忘记对手使用过哪些关键卡牌?…

2026/7/24 23:23:08阅读更多 →
研发效率上不去?可能是你的工具链拖了后腿

研发效率上不去?可能是你的工具链拖了后腿

不少药企将研发进度缓慢归咎于管线难度、实验周期,却长期忽视一个关键堵点:碎片化的工具链正在持续消耗科研生产力。行业调研显示,大量研发人员每天辗转于多个独立系统,在文献网站、绘图软件、通用AI、引文管理工具之间来回切换&a…

2026/7/25 4:54:06阅读更多 →
AI实践报告生成工具:百考通AI的技术与应用

AI实践报告生成工具:百考通AI的技术与应用

1. 项目概述 "百考通AI:实践报告智能生成"是一款面向大学生和职场新人的智能写作辅助工具。作为一名在教育科技领域摸爬滚打多年的从业者,我深知实习报告、实践总结这类文书写作的痛点——既要体现专业性,又要避免千篇一律的模板化…

2026/7/25 4:54:06阅读更多 →
哈希去重与AI检索:OmniRoute技术在网络内容处理中的实践与挑战

哈希去重与AI检索:OmniRoute技术在网络内容处理中的实践与挑战

在网络流量管理和内容分发领域,一个看似简单的技术问题正在引发深层次的架构思考:当我们使用哈希算法对会话内容进行去重时,AI系统真的能够准确找回原始内容吗?这个问题触及了现代网络基础设施的核心矛盾——效率与准确性之间的平…

2026/7/25 4:54:06阅读更多 →
CNN-LSTM-KAN混合模型在时序预测中的实践

CNN-LSTM-KAN混合模型在时序预测中的实践

1. 项目概述在时间序列预测和复杂模式识别领域,传统神经网络架构正面临新的挑战。这个项目实现了一种融合CNN(卷积神经网络)、LSTM(长短期记忆网络)和KAN(Kolmogorov-Arnold Network)的混合模型…

2026/7/25 4:54:06阅读更多 →
可解释AI(XAI)原理与实践:破解深度学习黑箱

可解释AI(XAI)原理与实践:破解深度学习黑箱

1. 项目背景解析"神谕的低语"这个标题本身就充满了神秘感和技术隐喻。作为一名长期关注AI技术发展的从业者,我第一眼就被这个标题吸引住了。它完美地捕捉了当前AI技术发展中最令人着迷又令人不安的维度——当AI系统的能力越来越强,其决策过程却…

2026/7/25 4:54:01阅读更多 →
MSP430FG6x实战:DAC/LDO配置与开发工具链详解

MSP430FG6x实战:DAC/LDO配置与开发工具链详解

1. 项目概述与核心价值如果你正在为医疗设备、便携式仪表或者任何对功耗极其敏感的嵌入式系统选型,那么TI的MSP430系列微控制器(MCU)大概率在你的候选名单里。这个以“超低功耗”为招牌的MCU家族,其FG6x系列(如MSP430F…

2026/7/25 4:52:01阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/25 1:01:14阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/25 1:01:14阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/25 1:01:14阅读更多 →
突破文档下载限制:kill-doc让你看到的都能保存

突破文档下载限制:kill-doc让你看到的都能保存

突破文档下载限制:kill-doc让你看到的都能保存 【免费下载链接】kill-doc 看到经常有小伙伴们需要下载一些免费文档,但是相关网站浏览体验不好各种广告,各种登录验证,需要很多步骤才能下载文档,该脚本就是为了解决您的…

2026/7/25 0:01:16阅读更多 →
C++ string类模拟实现:从深拷贝到内存管理的完整指南

C++ string类模拟实现:从深拷贝到内存管理的完整指南

1. 项目概述:为什么我们要“手撕”string类?在C的学习道路上,尤其是从C语言过渡到C的“初阶”阶段,string类绝对是一个绕不开的核心。标准库里的std::string用起来太方便了,、find、substr,几个操作符和函数…

2026/7/25 0:01:16阅读更多 →
三角洲寻宝鼠工具:高效文件搜索与资源管理实战指南

三角洲寻宝鼠工具:高效文件搜索与资源管理实战指南

1. 先搞清楚“三角洲寻宝鼠”到底是什么工具从名称来看,“三角洲寻宝鼠”更像是一个资源查找或文件检索类工具,而不是游戏或娱乐软件。这类工具的核心价值在于帮助用户快速定位特定资源,比如文档、图片、压缩包或特定格式的文件。如果你经常需…

2026/7/25 0:01:16阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/24 23:01:03阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/24 19:00:40阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/24 19:00:40阅读更多 →