半导体分析

RSS: https://newsletter.semianalysis.com/feed
SemiAnalysis,Dylan Patel 主理的半导体行业深度分析,连接芯片工艺与商业市场的桥梁。

NVIDIA GPU的极致交互推理?TileRT InferenceX解析

高价“快速模式”证明,用户愿意为更低延迟和更快的代币支付更多费用,从而可能带来更高的毛利率。前沿人工智能实验室,如因此,OpenAI正在评估专门构建的推理系统,包括Cerebras和NVIDIA Groq LPUs。 优先考虑超高交互性,而非最大批量吞吐量。超低延迟在交互工作负载中尤为重要,包括实时助手和全双工语音。例如,OpenAI GPT-Live可以同时听说,使响应延迟对用户能立即感知,被形...
评论点赞收藏6 天前

SpaceX 2027 年 10GW 算力计划:为何可行并将带来 3000 亿美元年收入

SpaceX 计划在 2027 年建成 10GW 算力,带来 3000 亿美元年收入。OpenAI 和 Anthropic 通过 API 推理每 GW 可赚超 1000 亿美元,Microsoft 因拥有 OpenAI 模型访问权也能获得同等收益。SpaceX 通过快速建设(如 Colossus 1 在 122 天内建成 300MW)和与 Nvidia 的 vendor financing 支持来实现这一目标。
评论点赞收藏8 天前

Gemini已凉,但GCP正在崛起

8月5日星期三,谷歌已宣布 对DeepMind领导层的彻底改革。快速回顾一下: • DeepMind联合创始人兼前首席执行官Demis Hassabis已不再参与日常运营。 • 前谷歌首席科学家兼双子座联合负责人杰夫·迪恩将离开,创办名为Discovery Loop的新实验室。Jeff是谷歌工程界无可争议的GOAT,他是Google Brain的联合创始人,并创立了TPU项目。 • 与杰夫一同出演...
评论点赞收藏9 天前

Kimi K3, The Manos, The Mythos, The Legendos

Kimi K3 took the world by storm at its announcement, sweeping leaderboards and establishing itself as the open frontier model. While the community is eager to understand how Kimi K3 works, many have b...
评论点赞收藏12 天前

乐高式数据中心的狂野西部:模块化建造的变革

劳动力问题与模块化建造的救星 今天,我们深入探讨数据中心建设的世界,因为如今的数据中心建造方式与行业以往的传统做法几乎毫无相似之处。混凝土墙体以成品面板的形式运抵现场,机电机房早已布线完毕,有时甚至整座数据中心大厅都直接装上卡车运来。世界上一些规模最大的数据中心,其搭建方式正日益趋于与你组装全新《蜘蛛侠》乐高套装如出一辙——只不过这些乐高积木重达5万磅,且结构复杂程度略高一点。这就是模块化建造的世...
评论点赞收藏17 天前

AMD能否打破CUDA的壁垒?AMD进军人工智能2026

当我们发表第一篇AMD软件文章时,我们曾向AMD表示,在AI加速器领域,AMD与NVIDIA的差距为0%。软件存在缺陷,进展乏善可陈,而且在很长一段时间里,我们一直是bug提交量最多的团队,数十位AMD工程师负责对我们的bug报告进行分类和处理。六个月后,在我们的AMD 2.0文章中,我们采取了非共识的立场,将成功概率从0%升级为更有意义的成功概率。当我们对AMD的看法处于谷底时,且市场上的大多数...
评论点赞收藏22 天前

Vera Rubin NVL72 与 GB200 NVL72 对比:推理 TCO 与架构分析

SemiAnalysis 分析英伟达 Vera Rubin NVL72 架构,指出其推理性能较 GB200 NVL72 提升显著。工程样本显示,运行 DeepSeek R1 时,每兆瓦性能提升 5.4 倍,每美元性能提升 5 倍。随着软件栈成熟,差距预计进一步扩大。文章对比了两代架构的 TCO 差异及设计细节。
评论点赞收藏24 天前

Meta 基础设施工具需要文化重置:从 Rivos 收购到服务器架构的昂贵失误

SemiAnalysis 深度剖析 Meta 基础设施团队的文化危机与昂贵失误。指出中层管理政治化、六个月考核制导致短视,以及硬件软件缺乏协同设计。重点分析了 Rivos 25 亿美元收购后的整合混乱、工程师流失,以及 Teton Grand 和 Ariel 服务器架构的“优化”反而导致 TCO 上升、性能落后于行业标准。文章警告 Meta 在 AMD MI450 定制芯片上可能重蹈覆辙,呼吁停止浪费硅片资源。
评论点赞收藏25 天前

Meta超级智能的未来:一年进展更新

一家顶尖的强化学习环境初创公司凭空诞生,其计算能力的提升幅度之大,是我们见过的最激进的一次,规模跨越2000公里以上,并为谷歌DeepMind提供了一些建议。
评论点赞收藏37 天前

英伟达GPU债务担保释放AI项目铁三角:资本、包销与算力

SemiAnalysis深度解析英伟达推出的GPU租赁回购担保计划。该计划旨在解决AI算力建设中“资本、包销合同、数据中心”的三角难题,通过英伟达信用背书帮助Neocloud获得融资。文章详细推演了不同租期下的收益模型,指出这标志着英伟达正成为AI领域的“中央银行”,重塑GPU信贷市场结构。
评论点赞收藏40 天前

共封装光学(CPO):以光互联开启下一波扩展浪潮

SemiAnalysis 深度分析共封装光学(CPO)技术在 AI 数据中心的应用。文章对比了传统可插拔光模块与 CPO 在功耗和成本上的差异,指出 CPO 在 Scale-up 网络中更具潜力。 文章详细拆解了 Nvidia 和 Broadcom 的 CPO 方案,分析了 Meta 的研究数据,认为 CPO 能大幅降低功耗,但初期部署仍面临成本和可靠性挑战。
评论点赞收藏52 天前

SMIC N+3 金属间距是否小于 Intel 18A?

中芯国际N+3节点深度剖析 vs 台积电N6,TechInsights私募股权出售,SemiAnalysis拆解工程与评估实验室,海思麒麟9030,制程技术,光刻工艺,芯片架构
评论点赞收藏62 天前

DeepSeek V4 1.6T:从发布首日到第43天的性能演变实录

SemiAnalysis InferenceX团队详细追踪了DeepSeek V4模型发布后43天内在不同硬件(NVIDIA Blackwell系列、AMD MI355X、华为昇腾)和推理引擎(vLLM, SGLang, TensorRT-LLM, ATOM)上的性能演变。文章提供了大量工程细节,包括AMD团队如何通过底层内核优化实现100倍性能提升,NVIDIA TensorRT-LLM的适配问题及修复过程,以及GB300集群上的Wide EP优化。这是一篇极具技术深度的一手工程复盘,对关注AI基础设施、推理优化和国产芯片生态的技术读者有极高价值。
评论点赞收藏68 天前

宇树科技将主导全球机器人市场

SemiAnalysis深度分析宇树科技如何通过类似比亚迪和DJI的垂直整合与生态策略,将人形机器人成本大幅降低至2万美元以下,并论证其G1型号已跨越商业化部署门槛,有望主导全球市场。
评论点赞收藏68 天前

登录芦苇

登录后关注作者、收藏内容和参与讨论。