引擎技术游戏AI产业观察评论分析· 4129· 约7分钟阅读

暴涨15倍之后,国产GPU才摸到光追门槛

A
AI编辑团队AI 原创内容
2026-09-04 12:32 发布· 本文由作者与AI协作完成
本内容由人工智能生成,仅供研究参考,不构成投资建议。
💡

摩尔线程"庐山"GPU年内上市,国产图形卡首次拥有硬件光追底座;同期英伟达DLSS5上线,渲染范式转向生成式AI。本文拆解两条技术路线的攻防时间差、各自的生态底牌,以及Steam一周720款新游的内容端踩踏,给出对GPU竞赛格局的三点判断。

9月初,GPU产业在同一周内扔出两枚炸弹:一边是摩尔线程在业绩说明会上确认,第五代“花港”架构的“庐山”GPU有望年内上市——国产图形卡第一次把硬件实时光线追踪写进参数表;另一边,英伟达DLSS5正式上线,首发却只适配一款游戏。

两件事看似平行,实则指向同一个命题:游戏渲染的范式正在换轨。追赶者刚补上光追这堂课,领跑者已经转身去答“生成式神经渲染”的新卷子。这场时间差里的攻防,才是本轮GPU竞赛真正的看点。

📈 庐山插旗:国产光追第一卡,账面与货架隔着最后一公里

国产GPU从来不缺发布会,缺的是插旗的底气。

场景先摆出来:2026年9月4日,摩尔线程半年度业绩说明会。管理层确认,基于“花港”架构的“庐山”GPU有望年内正式上市,这是国内首款支持硬件实时光线追踪的国产图形卡。用媒体的说法,国产GPU第一次在光追层面拥有了真正的硬件底座。

“庐山”是摩尔线程第五代“花港”架构的第二款芯片,主打高性能图形渲染。规格上的几个关键点值得圈出来:新一代指令集让算力密度提升50%、能效提升10倍;支持FP4到FP64全精度计算;集成第一代AI生成式渲染架构(AGR)和第二代硬件光线追踪加速引擎;完整支持DirectX 12 Ultimate。

对比上一代S80,性能曲线几乎是垂直的:

性能指标相对上一代S80的提升
3A游戏渲染性能15倍
光线追踪性能50倍
几何处理性能16倍
原子访存性能8倍
AI计算性能64倍

显存容量最高可达64GB,直接越过RTX 5090的32GB,业内普遍认为其性能对标RTX 50系列。而且“庐山”不止是一张图形卡:统一任务引擎(UNITE)调度所有计算单元,MUSA软件栈完整覆盖vLLM、SGLang、Ollama等主流推理框架,本地大模型推理能力是标配而非附赠。

底气来自业绩。2026年上半年,摩尔线程营收17.36亿元,同比增长147.42%——半年干完了2025年一整年的活;研发投入7.69亿元,同比增长38.16%;MUSA生态开发者突破80万名,累计申请专利2167项,发明专利占比超94%。

判断一家芯片公司的成色,就看三点:营收能不能自造血、研发是否持续、生态有没有人真用。摩尔线程三项都在改善,这是“庐山”敢叫板参数的根本。但素材里那句大实话值得整个行业背诵:“国产GPU不缺发布会参数,缺的是能买到、能跑光追的好卡。”

Q4上市,就是把参数变成货架的关键一跃。在从业者的讨论里,真正被盯的从来不是PPT倍数,而是实际出货量与驱动迭代节奏。

🔋 DLSS5上线:英伟达把战场从帧数挪到了像素

当屏显每24个像素里有23个出自AI,“渲染”这个词就需要重新定义了。

DLSS5上线当天,场面多少有点冷清:首发仅支持RTX 50系列显卡,游戏适配只有一款——2K Games的《NBA2K27》。但技术的野心里藏着更大的东西:官方名称叫“3D引导神经渲染”,与以往的超分或帧生成完全不同,它由生成式AI模型直接对画面的光照与材质细节逐帧重构。

和上一代的差异在侧重点。DLSS4靠生成新像素拉高帧数——按官方数据,DLSS4.5显示在屏的每24个像素中多达23个由AI生成;DLSS5的重心转向画质,给原始游戏中根本不存在的细节做加法,同时保持帧间一致以避免闪烁。一句话:从“造更多帧”进化到“造更好的画面”。

性能数字依然夸张。《NBA2K27》在开启DLSS5、6倍多帧生成与质量模式超分下,2560×1440分辨率:RTX 5090跑到594FPS,RTX 5070也有262FPS。官方同时留了一句冷静的提示:输入延迟仍取决于真实渲染帧数——AI造得再多,你的手还是连着那几十帧。

维度DLSS5适配现状
首发显卡仅RTX 50系列
RTX 40系列完成RTX 50优化后扩展
RTX 30/20系列暂无具体计划
首发游戏《NBA2K27》一款
GTC展示名单《星空》等五款,官方未确认

英伟达发言人Rajal Maharaj向The Verge确认,后续会把DLSS5扩展至RTX 40系列,更老的30系与20系暂无计划。另一个细节耐人寻味:玩家端只得到一个开关,模型选择与强度调节等精细控制仅面向开发者——控制权正在从玩家手里上移。

3月GTC大会曾展示更长的支持名单:《星空》《霍格沃茨之遗》《生化危机安魂曲》《刺客信条影》《上古卷轴IV:湮灭重制版》。被问及是否仍按计划支持时,官方未正面回应,只留下“更多游戏正在路上,许多开发者正在积极集成”。名单从发布会到落地之间缩水到一款游戏,这本身就是信号:新技术的适配,正在成为稀缺资源。

产业逻辑有三层。第一,技术垄断的重心从硅片转向模型——DLSS5的本质是把渲染变成AI生成问题,而模型迭代权牢牢握在英伟达手里。第二,硬件分层淘汰策略:老卡用户“暂无计划”四个字,就是下一次换卡的动员令。第三,当画面细节由AI逐帧重构,画面质量的裁判权从美术资产转移到模型版本,游戏工业的又一层话语权被平台方收走。

⚡ 范式相撞:补课者与换轨者的时间差

最危险的不是落后一个身位,而是你在拼命刷上一张考卷。

把两条新闻放在同一张桌上,荒诞感就出来了:摩尔线程刚把硬件光追立为历史性突破,英伟达的战略重心已经挪向生成式AI重构画面。追赶者补课,领跑者换轨,节奏差了整整一个范式。

但细看“庐山”的规格清单,会发现摩尔线程并不糊涂。它在堆第二代光追引擎的同时,也集成了第一代AI生成式渲染架构(AGR)——两条腿走路,谁也不放弃。这个选择背后,是对渲染技术演进路径的清醒判断:

这条链路上,硬件光追依然是入场券。DirectX 12 Ultimate是3A游戏的通行证,“庐山”完整支持它,意味着主流3A大作理论上“能跑”——这是从0到1的一步,没有它连考卷都拿不到。但DLSS5这类技术是深度绑定的私有生态,追赶者短期无法复制:模型、驱动、开发者集成、游戏适配,每一环都是英伟达用十年时间垒起来的墙。

所以国产卡的差异化窗口不在正面战场,而在开放生态。MUSA完整覆盖vLLM、SGLang、Ollama等主流推理框架,AI计算性能提升64倍,显存最高64GB——“庐山”最现实的战场,很可能先落在本地大模型推理与国产游戏生态,而不是硬刚光追3A。先在AI推理和本土内容端把营收做实,再回头反哺图形栈,这是更务实的路线图。

第三层判断是:时间差本身也是机会。AI渲染目前没有行业标准,DLSS5首发仅一款游戏适配、GTC名单悬而未决,说明连英伟达都还在摸着石头过河。规则没写完的赛场,后来者仍有上桌资格——前提是“庐山”能在Q4真正落地,而不是又一次停留在说明会的参数表上。

🎮 一周720款新游:踩踏之下,工具即命运

躲过手游买量,逃不过Steam踩踏。

过去很长一段时间,Steam都是中小团队和独游开发者眼中的“应许之地”:去中心化的流量分发模式,无需向平台上供,靠产品本身说话。然后,一周720款新游的数据把这个神话砸出了裂缝——平均每天超过100款游戏上架,曝光成了比资金更稀缺的资源。

把这条内容端的新闻放进本文的技术语境里,会看到一个残酷的合流:硬件、工具、平台三端同时在收紧。

硬件端,光追和AI渲染不断抬高画面基准线。玩家眼睛被594FPS和AI重构的画面养刁之后,“能跑”和“好看”之间的差距就是差评的直接来源。

工具端,DLSS5首发仅一款游戏适配的冷清,恰恰暴露了新技术的适配门槛——先集成的游戏吃到画质与帧数的双重红利,后来者连入场资格都要排队。对大厂这是节奏问题,对资源有限的独游团队这是生死问题:接不接光追、等不等AI渲染管线、要不要为国产GPU做适配,每一项决策都在挤占本就捉襟见肘的开发资源。

平台端,720款新游的一周意味着踩踏只会加剧。当去中心化分发演化成供给爆炸,中小团队的生存策略不得不从“做好产品”退到“做好产品之外的一切”。

这里有一个容易被忽略的交叉点:摩尔线程MUSA生态80万名开发者,与Steam独游人群的重合度,某种程度上决定了国产图形生态能否在内容端长出血肉。硬件光追需要游戏来验证,独游团队需要低成本的技术栈和潜在的政策与生态支持——如果这80万开发者中有足够多人做出适配“庐山”的作品,国产GPU的生态叙事就从参数表变成游戏库。反之,再亮的硬件参数也只是一座空城。

小结:三个观察点,决定这场较量的成色

一周之内,三条战线同时开火:摩尔线程用15倍性能跃迁和硬件光追插旗国产图形栈,英伟达用DLSS5把渲染推向生成式AI,Steam用一周720款新游把内容端的踩踏推向极限。三条线共同指向一个判断:GPU竞赛的上半场比的是硅片,下半场比的是模型、生态与内容的合围。

接下来盯三个节点即可:“庐山”Q4能否真正上市并跑通光追3A;DLSS5的游戏名单能否从一款扩容;以及国产图形生态里,什么时候出现第一批“为庐山而生”的游戏。旗已插上,高地还远。