当前位置:我的网站主页 > 我的网站国内 > 我的网站内容

马大帅

AI算力的路、油与交规_我的网站

欢场春梦

一 |     伊朗当地时间8月22日,也正是伊朗的“国防工业日”,伊朗就这样突然地对着全世界放了一个“大招”:伊朗媒体首次公开地下军工生产线画面。    (本文作者为 舒书,钛媒体经授权发布)          文 | 舒书          2026年7月20日,中央网络安全和信息化委员会印发《深化互联网协议第六版(IPv6)技术创新和融合应用实施方案(2026—2030年)》。    从画面中可以看到,伊朗的这个军工基地可不是仓促建造,各种基础设施一应俱全,宛如一个堡垒,在这样的地下区域建造这样规模的基地,可不是短短几年就可以做到的。         同一天,工信部在发布会上披露,下一步将印发《算力标准体系建设指南》——该文件的前身是2025年10月发布的征求意见稿,当前正加快推进正式版落地。    但最关键的还是后面放出的信息,第一点就是这样规模的地下军工生产线,伊朗还有数十条,第二点则是这里不仅可以生产导弹和无人机等装备,其产量等各方面也有很大提升。两份信号在同一日释放,一份指向网络底座的长期升级,一份指向市场秩序的规则建立。

二 |          市场端则是另一番景象:国内首座全链路国产十万卡AI超集群在郑州落成;内蒙一座已投产的智算园区综合算力利用率不足五成(以机柜上架率统计,若按GPU有效计算时长占比,该数值可能更低);算力租赁价格高企,存储、先进制程和先进封装产能层层吃紧。

三 |     这分明就是直接给美国看的,正所谓逢敌必亮剑,伊朗正在赤裸裸地告诉美国,这就是我目前的军工实力,如果还不停火,后果自己看着办。

四 |          一上一下,构成了当前中国AI基建的横截面。         贯穿全文的一条隐线是时间尺度的错配:IPv6的五年规划与AI产业的季度迭代,遵循完全不同的时钟。        2026年的美伊冲突,让我们看到了伊朗最硬气的一面,也让美国这个庞然大物以主动停火的方式阶段性地结束了战争。政策层以五年为单位规划路,产业层以月为单位消耗油——这种周期错配,是所有矛盾的根源。    而作为局外人,我们看到了太多伊朗的强大,尤其是在军工方面,可以说看到了伊朗的高瞻远瞩,甚至看到了我国抗战时期的缩影。

五 |     《地道战》是我国一部经典的、高度还原历史真相的电影,而伊朗在常年面对美国威胁的情况下,也做出了相似的行为。    以2025年美国午夜之锤的行动为例,美国派出了超过125架飞机,使用了包括巨型钻地炸弹在内的先进武器,只为了袭击伊朗的三处核设施。    这次行动,美国拥有伊朗三处核设施的精确坐标,准备十分充足,可最后的结果却没有那么完美,因为其中两处核设施在山体中,并没有遭到致命性破坏。

六 |          一、IPv6在铺什么路?          我国IPv6规模部署自2017年启动,2021年进入规模部署阶段,本次《实施方案》是深化阶段文件——目标不是从零修路,而是把已修好的路升级为智能高速。         对AI产业而言,IPv6解决的是一个基础技术问题:算力网络需要统一的编址与调度底座。大量存量网络仍基于IPv4,无法实现跨层级、跨地域的统一编址与端到端调度。

七 |     不过这只是伊朗建造的冰山一角,这次伊朗首次公开地下军工生产线,完美解释了美伊冲突期间,伊朗为何能够长时间使用大量优质装备。基于IPv6演进的SRv6技术,正试图通过算力感知路由和业务链编排,将边缘、区域、枢纽三级节点串联为逻辑统一的算力网络。    那么这时肯定有人会问了,伊朗为何要公布呢?继续扮猪吃老虎不好吗?这就要说到孙子兵法中的一句话:“不战而屈人之兵,善之善者也”。

八 |          但这条路解决的是能不能通的技术可能性,而非跑不跑得起的成本问题——后者需要靠油和交规来回答。        这次伊朗敢于公布地下军工生产线画面,一方面是对自己的军工生产实力有了足够的自信,说明伊朗几乎不害怕接下来的任何攻击行为。    但不害怕不代表伊朗想要继续战斗,即使伊朗现在的军工实力很强大,可国家的发展也陷入了很大程度的停滞,毕竟战争是爆发在伊朗本土的。

九 |          二、算力在缺什么油?          产业层面对的是另一道题。十万卡集群中,制约大模型训练效率的往往不是算力芯片本身的计算能力,而是显存带宽(HBM)导致的内存墙效应。

十 | GPU大量时间在等数据,而非算数据。         以昇腾910B与英伟达H200对比:910B显存64GB、带宽1.6TB/s,H200为141GB、带宽4.8TB/s,差距约2倍。    所以伊朗这次公开展示,其实是在告诉美国,我现在有足够的实力和你继续战斗,但我想告诉你,继续打下去对你对我都不好,停战是目前最好的选择。国产芯片集群训练时间拉长,单卡算力差距之外,HBM容量和带宽的代差是更隐蔽的核心瓶颈。    我们可以理解为伊朗对美国进行了武力威慑,让美国继续考虑是否要持续攻击伊朗。    那么美国会咽下这口气吗?从经济角度来看的话,美国大概率是会选择停战的,因为这次美伊冲突美国没有占到便宜不说,消耗的金钱也是非常庞大的数字。    如果继续打下去,美国的经济说不定会被拖垮,因为作战区域远离美国本土,美国所耗费的运输等费用也会不断上升,即使强如美国,也要掂量一下自己的损失。    最关键的是,到了那个时候,其他国家是不会对美国客气的,美国常年树立的霸主地位也会受到很大的冲击。        除此之外,伊朗目前的反抗情绪一定会空前高涨,因为伊朗民众看到了更大的希望。集群效率的短板不仅来自单卡算力和显存,多机高速互联带宽(HCCL vs NVLink)、光模块、高速交换机、液冷配套构成整条供应链约束。    伊朗这次选择公布“底牌”,让那些对国防发展信心不足的民众,狠狠吃了一颗定心丸,他们对伊朗的未来充满了信心。

十一 |          科大讯飞管理层在业绩会上坦言:在昇腾910B上训练大模型,因显存和带宽限制,训练效率从开箱状态的30%,经深度调优后提升至84%和93%。    而对于前线作战的士兵,在看到如此强大的装备实力后,也不会再畏惧和美军继续作战,要知道在无人机等装备的优势下,伊朗军队和美军的差距可以说被无限制缩小。    再简单一点说,在不启用核武器的情况下,伊朗完全有能力和美国进行持久作战,还能够进行长期对等反制,这还是在美国长期封锁的情况下完成。实验数据显示,在特定测试环境和框架下,昇腾910B在通用NLP任务中可达A800的约85%-90%,在复杂领域微调任务中降至50%-60%。

十二 |     仅仅是一次公开画面,伊朗就完成了对美博弈的姿态转变,这意味着美国对伊朗的武力威慑彻底失效的同时,中东地区的地缘博弈也发生了很大的转变,美国的那套威慑彻底不灵了。返回,查看更多。以上数据受测试框架、精度模式、集群互联方案影响显著,不代表全场景性能结论。         内蒙智算中心利用率不足的完整诱因包括:训练/推理需求分化导致时延不匹配、跨省数据合规顾虑、算力平台缺少标准化交易体系、西部本地AI产业薄弱、地方政绩驱动上马项目。多重因素叠加,才构成西部晒太阳、东部买不到的结构性割裂。         算力结构性紧缺并非中国独有。据中国信通院《中国算力发展研究报告(2026年)》及IDC数据,截至2025年底,中美智能算力规模(FP16理论峰值口径,不含边缘算力)差距约2倍。需要说明的是,理论峰值指硬件标称算力上限,未计入实际集群利用率、软件栈效率、互联损耗等因素——若以有效算力衡量,实际可用差距可能更大。         美国Meta将2026年全年资本开支(CapEx)指引上调至1250亿至1450亿美元,资金向AI基础设施倾斜,但该数字为包含元宇宙、社交基础设施在内的集团整体资本开支上限,并非全部用于GPU采购。多家市场机构据此预估其高端GPU部署规模将大幅扩张。海外依靠单一芯片生态短期调度更顺畅,但也承受供应链风险与定价权外溢的代价。         数据中心用电量预计从2024年1660亿千瓦时增至2030年3000亿至7000亿千瓦时,能耗指标已是比网络时延更前置的硬约束。美国对华高端GPU出口禁令、EDA工具限制、先进制程封锁,共同构成国产芯片追赶的外部硬约束。国产化是战略必选项,而非纯商业选择。

十三 |          三、油还不够,交规也没到位          如果把网络底座比作路,芯片和电力是油,那么当前缺的不仅是油,还有一套让车在跨省道路上顺畅行驶的交规。         这里有两条红线需要区分:IPv6和SRv6解决的是算力调度的技术可行性——能不能把东西部的算力在协议层连接起来。但跨省税收留存、GDP核算、能耗指标分摊、数据跨域流通规则,解决的是算力调度的制度可行性——体制机制允不允许算力顺畅流动。

十四 |          东数西算的理想模型是东部推理、西部训练,但跨省绿电交易机制不健全、碳排放指标不单列,导致西部绿电无法高效输向东部数据中心。即便网络时延达标,数据属地和行业监管要求——很多东部实时推理业务的数据不允许出省,西部算力从根源上无法承接——这是比网络时延更前置的门槛。         路、油、交规三者并非独立并行,而是层层牵制的关系:交规打通后,若无充足的算力油,调度平台无货可调;大量算力油投产,若缺少统一网络路和流通交规,依然会持续区域错配。         时间尺度上的错配进一步放大了这种牵制效应。

十五 | 某AI企业在季度财报压力下需要立即扩充推理算力,但一座新建智算集群从立项到投产需12至18个月,IPv6的SRv6网络升级规划按年度推进,跨省调度机制涉及多部门协商周期更长——产业端以月为单位决策,基建端以年为单位交付,两者之间没有中间缓冲层,这是节奏错配最具体的伤害路径。         与此同时,物理层面的微观交规也在迭代:单机柜功率从传统6-8kW攀升至AI集群普遍的30kW乃至50kW以上,传统风冷方案逐渐触达性能天花板,液冷(冷板式、浸没式)正在成为新建智算中心的隐性准入门槛。这套硬件层面的新标准,也在加速淘汰一批能耗偏高、密度不足的老旧算力集群。

十六 |          四、算力通胀会形成垄断吗?          答案是:结构性分化已经形成,且这种分层格局在短期内趋于固化。         第一层,万亿参数级大模型预训练。中国最强模型约1.6万亿参数(MoE架构,激活参数量远小于总参数量,与海外Dense或MoE模型直接对比总参数量不具备严格数学可比性),海外前沿模型总参数已进入十万亿级别。这一层是巨头游戏,且短期内看不到松动迹象。         第二层,行业大模型微调与中等规模训练。门槛持续下降。模型蒸馏、开源生态、轻量化技术正在降低算力消耗,但企业仍需承担相当的算力成本。         第三层,高并发、低时延商业推理。

十七 | 优质算力依旧紧缺,轻量化离线推理门槛相对较低。

十八 |          为验证普惠算力是否具备真实的商业履约能力,可以观察一种新兴模式:市场上出现了一些异构算力交易平台,宣称可降本30%以上。

十九 | 但中小企业使用便宜的异构算力,往往需承担高昂的算子适配、代码重构和调试成本。昇腾上适配一套模型需额外3至6个月。

| 如果省下的租金抵不上工程师的适配工资,普惠就是伪命题。真正的普惠不仅是买得便宜,更是用得平滑。

|          算力垄断的答案是:高端训练算力的垄断格局已经固化,短期内不可逆;推理侧正在分化,但优质实时推理算力依然稀缺。中小企业从推理侧向训练侧渗透的可能性极低——训练算力的规模效应构成结构性壁垒:万卡级集群的边际成本远低于千卡级,巨头在单位算力成本上具备持续扩大的优势,且数据规模与模型迭代速度形成正反馈闭环。

| 行业洗牌不会改变这一底层结构。         五、交规能定到什么程度?          当前算力租赁市场的深层问题,不仅是算力不够或算力放错了地方,更是行业缺乏统一的计量与定价参照。异构芯片之间不存在通用换算标准,这才是堵车的重要内因。

|          《算力标准体系建设指南》试图解决的是服务评估与交易结算层面的标准化问题,但需冷静看待标准的边界。

| 异构芯片架构完全不同,强制推行统一的算力度量衡会触及各厂商的商业护城河与生态壁垒。

| 统一换算标准不仅是技术问题,更是产业链多方商业博弈。标准在短期内只能停留在服务评估和交易结算层面,底层硬件的无缝互换仍需依赖类似CUDA的中间件生态——而这正是国产芯片当前最缺的软实力。而生态的本质是开发者习惯,国产芯片最缺的不仅是底层编译器,更是百万级习惯了海外生态的AI工程师。         一个更根本的制衡逻辑值得重视:算力供给扩容,会进一步推动大模型迭代、智能体普及与AI应用爆发,最终使得算力需求增速持续跑赢产能建设速度。

| 即便路、油、交规全部理顺,算力绝对缺口会有所缓和,但结构性紧缺仍将长期存在,只是矛盾表现形式发生转换。         六、谁能先跑通?          2026年7月20日,两份政策信号同日释放——一份升级路,一份加速推进交规。而油的供应——芯片产能、HBM、电力配套、高速互联——正在由市场、地方政府和云厂商共同博弈。

|          这里需要区分两套算力体系:全国一体化算力调度平台主要面向各地国资智算中心;头部云厂商和民营算力集群属于市场化主体,自愿接入调度平台的意愿有限。即便交规完善,民营商业算力是否愿意纳入统一调度,仍存在巨大的博弈空间——并非全社会算力可以自由流转。         这两套体系推进算力调度的逻辑完全不同。国资算力平台的优势在于政策执行力强、可承担跨省调度的制度性成本,但运营效率和市场化定价能力偏弱;大型科技企业的优势在于技术积累和商业化敏捷度,但缺乏将自身算力资源纳入公共调度体系的商业动力。两种主体各有利弊,孰为主导,将取决于政策设计能否在公共性与市场化之间找到平衡。         三件事的推进节奏差异巨大,且存在结构性错位:《算力标准体系建设指南》推进相对最快,但落地仍需多方博弈;跨省调度机制涉及利益博弈,落地缓慢;国产芯片受制于先进制程、HBM、EDA工具等卡脖子环节,短期难以突破。         更深一层的制度根源:地方同质化建设智算园区的冲动,源于能耗指标属地化管理、数字经济考核偏重机柜建设规模,缺乏算力利用率、产业落地成效等后置硬性考核指标。政策信号要转化为有效供给,还需考核机制的配套改革。         中国AI基建的终局,表面上是路、油、交规的赛跑,本质上是一场生态突围战。无论是IPv6的演进、国产芯片的迭代,还是算力标准的统一,最终都要回答一个问题:我们能否在脱离海外单一生态依赖的前提下,建立起一套自洽、高效、具备商业闭环的中国AI底座?          算力的结构性紧缺是全球AI爆发的共性挑战,而非中国独有的布局问题。

| 欧美同样面临算力分布不均、电价上涨、集群建设周期漫长的难题;海外依靠CUDA生态的便利,代价是算力供给高度集中于单一厂商,长期存在供应链风险。         真正拉开差距的,不是谁先建起更多集群,而是谁能在路升级、油补齐、交规理顺的三重节奏中,率先跑通那个从拼卡的数量到拼Token的产出成本的转型。         在算力紧缺的上行周期,囤积硬件资源的短期商业回报经常高于长期投入算力调度和算法优化的收益。原因在于:算力紧缺周期中,囤积硬件可在短期内获得确定性回报(租赁溢价),而投入算力调度优化和算法效率提升则需要长期研发投入且回报路径不确定。企业作为理性经济主体,天然倾向于前者。若不借助政策工具改变相对价格,这种激励扭曲将持续存在。         这场转型,注定不会靠市场自发完成。它必须依靠前述交规的强制纠偏——算力券补贴、标准化交易结算、能耗指标倾斜、考核机制调整——才能将市场的短期套利冲动,引导向长期的生态建设。         既然市场自发缺乏动力,那么推动算力精细化调度、提升资源利用率的主体,究竟是政策引导下的国资算力平台,还是具备长期投入能力的大型科技企业?          这个问题的答案,将决定对齐之日何时到来。         更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App。

Current article:http://u6qc6x.cesangrangshunzashuangruijiu.pics/7pi95u/jt9xzmc.html

Published on:16:28:44