B300半年涨三倍,大厂绕开算力中转站,AI Infra高层巨震|算力情报局Vol.13
2026/08/03 18:15阅读量 2
B300整机国内现货价半年内从400多万元/台涨至超1200万元/台,货源争夺加剧且出现借“现货”套取企业信息的情况。国产推理芯片加快流片与产品规划,大厂普遍因数据安全、并发性能、计费与封号风险绕开算力中转站;3D堆叠、RCD芯片等赛道升温,AI Infra公司现高层离职,投资人对未流片项目趋于谨慎。算力成本结构也正在冲击互联网“先圈人再变现”的旧逻辑。
B300 价格与货源
- B300 整机国内现货报价已从春节后的 400 多万元/台涨至超过 1200 万元/台,市场从“每周一个价”演变为“每天一个价”。
- 高价缺货下,部分所谓“现货”并不存在。知情者称,至少三四起交易中,卖方以有现货为由,要求买方提供验资材料、企业资质等信息,目的疑为套取企业资金、采购和算力部署数据,存在信息安全隐患。
- 真实货源争夺加剧。某华东大厂推进规模或超 1 万台 B300 的采购,扫货力度超过另一家头部互联网公司;为保障订单,还要求部分供应商优先供货,并限制同时向后者供货。
国产推理芯片进展
- 一家长期押注 AFN 架构的国产 AI 芯片企业,面向 FFN/MoE 的芯片已完成流片,Attention 芯片仍处于设计阶段;在 Attention 芯片成熟前,计划先与 GPU 组成异构推理方案。
- 另一家 AI 推理芯片公司选择从 Prefill 芯片切入,首款产品性能目标超过 H100,计划明年底推出;首代产品采用 LPDDR 存储方案,后续升级至 3D 堆叠。
大厂为何绕开算力中转站
- 算力中转站本是为解决国内开发者无法直接调用海外 AI 模型(如 Claude、GPT)而出现的中间层方案,价格往往比官方更低。
- 大厂不愿使用主要基于四点:数据安全(B 端无法接受数据经第三方中转)、并发性能(难以满足 TPM/RPM 高并发要求)、计费不透明(后台不可追溯)、封号风险(订阅账号逆向超刷易导致原厂封禁,字节、腾讯均曾因此受损)。
3D 堆叠芯片创业潮
- AI 推理需求增长、国内先进制程推进受限,3D 堆叠芯片成为创业新风口,有公司半年内估值从数亿元涨至数十亿元。
- 资本热度之外,3D 芯片仍面临堆叠工艺、良率、成本和供应链等挑战,能否完成量产闭环是关键。
存储厂商补位 RCD
- 国内头部存储厂商曾接触一家国内 IP 公司,希望以数百亿元估值控股其 RCD 芯片业务 BU,以补齐 RCD 存储接口芯片能力;因估值等问题未达成一致,交易未落地,随后转向西部某芯片公司推进合作。
- RCD 是 DDR5 RDIMM 服务器内存的核心接口芯片,全球主要供应商仅三家;AI 服务器需求增长使其成为国产存储产业链布局重点。
AI Infra 公司管理层变动
- 华北一家因“AI 工厂”路线受关注的 AI Infra 公司出现管理层重大变动,三位核心高管离职,包括去年从国际科技巨头加盟的 CTO。
- 该公司背靠地方国资,过去两年承担多个区域级算力基础设施项目,被视为国内 AI 工厂模式的重要探索者。当前智算产业从“拼卡”走向“拼运营”,核心团队离职原因尚不明确。
投资人对推理芯片态度
- 推理新架构持续升温,但多位投资人表示不知道该投哪家创业公司,部分直言不会考虑尚未完成流片的项目。
- 投资人对 GPU 赛道判断趋于一致:很难再诞生新的头部 GPU 公司,训练侧最终可能只剩一两家;推理侧市场更大,但长期同样容不下太多玩家。
- 部分国产 GPU 公司仍围绕地方智算集群项目开展业务,既卖芯片也承担部署、运维,项目难以标准化,即便上市也距良性经营有差距。
算力改变互联网商业模式
- AI 时代,互联网“先圈人再变现”的逻辑不再成立:互联网增量用户几乎不增加成本,而算力下每新增用户都会消耗 Token,产生直接成本增量。
- 因此“免费送 1000 万 Token”的补贴模式在商业上不可持续,每送出一份都是真实成本支出。
