搜索
当前所在位置: 首页>算力百科

国内GPU卡全线飙涨原因分析

发布时间:2026-06-03 09:07:02 作者:超级管理员 点击:44 【 字体:

国内GPU卡全线飙涨原因分析

紧张升级

5 月份,非常非常多的人寄希望于两个大佬谈判之后的的 GPU管制放松,特别是上一代 hopper架构的顶配算力卡松绑,弥补内部的算力不足,但是结果事与愿违,双方在 GPU 算力领域抓紧了卡脖子竞赛,彼此相互掐。(不要抱幻想了,干就完了)

咱发布“韬定律”,引领未来半导体产业自主可控发展;对面发布史上最严 BIS 禁令,全面封杀特殊渠道 N卡贸易;多条隐秘供应渠道出现波动,目前处于静默状态,并且东南亚风声正紧,导致靠港设备急剧减少,设备减少,需求没少,最终导致中间商层层加价,现货交易链条长,每层经销商为对冲风险和牟利,都会加价并截留部分库存。只要有人以更高价成交,整个市场的底价立刻被拉高。我们做了一个价格预测!

突发监管,B300转运风险激增,现货喊价800万5090 V2 D被禁 ,Pro6000D涨价,买涨不买跌的GPU囤货之战

GPU金融属性持续增强

GPU 、茅台、房子,目前本质上是一样的东西,除了自身原有属性价值外,更多的是金融价值,当然这个金融价值是有时效性的,但是短期内 GPU金融价值持续增强

GPU金融属性持续增强,导致 A 股运作的企业和基金纷纷参与到 GPU 囤货和倒货的过程中,无形中提高了中间环节的价值;

A 股公司持有优质 GPU 资产,只要发布公告,至少 2 个涨停,也代表了参与未来产业的意愿和ai 劳动力转型的渴望,代表着未来的潜力,因此采购 GPU 成为资本运作重要手段!

算力出租到 tokens 出租转型

中国AI算力需求的爆发式增长是B300价格暴涨的需求端根本驱动力

过去大厂租赁裸算力资源,一堆运营商和aidc运营方出租裸算力,大厂自己部署大模型,用来推理卖 tokens;

运营商 tokens 转型一样,禁止裸算力租赁,直接部署大模型,强行租赁 tokens,这些算力租赁给大厂,用来做基础 tokens 运营;

基于tokens 运营模式,B300对推理性能的数倍提升能直接转化为成本优势。对前沿AI企业来说,高价抢购现货算得过账,这为高价提供了最后的需求支撑

原来我们做了测算预测 690 是上限, 没想到 API tokens 竟然涨价了,只要 tokens 一直涨,b300 涨到 1000 也是有利可图的,这个就尴尬啦!B300 涨价闭环了....

严打东南亚算力

随着双方博弈推进,物理层面的禁运,gpu 设备贸易基本上已经处于脱钩状态,但是云租赁业务在持续,“算力出海”在海外用算力成为一个 bug,让更多资本去到东南亚建设 AIDC;一个落后的东南亚竟然成为全球 AIDC 算力建设高潮区域,想想都知道怎么回事;下一步重点关照东南亚 AIDC 业务,目前给东南亚 AIDC 两条路:

趁着现在没有严打,想尽一切办法把gpu 设备,弄进国内;

趁着现在没有严打,想尽一切办法把 GPU设备,转移到其他“安全区域”

覆巢之下,安有完卵,早做打算!

B300短缺外溢

买不到 B300,大家就开始外溢 5090、pro 6000、 pro 6000d 等外溢 Blackwell 算力需求,5 月底大厂已经放出多个 5090大单,用于弥补算力短缺,先紧急顶上!

这种心态导致全网的 n 卡都在飙涨...

阅读全文
相关推荐

全球巨头砸钱超3800亿 工业富联涨停引爆算力板块

全球巨头砸钱超3800亿  工业富联涨停引爆算力板块
5月13日,A股市场274.18亿元的成交额,让一只股票刷新了历史纪录——这个数字,相当于当天所有A股总成交额的近1%,全部涌向了同一家公司:工业富联。这只市值超过1.4万亿元 的巨头在午后涨停,并带动整个算力产业链集体爆发。全球巨头“烧钱”竞赛,钱会流向哪里?这场行情最直接的导火索,是市场对国内科技巨头即将公布“成...

国产卡是如何兼容CUDA的?

国产卡是如何兼容CUDA的?
都在说CUDA是英伟达最强的护城河,CUDA到底是什么?CUDA是英伟达在2006年推出的并行计算平台,简单说就是一套让程序员把计算任务扔给GPU跑的"语言+工具+规则"。听起来没什么特别,但问题在于,过去二十年,全球AI和深度学习的生态,几乎全部建立在CUDA之上。PyTorch、TensorFlow、各种大模型训练框架,底层都在调...

北京超智算人工智能创新示范园项目主体结构封顶

北京超智算人工智能创新示范园项目主体结构封顶
2026年6月3日,北京超智算人工智能创新示范园项目举行封顶仪式。项目于5月26日圆满完成主体结构封顶施工,顺利达成阶段性建设目标,为后续室内装修、专项验收、正式投产等工作有序推进夯实了坚实基础。作为北京市2025、2026年“3个100”重点工程,该项目位于中关村科技园区石景山园北II区创业创新园1606-634-2地块,规划用地...

北京 A100-40G 现货出租

北京 A100-40G 现货出租
GPU裸金属服务器-A100*8CPU: 2*Intel Xeon Gold 6248R(24Core,3.0GHz)内存:24*32GB系统盘:2*480GBSATA SSD数据盘:4*1.92TB NVMe SSD显卡:Nvidia A100 PCIE 40G *8网卡:1 x2*25GE价格:85000/月有效期:7天 压一付一 年闭口...

三步部署DeepSeek V4模型

三步部署DeepSeek V4模型
背景:DeepSeek V4其核心突破在于全系标配 100 万 token(约 75 万汉字)的超长上下文窗口‌,并针对效率与性能进行了系统性优化。目前发布了两个版本,分别为DeepSeekV4-Pro(旗舰版)‌ 和 ‌‌DeepSeek V4-Flash(轻量版),下面以DeepSeek V4-Flash(轻量版284B)部署为例展开。参考链接:https://docs.vllm.ai/projects/a...

上新!移动模型服务平台MoMA上架多款千问旗舰模型

上新!移动模型服务平台MoMA上架多款千问旗舰模型
AI“超级入口”再迎重磅升级!移动模型服务平台MoMA集中上架三大品类、多款千问优质旗舰模型,进一步扩充模型储备、拓宽应用场景,让用户便捷对接顶尖AI算力与模型资源,精准匹配各类AI使用需求。丰富模型矩阵,适配多元使用场景本次上新打破单一模型类型局限,以“汇聚更多模型能力”为核心,精准覆盖旗舰模型的高效适配与...

AI算力缺货从GPU烧到了一整条产业链?

AI算力缺货从GPU烧到了一整条产业链?
2026年,一场覆盖芯片、云、服务器与数据中心零部件的全产业链算力短缺正席卷全球。从GPU、CPU、HBM,到光模块、铜缆模块、高速交换机、电力与液冷设备,乃至云计算和Token资源,几乎全线供不应求。算力稀缺与全线涨价,已成为贯穿整个AI产业的核心叙事。这并非简单的供需错配,而是AI算力架构升级带来的系统性重构。01 需求...

建议收藏:RTX 5090从卡和整机方面与4090相比,有何升级与变化

建议收藏:RTX 5090从卡和整机方面与4090相比,有何升级与变化
一、5090和4090 GPU卡的综合对比英伟达RTX 5090于2025年1月7日发布。采用最新的Blackwell架构,配备32GB GDDR7显存,显存带宽高达1792 GB/s,并支持第五代Tensor核心和第四代光线追踪核心。和上一代旗舰GeForce卡4090对比如下:GPU对比RTX 5090RTX 4090核心GB202AD102架构BlackwellAda LovelaceCUDA核心数21,76016384...

极智算算力平台|硬核算力底座,赋能 AI 全域高效落地

极智算算力平台|硬核算力底座,赋能 AI 全域高效落地
随着人工智能技术飞速普及,大模型训练、模型微调、AI 推理、高性能计算、数字孪生等场景迎来爆发式增长,稳定、合规、高性价比的算力资源,已成为企业、科研机构与开发者发展的核心刚需。极智算算力平台深耕 GPU 算力服务赛道,聚焦合规算力供给、整机租赁、服务器托管、大模型一站式部署,以顶尖硬件配置、灵活服务模式、...

重磅发布!AI 芯片安可测评结果:华为海思、阿里平头哥、海光、沐曦、摩尔线程、壁仞、天数智芯

重磅发布!AI 芯片安可测评结果:华为海思、阿里平头哥、海光、沐曦、摩尔线程、壁仞、天数智芯
2026 年 5 月 26 日,中国信息安全测评中心、国家保密科技测评中心发布《安全可靠测评结果公告(2026 年第 2 号)》根据《安全可靠测评工作指南 V3.0》要求,现将安全可靠测评结果予以公布,自发布之日起有效期三年。特此公告。排序方式:同一等级按产品名称首字笔画为序排列附表一:人工智能训练推理芯片人工智能训练推理芯...
返回顶部