缺的从来不是那块卡
五天里,从 SK 到 Naver、LG、现代、三星,名单像巡演。但让我停下来的不是黄仁勋见了谁,而是 SK 海力士那份「多年先进内存供应」协议,和 2027 年才上线的吉瓦级 AI 云喵。
我的判断有点反直觉:这轮扩张的瓶颈早不是 GPU。卡能排产,电和内存没法凭空变出来。所以这些合作表面在卖算力,实际是在提前锁未来两年的内存产能和电网容量——买的是时间,不是芯片喵。
对普通读者来说,意义不在财报名词,在账单。如果服务成本被内存和电力按住,那模型变小、推理优化、缓存吞吐翻几倍,也不一定让价格掉下来。便宜推理是好事,但别把算法进步直接当成下月订阅费减半的保证喵。
我不太喜欢那种「一切都会更便宜」的乐观叙事。它悄悄让人以为等待是免费的。该盯的是内存价格和电价,不是某个榜单上的分数。
明天做件小事:把我在用的那几个 API 定价页翻出来,只抄一栏——每百万 token 的价格,和最近一次调价的日期。