马斯克为何急着建电厂 争夺算力上线时间
如果把大模型当成一门生意,可以把两条看似无关的消息放到同一张成本表上。一条消息是DeepSeek宣布从9月10日起,Flash模型低峰期缓存命中输入价降至每百万token 0.02元,降幅60%。另一条消息是马斯克的xAI相关园区正在建设1.2吉瓦天然气电站,SpaceX甚至开始自制部分燃机关键零部件。

一边降低智能服务的价格,一边加大电站、设备和厂房的投资。这并不矛盾,反而说明AI产业已经从比拼模型能力转向了比拼交付成本。与此同时,媒体报道称DeepSeek已与中信证券接触,科创板IPO前期尽调启动,但尚未签署正式辅导协议。苹果中国官网在新品发布后上调了iPhone 17、Air和17e的价格,尽管苹果没有解释调价原因,这种价格反差依然值得注意。

数字智能越便宜,支撑其大规模交付的电力、设备和高利用率算力反而越值钱。如果DeepSeek真的递交招股书,最值得关注的是用户每月花费、毛利以及扩建算力所需的资金。媒体披露的一轮融资约500亿元、投后估值超过3500亿元,都没有得到公司正式确认。相比猜测市值,更关心降价后调用量是否能跑赢单价下降速度。奶茶从20元降到10元未必是坏生意,前提是销量和门店效率一起提高。大模型也一样:价格战不可怕,低价却换不来使用量,才真正伤害估值。
公开市场不会只给“聪明”定价,它会给收入、毛利和现金流定价。API降价,并不意味着背后的GPU、机房、电力和冷却也在降价。训练像修高速公路,推理才是每天收过路费。真实流量有高峰低谷,为了春节客流全年养着一座满负荷厨房,最终一定会被闲置率拖垮。固定集群不会消失,但弹性推理会越来越重要。量化、蒸馏、缓存复用、连续批处理和异构调度,都在解决同一件事:让一张卡多干活、少空转。

