前DeepSeek专家罗福莉加入小米后首次直播大模型训练:每小时烧钱三万美元!

# 前DeepSeek专家罗福莉加入小米后首次直播大模型训练:每小时烧钱三万美元!

近日,前DeepSeek核心专家罗福莉在加入小米后,首次公开直播了其主导的大模型训练过程。这场直播不仅展示了小米在AI基础设施上的硬核实力,更因“每小时烧钱三万美元”的成本话题引发行业热议。作为曾在DeepSeek主导千亿参数模型训练的顶尖人才,罗福莉的加盟被视为小米AI战略从“跟随”转向“引领”的关键一步。

**背景:从DeepSeek到小米的AI野心**
罗福莉此前在DeepSeek负责大模型训练框架优化,其主导的模型在多项基准测试中达到全球前列水平。加入小米后,她直接领导“小米AI实验室”的大模型训练项目。此次直播的模型规模据推测在百亿至千亿参数级别,训练集群采用英伟达H100 GPU集群,单节点成本即超百万美元。加上电力、冷却、网络及人力成本,每小时三万美元的烧钱速度并非夸张——这基本是目前头部大模型训练的行业平均水平。

**成本拆解:为何每小时烧掉一辆特斯拉?**
以当前算力市场行情计算,使用数千张H100 GPU训练千亿参数模型,每张显卡每小时电费约0.5美元,仅电力成本就达数千美元/小时。加上GPU折旧、租赁费用(单卡日租金约30美元)以及冷却系统、存储、网络带宽、数据清洗和人工运维,每小时3万美元的成本覆盖了从硬件到软件的全链路消耗。这一数字也折射出大模型竞赛的本质:巨额资金堆砌的“暴力美学”仍是关键门槛。

**战略意义:小米的AI明牌**
罗福莉的首次公开直播,表面是技术展示,实则是小米向市场释放三重信号:其一,表明小米已拥有独立训练大模型的能力,不再依赖外部API;其二,通过高调烧钱,向人才和资本展示决心,吸引更多AI专家加入;其三,为后续将大模型落地至小米手机、智能家居、汽车等终端产品铺路。值得注意的是,直播中罗福莉特意演示了模型在端侧推理的优化技术,暗示小米正试图将庞然大物“压缩”进移动设备。

**未来展望:烧钱之后的价值落地**
每小时三万美元的成本不可持续,但这是通往技术垄断的必经之路。对小米而言,关键在于训练出的模型能否在手机、IoT和汽车场景中产生实际溢价。如果模型能真正提升小爱同学的对话能力、优化自动驾驶决策或实现智能家居主动服务,那么这笔烧钱将成为构建生态护城河的“入场券”。否则,它可能只是一场昂贵的技术秀。随着罗福莉等顶级专家的加入,小米AI的下一场硬仗,将从“烧钱训练”转向“场景变现”。

相关文章