我们把推理成本砍了一半,工厂老板终于同意继续用 AI 了:Blackwell FP8 稀疏化实战复盘
上个月,我去一家做汽车零部件的工厂调研。客户李总坐在满是油污的办公室里,手里拿着一张比A4纸还长的账单,眉头紧锁。他说:“沈工,我也想用 Llama 4 做实时质检,但云端的 API 费用每个月要烧掉五万美金,这 ROI 我算不过来账。” 这就是我们做 AI+制造业遇到的典型困境:技术够先进了,但成…
上个月,我去一家做汽车零部件的工厂调研。客户李总坐在满是油污的办公室里,手里拿着一张比A4纸还长的账单,眉头紧锁。他说:“沈工,我也想用 Llama 4 做实时质检,但云端的 API 费用每个月要烧掉五万美金,这 ROI 我算不过来账。” 这就是我们做 AI+制造业遇到的典型困境:技术够先进了,但成…
作为一名在投资机构摸爬滚打五年的技术顾问,我看过上百份 AI 项目的 BP。绝大多数都在讲「算法」、「模型」和「场景」,仿佛只要有了模型,世界就会改变。但我更关心的是硬件成本,特别是显存(HBM)成本。过去一年,我见证了无数 AI 初创公司因为算力成本过高而倒闭,也见证了云厂商为了争夺 HBM3e …
作为一个在投资机构干了5年的技术顾问,我看过上百个AI项目的BP。绝大多数创业者的技术路线图都犯了一个致命错误:他们假设算力是无限的,或者至少是可以按需购买的。在GPT-4.5发布后的这半年里,我反复验证了一个残酷的事实——HBM3e内存短缺正在成为AI行业的“达摩克利斯之剑”。这不仅仅是供应链问题…