别再被语言锁死了,AWS Lambda 这一手 Wasm 才是 Serverless 的终极形态
2026年9月,当我在 VS Code 1.13x 的最新版插件里调试一段 Rust 代码时,后台 Lambda 的冷启动时间已经缩短到了惊人的 50毫秒以内。这不再是两年前那种需要预热、需要依赖外部运行时的“伪 Serverless”体验。AWS 正式宣布 Lambda 原生支持 WebAssem…
2026年9月,当我在 VS Code 1.13x 的最新版插件里调试一段 Rust 代码时,后台 Lambda 的冷启动时间已经缩短到了惊人的 50毫秒以内。这不再是两年前那种需要预热、需要依赖外部运行时的“伪 Serverless”体验。AWS 正式宣布 Lambda 原生支持 WebAssem…
在创业的第三段路上,我兜兜转转又回到了制造业。这次不是简单的AI应用,而是要给那些僵化的制造系统注入灵魂。做AI+制造,最大的挑战不是算法,而是那些年积攒下来的、用C++和Java写成的老代码。这些系统就像工厂里的老设备,功能还在,但维护成本高得吓人,而且根本无法适应云时代的快速迭代。 2026年9…
大家好,我是许彦,一个在机器人领域摸爬滚打了五年的工程师。从早期的机械臂到如今的人形机器人,我见证了无数仿真模型在实验室里完美运行,却在真实世界的传感器噪声、延迟和标定误差面前折戟沉沙。这种“仿真很美好,真实世界很残酷”的体验,几乎每个搞硬件和具身智能的人都深有体会。今天,我想和大家聊聊一个我在重构…
事情是这样的:去年我接了个AI推理管线项目,用Rust写一个多模型串联的服务。用户上传一段音频,背后要过三个模型——语音转文字、情感分析、内容审核——最后合并结果返回。我心想,Rust + Tokio天生就是干这个的,搞个异步流水线不是跟喝水一样? 结果第一版写完,我看着屏幕上将近1200行代码和编…
去年十月份,我们的AI质检系统在生产线上跑了三个月后,开始出现一个让我凌晨三点爬起来看监控的问题:Redis Stream消息积压。每天凌晨的换班时段,质检数据流会暴增三倍,然后整个消息处理链路就开始堵。等到早上七点工人换班的时候,系统已经积压了20分钟的数据,生产线主任直接打电话骂人。 这个问题折…
我的一个中后台项目,跑了快两年,从 Vue3 + Vite4 一路升到 Vite5,200 多个页面、30 多个模块,平时改一行文案等 HMR 热更只要半秒,这让我一直觉得 Vite 的速度已经到天花板了。直到上个月我试着把生产构建加速,才发现这货冷启动要 17 秒,生产打包跑到 42 秒——一个破…
一个周三凌晨的性能复盘:连接池健康检查的锁争用吃掉15%核时 那是2024年底一个挺冷的周三凌晨。我盯着Grafana面板上的P99延迟曲线,看到健康检查模块的CPU时间片被一堆Arc<Mutex>的锁争用吞掉将近15%。这不是一个并发写入的场景——健康检查就是读一下TCP连接的远端状态…
为了搞掉在线教育平台批改服务的延迟和内存问题,我用Rust重写了推理网关。结果吞吐暴增5倍,p99延迟从510ms压到42ms,但开发过程几乎让我放弃——Session不支持Send、编译时间漫长、错误信息无法理解。这篇文章记录了我如何手写线程池、用Axum+ONNX Runtime趟过生产坑,以及最终为什么还说“Rust值得,但要用在刀刃上”。
我把电商推荐系统的推理服务从Python重写成Rust,吞吐量从1200 QPS飙升到6500 QPS,但开发时间从2天暴增到2周。Rust的所有权系统和异步编程让简单功能变得复杂,但性能提升确实惊人。如果你考虑用Rust做AI服务,先看看这篇血泪史。