🏷️ Ollama

把Llama 3塞进消费级显卡:我的资源受限AI部署实战

作为一名从嵌入式系统转岗到AI部署领域的工程师,我每天都在和资源限制作斗争。在那些只有几GB内存、几十MHz主频的设备上,让AI模型运行流畅几乎是一项不可能完成的任务。现在,我转向了消费级显卡,试图在预算有限的情况下部署开源大模型。这篇文章不是什么理论文章,而是我踩坑、调优、最终跑通Llama 3模…

凌晨三点被报警叫醒的教训:VS Code 官方 AI 助手深度实战与本地化部署冲击

2026年9月,VS Code 1.13x系列的发布更新彻底改变了我的工作流。作为一名在DevOps领域摸爬滚打8年的老兵,我见证了无数工具的更迭,但这次官方AI助手的推出,不仅仅是功能迭代,更像是一场无声的革命。凌晨被报警叫醒的次数已经从每周三次锐减到一次,但新的挑战也随之而来——本地化部署的复杂…

VS Code的本地AI重命名,是微软写给合规部门的一封密信

事情要从两周前讲起。一家医疗影像软件团队的架构师给我打了一通电话,语气像刚被合规部门扣了一顶“数据泄露风险”的帽子——他们用 GitHub Copilot 做代码重构,结果 AI 生成的变量名建议被传到云端,安全审计直接亮红灯。他问我:“有没有一种办法,能在完全断网的环境下,让 AI 帮我做项目级的…

用Ollama + LangChain构建本地隐私聊天机器人,30行代码搞定!

那篇 DeepMind 论文提的本地推理,我复现时踩了三个星期的坑 上周我在组里分享用 Ollama 搭本地聊天机器人的经历,说实话,那篇文章写得有点潦草。有读者私信反馈代码根本跑不通,我回去一看,确实是我把 API 记串了——在草稿里随手写的 Ollama Python 库无需调用 init(),…