35B 的模型离线跑在 iPhone 上只占 1.8GB 内存,这压缩水平真少见,做端侧 AI 的朋友可以看看他们的开源方案。
#内存优化
共 23 条 · 7 天 2 条 · 30 天 4 条
信息流里打上「内存优化」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月9日
Edge0 35B 模型在 iPhone 飞行模式下运行,峰值内存仅 1.8GB
10月5日
内存涨价倒逼系统瘦身:微软详解 Win11 降低 RAM 占用计划
内存涨价逼得微软亲自下场给 Win11 瘦身,25H2 升 26H2 实测省 1.5GB~2GB 内存,8GB 内存的用户可以留意后续更新。
IT之家原文
10月1日
9月10日
8月29日
8月27日
8月12日
8月9日
8月6日
IDC:MacBook Neo 倒逼微软优化 Win11 8GB 内存体验
苹果 MacBook Neo 一施压,微软开始认真处理 Win11 吃内存的问题,WinUI 3 和 WPA AI 都安排上了。
IT之家原文
7月23日
产品09:45
Fable 自主发现 Turbopack / Next.js 内存效率提升 15-30%Fable 自己找到了 Next.js 内存优化 15-30%,这 AI 太猛了。看看它怎么干活的。
7月15日
6月17日
用xFormers构建内存高效Transformer:Packed Sequences、GQA、ALiBi、SwiGLU和因果注意力教程
手把手教你用xFormers做内存优化,打包序列、GQA、ALiBi、SwiGLU全都有,比标准实现省显存还快。
6月16日
6月12日
MoE反向传播数学重写:降低激活内存,加速细粒度MoE
做MoE模型训练和推理的开发者,这个数学重写能直接降低你的显存压力并加速训练,尤其适合细粒度MoE场景,建议试试Blackwell新特性带来的性能提升。
6月7日
产品07:57
TurboVec 将 31GB AI 内存压缩至 4GB,开源向量搜索工具做向量搜索或部署 AI 应用的团队,如果被内存和 GPU 成本卡住,TurboVec 的开源方案值得一试——16 倍内存压缩可能改变你的架构选择。
TurboVec:Google 将 31GB AI 内存压缩至 4GB,开源且无需 GPU
做向量搜索或 AI 应用部署的开发者,内存和成本一直是痛点——TurboVec 直接砍掉 16 倍内存,还开源可离线跑,值得立刻试。
6月6日
产品02:54
Milvus 用不到 1GB 内存跑 2500 万向量:FP16 + mmap 实战做向量搜索的团队常被内存预算卡住,这个案例直接展示了 FLAT + FP16 + mmap 的组合拳如何把 139GB 需求压到 600MB,适合资源受限的单机部署场景,值得参考。
6月3日
微软为英伟达 RTX Spark 重塑 Win11 底层:改写 CPU 调度、优化 AI 内存负载
微软为 RTX Spark 深度优化 Win11 底层,解决了 AI 工作负载在 Arm 平台上的调度和内存瓶颈,做本地大模型部署或 AI 智能体开发的团队可以直接受益,值得关注。
5月22日
5月19日
5月16日
Weaviate 推出 HFresh:将向量索引内存占用降低至 HNSW 的零头
做向量搜索的团队终于不用为内存账单发愁了——HFresh 把 HNSW 的内存占用砍到零头,十亿级向量也能跑在更小的机器上,成本敏感或写入密集的场景尤其值得一试。