11:41量子位@量子位的朋友们蚂蚁百灵发布了新一代原生混合推理模型Ling-3.0-Flash。该模型在MATH-500和HumanEval基准上取得了领先成绩,推理速度相比上一代有显著提升。它支持文本与代码等多模态输入,已通过百灵开放平台提供API。AI模型Ling-3.0-Flash蚂蚁百灵推理模型推荐理由:蚂蚁百灵出了Ling-3.0-Flash,数学和代码能力强,速度更快,开发者直接调API就能用。原文稍后读已读值得跟进有用关注 Ling-3.0-Flash
05:42Aravind Srinivas@AravSrinivasPerplexity CEO Arav Srinivas 宣布与 Intel 合作,将本地模型和混合推理带到 Intel Ultra Series 3 笔记本电脑上。Intel CEO Lip-Bu Tan 在 Computex 2026 主题演讲中阐述了从硅到系统到软件的愿景,涵盖 PC、边缘设备、数据中心和智能中心。该合作旨在提升个人电脑的 AI 能力,实现更高效的本地推理。这是 Intel 转型过程中的重要一步,也标志着 AI 与 PC 的深度融合。AI产品PerplexityIntel本地模型推荐理由:本地 AI 推理终于要走进主流笔记本了——Perplexity 与 Intel 的合作让 Ultra 3 用户无需联网也能跑模型,做 AI 应用或本地推理的开发者值得关注。原文稍后读已读值得跟进有用关注 Perplexity
19:19官方一手marktechpost@Michal SutterPerplexity AI 发布了一款面向个人电脑的混合本地-服务器推理编排器,能够自动将 AI 任务在本地设备和云端模型之间进行路由。该编排器根据任务复杂度、延迟要求和隐私需求,智能选择最佳执行环境,从而优化性能和成本。这一创新解决了用户在使用 AI 应用时面临的本地算力不足与云端延迟之间的权衡问题。对于注重隐私或需要低延迟响应的用户,本地推理可优先处理敏感或简单任务;而复杂推理则自动切换至云端。Perplexity AI 的这一举措旨在提升个人电脑上 AI 助手的实用性和用户体验。AI产品Perplexity AI混合推理本地-云端编排推荐理由:Perplexity AI 的混合编排器解决了本地与云端 AI 任务调度的痛点,让 PC 用户无需手动切换即可获得最佳性能与隐私平衡。做本地 AI 应用开发或重度使用 AI 助手的团队,值得关注这个自动路由方案。原文稍后读已读值得跟进有用关注 Perplexity AI
08:42Aravind Srinivas@AravSrinivasPerplexity 宣布其 AI 计算机 Perplexity Computer 将支持本地模型运行,实现混合智能推理。该功能允许任务在本地硬件与云端前沿模型之间智能拆分,既保护隐私数据又提升 token 效率。当需要更强算力时,系统可自动调用服务器端 GPU 上的前沿模型。该功能即将登陆 Windows 笔记本,具体上线时间待公布。AI产品Perplexity混合推理本地模型推荐理由:混合推理架构解决了隐私与性能的平衡难题,做本地 AI 部署或关注数据安全的开发者值得关注,Windows 用户很快就能直接体验。原文稍后读已读值得跟进有用关注 Perplexity