12:43IT之家(博客/媒体)精选商汤科技发布并开源SenseNova-Vision理解生成统一视觉大模型,在目标检测、图像分割、深度预测、3D重建等任务上实现原生统一。该模型在多项权威评测中全面领先,比肩甚至超越各领域专用专家模型。相比仅能处理两类问题的Vision Banana,SenseNova-Vision能同时覆盖结构化理解、稠密几何、全景分割和多视角3D四类核心视觉任务。商汤还同步开源了包含5000万条样本的视觉指令语料库SenseNova-Vision Corpus-50M。AI模型SenseNova-Vision商汤Vision Banana推荐理由:商汤刚开源了SenseNova-Vision,统一四大视觉任务还比Vision Banana强,附带5000万条数据,快试试吧原文稍后读已读值得跟进有用关注 SenseNova-Vision
08:12官方账号Simon Willison’s Weblog(博客/媒体)精选苹果在WWDC 2026上发布了新版Siri AI,采用基于Gemini的定制模型,运行在私有云上。新Siri利用视觉大模型从用户屏幕提取信息,无需应用单独适配。苹果还推出了Core AI库,支持PyTorch模型在苹果硬件上运行。iOS 27开发者测试版已包含新功能,但需排队等待使用。AI产品苹果Siri AI视觉大模型3 个信源在谈事件专题推荐理由:苹果终于用视觉LLM绕开了应用适配难题,做iOS开发或关注AI助手的开发者值得关注,新Core AI库也让本地模型部署更简单。原文稍后读已读值得跟进有用关注 苹果