全部动态
蚂蚁灵波开源了新一代具身模型 LingBot-VLA 2.0,在 20 种机器人构型上泛化,GM-100 评测中全面领先 π0.5 和 GR00T N1.7,而且推理速度很快,适合开发者试玩。
蚂蚁Robbyant开源了1B参数的视觉模型LingBot-Vision,聚焦边界感知,能直接初始化深度模型,性能不输更大模型。
马斯克的SpaceXAI联手Cursor搞了个新模型,据说能跟GPT-5.5和Claude Opus 4.8掰手腕,可以看看。
Meta 发了新模型 Muse Image,免费在 Instagram 和 WhatsApp 上用,能生成二维码、修老照片,还能和 Facebook Marketplace 联动装修房间。
Cohere搞了个阿拉伯语语音模型,20亿参数,专门对付方言和双语,据说比Whisper还牛,搞语音识别的快试试。
灵波科技发布了空间感知模型 LingBot-Depth 2.0,训练数据暴涨到 1.5 亿,深度补全拿了 12 项第一,玻璃镜面场景也稳得很。
招商局 LionRock AI Lab 搞了个新方法,专治 VLA 模型“只看局部不看整体”的空间视觉错觉,被 IROS 2026 收录,做具身智能的值得关注。
蚂蚁用1.1B参数的视觉模型干翻了Meta的7B DINOv3,空间感知能力更强,参数少这么多还拿下12个第一,值得看看细节。
英伟达和 Hugging Face 把机器人基础模型和远程操作框架接入了开源库 LeRobot,还计划加入 Cosmos 3,海量数据集也能直接用。
腾讯刚开源Hy3,激活21B参数就能在SWE-Bench拿到78.0,还支持256K长上下文,想尝鲜推理模型的话OpenRouter上免费到7月21日。
OpenAI 新出的实时语音模型,延迟砍了至少25%,mini版推理更强还保持原价,做语音agent正合适。
如果你受够了总是呛声、还想教你做事的 AI,Claude Sonnet 5 绝对让你体验什么叫叛逆——连基础会计任务都被它当成欺诈案例。
小米新出的语音模型 MiMo-V2.5-ASR 能听方言、混中英文、扛噪音,每小时才五毛钱,适合做语音转录的朋友试试。
苹果在 iOS 27 里塞了个 RAW 9 引擎,基于 CoreML 模型,降噪和细节提升肉眼可见,连佳能 5D3 的 ISO 51200 都能救回来。
Mistral AI 新出的 Leanstral 1.5,专攻数学证明,miniF2F满分,解决成本只要几美元,比竞品便宜几十倍,搞形式化验证的可以试试。
阿里千问发了新语音模型,支持30种语言+16种方言,方言准确率干过火山腾讯,离线版字错率全球最低。