Soofi 出了一款开源模型,31.6B参数只激活3.2B,混合Mamba+Transformer架构,支持德语和英语,适合多语言场景。
全部动态
Thinking Machines终于亮出了首款开放模型Inkling,主打专精不搞一刀切,和GPT这类通用模型路线很不一样,值得看看。
小米开源了Xiaomi-Robotics-U0,能生成场景、迁移轨迹、做视频,WorldArena第一,真机效果提升26%,效率快83倍,值得关注。
阿里刚发的Qwen-Audio-3.0-Realtime,实时语音四项升级,又快又聪明,做语音交互项目的可以试试。
阿里新模型Qwen-Audio-3.0-Realtime能实时语音对话、调用工具、感知情绪,语音指令和综合排名都超过了GPT-Realtime-2。
PrismML 这技术能把 27B 模型塞进 iPhone,内存从 54G 砍到 4G 不到,苹果都在看,手机跑大模型要成真了。
PrismML 把 Qwen 3.6 27B 压缩到 3.9GB,iPhone 17 Pro 直接跑,本地 AI 终于不卡了。
PrismML 把 Qwen3.6-27B 压到 5.9GB,手机都能本地跑,还全开源,适合离线使用。
Mistral AI这个8B模型Robostral Navigate挺有意思,只用普通摄像头就能让机器人听懂指令找路,R2R-CE上76.6%成功率,省了激光雷达的钱。
GPT-5.6-sol刚冲进DRACO排行榜,OpenSquilla那个集成方案在Brave组又便宜又能打,搞模型部署的值得关注。
高德发了ABot-World Studio,用一张5090就能生成小时级的实时3D场景和交互视频,做游戏或数字孪生都可以试试,门槛低了很多。
想快速了解本周最强AI模型?Arena周榜给出硬核排名:代码能力claude-opus-4-7-thinking超了claude-fable-5,国产qwen3.7也稳在Top20。
OpenAI 最强模型 GPT-5.6 系列直接上架 AWS,现在在 Bedrock 就能用,省去自己部署的麻烦,三个版本各有特色,性能很强。
商汤刚开源了SenseNova-Vision,统一四大视觉任务还比Vision Banana强,附带5000万条数据,快试试吧
Meta 的 Muse Spark 1.1 强化了多智能体协作与代码开发,支持百万 token 长上下文,但部分场景弱于 GPT-5.5 和 Claude Opus 4.8。