全部动态
有人把 Claude Fable 5 的思维链塞进了 MiniCPM5-1B,搞出个 657MB 的本地推理模型,128K 上下文还能看它怎么想的,部署门槛极低。
摩尔线程用自家MTT S5000 GPU训出的世界模型拿了斯坦福评测第一,三个AI工厂的划分也挺新鲜,值得关注国产GPU的进展。
阿里巴巴要开源一个2.4万亿参数的Qwen3.8,预览版已经能用了,据说只比Fable 5差一点,和Kimi K3直接对标,想试试大模型的可以关注。
面壁的MiniCPM5-2B在4B以下模型里AA榜单第一,还有512K上下文和智能体能力,马上要开源了,小模型也能干大事。
阿里Qoder新上的Qwen3.8-Max-Preview参数有2.4T,现在限时1折夜间更是0.2折,便宜得离谱,性能还比Qwen3.7-Max强很多
阿里千问刚更新了 Qwen3.8-Max-Preview,参数量 2.4T,比上一代 Qwen3.7-Max 更强,PC 和 Web 端都能直接用了,快去试试吧。
阿里千问刚放了个2.4T参数的 Qwen3.8 预览版,官方说只比 Fable 5 差点,想尝鲜直接去 Token Plan 体验吧。
想测你的研究智能体能不能又广又深地搜证据?Perplexity 新出 WANDR 基准,500个任务等着,看看 Search as Code 怎么跑到了0.36 F1。
阿里刚发的 HappyOyster 1.0,能根据一句话或一张图生成实时可探索的 3D 世界,还能像导演一样用文字操控剧情,支持 1 分钟以上互动,挺有新意的。
Sunday Robotics的ACT-2模型让Memo在陌生家庭叠衣成功率超99%,不需要重新训练。家庭机器人终于有希望了。
英伟达 N1X 芯片首次跑分曝光,单核打平苹果 M3 Max,Surface Ultra 工程机透露性能端倪,想了解 Win on Arm 性能上限的可以看看。
英伟达的 RTX Spark 驱动曝光了 6144 核心猛兽,Arm Windows PC 要变天了,微软还专门改了调度器,等等党的新目标来了。
Kimi K3定价$3-15/M token,比美国模型便宜很多,看看Moonshot怎么用低价倒逼市场。
Sakana AI 搞出了不用反向传播也能训练的网络,MNIST 和 CIFAR-10 成绩还不错,研究生物合理学习的人可以看看。
Anthropic给Claude Fable 5加了50%限额,网友直接拿Kimi K3来比。你要是纠结订阅选哪个,这篇信息很关键。
东方算芯的新AI芯片DF1000,算力520 TFLOPS,14nm工艺下做到这个水平,全国产供应链,3D堆叠近存计算,技术路线挺有意思,可以看看怎么实现的。
想看看两个顶级AI花100美元能做出什么视频?实验显示Claude Fable 5和GPT-5.6 Sol的作品都还行但不惊艳,而且Claude的token成本比GPT高出好几倍。
英伟达发了三个检索模型,8B 版直接登顶 RTEB 榜首,适合做 RAG 和智能体,还能省 token。
Zyphra 把 EEG 模型输入从固定5秒扩展到0.5-30秒,还开源了 Apache 2.0,搞脑电研究的可以直接上手。
Kimi K3 用 300 人就追上 Anthropic 顶配,OpenAI 的人还吐槽开源是 AI 共产主义,值得看算力是否真的重要。