Claude 把黎曼零点下界从 41.6% 推到 67.2%,人类 50 年才推不到 9 个百分点,它一步干了 26 个点。
全部动态
Dyna Robotics放出了个叫Dyna-2的世界动作模型,用100万小时人类视频训的,能预测未来再行动,还发现了数据量越大越强的缩放规律,值得看看。
Anthropic让Claude试解黎曼假设,没解开但把零点下界从41.6%刷到67.2%,感受下AI数学推理现在能到哪一步。
Discovered Materials用AI造出了几百种芯片新材料,还放出基准让跟踪进展,跟传统材料玩法不一样。
Anthropic让Claude研究版试解黎曼猜想,没解得动,却把下界从41.6%拉到67.2%,AI数学能力又往前一点。
OpenAI把模型分成前台聊天和后台推理两条线,Meta开源了个300亿参数的边缘模型,Claude Code也自动干活了,快讯直接看这条。
Meta把Muse Glimmer开源了,30B参数能在本地跑智能体,还说要放出Muse Spark 1.2,比Gemma4和Qwen3.6都强,建议看看。
新出的 Muse Glimmer 是 30B 开源模型,Apache 2.0 随便用,24GB 显存就能跑,做智能体应用可以直接拿来试。
Meta开源了30B的Muse Glimmer,用Ollama就能在苹果芯片上跑,还能配合Claude Code和Codex做本地智能体,上手试试吧。
Meta 一口气开源两个 Muse,30B 的 Glimmer 能跑 24GB 显存,智能体任务比 Qwen、Gemma 更轻量。
Meta 把 30B 的 Muse Glimmer 开源了,现在就能在 Hugging Face 下载,想试试新模型的别错过。
Meta放出了30B的开源模型Muse Glimmer,能在Mac和普通电脑上跑,专门做本地智能体任务,和同尺寸大模型比不落下风。
Simon Willison 挖到 Claude Opus 5 系统提示里居然写了 Fable 出口管制这事,怕模型答不上来。挺有意思的。
字节的Seed模型在OpenRouter上线了,一次能喂30张图加10段视频和10段音频,改视频里的东西很方便。
字节 Seedance 2.5 上线 OpenRouter,一次生成 30 秒带声音视频,支持 50 条参考做长叙事。
UCLA博士生搞了个Trace-and-Amplify,不用诱导就能抓训练时的奖励黑客,准确率从60%提到90%,比老方法强多了。
geekbb说V4 Flash找不到平替,就怕官方和OpenCode涨价。同用这个模型的话,你怎么看?
Ollama 云把 DeepSeek-V4-Flash 设为默认了,现在跑 200+ tps 还零数据保留,Pro 套餐能开多个长会话,写代码的可以试试。
SpaceXAI的Grok Imagine 2.0在文生图竞技场直接冲到第二,图片编辑也第二,现在只在App里能用,想试试可以去下载。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档