全部动态
阿里云在 Apsara 2026 上讲了 QwenWork,主打让智能体调用各种工具干活,感兴趣可以看看详情链接。
Claude Code 作者本尊发话:别折腾微调和小模型,脚手架只提 10%-20%,下一代模型一发全白干,直接等新模型就行。
阿里云在云栖大会讲了 AgentCore,思路挺有意思:Agent 跑完的任务结果不浪费,验证后变成可复用能力,做企业 Agent 的可以看看。
用 Magpie 加 DeepSeek 本来就便宜,再配 RTK 过滤 Bash 输出,token 直接省七成,搞 agent 的可以试试这套省钱组合。
阿里云的王俊华在 Apsara 大会上讲了智能体时代用户怎么拿回数据和控制权,做云平台或 Agent 应用的话可以看看他们的思路。
Chamath 用两句话讲清了推理时 prefill 和 decode 的区别,想搞懂为什么 Nvidia 在长上下文里占优的可以看看。
Bindu Reddy 演示了用 Astra 6 加 Opus 5.5 自动选模型,直接做出带支付和多人功能的 3D 应用,做 3D 项目的可以试试。
rauchg 把自己的 Mini 浏览器从 Electron 迁到 Rust+Swift,还嵌了个 agent 进去,启动更快、更 Mac 原生,过程细节很实在。
有人把 Chrome 小恐龙变成了两个智能体的对局,一个跑本地一个走 API,延迟差异一目了然,代码也开源了,适合想学智能体部署的人看看。
有人实测了 Claude Opus 5.5 做视觉设计,说是目前所有模型里最强的,视频里有实际效果,做前端设计的可以看看对比。
有人只对电脑说了 5 分钟需求,Claude Opus 5.5 就自主干了一整晚,帖子里连完整提示词都贴出来了,想学长任务提示词的可以看看他怎么写的。
有人把 Claude Opus 5.5 做视觉设计的完整 Prompt 拆给你看,连生成的 JS 动画源码都开源了,写提示词的可以直接抄结构。
有人录了 5 分钟语音给 Claude Opus 5.5,它自己干了 12 小时做出一支完整音乐视频,角色动画歌词全包了。
Simon Willison 把 2026 年的 agent 出逃、OpenClaw 爆红、模型王座更迭串成一条线,信息量很大,读完对全年脉络就清楚了。
Meta 这次没走 self-distillation 老路,用 DCE 加 SRCL 就把 Qwen3-8B 从 30% 拉到 66%,方法细节可以看看。
Higgsfield 现在生成视频还能给你 Blender 场景和 AE 合成文件,改起来不用从头重做,做后期的会很省事。
阿里这次没发新模型,而是让 Qwen3.8-Max 自己训自己,33 轮迭代后成绩追上 Claude 和 GPT,还顺手把多模态价格砍了九成。
NVIDIA 把社区写的 3.4k 个 Agent Skills 直接变成 RL 训练环境,300 步就把 Qwen 27B 在 Terminal-Bench 上拉高近 5 个点,流水线和负结果都写得很细,做 agent 训练的值得看看仓库。
Higgsfield 给 Claude Opus 5.5 做了 11 个技能包,从 Blender 建场景到 PR 调色都能接手,交付后还能接着改,做后期的可以看看。
用 Claude Opus 5.5 做的 282 条爆款视频,每条都附了原提示词,还能在 Skillry 上对照重制效果,抄作业直接抄提示词就行。
Claude Code 作者是这么用 AI 的:别套死流程,给工具给自由,模型自己会找到路。做智能体的可以听听这期播客。
这期播客聊了 Claude Opus 5.5 玩视频、Muse 在美国爆火,还讨论了中国为啥缺 AI 产品经理,路上听挺合适。
用 GPT-6 Pro 调研、Opus 5.5 做视频,把 GIS、古籍文本挖掘这些数字史学工具讲了一遍,文科研究可以抄这个流程。
Tw93 开源的 Mac 终端 Kaku,装完不用配置就能用,专门照顾 AI 编程场景,已经迭代了 21 个版本,Mac 用户可以装来试试。
一个开源框架能让 Claude Code 和 Codex 组队干活,跟 lead agent 说结果就行,做开发工作流的可以试试。
沃顿教授 Mollick 发帖吐槽 LinkedIn 上那些拿 BLEU、ROUGE 指标说事的半吊子 AI 建议,挺有意思。
Sakana AI 和东大搞了个给机器人“先在模拟器里彩排再上场”的方法 SAIL,成功率能从 25% 拉到 73%,做机器人方向的可以看看。
Fireworks 拿 Kimi K3 改了个 Ember-1,推理 token 少用 40% 还不掉分,省钱党可以看看。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档