Cua 的 Francesco Bonacci 讲怎么放心让智能体整夜写代码,低质量 PR 怎么处理、为什么补丁不能直接合并,做智能体编程的可以听听。
全部动态
Databricks 演示了 Unity Gateway 怎么追踪团队用了哪些模型、花了多少钱,Omnigent 还能把你手头的编码智能体拼在一起用。
训练 LLM 时 loss 突然炸了却找不到原因?OpGuard 能逐比特比对两次训练,直接定位出错的那个算子。
有人把 Claude 接进 Slack 当团队自动化员工用,复现 bug 自动提 PR、花千万 token 挖数据,4 条提示词直接抄走。
AWS 官方给出了在 EKS 上跑 MoE 强化学习的架构,用 EFA 加 DeepEP 把 RLHF/GRPO 训练吞吐量提高了 40%,自建训练集群的可以抄作业。
Rest of World 跟了 6 位亚非从业者,看他们真拿 AI 干活:搭工具、做生意、做研究,比看厂商发布会实在多了。
教你用 SageMaker 一键部署阿里开源的 Qwen3-TTS 语音模型,短音频就能克隆音色,还能跨语言保持同一个人声。
AWS 分享了在 Bedrock 上做 LLM 质量评估的五个具体技术,跨账号故障切换和流式评估都能直接抄进自己项目,数值准确率能到 99%。
AWS 出的实操教程,手把手教你在 HyperPod 上用 SkyRL 给 Qwen3-VL-8B 做 GRPO 多模态训练,最后还能部署 LoRA 推理。
AWS 官方教程,讲怎么用 HyperPod 加 Qumulo 把训练算力和数据分开放在两个 Region,还附了吞吐量对比数据,做大规模训练的可以参考。
Databricks 分享了自家排障实录:用 Unity Gateway 和 Genie One 追踪 MCP-server,一年白烧 49.9 万美元 token 的 Bug 全揪出来了,做智能体运维的可以抄作业。
Lovart 用 GPT-Image 2.5 一口气生成整套品牌视觉,从 logo 到配色都齐了,做设计的朋友可以看看这套流程。
博主用 Claude Opus 5.5 加一个视频技能包,丢个网址就自动剪出播客宣传片,还顺带聊了 JEV 模型 5 美元免费额度怎么玩。
两家泰国公司现场聊怎么用 WonderClip 做视频,讲的是工作流和本地化落地的实战经验。
LangChain 9 月底连办三场 AMA,手把手教 LangSmith 评估 Agent 和部署 Deep Agents,做 Agent 开发的可以直接去提问。
OpenClaw 把自家删了 40 万行测试的 skill 开源了,agent 写测试前先过四个问题,做 AI 编程的可以直接抄这个工作流。
歸藏试了 Claude Opus 5.5 一键给产品做宣传片,效果比 GPT-6 Astra 还好,还要把这套玩法蒸馏给便宜模型用。
Fujitsu 的工程师要在 PyTorch 大会讲怎么用 vLLM 和 OpenVINO 在 ARM CPU 上跑 MoE 模型,做端侧部署的可以关注。
LlamaIndex 创始人 Jerry Liu 简短点评:模型上 Opus 5.5 稍好,客户端却是 Codex 更顺手,适合纠结选哪家的人参考
一个叫 Relate 的开源小工具,帮你记下答应过别人的事和没回的消息,Claude 和 Cursor 都能读,朋友圈健忘症患者可以试试。
Alibaba 的 Wan3.0 工作流实测,10 秒 1080p 视频在 AskVenice 上只花 1.82 美元,算成本账的朋友可以看看。
写重构方案、事故复盘别再堆 bullet 列表了,这套 ASCII 图表组件源码就是纯文本,Agent 也能直接改,一条 shadcn 命令装好。
有人用 Claude Code 挂 Opus 5.5,不写脚本不套模板,直接让模型从零做出一部《崂山道士》3D 片,思路很值得参考。
两位资深开发者聊 coding agent 的真实体验:模型能写出接近他们的代码,但生产环境还是离不开人。
Databricks 出了个可直接导入的 notebook,教你把 Jev 决策模型跑在自家 Serverless GPU 上,SQL 里调 ai_query 就能拿分类和概率分数,换上自己数据就能用。
GitHub Security Lab 出了个 Taskflow Agent 框架,教你怎么搭 AI 驱动的 fuzzing 工作流,做安全测试的可以照着上手。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档