全部动态
Cognition把Devin Outposts搬上NVIDIA Brev,让Devin能直接动用GPU来定位训练bug、检查显存状态,不用自己搭环境。
看看cognee怎么把RAG、GraphRAG和短期记忆揉成一个统一层,还能自动建知识图谱,团队也能共享记忆,加上TurboQuant压缩搞定海量图数据。
想搞分布式LLM基准测试?NVIDIA这个srt-slurm框架让你用YAML写配置,一键跑SLURM,还能做参数扫描和Pareto分析,超实用。
实测Kimi K3确实强,但烧token也快。作者分享了用claude-context省40% token的实操,适合搞智能体的团队参考。
Linear 做的这个 Loops 让你用大白话就能写循环任务,不会代码也能直接上手,自动化干活省心多了。
作者把自己踩过的坑和适配经验都摊开了,包括 eval() 限制、E2E 测试怎么覆盖多个框架,做 CF Worker 开发的朋友值得一看。
想用代码搞懂大模型训练全流程?这个教程把 MiniMind 的源码一行行讲透,从 Tokenizer 到 GRPO 都有,还附赠量化、RLHF 等进阶知识。
AWS和NVIDIA联手,帮你用Quick仪表板加上NeMo Agent Toolkit,快速搭一个能自动分析供应链风险的智能体,不用写代码。
Milvus 团队开源了 MemSearch,新增 Memory-to-Skill 功能,能自动从Agent历史里挖出重复工作流生成技能文件,直接给 Claude Code、Codex 用,省得手动整理。
HubSpot分享了如何用Qdrant处理20B+向量搜索,自己写K8s operator搞定Helm搞不定的集群管理,集群创建从小时变分钟,资源偏差降65%。硬核实战经验。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档