#性能基准
共 7 条 · 7 天 0 条 · 30 天 2 条
信息流里打上「性能基准」标签的资讯、产品与论文,按刊登时间排,新的在上。
9月22日
9月20日
AI Engineer World's Fair 2026 推出推理工程专题,涵盖分布式部署、性能基准等议题
AI工程师们关心的推理工程专题来了,有 Meta、OpenAI、Google 的最新实践和论文,还有 Superlinked、FriendliAI 等公司的分享,对想了解如何高效部署和优化 LLM 的人很有用。
9月6日
Claude Fable 5.1 (Max)登顶Agent Arena榜首
Anthropic的Claude Fable 5.1 (Max)在Agent Arena排名第一,性能领先但成本较高,用户满意度极高。
9月3日
6月19日
DeepSeek V4 Pro on Together AI 登顶 Artificial Analysis 性能榜首
Together AI 把 DeepSeek V4 Pro 调到了速度与延迟双第一,还公开了优化方法,搞推理部署的值得看看。
6月16日
5月21日
LLM辅助零依赖Python库:stdlib能否替代第三方?
Python开发者面临依赖管理痛点,这项研究用数据告诉你哪些第三方库可以用stdlib替代,哪些不行。做轻量级部署或减少供应链风险的团队,值得参考zerodep的实践。