01:25官方账号NVIDIA AI@NVIDIAAI74°英伟达对超300项验证技能开展基准测试,以相同任务、模型和设置对比有无技能的代理表现。在多项真实任务基准中,带技能的代理正确率提升41个百分点。与无技能代理相比,带技能代理效率提升35个百分点。AI模型NVIDIASkillsBenchmark7 个信源在谈事件专题推荐理由:英伟达测试超300项技能,对比后可知技能对代理帮助大小, 和无技能代理比效果不同, 值得去了解。原文稍后读已读值得跟进有用关注 NVIDIA
12:42AI Will@FinanceYF5据估算,以色列世界模型创业公司 Decart 若以70亿美元被收购,Sequoia 跨多轮投入约7000万美元,对应回报约9亿美元。Sequoia 的综合回报倍数预计在11–14倍之间。Benchmark 同样被视为这场交易中的大赢家。若交易成行,这笔投资将成为 Sequoia 合伙人 Shaun Maguire 的代表作之一。行业DecartSequoiaBenchmark推荐理由:Sequoia 投了 Decart 大概7000万美元,如果真按70亿美元卖掉,能翻到9亿美元,这回报够吹一阵子了。原文稍后读已读值得跟进有用关注 Decart
20:50shao__meng@shao__mengDeepSeek V4 Pro 今日低调发布。官方同步调整了 V4 Pro 和 V4 Flash 的 API 价格。具体涨幅和正式版 Benchmark 成绩见官方图表。AI模型DeepSeekV4 ProAPI价格推荐理由:DeepSeek V4 Pro 出来了,API 价格也变了,想了解涨价多少和性能表现,直接看官方图表吧。原文稍后读已读值得跟进有用关注 DeepSeek
21:09techcrunch@Julie Bort76°Ollama 是一款让开发者轻松在本地 PC 上运行 AI 模型的开源工具,目前 GitHub 已获 176,000 星标、近 17,000 分支。该项目宣布获得 Benchmark 领投的 6500 万美元融资,用户量增长至接近 900 万。Ollama 支持 Llama、Mistral 等多种开源模型一键部署,降低了本地推理门槛。行业Ollama融资开源AI工具推荐理由:Ollama 拿了 6500 万美元,用户快 900 万了。想在本地跑开源模型但嫌麻烦?用它一键搞定。原文稍后读已读值得跟进有用关注 Ollama
10:30shao__meng@shao__mengClaude Opus 4.8 在基准测试、诚实度和长任务处理上优于 4.7,但作者认为这种进步对用户来说并不构成真正的改变,只是 4.7 的升级版。对于已经在用 Opus 4.7 的用户,切换到 4.8 是自然的选择,但不会吸引 GPT-5.5 或 DeepSeek 的用户迁移。作者指出,除非 Opus 5 有重大突破,否则难以撼动现有格局。AI模型Claude Opus 4.8模型对比升级3 个信源在谈事件专题推荐理由:如果你在用 Opus 4.7,升级到 4.8 是顺理成章的事;但如果你是 GPT 或 DeepSeek 用户,这次更新不值得你切换。做模型选型的团队可以看看这篇冷静分析,避免被 Benchmark 数字带偏。原文稍后读已读值得跟进有用关注 Claude Opus 4.8