02:05lmarena.ai@lmarena_ai查看Image-to-WebDev排行榜完整版,了解最新排名和成绩。AI模型Image-to-WebDev排行榜AI模型推荐理由:想了解最新排行榜,看看谁在Image-to-WebDev领域表现最佳吧!原文稍后读已读值得跟进有用关注 Image-to-WebDev
00:11官方账号Perplexity@perplexity_ai精选便携电脑支持运行经过训练和本地安装的PPLX 27B模型。Qwen 3.8 27B版本即将推出,支持NVIDIA Nemotron 3.5 Lightning。AI产品PPLX 27B便携电脑AI模型4 个信源在谈事件专题推荐理由:便携电脑支持PPLX 27B模型,使用方便,适合需要高性能AI模型的用户。原文稍后读已读值得跟进有用关注 PPLX 27B
10:45官方账号arXiv cs.AI@Melissa Dell, Ashesh RambachanAI模型将非结构化数据转换为结构化变量,推动经济学测量变革。本文提供指导,描述AI在测量流程中的三个阶段:发现、构建定义和观察,并强调对AI生成变量的可信推理需要适当设计的验证。同时,探讨如何支持有效推理,即使AI预测存在任意偏差,以及随机验证样本不可用时如何处理。论文AI模型经济学测量可信推理推荐理由:这篇论文深入探讨了AI在经济学测量中的应用,提供了关于如何进行可信推理的宝贵见解,对于对AI在测量领域应用感兴趣的人来说是个好资源。原文稍后读已读值得跟进有用关注 AI模型
06:38Gary Marcus@GaryMarcus78°Anthropic IPO预期过高,若不调整,恐成灾难。Thomson Reuters欲减少对Claude依赖,自建基于Qwen的AI模型。TR CTO认为使用前沿实验室而非开源如租房。行业AnthropicIPOAI模型8 个信源在谈事件专题推荐理由:Anthropic IPO遇阻,Thomson Reuters自建AI模型,Claude受影响。了解行业动态,关注AI模型发展。原文稍后读已读值得跟进有用关注 Anthropic
23:37Geek@geekbb78°DeepSeek V4在价格战中败给Ox Alpha,开发者对模型忠诚度低;Ox Alpha在3天内超越DeepSeek V4;任何公司都能通过努力和发布优质模型赢得市场。AI模型DeepSeek V4Ox Alpha价格战8 个信源在谈事件专题推荐理由:看看DeepSeek V4和Ox Alpha的价格战,Ox Alpha以更快的速度超越DeepSeek V4,显示出其性价比优势。原文稍后读已读值得跟进有用关注 DeepSeek V4
22:04IT之家(博客/媒体)精选汤森路透推出基于阿里千问构建的大语言模型Thomson,研发成本约4000万美元,Qwen3.5-397B版本,在Stanford LegalBench测试中得分0.823,落后于Gemini 3.1 Pro和GPT-5.5。AI模型Thomson阿里千问汤森路透推荐理由:汤森路透新推AI模型,基于阿里千问,适合文档审查等场景,成本更低,调整更自由。原文稍后读已读值得跟进有用关注 Thomson
21:23官方账号Decoder@Maximilian SchreinerThomson Reuters推出基于阿里巴巴Qwen的AI语言模型Thomson,投资约4000万美元,为期两年。模型在访问公司内部内容如Westlaw时表现最佳。CTO Joel Hron强调,重要的是拥有所需智能而非智能本身。行业Thomson ReutersAI模型自建AI推荐理由:Thomson Reuters投资4000万美元自建AI模型,与OpenAI或Anthropic租赁相比,拥有自己的AI模型更具优势。原文稍后读已读值得跟进有用关注 Thomson Reuters
18:28官方账号Decoder@Maximilian SchreinerCerebras推出CS-4 AI加速器,CEO Andrew Feldman称其为行业最快系统。CS-4在相同芯片上实现性能翻倍。AI模型CerebrasAI加速器性能翻倍推荐理由:Cerebras发布CS-4,性能翻倍,行业领先!原文稍后读已读值得跟进有用关注 Cerebras
16:24官方一手Pandaily@contact@pandaily.com (Pandaily)8月20日,OpenRouter低调列出匿名、免费的模型'ox-alpha',其真实世界编码结果击败多个封闭前沿模型,引发行业猜测游戏,并聚焦中国隐形模型策略。AI模型Ox Alpha编码基准OpenRouter8 个信源在谈事件专题推荐理由:OpenRouter发布了一个免费模型,其编码能力超越多个前沿模型,引发行业关注。原文稍后读已读值得跟进有用关注 Ox Alpha
09:36Gary Marcus@GaryMarcusMisha Glouberman将八年的Fitbit数据输入到Claude模型,模型分析后得出结论:熬夜导致睡眠时间减少。AI模型ClaudeFitbit数据睡眠分析推荐理由:想看看你的Fitbit数据如何被AI分析?Claude模型给你答案!比其他AI更直观!原文稍后读已读值得跟进有用关注 Claude
01:04Stanford AI Lab@StanfordAILabStanfordAILab启动了Marin 535B-A23B模型的训练,使用11 x GB200 NVL72进行,预计3个月完成。这是迄今为止最大的训练,预计将出现意外。AI模型StanfordAILabMarin 535B-A23B模型训练3 个信源在谈事件专题推荐理由:StanfordAILab发布了Marin 535B-A23B模型的训练消息,这是他们迄今为止最大的训练项目,值得关注。原文稍后读已读值得跟进有用关注 StanfordAILab
18:18官方账号Decoder@Matthias Bastian自2025年2月6日起,AI代理在OpenRouter上消耗的令牌数量已超过人类。代理使用量增长了14倍,而人类使用量仅增长2.8倍。尽管如此,近70%的代理令牌消耗来自廉价的缓存提示,因此实际成本增长速度远低于原始数据所显示的速度。AI模型OpenRouter代理令牌AI代理推荐理由:OpenRouter上AI代理令牌使用量激增,成为自身最大客户,了解代理令牌的消耗情况,对比人类使用量增长。原文稍后读已读值得跟进有用关注 OpenRouter
16:14IT之家(博客/媒体)78°英伟达向Poolside支付60亿美元获取AI模型授权,并追加10亿美元投资,旨在开发与DeepSeek和Kimi K3竞争的AI模型。Poolside将保持独立运营,英伟达寻求加快AI技术渗透各行各业。行业英伟达PoolsideAI模型1 个信源在谈事件专题推荐理由:英伟达投资Poolside,助力打造中国开源AI竞争者,值得关注其未来发展。原文稍后读已读值得跟进有用关注 英伟达
17:13官方账号Latent Space (swyx)@Dan McAteer模型持续吸收注意力约束,未来将转向人类注意力而非模型自身。模型名:智能体;约束类型:注意力约束;未来趋势:转向人类注意力。AI模型智能体注意力约束模型进化推荐理由:Latent Space 发布了智能体注意力约束的进化,看看它如何影响人类注意力吧!原文稍后读已读值得跟进有用关注 智能体
03:53techcrunch@Julie BortNvidia研究显示,即使AI模型在任务上表现不佳,通过微调,AI智能体仍能良好表现,不会失控。AI模型NvidiaAI智能体微调3 个信源在谈事件专题推荐理由:Nvidia展示了AI模型之外的另一个关键因素——harness,它对AI性能至关重要。原文稍后读已读值得跟进有用关注 Nvidia
22:05elvis@omarsar0Ox Alpha(隐秘模型)免费一周,支持1M上下文、多模态、零数据保留,每日100T令牌容量,限时体验。AI模型Ox Alpha多模态零数据保留5 个信源在谈事件专题推荐理由:Ox Alpha免费一周,多模态、零数据保留,体验最新AI模型。原文稍后读已读值得跟进有用关注 Ox Alpha
19:53Geek@geekbbDeepSeek-V4-Flash-Vision-Exp模型上线,多模态能力提升,接近Opus-4.8水平。DeepSeek Harness 0.1.1支持新模型。AI模型DeepSeek-V4-Flash-Vision-Exp多模态模型发布推荐理由:DeepSeek新模型发布,多模态能力大幅提升,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-Exp
15:06orange.ai@oran_geBen Davis 在 x.com 上分享,DeepSWE 在 10 项任务中表现优于 Fable 和 GPT-5.6-sol,得分超过 80%,引发热议。AI模型DeepSWEFableGPT-5.6-sol推荐理由:Ben Davis 在 x.com 上展示了 DeepSWE 在多项任务中的出色表现,比 Fable 和 GPT-5.6-sol 更胜一筹,值得关注。原文稍后读已读值得跟进有用关注 DeepSWE
13:41IT之家(博客/媒体)DeepReinforce推出Ornith-1.5系列开源模型,其最大397B规模模型部分性能超过Claude Opus 4.8;Ornith-1.5系列包含多规模模型,397B版在部分测试中胜过Claude Opus 4.8;该系列还有9B量化版本,可在iPhone 17等手机上运行。AI模型Ornith-1.5Claude Opus 4.8iPhone 17推荐理由:DeepReinforce刚发布了Ornith-1.5系列开源模型,里面有量化版居然能在iPhone 17手机上用,而且大模型性能和Claude Opus 4.8差不多甚至更强,和其他模型比也有优势,值得看看。原文稍后读已读值得跟进有用关注 Ornith-1.5
11:22量子位@量子位的朋友们墨奇智能首次亮相国内,公开展示其新近发布的具身智能模型MoRA架构,该模型在WRC场景下的长程任务实战中表现出色,完成超5小时连续作业,展现出具身大脑的技术革新AI模型MoRA墨奇智能具身智能推荐理由:墨奇发的MoRA模型,能让机器人做长程任务,比普通模型实战效果更好原文稍后读已读值得跟进有用关注 MoRA
10:16官方账号arXiv cs.AI@Boqiao Zhang, Godbless James, Sai Krishna Gottipati, Andrew FitzgibbonPGFS++是一种用于分子性质优化的强化学习框架,在合成和多样性约束下实现改进。该框架基于PGFS升级,采用可训练反应模板表示,显著提升性能。相比前代方法,它在改善目标性质的同时保持了输出多样性。AI模型PGFS++分子优化强化学习推荐理由:PGFS++是新分子优化方法,能解决合成和多样性难题,比之前版本效果更好还保分子多样性。原文稍后读已读值得跟进有用关注 PGFS++
10:13官方一手pandaily@contact@pandaily.com (Pandaily)小米MiMo - V2.5模型登顶OpenRouter月周通话榜单,展现前沿实力;自研Xuanjie芯片完成大规模验证,技术突破明显;新类人机器人工厂应用成功率达98%,拓展业务边界。AI产品XiaomiMiMo-V2.5OpenRouter推荐理由:小米发布了MiMo - V2.5模型、Xuanjie芯片和新机器人,这些新品在性能和场景上比之前更好了,值得了解下。原文稍后读已读值得跟进有用关注 Xiaomi
07:40techcrunch@Julie Bort支付巨头Stripe表示未因‘奇点’概念收购OpenRouter,这家名为OpenRouter的创业公司专注于在不同AI模型间路由提示词。其真实收购动因是为优化不同AI模型的提示词分发流程。与市场上同类服务相比,OpenRouter在多模型协作场景下的效果更优。行业StripeOpenRouterAI模型推荐理由:Stripe没真因‘奇点’买OpenRouter,OpenRouter是做AI模型间提示词路由的,和同类不一样,值得了解下。原文稍后读已读值得跟进有用关注 Stripe
06:45Jerry Liu@jerryjliu0LlamaParse 模型新增功能,可提取 Word 风格的文档修订记录与评论。该功能可将修订历史和变更信息作为结构化元数据,附加到解析后的 markdown 内容中。这让下游 AI 助手能获取文档的完整修订历史,而非仅最新的静态快照。AI模型LlamaParse文档修订markdown解析推荐理由:LlamaParse 新加文档修订跟踪功能,能把修订记录整理成结构化数据,和之前没这功能的工具不一样,现在能查历史修改啦。原文稍后读已读值得跟进有用关注 LlamaParse
06:16官方账号Pika Labs@pika_labs精选皮卡实验室的Pika SFX在音频效果测试中表现最佳,该系统在内容实用性和生产质量两项指标上领先其他系统,这两项指标接近判断输出是否可用于创意工作流程的标准。AI模型Pika SFXPika Labs音频效果推荐理由:皮卡实验室发布了Pika SFX音频效果系统的测试结果,这个系统能做音频效果创作,和别的系统比起来它在实用性等方面表现更好,值得了解下~原文稍后读已读值得跟进有用关注 Pika SFX
03:16Scott Wu@ScottWu46Cognition推出的Devin模型于2024年首次发布后经迭代升级,当前版本执行任务表现更优;与旧版本相比,其在处理复杂工作时效率更高;作为行业创新AI模型,此次升级拓宽了其应用范围。AI模型DevinCognitionAI模型推荐理由:Cognition发布了新版Devin,这是给团队用的工程师工具,比之前版本好用,想提升效率的人可以用原文稍后读已读值得跟进有用关注 Devin
02:26Mustafa Suleyman@mustafasuleyman精选微软推出的MAI-Image-2.5-Pro成为Artificial Analysis图像编辑榜单第一名,超越了Reve 2.1、GPT Image 2等模型,同时在文本转图像领域位列第七;该模型于7月23日在Microsoft Foundry预览发布,主打高质量图像处理功能。AI模型MAI-Image-2.5-ProArtificial Analysis图像编辑4 个信源在谈事件专题推荐理由:微软发布了MAI-Image-2.5-Pro,做高质量图像编辑很厉害,比Reve 2.1这些模型表现更好,适合专业图像任务使用。原文稍后读已读值得跟进有用关注 MAI-Image-2.5-Pro
22:48orange.ai@oran_ge中转站平台已下架Luna模型,因该模型价格过低导致运营亏损。Luna模型的利润甚至无法覆盖云服务成本,平台运营一天亏损一天。行业分析认为,当前模型价格已接近最低点,未来竞争将转向端侧模型。行业Luna中转站AI模型推荐理由:中转站下架Luna模型,揭示低价AI模型已无法盈利的行业现状。原文稍后读已读值得跟进有用关注 Luna
22:39官方账号Decoder@Maximilian SchreinerAnthropic的Claude模型在蛋白设计中实现35%成功率,远高于行业平均10 - 15%;该模型仅辅助已有专业工具,独立评估仍在进行中;此技术让任意实验室能完成蛋白质设计的完整流程。AI模型ClaudeAnthropic蛋白设计10 个信源在谈事件专题推荐理由:Anthropic放出Claude模型新功能,能让任意实验室完成全蛋白设计流程,比行业平均效率高很多。原文稍后读已读值得跟进有用关注 Claude
15:13官方账号Decoder@Matthias Bastian据彭博社报道,Stripe 将以超过70亿美元收购 AI 创企 OpenRouter,较其最新估值13亿美元大幅溢价。OpenRouter 平台聚合超过400个 AI 模型,拥有800万用户。其 CEO 曾将公司描述为“AI 界的 Stripe”,如今这笔交易成为现实。行业OpenRouterStripeAI模型推荐理由:OpenRouter 是个能一次调用几百个模型的服务,现在被 Stripe 用70多亿美元买下了,做支付的巨头开始押注 AI 基础设施了。原文稍后读已读值得跟进有用关注 OpenRouter
10:43官方一手Pandaily@contact@pandaily.com (Pandaily)文章指出,中国出口的'新新三样'已变为机器人、AI模型和创新药物。澳大利亚出现了中国制造的爬墙清洁机器人,巴西电网则采用中国大语言模型运行。澳大利亚与巴西的案例表明,中国出口的这三个领域正在改变海外印象。行业机器人AI模型创新药物推荐理由:这篇讲的是中国出口的新花样:机器人、AI模型和药物,连巴西电网都在用中国LLM,有意思。原文稍后读已读值得跟进有用关注 机器人
00:08官方账号Logan Kilpatrick@OfficialLoganKGoogle 推出 Gemini Robotics ER 2 模型,已在 Gemini API 和 Google AI Studio 中可用。演示展示了多机器人协作场景,成为亮点。该模型可处理复杂的物理世界交互任务。AI模型Gemini Robotics ER 2Google AI StudioGemini API推荐理由:Google 新出的 Gemini Robotics ER 2 能直接调 API 玩多机器人协作,看演示很酷,可以试试。原文稍后读已读值得跟进有用关注 Gemini Robotics ER 2
07:30IT之家(博客/媒体)微软CEO萨提亚·纳德拉警告,企业若将AI能力完全外包给模型开发商,可能丧失竞争力甚至无法生存。他建议企业控制每次调用AI模型产生的元数据,用于未来训练自有模型或开源模型。纳德拉具体提到,企业应部署AI Gateway隔离Prompt,避免直接交给Claude Code、ChatGPT Codex等内置编程工具。他认为,企业至少应拥有自己的AI模型或分离上下文与模型,以根据不同任务灵活选择模型,防止被模型开发商锁定或面临直接竞争。行业微软萨提亚·纳德拉AI模型推荐理由:微软 CEO 纳德拉说了大实话:别把思考能力外包给 AI 公司。他给了具体方法,比如用 AI Gateway 隔离 Prompt、自己掌握训练数据,否则以后可能被模型厂商吃掉。原文稍后读已读值得跟进有用关注 微软
10:09IT之家(博客/媒体)日本大阪大学团队利用AI模型系统评估了16种分子结构描述方法,找到了最能精准表征水分子在不同温度、压力下微观变化的方案。研究揭示了过冷水中“高密度液态”(HDL)与“低密度液态”(LDL)的结构竞争是水反常特性的底层机制。该成果为统一理解水结冰膨胀及过冷水异常行为提供了科学框架。论文水结构过冷水AI模型推荐理由:AI帮科学家搞清楚了水为什么结冰会膨胀,16种方法逐一筛选,发现了HDL和LDL的竞争机制,真解渴。原文稍后读已读值得跟进有用关注 水结构
10:16官方一手歸藏(guizang.ai)@op7418Kimi K3 模型正式上线,引发广泛关注。用户反馈称其性能表现相当突出。有评论猜测该发布可能刺激 Anthropic 的 Dario 再次撰写博客强调开源模型的潜在危害。AI模型Kimi K3模型发布AI模型10 个信源在谈事件专题推荐理由:Kimi 发了新模型 K3,性能聊得很猛,想了解它为什么让 Anthropic 紧张?原文稍后读已读值得跟进有用关注 Kimi K3
12:04techcrunch@Ram IyerApplied Computing 完成 2000 万美元 Series A 融资,用于开发针对石油、天然气和石化行业的 AI 基础模型。该模型旨在覆盖整个工厂运营,帮助操作员优化生产、预测设备故障并降低排放。公司计划将模型部署到数十家炼油厂和化工厂。行业Applied Computingoil and gasAI模型推荐理由:Applied Computing 拿了 2000 万美元给油气厂做个专属大模型,覆盖整个工厂的运营,挺对口的。原文稍后读已读值得跟进有用关注 Applied Computing
09:49官方账号Sam Altman@samaOpenAI CEO Sam Altman在X平台发推,表示看到自家模型在设计方面终于表现出色,令他感到惊讶。该推文获得2276个赞、12.6万次查看和377条回复。目前尚未公布具体模型版本或基准成绩。AI模型OpenAI设计AI模型10 个信源在谈事件专题推荐理由:OpenAI老板亲自说模型设计能力进步了,想看看具体强在哪?原文稍后读已读值得跟进有用关注 OpenAI
09:04爱范儿@郑廷旭GPT-5.6 定于本周全量上线。Claude Fable 5 免费使用期延长至 7 月 12 日。SpaceX 股价跌破上市首日开盘价。AI模型GPT-5.6Claude Fable 5SpaceX10 个信源在谈事件专题推荐理由:今天早报有GPT-5.6上线、Claude Fable 5免费延长、SpaceX股价破发,三条短讯快速掌握动态。原文稍后读已读值得跟进有用关注 GPT-5.6
00:30Thomas Wolf@Thom_WolfHugging Face 新增了一项实用功能,允许用户根据自身硬件配置(如 GPU 型号、显存大小)筛选 AI 模型。用户无需手动查看模型兼容性,即可快速找到能在自己设备上运行的模型。该功能直接集成在模型搜索页面,提升了模型选择的效率。AI产品Hugging FaceHF模型筛选推荐理由:Hugging Face 上线了按硬件筛选模型的功能,直接告诉你能跑哪些模型,省去自己查兼容性的麻烦。原文稍后读已读值得跟进有用关注 Hugging Face
10:33techcrunch@Anna HeimBase44是Wix旗下的vibe coding平台,近日开始推出自己的AI模型。此举旨在让平台在AI初创公司中建立防御性,减少对外部前沿模型的依赖。Base44表示希望该模型最终能超越当前最先进模型的表现。目前该模型已在部分用户中测试。AI模型Base44Wixvibe coding推荐理由:Base44搞了个自己的AI模型,想不靠别人,自己干翻前沿模型。vibe coding玩家可以期待一下。原文稍后读已读值得跟进有用关注 Base44