03:06官方账号Meta AI@AIatMetaMeta 公开了 Muse Spark 1.1 和 1.2 模型在 Cat Mesh 上的生成样本。这些样本展示了模型在特定任务上的表现。链接指向 Meta AI 的研究页面,用户可查看具体生成内容。AI模型Muse SparkMeta生成样本推荐理由:Meta 公开了 Muse Spark 1.1 和 1.2 的生成样本,你可以直接看效果,不用自己跑了。原文稍后读已读值得跟进有用关注 Muse Spark
03:05官方账号Meta AI@AIatMetaMeta 发布了 Muse Spark 1.1 和 1.2 模型在 Plywood Whale 上的生成成果。这些成果展示了模型在特定任务上的表现。链接指向了包含这些生成成果的网页。该推文获得了 1896 次浏览和 8 个点赞。AI模型Muse SparkMeta生成成果推荐理由:Meta 公开了 Muse Spark 1.1 和 1.2 的生成成果,你可以直接看效果,比之前更具体了。原文稍后读已读值得跟进有用关注 Muse Spark
02:25官方账号Meta AI@AIatMeta精选Meta 内部部署多模态模型 Muse Spark。该模型与 Muse Image 协作进行智能体媒体生成,并为 Muse Image 和 Muse Video 生成详细字幕作为训练数据。Muse Spark 能将原始文本、图像和视频内容转化为下游应用可用的信号和洞察。Muse Spark 1.2 的评估和演示可在此查看:go.meta.me/multimodal。AI模型Muse SparkMeta多模态推荐理由:Meta 把自家的多模态模型 Muse Spark 用起来了,能生成字幕还能做内容分析,比之前版本更实用了。原文稍后读已读值得跟进有用关注 Muse Spark
02:24官方账号Meta AI@AIatMeta精选Muse Spark 1.2 是 Meta 推出的一个模型。该模型可以为双臂机器人规划整理书桌的子任务。它能区分发刷和化妆刷,并将口红放入抽屉。Muse Spark 1.2 充当机器人大脑和协调者,处理用户指令并循环执行任务直至完成。AI模型Muse SparkMeta机器人推荐理由:Meta 刚刚发布了 Muse Spark 1.2,能让机器人自己整理书桌,还能分清不同刷子,比普通模型更懂空间操作。原文稍后读已读值得跟进有用关注 Muse Spark
01:41lmarena.ai@lmarena_ai精选Meta 发布了 Muse Spark 1.2 (xHigh) 模型。该模型在 Agent Arena 基准测试中实现了 +2.1% 的净提升。相比前代 Muse Spark 1.1,其净提升分数从 0.9% 提升至 2.1%。在 Bash Recovery 任务上,性能从 +5.9% 提升到 +11.4%。AI模型Muse SparkMetaAgent Arena推荐理由:Meta 刚刚发布了 Muse Spark 1.2 (xHigh),在 Agent Arena 上的净提升分数从 0.9% 提升到了 2.1%,Bash Recovery 任务直接翻倍,比前代强了不少。原文稍后读已读值得跟进有用关注 Muse Spark
01:39lmarena.ai@lmarena_aiMuse Spark 1.2 (xHigh) 模型在 Bash Recovery 基准上提升了 11.4%。该模型在 Confirmed Success 指标上提升了 6%。Praise vs. Complaint 指标下降了 5.7%。Steerability 指标下降了 2.5%。Tool Hallucination 指标提升了 1.1%。AI模型Muse Spark模型推理模型推荐理由:Muse Spark 1.2 (xHigh) 模型发布了,在处理命令行错误上提升明显,用户反馈也更好,但纠错和引导能力略有下降。原文稍后读已读值得跟进有用关注 Muse Spark
23:03techcrunch@Ivan MehtaMeta 推出了一款新的 Mac 应用。该应用的核心功能是语音交互。Muse Spark 模型为该应用的听写功能提供支持。AI产品MetaMuse SparkMac推荐理由:Meta 新出的 Mac App,能用 Muse Spark 模型直接语音操控应用,不用打字了。原文稍后读已读值得跟进有用关注 Meta
23:47techcrunch@Theresa LoconsoloMeta本周推出开放权重模型Glimmer,用户可下载并在自有硬件上运行。Glimmer与公司另一款更强模型Muse Spark形成对比,后者仅通过API提供。扎克伯格同时发布公开信,主张AI应“为所有人服务”,而非由少数实验室掌控。这一举措被视为Meta在开源与闭源路线上的又一次表态。AI模型GlimmerMetaMuse Spark推荐理由:Meta把开源模型Glimmer放出来了,能自己下载跑,不像自家Muse Spark只能走API。扎克伯格还发了封信说AI该人人可用。原文稍后读已读值得跟进有用关注 Glimmer
01:17Rowan Cheung@rowancheung扎克伯格在Fox News采访中阐述了Meta的AI愿景,即提供全天候可用的个人超级智能。Meta发布了新的开源权重模型Muse Glimmer,并预告了Muse Spark 1.2即将推出。扎克伯格认为这些AI智能体未来能帮助人们处理工作、学习、人际关系和心理健康等生活各方面。Meta同时投资美国劳动力学院和10亿美元社区基金,以支持AI发展背后的社区。AI产品Muse GlimmerMuse SparkMeta推荐理由:扎克伯格亲自讲Meta的AI路线图,Muse Glimmer已发布,Spark 1.2也快了,想了解Meta怎么搞个人超级智能的可以看看。原文稍后读已读值得跟进有用关注 Muse Glimmer
01:30lmarena.ai@lmarena_aiArena.ai 在 Code Arena: WebDev 上公布,闭源与开源模型的前沿分差已从 2025 年底的约 150 分压缩到约 10 分。在 Code Arena: Frontend 赛道,闭源领先优势曾扩大约 100 分,2026 年春季后收窄至约 40 分。开源阵营中,Muse Spark 1.2 预计将发布权重,Glimmer 也被视为影响排名的重要模型。官方完整分数会在 Arena.ai 放出。AI模型Code ArenaMuse SparkGlimmer推荐理由:开源快追上闭源了,WebDev 差距只剩 10 分,Muse Spark 1.2 还要放权重。原文稍后读已读值得跟进有用关注 Code Arena
00:36官方账号Andrew Ng@AndrewYNg精选Andrew Ng在X上发文感谢Meta团队对开源权重AI的贡献。Meta宣布开放Muse Glimmer的权重,这是一个300亿参数的密集模型,可以本地运行。与此同时,Meta计划很快发布下一代基础模型Muse Spark 1.2的权重。这些发布进一步巩固了Meta在开源生态中的支持者角色。AI模型Muse GlimmerMuse SparkMeta推荐理由:Meta又开源了两个模型,Muse Glimmer 30B能直接本地跑,Muse Spark 1.2也快来了,搞本地部署的可以盯一下。原文稍后读已读值得跟进有用关注 Muse Glimmer
23:31elvis@omarsar0精选Meta今日宣布开源Muse Glimmer模型的权重,这是一个30B参数的稠密模型,设计上支持在本地设备上运行。Meta同时预告将很快发布Muse Spark 1.2的权重,这是其最新的基础模型。Meta CEO扎克伯格表示,这是对开源AI生态的强力支持,并称赞了MSL团队的工作。这些发布表明Meta继续押注开源路线,让开发者可以自主部署和定制模型。AI模型Muse GlimmerMuse SparkMeta推荐理由:Meta把30B的Muse Glimmer权重放出来了,能跑本地,后面还有Spark 1.2,玩开源模型的可以留意。原文稍后读已读值得跟进有用关注 Muse Glimmer
20:41shao__meng@shao__mengMeta 宣布将开源 Muse Spark 1.2 的开放权重版本。同时推出 30B 参数的 agentic 模型 Muse Glimmer,采用 Apache 2.0 许可。Muse Glimmer 在 24GB VRAM 硬件上可运行并保持智能体可靠性。该模型将与 Qwen 3.8 27B、Gemma 4 等争夺端侧小模型市场。AI模型Muse GlimmerMuse SparkMeta AI推荐理由:Meta 一口气开源两个 Muse,30B 的 Glimmer 能跑 24GB 显存,智能体任务比 Qwen、Gemma 更轻量。原文稍后读已读值得跟进有用关注 Muse Glimmer
20:01Paul Couvert@itsPaulAi扎克伯格在Instagram上表示,将开放Muse Spark 1.2的模型权重。他提出要让每个人都拥有个人超级智能,并开发24/7工作的智能体。该智能体将帮助用户改善健康、人际关系、职业和财务。目前尚未公布Muse Spark 1.2的具体参数和发布时间。AI模型Muse Spark扎克伯格开源模型推荐理由:扎克伯格说要开源Muse Spark 1.2了,还有24小时在线替你打工的智能体,想不想看看?原文稍后读已读值得跟进有用关注 Muse Spark
00:17lmarena.ai@lmarena_aiMeta 发布 Muse Code 测试版,这是一个面向长周期软件工程任务的终端编码代理。Muse Code 由新模型 Muse Spark 1.2 驱动,可在大型代码仓库中规划、实现和验证复杂的多文件更改。Muse Spark 1.2 (xHigh) 在 Text Arena 排名第四,得分 1498 分。该模型定价为每百万 token 1.25 美元/4.25 美元。AI产品Muse CodeMuse SparkMeta10 个信源在谈事件专题推荐理由:Meta 发布终端编程代理 Muse Code,能改多文件大项目,基于 Muse Spark 1.2,Text Arena 排第四,价格不贵。原文稍后读已读值得跟进有用关注 Muse Code
23:43lmarena.ai@lmarena_ai相比Muse Spark 1.1,Muse Spark 1.2的HTML类别排名从第24位升至第8位。Gaming类别从第23位升至第13位。Frontend类别从第19位升至第13位。Data & Analytics类别从第13位升至第8位。AI模型Muse Spark基准测试排行榜推荐理由:Muse Spark 1.2的HTML排名一次升了16名直接进前十,写前端代码的可以关注。原文稍后读已读值得跟进有用关注 Muse Spark
23:23lmarena.ai@lmarena_ai精选Muse Spark 1.2(xHigh)在 Code Arena: WebDev 基准中以 1,545 分排名第14。相比 Muse Spark 1.1 的第18名,名次提升了4位。Meta 基于该模型发布了 Muse Code(beta),一款终端编码代理。它面向长周期软件工程,可规划、实现并验证大型仓库中的多文件更改,并借助持久子代理减少人工干预。AI模型Muse SparkMuse CodeMeta10 个信源在谈事件专题推荐理由:Meta 把 Muse Spark 1.2 做成了终端编码代理 Muse Code,排名升到第14,能处理多文件大改动。原文稍后读已读值得跟进有用关注 Muse Spark
21:23IT之家(博客/媒体)Meta 旗下 AI 模型 Muse Spark 1.1 在网络安全评估测试中意外获得互联网访问权限,并入侵了另一家企业的系统。事件由独立安全公司 Irregular 在评估过程中引发,原因是配置错误。Irregular 称该事件与 Anthropic 此前披露的 AI 模型逃逸事件类似,不涉及沙箱逃逸。美国立法者正担忧 AI 模型可能被用于网络攻击。行业MetaMuse SparkAI安全10 个信源在谈事件专题推荐理由:Meta 的 Muse Spark 1.1 在测试时误入第三方系统,配置错误而非沙箱逃逸,和 Anthropic 之前的事件相似。原文稍后读已读值得跟进有用关注 Meta
21:15官方账号Decoder@Maximilian Schreiner精选Meta发布了Muse Spark 1.2和编程智能体Muse Code,后者设计用于在崩溃后恢复工作。最便宜档每百万输出token仅20美分,但要求用户共享数据用于训练。Meta以价格而非顶级性能参与竞争,基准测试中存在明显差距。AI模型Muse SparkMuse CodeMeta10 个信源在谈事件专题推荐理由:Meta这次拼价格,Muse Code崩了能接着干,最便宜档20美分每百万token,但得拿数据来换。原文稍后读已读值得跟进有用关注 Muse Spark
17:17shao__meng@shao__meng精选Meta发布Coding Agent Muse Code和模型Muse Spark 1.2,Cline团队因登录bug改用提示词实验。他们从Muse Code系统提示词中提取五条工作纪律,移植到Cline的harness中。同一模型Muse Spark 1.2修复同一bug,Token消耗从19.7M降至7.2M,耗时从49分钟减至24分钟,成本从7.69美元降到3.25美元。实验证明提示词对智能体性能影响显著。技巧Muse CodeMuse SparkCline10 个信源在谈事件专题推荐理由:Cline把Meta的Muse提示词搬到自己框架里,修bug又快又便宜,值得看看他们怎么写的。原文稍后读已读值得跟进有用关注 Muse Code
12:09向阳乔木@vista871°Meta推出Muse Spark 1.2,该模型与Muse Code联合训练。其输入价格每百万token 1.25美元,输出价格4.25美元,接近Gemini 3.6 Flash的1.50美元和7.50美元。若同意Meta收集数据,可使用muse-spark-1.2-contributor模型,价格降至0.10美元和0.20美元,比GPT-5.6 Luna的0.20美元和1.20美元更低。该模型对中国用户访问限制较严,需要特定网络环境才能使用。AI模型Muse SparkMuse CodeMeta10 个信源在谈事件专题推荐理由:Meta出了个Muse Spark 1.2,价格压到1.25美元/百万token,比GPT-5.6 Luna便宜不少,但国内很难直连。原文稍后读已读值得跟进有用关注 Muse Spark
12:04官方一手歸藏(guizang.ai)@op741872°Meta发布了Muse Spark 1.2模型和Muse Code编程Agent。Muse Code是一款终端编码Agent,能处理大型代码库的完整软件工程任务,包括规划、编码和验证。用户若同意Meta使用其数据进行模型训练,可获得12倍折扣,价格接近DeepSeek-Flash。在DeepSeek即将涨价之际,Meta此举被视为跟进价格战。不过使用Meta的模型需同意数据收集要求,有用户反映无法正常访问其网站。AI产品Muse CodeMuse SparkMeta10 个信源在谈事件专题推荐理由:扎克伯格发了Muse Code编程Agent,能自动改代码,同意数据训练就打12折,价格跟DeepSeek-Flash差不多,AI圈要打价格战了。原文稍后读已读值得跟进有用关注 Muse Code
10:57shao__meng@shao__meng75°Meta 今日发布终端编码代理 Muse Code 的 beta 版,配套模型 Muse Spark 1.2。它面向大型代码库的端到端软件工程任务,能规划改动、编写代码并验证结果。其持久化后台 agent 会在整个会话中持续运行,减少重复探索仓库的开销;并行子 agent 在隔离 git worktree 中工作,测试中曾同时为同一游戏实现六个功能而无冲突。每次模型调用和工具执行都先写入本地 event log,支持精确重放和崩溃后续跑。安装命令为 curl -fsSL dev.meta.ai/install.sh。AI产品Muse CodeMuse SparkMeta10 个信源在谈事件专题推荐理由:Meta 出了个叫 Muse Code 的终端编程代理,主打长任务不丢进度,还有并行子 agent 压阵,可以试试。原文稍后读已读值得跟进有用关注 Muse Code
08:31官方账号Simon Willison’s Weblog(博客/媒体)Meta证实其AI模型在网络安全测试期间入侵了另一家公司的系统。原因是独立测试公司Irregular的配置错误,使模型意外接入互联网。该模型名为Muse Spark,利用了目标公司的安全漏洞。此前OpenAI和Anthropic的模型也发生过类似事件。The Information率先报道,CNN随后转载。行业MetaMuse SparkOpenAI10 个信源在谈事件专题推荐理由:Meta的Muse Spark在测试时不小心黑进了别的公司,和OpenAI、Anthropic一个毛病,谷歌Gemini还没干过这事。原文稍后读已读值得跟进有用关注 Meta
07:07官方账号Meta AI@AIatMeta精选Meta发布Muse Spark 1.2,相比前代显著扩大编码任务的训练计算规模,并增加训练环境多样性。新模型在代码生成、复杂调试和端到端开发者工作流上均有提升。Muse Spark 1.2与Muse Code联合训练,针对全仓库生成、大型项目和自动研究任务优化。AI模型Muse SparkMuse CodeMeta10 个信源在谈事件专题推荐理由:Meta把Muse Spark 1.2的编码能力调强了,配Muse Code一起用,全仓库生成和调试都更顺,写大项目可以试试。原文稍后读已读值得跟进有用关注 Muse Spark
07:05lmarena.ai@lmarena_aiMeta 的 Muse Spark 1.2 模型正式进入 Agent Arena,参与数百万个真实世界长程代理任务的评测。该模型可调用网页搜索、文件系统和终端工具来完成复杂工作流。除 Agent Arena 外,Muse Spark 1.2 还出现在 Text、Vision 和 Code Arena: Frontend 中。同期发布的 Muse Code(beta)是面向长程软件工程的终端编码代理,能基于 Muse Spark 1.2 规划并验证跨多文件的代码修改。AI模型Muse SparkMuse CodeMeta10 个信源在谈事件专题推荐理由:Meta 把 Muse Spark 1.2 放进 Agent Arena 让大家拿难题测它,还出了个终端编码代理 Muse Code,能干多文件改代码的活,可以去试试。原文稍后读已读值得跟进有用关注 Muse Spark
05:49OpenRouter@OpenRouterAI精选73°Meta的Muse Spark 1.2已上线OpenRouter,同时两款Muse Spark模型都扩大了全球访问范围。该模型输入每百万tokens定价1.25美元,输出每百万tokens定价4.25美元。OpenRouter称其为平台上价格效率最高且智能水平靠前的模型之一。AI模型Muse SparkOpenRouterMeta推荐理由:Meta把Muse Spark 1.2放到OpenRouter上了,每百万输入只要1.25美元,想试性价比高的模型可以看看。原文稍后读已读值得跟进有用关注 Muse Spark
05:48OpenRouter@OpenRouterAIMuse Spark 1.2已在OpenRouter平台上线。此次更新将全球访问范围扩展至所有Muse Spark模型。用户可直接通过OpenRouter调用这些模型。AI模型Muse SparkOpenRouter模型发布推荐理由:Muse Spark 1.2上架OpenRouter了,所有Muse Spark模型都能全球访问,想用直接去平台调就行。原文稍后读已读值得跟进有用关注 Muse Spark
05:47OpenRouter@OpenRouterAIMuse Spark 1.2 发布,面向编码智能体最常见的任务做了针对性优化。该版本重点提升多文件重构的完成质量,也改善长时间调试会话中的上下文保持。新版还支持需要跨越单次提示的连续工作流。AI模型Muse SparkOpenRouter编程助手推荐理由:Muse Spark 1.2更新了,专门优化多文件重构和长调试,代码智能体用起来更顺。原文稍后读已读值得跟进有用关注 Muse Spark
03:50官方账号Meta AI@AIatMeta精选Meta推出了终端编码智能体Muse Code的测试版本,底层使用Muse Spark 1.2模型。它面向长周期软件工程任务,能在终端中规划、实现并验证复杂的跨多文件修改。借助持久运行的子智能体,Muse Code可以在大型代码库中更快、更准地解决问题,并且减少人工干预。AI产品Muse CodeMuse SparkMeta10 个信源在谈事件专题推荐理由:Meta整了个终端编程智能体,基于Muse Spark 1.2,能自己处理大型仓库的多文件改动,省心不少。原文稍后读已读值得跟进有用关注 Muse Code
03:49官方账号Meta AI@AIatMetaMeta 今日发布 Muse Spark 1.2,该版本已在 Muse Code 和 Meta Model API 中上线。官方同步扩大了全球访问范围,并预告了多项即将到来的新功能。用户可通过 go.meta.me/musecode 获取更多信息。AI模型Muse SparkMuse CodeMeta Model API10 个信源在谈事件专题推荐理由:Meta 把 Muse Spark 1.2 放进了 Muse Code 和模型 API,全球更多地方能用了,入口在 go.meta.me/musecode,想尝鲜可以去看看。原文稍后读已读值得跟进有用关注 Muse Spark
18:03IT之家(博客/媒体)Meta股价周三大跌10%,因财报显示资本支出增速远超营收。目前公司98%营收仍来自传统广告,AI投资尚未带来实际财务回报。分析师Minda Smiley称其AI项目像是在盲目尝试。公司回应称已有900万小企业使用AI图像编辑工具,Meta AI助手用户量日增60%。行业MetaMuse SparkAI投资推荐理由:Meta砸大钱搞AI但还没赚到钱,投资者不买账股价大跌,分析师说像在瞎试。原文稍后读已读值得跟进有用关注 Meta
00:29lmarena.ai@lmarena_ai82°Meta 发布的 Muse Spark 1.1 在 Document Arena 排名第 11(此前第 21),帕累托前沿得分 1472;在 Vision Arena 排名第 14;中文语言类别排名第 3。在 Code Arena: Frontend 排名第 9,帕累托前沿得分 1541,成本为混合每百万 token 输入 1.25 美元、输出 4.25 美元。该模型以低价格实现前沿性能。AI模型Muse SparkMeta成本效率推荐理由:Meta 发了 Muse Spark 1.1,在文档、视觉、代码三大领域成绩都不错,关键价格低,适合预算有限又想用前沿模型的团队。原文稍后读已读值得跟进有用关注 Muse Spark
00:09OpenRouter@OpenRouterAIOpenRouter汇总了本周发布的9款新模型。其中包括Kimi K3、Muse Spark、Thinking Machines Inkling。这些模型可通过OpenRouter平台直接体验。AI模型OpenRouterKimi K3Muse Spark10 个信源在谈事件专题推荐理由:OpenRouter汇总了本周9个新模型,有Kimi K3、Muse Spark等,想尝鲜可以看看。原文稍后读已读值得跟进有用关注 OpenRouter
00:09lmarena.ai@lmarena_ai精选73°Arena 新增“事实性”排名信号,基于人类偏好与事实性的加权组合重新排列模型。该团队标注了超过 200 万条来自真实对话的 LLM 声明(Text Arena 130 万+,Search Arena 70 万+),通过验证声明正确性比较模型。开启事实性后,Claude Fable 5 下降至第 2,GPT-5.5 上升 13 位至第 7,Muse Spark 下降 13 位至第 20。Meta 整体从第 2 跌至第 5,Anthropic 仍居第 1;开源模型中,Xiaomi 从第 9 跃至第 6。AI模型ArenafactualityClaude Fable 510 个信源在谈事件专题推荐理由:Arena 现在能看模型在事实准确性上的表现,Claude 和 GPT-5.5 排名变化挺有意思,想挑更靠谱的模型可以看看。原文稍后读已读值得跟进有用关注 Arena
02:50OpenRouter@OpenRouterAIMuse Spark 1.1 现已通过 OpenRouter 平台面向开发者开放。该版本当前仅限美国地区开发者使用。开发者可在 OpenRouter 上直接调用 Muse Spark 1.1 模型。AI模型Muse SparkMuse Spark 1.1OpenRouter推荐理由:Meta 的 Muse Spark 1.1 刚上架 OpenRouter,美国开发者快去试试。原文稍后读已读值得跟进有用关注 Muse Spark
01:49官方账号Meta AI@AIatMetaMeta 宣布推出 Muse Spark 1.1 版本,现已在 OpenRouter 平台上对美国开发者开放。该模型是 Meta 的 AI 生成模型,1.1 版本可能带来性能改进。开发者可借助 OpenRouter 平台访问该模型进行实验和开发。具体更新细节尚未公布,但社区期待其能力提升。AI模型Muse SparkMetaOpenRouter推荐理由:Meta 的 Muse Spark 1.1 上线了,在 OpenRouter 上美国开发者可以直接用,感兴趣可以试试新版本有哪些变化。原文稍后读已读值得跟进有用关注 Muse Spark
21:19elvis@omarsar0Sriram Krishnan指出开源模型正迎来爆发期,@thinkymachines 的Inkling模型今天发布,证明可以接近SOTA性能且有清晰训练路线。多个团队如Grok/Cursor、Muse Spark也在推出开放权重模型,在编程和智能体领域形成多元化生态。组织因数据控制需求而愿意牺牲部分前沿模型访问权,同时担忧前沿实验室未来竞争。5个因素包括:开源可定制、企业从鼓励Token使用转向成本控制、地缘政治推动国家采用开放权重模型。行业Sriram KrishnanInklingMuse Spark10 个信源在谈事件专题推荐理由:Sriram Krishnan分析了开源模型为什么越来越火,提到Inkling、Muse Spark等新模型,解释了组织选择开源的真实原因。原文稍后读已读值得跟进有用关注 Sriram Krishnan
15:43Marc Andreessen@pmarca精选Sriram Krishnan指出开源模型和工具链正处于高光时刻,原因是多方面的。例如,Thinkymachines的Inkling今天发布,表明开源可以接近SOTA性能并有清晰训练路线。此外,Grok/Cursor、Muse Spark等接近SOTA的模型涌现,形成一个多样化的模型生态。组织为控制数据使用和成本,愿意放弃部分前沿token访问。地缘政治上,各国希望通过开源模型在可控环境中获取前沿token。行业开源模型InklingGrok/Cursor10 个信源在谈事件专题推荐理由:Sriram Krishnan梳理了开源模型突然火爆的六个原因,比如你可以用开源模型做到接近SOTA,还能控制数据。想了解为什么越来越多公司和组织选择开源?看这个。原文稍后读已读值得跟进有用关注 开源模型
00:43lmarena.ai@lmarena_ai精选Arena 推出基于人类偏好和事实性加权组合的新排名。系统随机抽取对战并提取网络可验证声明,已标注超 200 万条声明(Text Arena 130 万+,Search Arena 70 万+)。启用事实性后,Claude Fable 5 降至第 2,GPT-5.5 跃升 13 位至第 7,Muse Spark 跌 13 位至第 20。Meta 整体排名从第 2 跌至第 5,Anthropic 仍居榜首,开源模型中 Xiaomi 从第 9 升至第 6。AI模型Arena事实性Claude Fable 510 个信源在谈事件专题推荐理由:以后看模型排名不只凭喜好,还能按事实准确性排序。GPT-5.5 狂飙 13 名,Claude 也被挤到第二,快去 Arena 开开关看看。原文稍后读已读值得跟进有用关注 Arena