18:10elvis@omarsar0Grok 4.6正式发布,官方称其具备前沿智能。相比Grok 4.5,性能显著提升,但价格维持不变。原推文对Grok 4.6能否媲美Fable 5的质量表示不确定。目前官方未公布具体基准测试数据。AI模型Grok 4.6Grok 4.5SpaceXAI推荐理由:哎,Grok 4.6出来了,说比4.5强不少,价格没变。到底能不能打Fable 5还不清楚,先观望下。原文稍后读已读值得跟进有用关注 Grok 4.6
18:10向阳乔木@vista8腾讯旗下有混元和WeLM两个大语言模型。WeLM由微信团队构建,是一个大语言模型家族。该模型以资源效率为核心设计目标。腾讯官方在X平台通过微信账号介绍了WeLM。AI模型腾讯微信WeLM推荐理由:微信团队自己做了个WeLM大模型,主打资源效率,跟混元是腾讯的两个大模型,来了解下吧。原文稍后读已读值得跟进有用关注 腾讯
18:10Mustafa Suleyman@mustafasuleyman微软AI负责人Mustafa Suleyman在X上发布推文,公开了MAI Thinking的试用链接aka.ms/mai-thinking-1。该推文目前获得2条回复、1次转发和12个赞,但已有2395次查看。从命名看,MAI Thinking可能是微软面向推理场景推出的模型。用户可直接通过链接体验,无需等待排队。具体能力和基准成绩尚未公布。AI模型MAI ThinkingMicrosoftMustafa Suleyman推荐理由:微软AI老大亲自甩了个体验链接,MAI Thinking听着像推理模型,想抢先试的直接点。原文稍后读已读值得跟进有用关注 MAI Thinking
18:10The Rundown AI@therundownaiSpaceXAI发布了Grok 4.6。该模型在智能、编码和智能体任务等基准上接近或达到Fable和5.6-Sol的水平。定价明显低于同类前沿模型。AI模型Grok 4.6SpaceXAIFable推荐理由:Grok 4.6跑分追上Fable和5.6-Sol,价格还便宜不少,可以关注下。原文稍后读已读值得跟进有用关注 Grok 4.6
18:10Fireworks AI@FireworksAI_HQ精选Qwen3.8-2.4T-A95B 已在 Fireworks 平台上线,提供 Day-0 支持。该模型采用 2.4T 参数 MoE 架构,专为自主智能体、重度编码和大上下文窗口设计。Fireworks 表示它适合编码和智能体任务,开发者现在即可开始使用。AI模型Qwen3.8-2.4T-A95BFireworks智能体推荐理由:Fireworks 上线了 Qwen3.8-2.4T-A95B,2.4T 参数 MoE,主打智能体和写代码,有 Day-0 支持,直接就能用。原文稍后读已读值得跟进有用关注 Qwen3.8-2.4T-A95B
18:10向阳乔木@vista8DeepSeek V4 Pro在未开启思考模式下,按提示词“鹈鹕骑自行车svg,撞上大象,循环播放”生成动画。测试动画中鹈鹕骑自行车撞上大象并循环播放,说明模型能理解多物体交互和循环指令。该模型名为DeepSeek-V4-Pro-0813,百万tokens输入(缓存未命中)定价3元,输出定价6元,均高于DeepSeek Flash的1元和2元。其并发限制为500,低于DeepSeek Flash的2500。AI模型DeepSeekDeepSeek V4 Pro视频生成10 个信源在谈事件专题推荐理由:DeepSeek V4 Pro不开思考模式就能按提示词生成鹈鹕撞大象的SVG动画,效果挺逗,价格和限流也都摸清了,来看看。原文稍后读已读值得跟进有用关注 DeepSeek
18:09Sualeh Asif@sualehasif996SpaceXAI 发布 Grok 4.6,定位前沿智能水平的日常驱动模型。官方称其相较 Grok 4.5 有显著进步,且保持相同定价。目前未公布具体基准成绩,但强调这是值得日常使用的升级版本。AI模型GrokSpaceXAI推理模型推荐理由:Grok 4.6 来了,官方说比 4.5 强不少还同价,日常用着应该更顺手。原文稍后读已读值得跟进有用关注 Grok
18:09官方一手歸藏(guizang.ai)@op7418DeepSeek V4 Pro 正式版 0813 发布。从流传的测试成绩来看,0813 的性能表现相当突出。目前官方尚未公布 0813 的完整基准数据。AI模型DeepSeekDeepSeek V4 Pro模型发布10 个信源在谈事件专题推荐理由:DeepSeek V4 Pro 0813 正式版来了,听说测试成绩很炸,想蹲实测的可以先围观。原文稍后读已读值得跟进有用关注 DeepSeek
18:09Windsurf@windsurf_ai精选Cognition 宣布 Grok 4.6 登陆 Devin Desktop 和 Devin CLI。相比 Grok 4.5 提升明显,性能超过 GPT-5.6 Sol。目前表现仅次于 Opus 5 和 Fable 5。AI模型Grok 4.6DevinGPT-5.6 Sol推荐理由:Grok 4.6 已经能在 Devin 里用了,Desktop 和 CLI 都支持,比 GPT-5.6 Sol 强,仅次于 Opus 5 和 Fable 5,想尝鲜的赶紧试试。原文稍后读已读值得跟进有用关注 Grok 4.6
18:08官方账号Cohere@cohere精选Cohere 今日推出 North Micro Vision,这是其最小的视觉语言模型,专为复杂文档理解设计。该模型以 Apache 2.0 许可证开源,权重已上传至 Hugging Face。相比 Cohere 其他模型,North Micro Vision 更轻量,适合在资源受限场景下处理视觉任务。开发者可直接从 Hugging Face 下载权重进行部署。AI模型CohereNorth Micro Vision视觉语言模型推荐理由:Cohere 出了个超小的视觉模型 North Micro Vision,专门用来读懂复杂文档,而且开源了,直接去 Hugging Face 就能下载权重。原文稍后读已读值得跟进有用关注 Cohere
18:07官方账号xAI@xai75°Grok 4.6 今日上线,已同步开放至 Grok Build、Cursor、Grok Bot 和 API。用户在 Cursor 与 Grok Build 中可在首周享受 2 倍用量。官方公告详见 x.ai/news/grok-4-6。AI模型Grok 4.6CursorGrok Build10 个信源在谈事件专题推荐理由:官方发布了 Grok 4.6,Cursor 和 Grok Build 里首周用量翻倍,想尝鲜的赶紧去试试。原文稍后读已读值得跟进有用关注 Grok 4.6
18:06官方账号NVIDIA AI@NVIDIAAI精选71°Harvey联合Trajectory Labs对NVIDIA的Nemotron 3.5 Lightning进行后训练,在Legal Agent Bench上得分从0%升至8.3%。该成绩超过了Opus 4.6和更大的后训练版Nemotron 3 Ultra。后训练覆盖九个执业领域,未出现能力退化。平均输出长度从90k tokens降至37k tokens,每token奖励提升2.4倍。AI模型Nemotron 3.5 LightningNVIDIAHarvey10 个信源在谈事件专题推荐理由:Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
18:05小互@imxiaohuLightricks发布开源视频模型LTX-2.5。生成10秒视频只需6.8秒。支持文本、图片、视频三种输入。画面和声音在同一模型中联合生成。支持原生多镜头,跨镜头保持人物、场景和声音一致。年营收1000万美元以下可免费商用。AI模型LTX-2.5Lightricks视频生成推荐理由:Lightricks把LTX-2.5开源了,6.8秒就能出10秒带声视频,还支持多镜头,小团队免费商用,赶紧试试。原文稍后读已读值得跟进有用关注 LTX-2.5
18:05Cognition@cognition_labsGrok 4.6 现已集成到 Devin 中。相比 Grok 4.5,它在多项基准上表现更好。成绩超过 GPT-5.6 Sol,排名仅次于 Opus 5 和 Fable 5。AI模型GrokDevinGPT-5.6推荐理由:Grok 4.6 上 Devin 了,跑分超过 GPT-5.6 Sol,只差 Opus 5 和 Fable 5,想试试的可以关注。原文稍后读已读值得跟进有用关注 Grok
18:04官方账号NVIDIA AI@NVIDIAAI精选NVIDIA Nemotron 3.5 Lightning 已在 Together AI 平台上线。该模型被定位为同类中速度最快的开源模型。它专为常驻型智能体设计,能快速完成高吞吐量的专业工作。AI模型NVIDIANemotron 3.5 LightningTogether AI10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 开源模型上线 Together AI,跑得最快,适合需要高强度处理任务的智能体。原文稍后读已读值得跟进有用关注 NVIDIA
18:04官方账号NVIDIA AI@NVIDIAAI精选Reasonable 团队用 4B token 的合成 Verus 数据微调了 NVIDIA 最新开源模型 Nemotron 3.5 Lightning(30B)。微调后的模型在单次尝试通过率上超越了一个规模约 50 倍于它的模型,pass@3 则几乎持平。它的 token 生成速度也快于测试过的所有同尺寸开源模型。配套博客还分析了各模型在形式化证明中的失败方式、作弊行为,以及微调带来的影响。AI模型NemotronNVIDIAVerus10 个信源在谈事件专题推荐理由:Reasonable微调了NVIDIA的30B开源模型,形式化证明通过率胜过50倍大的模型,生成还更快。博客还拆解了模型怎么作弊。原文稍后读已读值得跟进有用关注 Nemotron
18:04Poe@poe_platformGrok 4.6 已在 Poe 平台正式上线。该模型拥有 500K token 的上下文窗口。它专为长时间运行的智能体、编程和知识工作设计。用户可通过 poe.com/Grok-4.6 直接试用。AI模型Grok 4.6Poe智能体推荐理由:Grok 4.6 上架 Poe 了,上下文窗口有 500K,跑长任务智能体和写代码都合适,想试直接去 Poe 点开就能用。原文稍后读已读值得跟进有用关注 Grok 4.6
18:04官方账号NVIDIA AI@NVIDIAAIFastino Labs与NVIDIA合作发布两款开源模型Fastino-Nemotron-3.5-Lightning-Finance和Fastino-Nemotron-3.5-Lightning-Healthcare,均基于Nemotron 3.5 Lightning微调。金融模型在FinQA基准上执行准确率从15.86%提升至59.23%,增幅43.37个百分点;在BizFinBench上从49.65%升至57.46%。医疗模型在HealthAdminBench上从25.67%升至29.95%,在MedCalc-Bench上从49.09%升至54.18%。两款模型均以Apache 2.0许可发布在Hugging Face上。同时,Fastino还发布了自动微调工具Fastino Fine-Tuning Agent的私人预览版。AI模型FastinoNVIDIANemotron 3.510 个信源在谈事件专题推荐理由:Fastino跟NVIDIA合作,用自动微调Agent搞出了金融和医疗两个开源模型,FinQA涨了43个点,Apache 2.0随便用。原文稍后读已读值得跟进有用关注 Fastino
18:03官方账号Runway ML@runwaymlRunway 宣布 Grok Imagine Image 2.0 上线其平台。该模型是 Runway 当前提供的最新图像生成模型,与平台上其他图像和视频模型并列。用户现在即可通过 Runway 官方链接试用 Grok Imagine Image 2.0。AI模型Grok Imagine Image 2.0Runway图像生成推荐理由:Grok Imagine Image 2.0 现在能在 Runway 直接用了,和顶级图像视频模型放一块,试图像生成又多了个选择。原文稍后读已读值得跟进有用关注 Grok Imagine Image 2.0
18:02官方账号NVIDIA AI@NVIDIAAI72°NVIDIA今日推出Nemotron 3.5 Lightning模型,并已上线Tinker平台。该模型仅激活3B参数,针对吞吐速度进行优化。它面向对延迟和成本敏感的应用场景,适合高频实时推理任务。用户可在Tinker上直接体验该模型。AI模型NemotronNVIDIATinker10 个信源在谈事件专题推荐理由:NVIDIA出了个轻量级新模型,3B参数跑得快又便宜,延迟敏感场景用得上,Tinker上现在就能玩。原文稍后读已读值得跟进有用关注 Nemotron
18:02Genspark@genspark_ai71°Grok 4.6已在Genspark平台上线,用户可在AI Chat、Code Agent和Genspark Claw中直接选用。该模型由xAI推出,专为长时间运行的智能体和编码任务设计。相比Grok 4.5,Grok 4.6在保持相同定价的同时实现了显著性能提升,属于前沿智能水平。用户只需在模型选择器中切换即可使用。AI模型Grok 4.6GensparkxAI1 个信源在谈事件专题推荐理由:Genspark上线了xAI的新模型Grok 4.6,专为长任务智能体和写代码优化,价格不变但比4.5强不少,做Agent开发可以试试。原文稍后读已读值得跟进有用关注 Grok 4.6
18:00shao__meng@shao__meng81°Grok 4.6 已通过 Grok Build、Cursor、Grok Bot 和 API 开放。官方对比 Grok 4.5 High、GPT-5.6 Sol Max、Fable 5 Max,Artificial Analysis 综合指数 61,与 GPT-5.6 Sol Max 持平,距 Fable 5 Max 的 62 差 1 分。长程 Agent 任务提升明显:DeepSWE 从 54% 升至 65.9%,APEX-Agents 从 47.1% 升至 57.5%,Terminal-Bench 从 15.7% 升至 26%。上下文窗口 50 万 token,支持文本与图像输入、文本输出,函数调用和结构化输出。相对 4.5 的 10 项评测全升,但 APEX-SWE 仅增加 2.8 个百分点,编码能力提升不均。AI模型Grok 4.6GrokCursor10 个信源在谈事件专题推荐理由:Grok 4.6 上线,长程 Agent 强化,指数追平 GPT-5.6 Sol Max,试试?原文稍后读已读值得跟进有用关注 Grok 4.6
17:59AI Will@FinanceYF572°xAI 发布 Grok 4.6,已上线 Cursor、Grok Build、API、OpenRouter、Vercel 和 Cloudflare 六个平台。普通版价格维持不变,Fast 版本价格翻倍。Cursor 与 Grok Build 首周提供 2 倍包含用量,现已开放试用。AI模型Grok 4.6CursorOpenRouter10 个信源在谈事件专题推荐理由:Grok 4.6 一口气上了 Cursor 和 API 等多个平台,普通版没涨价,Fast 版翻倍,首周还有双倍用量可薅。原文稍后读已读值得跟进有用关注 Grok 4.6
17:57shao__meng@shao__mengDeepSeek 静默发布新模型 V4-Pro-0813,官方 X 账号未官宣。Cline 团队实测其在 Terminal-Bench 2.1 上得分 87.9,仅比 Claude Fable 5 低 0.1 分。该模型价格约为 Fable 5 的 1/57,参数规模 1.6T,激活参数 49B,上下文窗口 1M。模型已上线 ClinePass,Cline 称其为当前市场性价比最高的模型。AI模型DeepSeek-V4-Pro-0813Claude Fable 5Terminal-Bench1 个信源在谈事件专题推荐理由:DeepSeek 新模型跑分只比 Claude Fable 5 低 0.1,价格却便宜 57 倍,Cline 用户现在就能用,高性价比首选。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Pro-0813
17:55Geek@geekbb博主geekbb在X上表示,日常使用中已无法区分DeepSeek-V4-Pro-0813和DeepSeek-V4-Flash-0731的表现。他翻看了X上其他用户的评价,认为Pro相比Flash没有明显优势。他还提到,Pro-0813缺少Flash-0731刚发布时的惊艳感。AI模型DeepSeekDeepSeek-V4-Pro-0813DeepSeek-V4-Flash-073110 个信源在谈事件专题推荐理由:有博主说DeepSeek新Pro和Flash用起来没啥差别,还嫌Pro没惊喜,可以看看社区咋说。原文稍后读已读值得跟进有用关注 DeepSeek
17:55官方账号NVIDIA AI@NVIDIAAI72°英伟达宣布推出开源权重模型 Nemotron 3.5 Lightning。Deep Cogito 表示该模型继续推动开放模型生态,并宣布加入英伟达后训练合作伙伴生态。此次合作聚焦开源权重与可定制模型,旨在让前沿智能更易获取。AI模型Nemotron 3.5 LightningNVIDIADeepCogito10 个信源在谈事件专题推荐理由:英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:55官方账号NVIDIA AI@NVIDIAAIUniphore实测NVIDIA Nemotron 3.5 Lightning在企业级智能体工作负载中的表现。与参数规模相近的Gemma 4 31B IT相比,Nemotron 3.5 Lightning吞吐量提升5倍,准确率也有明显增长。Uniphore已将其纳入Business AI Cloud高流量路径的评估范围。AI模型Nemotron 3.5 LightningNVIDIAGemma 410 个信源在谈事件专题推荐理由:NVIDIA新模型在企业任务上直接碾压Gemma 4,吞吐量翻5倍,跑真实负载的数据很硬核。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:54AI Will@FinanceYF575°Grok 4.6正式发布,延续4.5的定价策略。新版本在Agent能力和编程任务上有所提升,并能更长时间处理复杂任务。在AA Intelligence Index基准上,Grok 4.6得分追平GPT-5.6 Sol。API价格为每百万输入Token 2美元,输出Token 6美元。AI模型GrokGPT-5.6 Sol智能体推荐理由:Grok 4.6发布,价格不变,Agent和编程更强,AA Intelligence Index追平GPT-5.6 Sol,API输入2美元/百万Token。原文稍后读已读值得跟进有用关注 Grok
17:54官方账号Cohere@cohere精选Cohere 宣布其视觉模型 North Micro Vision 已集成至开源微调框架 Axolotl。用户无需自备 GPU 或服务器,即可直接开始训练该模型。Axolotl 官方文档已提供 Cohere 模型的配置说明,地址为 docs.axolotl.ai。这降低了视觉模型微调的门槛。AI模型North Micro VisionAxolotlCohere推荐理由:想微调 Cohere 的视觉模型 North Micro Vision?现在用 Axolotl 就能跑,不用自己买显卡,直接上手试试吧。原文稍后读已读值得跟进有用关注 North Micro Vision
17:53官方账号NVIDIA AI@NVIDIAAI精选Trajectory 获得 NVIDIA Nemotron 3.5 Lightning 早期访问权,在 Harvey LAB 上完成后训练。该后训练在 Trajectory 平台一键完成,无需新工程。模型在一项测试中从 0% 提升到 8.3%,超过 Opus 4.6 的 6.6%。Trajectory 强调持续学习让小型模型可每晚、按客户反复训练,逼近按量计费的智能。AI模型NemotronNVIDIATrajectory10 个信源在谈事件专题推荐理由:Trajectory 一键后训练 Nemotron 3.5 Lightning,测试冲到 8.3% 超 Opus 4.6,小模型按客户定制能落地。原文稍后读已读值得跟进有用关注 Nemotron
17:53lmarena.ai@lmarena_aiArena AutoEval利用数千万条真实人类对战数据训练奖励模型,能在数小时内完成新模型评估,而传统流程通常需要数周。该方法通过人类提示和模型响应进行评分,保持实时基准特性,不同于LLM-as-judge方式。Arena ML工程师Haoran Guo和Wayne Zhang在视频中讲解了其方法论与应用场景。AI模型Arena AutoEval模型评估奖励模型推荐理由:LMArena出了个AutoEval,拿历史对战数据训练奖励模型,几小时就能出评估结果,比之前快多了,搞模型的可以看看。原文稍后读已读值得跟进有用关注 Arena AutoEval
17:52lmarena.ai@lmarena_aiCode Arena 在 X 平台公布了 WebDev 排行榜的完整链接。榜单页面位于 arena.ai/leaderboard,用户可查看各模型在网页开发任务上的表现。推文目前获得 6 次点赞和 1358 次浏览。该排行榜为开发者选择适合的编码模型提供了参考。AI模型Code ArenaWebDev排行榜推荐理由:Code Arena 开了个 WebDev 榜,想看看哪个模型写网页更行,直接点链接看排名就行。原文稍后读已读值得跟进有用关注 Code Arena
17:52lmarena.ai@lmarena_ai精选DeepSeek-V4-Pro (Max)在LMArena Code Arena WebDev榜单以1607分暂列第8,开源模型中排名第2。其分数低于Kimi K3 (Max)的1674分,也低于GPT-5.6 Sol (xHigh)的1622分。该成绩来自AutoEval早期评分,由奖励模型基于人类偏好自动投票产生,并非真人实时投票。后续真人投票加入后,最终排名可能变化。AI模型DeepSeek-V4-ProCode ArenaKimi K310 个信源在谈事件专题推荐理由:DeepSeek新模型V4-Pro专攻代码生成,在Code Arena排第8,开源第2,仅次于Kimi K3,还超过了GPT-5.6 Sol。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Pro
17:52小互@imxiaohuxAI 发布 Grok 4.6,性能追平 GPT-5.6 Sol。该版本附带有提示词和使用指南,文章链接指向 best.xiaohu.ai。推文数据显示有 1232 次浏览、3 条回复和 2 个喜欢。AI模型GrokxAIGPT-5.6 Sol推荐理由:xAI 出了 Grok 4.6,据说追平 GPT-5.6 Sol,还附提示词和使用指南,想试试新模型的可以看。原文稍后读已读值得跟进有用关注 Grok
17:51lmarena.ai@lmarena_ai81°LMArena分析了数万条Claude Opus和Fable从4.5到5版本的真实高推理输出。Opus 5平均每响应510个词,是Opus 4.5平均158个词的3倍多。句子长度上升58%,从句频率上升46%,但长实词占比从46.9%降至40.1%,抽象名词每千词从6.02个降至3.79个。Opus 5的破折号使用量是4.5的2.3倍,'honestly'等诚实类措辞增加50%。Fable 5平均316个词,比Opus 5短38%,但包含赞扬或'yes, exactly'式开头的概率接近2倍。AI模型ClaudeOpusFable推荐理由:Claude Opus 5和Opus 4.5差多少?LMArena用数据告诉你:回复长度是4.5的3倍,词汇反而更简单,破折号也更多。原文稍后读已读值得跟进有用关注 Claude
17:51andrew chen@andrewchenAndrew Chen 在 X 上分享 Deepseek v4 flash 0731 在双 DGX Spark 上的本地运行体验。他表示生成速度约为 50 tok/s,首字延迟(TTFT)很低。他认为这是目前最适合 prosumer 级用户的本地 AI 配置。AI模型Deepseek v4 flash 0731DGX Spark本地部署1 个信源在谈事件专题推荐理由:Andrew Chen 说这套是目前最强家用本地 AI 配置:双 DGX Spark 跑 Deepseek v4 flash 0731 约 50 tok/s。原文稍后读已读值得跟进有用关注 Deepseek v4 flash 0731
17:51向阳乔木@vista8精选Deepseek V4 Pro 0813在网友vista8的测试中完成了三个任务。第一个任务调用3个Skill完成网站开发、子域名解析和上线。第二个任务模仿60种设计风格生成Bento卡片图。第三个任务用Three.js制作3D打砖块游戏。AI模型Deepseek V4 Pro 0813Three.js网站开发推荐理由:vista8用Deepseek V4 Pro 0813跑了三个活:网站部署、60种设计风格、3D游戏,视频挺直观。原文稍后读已读值得跟进有用关注 Deepseek V4 Pro 0813
17:50lmarena.ai@lmarena_aiDeepSeek-V4-Pro (Max)在Text Arena开源模型榜单中位列第五,AutoEval得分为1465。该分数与GLM-5.1的1467分、GPT-5.6 Terra (xHigh)的1464分以及Grok 4.6 (High)的1464分基本持平。该排名来自@deepseek_ai的官方发布,针对的是文本竞技场中的开源模型。AI模型DeepSeekDeepSeek-V4-ProText Arena10 个信源在谈事件专题推荐理由:DeepSeek新模型在Text Arena拿1465分,和GLM-5.1、GPT-5.6 Terra一个水平,开源阵营排第五。原文稍后读已读值得跟进有用关注 DeepSeek
17:48官方账号NVIDIA AI@NVIDIAAICodeRabbit与Baseten合作,用CodeRabbit自身的路由决策数据微调了NVIDIA Nemotron 3.5 Lightning。整个微调过程耗时不到3小时,花费低于100美元。微调后的模型相比此前的GPT级模型,准确率提升约4%,推理成本下降约50%。详细技术解析已发布在CodeRabbit官方博客。AI模型CodeRabbitNemotron 3.5 LightningBaseten10 个信源在谈事件专题推荐理由:CodeRabbit用不到100美元和三小时微调了NVIDIA新模型,比原来的GPT级模型准确率高4%,推理成本还省一半,想省钱的可以看看。原文稍后读已读值得跟进有用关注 CodeRabbit
17:47shao__meng@shao__meng76°马斯克在 X 上表示,Grok 4.7 将超过当前所有模型。他称 SpaceX 的训练语料独特,若存在真实工程能力更强的模型会感到惊讶。马斯克预计 Grok 4.7 将在一个月内发布。他还提到 Anthropic 是家很棒的公司,可能会很快发布更好的模型。AI模型GrokElon MuskSpaceX10 个信源在谈事件专题推荐理由:马斯克给 Grok 4.7 背书,说工程能力无敌,还夸了 Anthropic,一个月内就发布,到时候看有没有被打脸。原文稍后读已读值得跟进有用关注 Grok