20:13小互@imxiaohuDatabricks 在数百万行复杂代码库中进行实测,比较了不同模型搭配 Harness 框架的性价比和易用性。测试评估了多种组合在实际代码处理中的效率与稳定性,并给出了最佳搭配建议。结果显示某些模型与 Harness 的组合在成本控制和开发体验上表现突出。技巧DatabricksHarness编程助手推荐理由:Databricks 用真实的百万行代码库帮你试了一遍,哪个模型配哪个框架最省钱最好使,直接看结果选就行原文稍后读已读值得跟进有用关注 Databricks
18:51Dify@dify_ai精选Dify 推出 CLI 工具 difyctl,允许 AI 编码代理(如 Claude Code、Codex)直接从终端调用 Dify 工作流。代理负责决定何时触发流程,Dify 执行业务逻辑(结构化工作流、组织知识),并在需要时通过 Human Input 节点加入人工审批。用户无需在多个工具间切换,一个复杂流程简化为一次指令和一次审查。该工具已在 dify.ai 博客中提供完整教程。AI产品difyctlDify工作流推荐理由:Dify 把 CLI 和编码代理串起来了,终端里一句话就能跑公司流程,还能让人审一下,比纯写代码靠谱多了。原文稍后读已读值得跟进有用关注 difyctl
17:06Thomas Wolf@Thom_WolfPoolside AI 发布最新 agentic coding 模型 Laguna S 2.1。在 Terminal-Bench 2.1 上得分 70.2,与 5-25 倍大小的模型并列甚至领先。在 DeepSWE 基准上得分 40.4,超越部分超 1T 参数的开源模型。该模型可在单个 DGX Spark 或 Mac 上本地运行。AI模型LagunaPoolsideTerminal-Bench8 个信源在谈事件专题推荐理由:Poolside 又出了个厉害编码模型,Laguna S 2.1 在本地就能跑,多项基准比大它几十倍的模型还强。原文稍后读已读值得跟进有用关注 Laguna
16:46AI Will@FinanceYF5腾讯CodeBuddy月访问量在2025年1月接近零,3月达到峰值745万,6月稳定在731万。该产品是AI编程助手,定位于编程赛道。同期,智能体、视频生成等AI赛道也出现剧烈变化。AI产品CodeBuddy腾讯编程助手推荐理由:腾讯CodeBuddy半年从0冲到730万+月访问,编程赛道竞争激烈,还顺带看看Agent和视频赛道的变局。原文稍后读已读值得跟进有用关注 CodeBuddy
15:45AI Will@FinanceYF5精选通过将多个Claude Code项目的CLAUDE.md文件指向同一个vault,可以实现跨项目的知识共享。这个方法适用于写作、调研和编程等多种项目类型,一次读取即可随处使用。大约95%的用户会忽略这一步骤,但能显著提升效率。技巧Claude CodeCLAUDE.mdvault推荐理由:Claude Code有个隐藏技巧:所有项目共享同一个CLAUDE.md vault,读一次到处用,省事又高效。原文稍后读已读值得跟进有用关注 Claude Code
15:32@koltregaskes@koltregaskes一位用户在X平台表示,经过一段时间使用后,认为GPT-5.6是自GPT-4相比GPT-3.5以来最明显的性能跳跃。该模型更善于按照指令完成任务,执行力显著增强。用户同时指出主要问题在于Codex(编程界面)仍需大量改进。AI模型GPT-5.6GPT-4Codex10 个信源在谈事件专题推荐理由:有用户说GPT-5.6干活更利索比之前版本强一大截,但Codex还不够好,来看看他的体验。原文稍后读已读值得跟进有用关注 GPT-5.6
15:20官方一手歸藏(guizang.ai)@op7418CodePilot 最新更新支持通过 Super Grok(Twitter 账号)授权免费使用 Grok 4.5。Twitter Premium 用户可获得更高额度。同时平台推出新的千问 Token Plan,现可正常使用千问 3.8 Max Preview 模型。用户可通过“设置-服务商-添加服务-XAI Grok OAuth”路径添加 Grok 授权。AI产品CodePilotGrok 4.5千问3.8 Max Preview推荐理由:CodePilot 现在能免费连 Grok 4.5,还支持千问3.8,白嫖老马算力,写代码更爽。原文稍后读已读值得跟进有用关注 CodePilot
14:04官方一手歸藏(guizang.ai)@op741878°谷歌上线Gemini 3.6 Flash模型,相比3.5 Flash在编码、推理和工具调用上有所提升,在DeepSWE基准上输出token减少高达65%。同时推出速度更快的3.5 Flash-Light模型。谷歌宣布已开始训练Gemini 4,称规模为史上最大,目标对标GPT-5.6和Fable 5。目前模型迭代速度落后于一月一版的竞品。AI模型Gemini 3.6 FlashGoogleGemini 3.5 Flash10 个信源在谈事件专题推荐理由:谷歌出了Gemini 3.6 Flash,日常模型更强了,编码和推理升级,还省了最多65%的token。另外还有个更快的3.5 Flash-Light,Gemini 4也在训练了,可以关注。原文稍后读已读值得跟进有用关注 Gemini 3.6 Flash
12:47小互@imxiaohu73°Anthropic 更新了 Claude Code 桌面版,新增对 iOS 模拟器的原生支持,可直接对接苹果官方模拟器底座。模拟器画面内嵌在 Claude 软件旁,AI 在后台自动操作,不抢占用户屏幕。支持人机协作,用户可随时手动点按、滑屏或快捷键操作,操作实时同步。单个会话最多可同时开 4 个独立模拟器,并支持手势、快捷键(如 Cmd+Shift+H 回主界面)及画质调节(帧率、分辨率、编码格式)。AI产品Claude CodeiOS模拟器编程助手10 个信源在谈事件专题推荐理由:Claude Code 现在能帮你直接操控 iOS 模拟器跑测试,AI 自己干活还不占你屏幕,你还能随时上手介入,开发效率拉满。原文稍后读已读值得跟进有用关注 Claude Code
10:47IT之家(博客/媒体)Anthropic发布Mac桌面版Claude Code公测,内置集成iOS模拟器。开发者无需macOS辅助功能权限或屏幕录制授权,即可直接驱动模拟器构建、运行和交互iOS应用。模拟器设备截图会发送给Anthropic并按标准对话保留设置保存。Anthropic建议用户不要在Claude使用的设备上登录真实账户。AI产品Claude CodeAnthropiciOS模拟器10 个信源在谈事件专题推荐理由:Anthropic的Claude Code Mac版现在能直接驱动iOS模拟器了,不用折腾权限就能构建和测试App,公测免费,开发者快去试试。原文稍后读已读值得跟进有用关注 Claude Code
02:53官方账号NVIDIA AI@NVIDIAAICognition 公司的 AI 编程智能体 Devin 推出 Outposts 功能,现已集成到 NVIDIA Brev 平台。用户可以通过 Brev 编写和 profiling 内核、运行实验、部署和微调开源模型,并在真实硬件上测试。Outposts 支持将 Devin 运行在任何机器上,包括 Mac mini、实验室 GPU 盒、私有网络 VM 或 Kubernetes 集群。该集成降低了 Devin 的部署门槛,允许开发者在自己控制的基础设施上使用。AI产品DevinNVIDIA BrevCognition9 个信源在谈事件专题推荐理由:现在你可以把 Devin 跑在自己的 GPU 上了,NVIDIA Brev 直接集成了 Outposts,写代码调试都更方便。原文稍后读已读值得跟进有用关注 Devin
02:49OpenRouter@OpenRouterAIPoolsideAI 发布了开放权重的 Laguna S 2.1 模型,采用 118B-A8B 混合专家架构。该模型拥有 1M 上下文窗口,专门用于智能体编码和长时任务。在 Terminal-Bench 2.1 基准上得分 70.2%,在 DeepSWE 上得分 40.4%。模型现已通过 OpenRouter 平台提供使用。AI模型Laguna S 2.1PoolsideAIOpenRouter推荐理由:PoolsideAI 出的 Laguna S 2.1,118B MoE 带 1M 上下文,Terminal-Bench 上 70.2%,专搞编码智能体,想试试直接去 OpenRouter 用。原文稍后读已读值得跟进有用关注 Laguna S 2.1
02:22宝玉@dotey81°Google发布了Gemini 3.6 Flash、3.5 Flash Lite和3.5 Flash Cyber三款新模型。Gemini 3.6 Flash输出定价从每百万token $9降至$7.5,生成速度达304 tokens/s(前代165 tokens/s),在Artificial Analysis Index上平均少用17%输出token。OSWorld-Verified计算机使用能力从78.4%提升至83%,知识工作基准GDPval-AA得分从1349升至1421。3.5 Flash Lite定价$0.30/$2.50适合高吞吐场景,3.5 Flash Cyber专注网络安全。Gemini 3.5 Pro仍延迟发布,仅对部分合作伙伴开放。AI模型GeminiGemini 3.6 FlashGoogle10 个信源在谈事件专题推荐理由:Google新出的3.6 Flash更便宜更快还省token,Agent工作流速度翻倍,编程助手场景很合适,推荐试试。原文稍后读已读值得跟进有用关注 Gemini
02:14Cognition@cognition_labs精选72°Cognition宣布Devin Outposts可在NVIDIA Brev上部署。这一集成使Devin能够访问GPU基础设施,用于调试训练运行、检查GPU状态、重现故障,并在实际硬件上验证修复。部署入口位于brev.nvidia.com的launchable页面。该方案面向需要GPU调试的AI工程团队。技巧DevinNVIDIA BrevGPU3 个信源在谈事件专题推荐理由:Cognition把Devin Outposts搬上NVIDIA Brev,让Devin能直接动用GPU来定位训练bug、检查显存状态,不用自己搭环境。原文稍后读已读值得跟进有用关注 Devin
01:49Paul Couvert@itsPaulAi78°Google 推出 Gemini 3.6 Flash,这是一款基于开发者反馈优化的模型,具备更高智能和更低价格。它在前端任务中表现出色,速度极快且 token 效率高,能够创建简单的 3D 内容(如 Subway Surfers 复制品)。启用“extended thinking”模式可进一步提升编码效果。该模型已在 X 上由 Logan Kilpatrick 正式宣布。AI模型Gemini 3.6 FlashGoogle推理模型10 个信源在谈事件专题推荐理由:Google 刚发的 Gemini 3.6 Flash 速度快、token 省,还能搞点 3D 小玩意儿,价格也降了,做前端活很顺手。原文稍后读已读值得跟进有用关注 Gemini 3.6 Flash
01:30官方账号Google DeepMind@GoogleDeepMind72°Google DeepMind 发布 Gemini 3.6 Flash,该模型在生成生产级代码时速度更快且不易陷入循环。同时,它在多模态任务上表现出色,可分析图表、理解文档并起草报告。Gemini 3.6 Flash 已在 Gemini App 中逐步推送,开发者可通过 Antigravity、Google AI Studio 和 Android Studio 获取 API 访问。AI模型Gemini 3.6 FlashGoogle DeepMind代码生成10 个信源在谈事件专题推荐理由:Gemini 3.6 Flash 写代码不卡壳了,还能读图表写报告,开发者可以马上在 Android Studio 里试。原文稍后读已读值得跟进有用关注 Gemini 3.6 Flash
01:10官方一手GitHub Blog@Jacklyn Carroll本文介绍如何使用GitHub Copilot的Canvases功能将AI转化为交互式工作空间。Canvases支持可视化信息、探索工作流,帮助用户在复杂任务中直接操作。通过拖拽组件,开发者可以快速搭建数据处理界面。技巧GitHub CopilotCanvases编程助手推荐理由:GitHub Copilot的Canvases让AI变成能拖拽的工作区,可视化数据、梳理工作流,做复杂任务挺顺手。原文稍后读已读值得跟进有用关注 GitHub Copilot
01:06GitHub@github72°GoogleAI 的 Gemini 3.6 Flash 现已正式推出,正在 GitHub Copilot 中逐步上线。该模型专为 Web 和应用程序开发、编码以及代理任务设计。测试表明,在编码和代理工作流中,其任务完成率高于 Gemini 3.5 Flash,且 token 效率更优。用户可以在 GitHub Copilot 或 VS Code 中体验。AI模型Gemini 3.6 FlashGoogleAIGitHub Copilot10 个信源在谈事件专题推荐理由:Google 新模型 Gemini 3.6 Flash 正式上线,直接在 GitHub Copilot 里用。比上一代 3.5 Flash 任务完成率更高,token 更省,写代码和做智能体任务更高效。原文稍后读已读值得跟进有用关注 Gemini 3.6 Flash
01:04Ate-a-Pi@svpino一位开发者分享了利用 Claude Code 和 MCP 协议构建的自动化技能,称这是他用过最好的自动化平台。他运行着半打类似的自动化任务,每天自动执行。这些技能易于构建、维护和调度,可帮助减少重复工作。技巧Claude CodeMCP自动化推荐理由:教你用 Claude Code 加 MCP 搭自动化工作流,每天省半小时重复劳动。原文稍后读已读值得跟进有用关注 Claude Code
00:58Ate-a-Pi@svpino一位开发者在X上分享观点,指出当前编码工具让写代码变得前所未有地简单,但思考难题并未改变。真正的瓶颈是人的大脑,而不是AI模型。他提醒开发者不要被工具迷惑,要重视自身思考能力。技巧编程助手思考瓶颈推荐理由:这篇帖子点醒了很多人——工具再好,不会思考也没用。原文稍后读已读值得跟进有用关注 编程助手
23:48Milvus@milvusio精选Kimi K3拥有2.8T参数和1M token上下文窗口,支持原生的视觉理解,在编码智能体基准上得分很高。实际测试中,营销团队用K3一个下午就完成了活动登陆页原型。但token开销巨大:cache-hit输入0.30美元/MTok,cache-miss输入3.00美元/MTok,输出15.00美元/MTok。通过添加claude-context MCP工具,实现语义代码搜索,在保持同等检索质量下减少约40%的token消耗。技巧Kimi K3claude-context编程助手10 个信源在谈事件专题推荐理由:实测Kimi K3确实强,但烧token也快。作者分享了用claude-context省40% token的实操,适合搞智能体的团队参考。原文稍后读已读值得跟进有用关注 Kimi K3
23:41官方账号LangChain@LangChainAI精选LangChain 发布了一个 tracing 插件,能将每个 @cursor_ai 代理会话转换为 LangSmith 中的结构化 trace,包含模型运行、每个工具调用以及嵌套子代理工作。附件会被恢复并内联渲染。这是系列视频的第三个,之前有 Claude Code 和 Codex 的 trace,三者使用相同 schema,可在一个地方对比。AI产品LangSmithLangChainCursor8 个信源在谈事件专题推荐理由:想对比 Cursor、Claude Code、Codex 的代理行为?LangChain 出了个插件,把它们的 trace 统一到 LangSmith 里,方便你直接看模型和工具调用链。原文稍后读已读值得跟进有用关注 LangSmith
23:03官方账号阿里通义 Qwen@Alibaba_QwenQwen3.8-Max-Preview模型参数达2.4万亿,在Coding和Cowork基准上取得显著提升。该模型运行于Qoder的智能体核心,能自主执行长时间、端到端的任务。目前Qoder提供高达98%的折扣,价格从0.5x降至0.01x。AI模型Qwen3.8-Max-PreviewQoder编程助手推荐理由:Qwen出了个2.4万亿参数的新模型,在编码和协作能力上很强,而且现在Qoder上打98%折扣,做长周期任务你可以直接甩手不盯着。原文稍后读已读值得跟进有用关注 Qwen3.8-Max-Preview
22:09官方账号Simon Willison@simonw精选Anthropic 推出的 Claude Tag 允许通过 Slack 使用 Claude Code 自动处理代码提交。该工具目前为 Claude Code 团队完成了 65% 的产品工程 PR。在相关访谈中,讨论了 Claude Code、Claude Tag、Fable 等工具,以及编码代理安全、评估和工具设计。Anthropic 展示了他们如何内部使用自己的 AI 工具进行代码审查和合并。行业Claude CodeClaude TagAnthropic10 个信源在谈事件专题推荐理由:Anthropic 用 Claude Tag 搞定了六成五的产品 PR,效率炸裂,看看他们怎么用AI写代码的。原文稍后读已读值得跟进有用关注 Claude Code
22:06官方账号Simon Willison@simonwSimon Willison在aiDotEngineer大会采访了Claude Code团队的两名成员,访谈视频及注释转录现已发布。本次采访获得了12237次观看和12条评论。团队讨论了Claude Code从原型到发布的关键设计决策,包括如何平衡代码生成速度与准确性。这是了解Claude Code开发理念的第一手资料。AI产品Claude Code编程助手AI编程推荐理由:想听Claude Code团队自己讲怎么把编程助手做出来的?比看文档有意思多了。原文稍后读已读值得跟进有用关注 Claude Code
21:35AI Will@FinanceYF5天际资本创始人张倩复盘了编程助手与开发基础设施的分化。她分析了Agent赛道的产品市场匹配进展。她还探讨了AI视频格局的演变以及搜索赛道的结构性变化。她介绍了资本近半年的流向和新项目案例。她推荐了几个实测好用的AI工具。行业张倩天际资本编程助手推荐理由:张倩在硅谷一线看项目,这次分享了编程助手、Agent、AI视频和搜索赛道的新变化,还推荐了好用工具。原文稍后读已读值得跟进有用关注 张倩
21:33AI Will@FinanceYF5过去半年AI赛道格局快速变化,编程助手、Agent、视频生成、搜索等热门领域均出现新的领跑者。硅谷时间19点(北京时间明天10点),将与硅谷投资人张倩连麦复盘上半年趋势,探讨下半年的机会所在。对话将覆盖具体赛道变化和投资视角。行业硅谷投资人编程助手Agent推荐理由:听硅谷投资人张倩复盘半年AI格局变化,编程助手、Agent、视频、搜索都换了老大,想找下半年机会别错过。原文稍后读已读值得跟进有用关注 硅谷投资人
21:09官方账号Simon Willison’s Weblog(博客/媒体)Anthropic的Claude Code团队在AI Engineer World's Fair上分享了开发经验。Claude Tag协作工具已完成65%的产品工程PR。Fable 5模型已不再适合通过添加示例来优化系统提示。Claude Code系统提示规模减少了80%。团队内部公开协作文化是其成功关键。AI产品Claude CodeFableAnthropic10 个信源在谈事件专题推荐理由:Anthropic工程师分享Claude Code和Fable的开发经验,告诉你他们如何使用自己的工具。原文稍后读已读值得跟进有用关注 Claude Code
16:10AI Will@FinanceYF5Kimi-K3在Arena AI前端代码竞技场获得1679分,超过Claude Fable 5的1631分。这是中国模型首次在该竞技场超越美国模型。上一次中国模型逼近该位置是2025年初的DeepSeek-R1。该结果由中国AI公司月之暗面推出。AI模型Kimi-K3Claude Fable 5Arena AI10 个信源在谈事件专题推荐理由:Kimi-K3在代码竞技场拿了1679分,比Claude Fable 5高48分,中国模型第一次赢美国模型,可以看看。原文稍后读已读值得跟进有用关注 Kimi-K3
12:45Sahil Lavingia@shlSahil Lavingia 表示其公司中 AI 编程助手 Devin 已承担 41% 的 Pull Request 编写工作。人类开发者负责决定构建内容并审查所有合并请求,但 AI 应尽可能多地编写代码。Lavingia 预计到明年底 Devin 将负责 80% 的 PR。AI产品DevinSahil Lavingia编程助手推荐理由:Sahil Lavingia 分享了他公司用 Devin 写代码的真实数据:41% 的 PR 由 AI 完成,明年还要翻倍。AI 编码已经不是概念了。原文稍后读已读值得跟进有用关注 Devin
06:12宝玉@dotey精选Claude Code 新增屏幕阅读器模式,替换终端为纯文本输出,支持 VoiceOver 和 NVDA 等辅助工具。启用后界面变为逐行文本,并带有 you:、claude:、tool: 等明确标签;菜单改为编号选择,确认用 y/n 输入。开启方式包括命令行参数 --ax-screen-reader、环境变量 CLAUDE_AX_SCREEN_READER=1 或配置文件设置。需要版本 v2.1.181 或更高。该更新还包含色盲友好主题 dark-daltonized 和 light-daltonized。AI产品Claude Code屏幕阅读器模式无障碍推荐理由:Claude Code 新加屏幕阅读模式,视障开发者也能用 VoiceOver、NVDA 顺畅编程了。原文稍后读已读值得跟进有用关注 Claude Code
05:09elvis@omarsar0精选Cursor团队使用多个AI代理从835页手册重建SQLite的Rust版本,通过100%测试集。成本因模型组合不同而相差15倍。实践建议:用前沿模型做分解和架构设计,用便宜模型执行具体实现。注意代理协调中的偏差和失败。技巧CursorSQLiteRust6 个信源在谈事件专题推荐理由:Cursor团队实战分享:如何搭配不同模型,用最小成本完成高难度编程任务,成本能差15倍。原文稍后读已读值得跟进有用关注 Cursor
02:13向阳乔木@vista8该项目qiao由开发者joeseesun发布,提供了一个在Codex中集中使用多种AI模型的方案。用户可通过统一接口切换不同模型,无需在多个工具间跳转。代码已开源在github.com/joeseesun/qiao,支持自定义配置。技巧Codexjoeseesunqiao推荐理由:想在一个编辑器里用不同AI模型?试试qiao这个开源项目,能直接在Codex里切换,省事。原文稍后读已读值得跟进有用关注 Codex
02:00向阳乔木@vista8用户vista8发布了一个Skill,可在Codex中通过一句话调用Grok、Kimi、Claude三个模型执行任务。该Skill自动调用本机CLI执行并返回结果给Codex,合规安全。安装指令为npx skills add joeseesun/qiaomu-model-cli。用户可根据模型优势分工,例如用K3做前端、Grok 4.5做搜索、Claude Opus 4.8做Fable叙事。技巧CodexGrokKimi推荐理由:想在一个编辑器里用上Grok、Kimi、Claude?装这个Skill,一句话调不同模型干活,不用来回切换了。原文稍后读已读值得跟进有用关注 Codex
01:32lmarena.ai@lmarena_ai精选73°Kimi K3 在 Agent Arena 排行榜上位列第4,与 Claude Opus 4.8 和 GPT-5.6 Sol 持平。若按计划于7月27日开源权重,将成为开源模型中排名第1。相比 Kimi K2.7 Code(第23名),K3 跃升至第4名,基于8000+实时智能体会话,确认任务成功率排名第1,好评相比投诉提升20.6%(第3名)。在 Frontend Code Arena 中,K3 以1679分超越 Claude Fable 5,从第18名跃升至第1名,并在7个领域中的6个取得第一。AI模型Kimi K3Agent ArenaFrontend Code Arena10 个信源在谈事件专题推荐理由:Kimi K3 智能体能力追上 Claude 和 GPT,还计划开源,前端编码直接登顶,值得关注这个国产模型的新进展。原文稍后读已读值得跟进有用关注 Kimi K3
00:52向阳乔木@vista8AI编程工具Codex的前端审美不佳,OpenCodex项目允许用户自由切换后端模型。支持非OpenAI模型如Kimi K3(OAuth)、Grok 4.5(OAuth)、GLM 5.2。用K3做前端设计,切GPT sol5.6做后端,还能随时调用Grok 4.5搜索X信息。该项目在GitHub上开放,热度已有1534次浏览。技巧CodexOpenCodexKimi K310 个信源在谈事件专题推荐理由:Codex用户注意,OpenCodex可以让你用K3、Grok等模型做前端,GPT做后端,切换超方便。原文稍后读已读值得跟进有用关注 Codex
00:33coderabbitai@coderabbitaiCodeRabbit 新增调查和修复 CI 失败的功能,专用于 GitHub。用户通过 '@coderabbitai fix-ci' 触发后,工具会自动调查原因、生成修复代码,并以 stacked PR 形式提交。该功能旨在减少开发者手动排查 CI 问题的耗时,提升迭代效率。目前已在官方文档中提供详细使用指南。AI产品CodeRabbitGitHubCI推荐理由:CodeRabbit 现在能帮你自动修 CI 了,输入 '@coderabbitai fix-ci' 就行,省得自己查日志改代码。原文稍后读已读值得跟进有用关注 CodeRabbit
21:12官方账号阿里通义 Qwen@Alibaba_Qwen阿里巴巴Qwen团队发布Qwen3.8-Max-Preview的最新版本,在多项能力上取得广泛进步,尤其在Web前端任务上有显著提升。该模型仍处于每日迭代中,团队邀请用户测试并反馈问题。未来计划发布更强大的正式版,并开源模型权重。AI模型Qwen3.8Alibaba编程助手推荐理由:Qwen3.8预览版每天都在进化,这次Web前端进步特别大,写网页生成代码的好工具,快去试试吧。原文稍后读已读值得跟进有用关注 Qwen3.8
18:42IT之家(博客/媒体)Arena平台2026-29期大模型排行榜显示,国产模型Kimi K3以1486分ELO首次进入综合榜第9位,与gemini-3-pro、gpt-5.6-sol-xhigh并列。在前端开发榜中,Kimi K3超越所有海外模型登顶榜首,ELO分数领先。综合榜第一由claude-fable-5以1507分占据,Anthropic多款思考模型包揽前5。代码榜中claude-opus-4-7-thinking以1553分升至第一,Kimi K3以1529分首次进入代码榜Top10。AI模型Kimi K3ArenaClaude10 个信源在谈事件专题推荐理由:月之暗面的Kimi K3这次真争气,综合榜前十、前端开发榜第一,国产模型越来越能打了。原文稍后读已读值得跟进有用关注 Kimi K3
18:39掘金本周最热@SameX精选文章分享了在 HarmonyOS 应用中使用 relationalStore 的5个工程决策,包括将 RdbStore 设计为应用级单例并复用初始化 promise 避免并发问题,合理选择 securityLevel(S1 适合普通业务数据),以及使用 CREATE TABLE IF NOT EXISTS 和 ALTER TABLE 处理 Schema 迁移。还提到 securityLevel 从 S1 到 S4 影响加密与跨设备同步,选低等级性能更好。最后指出设计阶段需预判未来加字段以避免老用户崩溃。技巧HarmonyOSrelationalStore本地数据库推荐理由:讲的是 HarmonyOS 里 relationalStore 真正上线的坑,单例、安全等级、加字段怎么不崩,踩过的人才写得出来。原文稍后读已读值得跟进有用关注 HarmonyOS