11:43量子位@梦晨在2026年世界人工智能大会(WAIC)上,一款AI图片生成模型展示了其输出结果,图片在细节和色彩上达到高度写实。现场演示中,模型仅用文字描述就生成了高质量图像。该模型没有公布具体名称,但据称在推理速度和图像分辨率上相比上一代有提升。AI模型图片生成WAIC文生图推荐理由:WAIC上那AI画的图太惊艳了,文字转图片的效果几乎以假乱真。原文稍后读已读值得跟进有用关注 图片生成
11:42IT之家(博客/媒体)小鹏图灵第二代VLA模型发布,实现同一套模型同时适配中国和欧洲路况。该模型通过世界模型与VLA结合提升在真实世界中的理解力与行动力。即使在训练数据不足的海外市场,也能自主生成训练数据加速泛化。小鹏目标在2027年逐步向海外用户交付。AI模型小鹏图灵VLA小鹏汽车1 个信源在谈事件专题推荐理由:小鹏的智驾模型做到了全球通吃,同一套代码跑通中欧路况,还有明确的2027年海外交付计划,挺酷的。原文稍后读已读值得跟进有用关注 小鹏图灵
10:54IT之家(博客/媒体)72°阿里巴巴发布 HappyOyster 1.0(快乐生蚝),已登陆阿里云百炼面向企业和开发者开启灰测。该模型提供世界探索(Adventure)与实时导演(Directing)两种模式。世界探索模式支持输入一句话或一张图,生成可实时探索和交互的开放世界,体验时长 1 分钟以上且音画同出。实时导演模式允许用户用文字指令操控镜头、调度角色、改变剧情走向,支持暂停、改写、回溯。HappyOyster 1.0 提供 Android/iOS/Web 三端 SDK,开发者可通过 Open API 管理世界,客户端 SDK 封装 RTC 连接和视频渲染。AI模型HappyOyster阿里巴巴多模态推荐理由:阿里刚发的 HappyOyster 1.0,能根据一句话或一张图生成实时可探索的 3D 世界,还能像导演一样用文字操控剧情,支持 1 分钟以上互动,挺有新意的。原文稍后读已读值得跟进有用关注 HappyOyster
09:48官方一手marktechpost@Michal Sutter82°文章对三款开源万亿参数MoE模型Kimi K3、DeepSeek V4 Pro和GLM-5.2进行了全面对比。对比涵盖了在多项基准测试中的表现、采用的MIT或Modified MIT许可证以及实际服务成本。文章提供了这些模型在不同维度上的差异分析,帮助读者了解各模型的优劣势。AI模型Kimi K3DeepSeek V4 ProGLM-5.210 个信源在谈事件专题推荐理由:想选开源万亿模型?这篇直接拿三个主流模型比了基准、许可证和成本,看完就知道选哪个合适。原文稍后读已读值得跟进有用关注 Kimi K3
08:09IT之家(博客/媒体)Sunday Robotics发布新一代机器人AI模型ACT-2,用于轮式家庭机器人Memo。在未经训练的陌生家庭环境中,Memo叠衣成功率超过99%。ACT-2具备环境迁移能力,避免为每个家庭重新训练。公司已完成1.65亿美元融资,估值达11.5亿美元,并提出新评估标准Solve。AI模型ACT-2Sunday RoboticsMemo推荐理由:Sunday Robotics的ACT-2模型让Memo在陌生家庭叠衣成功率超99%,不需要重新训练。家庭机器人终于有希望了。原文稍后读已读值得跟进有用关注 ACT-2
02:57techcrunch@Anthony Ha中国公司Moonshot AI于本周发布了新版Kimi模型。该模型引发了关于'全面AI共产主义'的担忧,讨论集中在AI对社会结构的潜在影响。目前尚无基准成绩或具体能力细节披露,但业界对模型意图和意识形态导向产生争议。AI模型Moonshot AIKimiAI监管6 个信源在谈事件专题推荐理由:Moonshot AI的新Kimi惹了争议,不是技术问题而是政治担忧,值得看看怎么回事。原文稍后读已读值得跟进有用关注 Moonshot AI
23:39IT之家(博客/媒体)爆料者 @ExoticSpice101 展示了英伟达 N1X 芯片在 Cinebench 2026 中的首个跑分数据,测试平台为微软 Surface Ultra 工程样机。单核得分 540 分,多核得分 5771 分,单核性能据称与苹果 M3 Max 相当。N1X 是英伟达与微软推进 Windows on Arm 生态的重要芯片,基于 RTX Spark 平台,最高支持 20 个 Arm CPU 核心、6144 个 Blackwell RTX 核心以及 128GB 统一内存。工程样机成绩可能受固件及散热影响,最终产品性能可能有偏差。AI模型N1XCinebench 2026Surface Ultra推荐理由:英伟达 N1X 芯片首次跑分曝光,单核打平苹果 M3 Max,Surface Ultra 工程机透露性能端倪,想了解 Win on Arm 性能上限的可以看看。原文稍后读已读值得跟进有用关注 N1X
23:30IT之家(博客/媒体)73°英伟达发布了专为 RTX Spark PC 定制的 Windows 11 Arm64 驱动程序,版本号为 616.00。驱动文件确认了两款 RTX Spark N1X GPU 配置,分别搭载 6144 和 5120 个 Blackwell RTX 核心。该平台采用 Arm CPU 结合 Blackwell GPU,最高提供 20 个 CPU 核心和 128GB 统一内存。微软已为 RTX Spark 优化 Windows 11 调度器,并计划通过 MPTF 框架管理功耗。首批产品预计 2026 年秋季上市,包括微软、华硕、戴尔等品牌的笔记本和迷你主机。AI模型RTX SparkN1XBlackwell推荐理由:英伟达的 RTX Spark 驱动曝光了 6144 核心猛兽,Arm Windows PC 要变天了,微软还专门改了调度器,等等党的新目标来了。原文稍后读已读值得跟进有用关注 RTX Spark
22:57IT之家(博客/媒体)72°埃隆·马斯克透露 xAI 的下一代 Grok 4.6 模型参数规模为 2 万亿,预计下周完成初始训练。该模型在各方面优于当前 1.5 万亿参数的 Grok 4.5,且推理速度和 Token 效率接近。马斯克猜测 Grok 4.6 可能超过月之暗面的 Kimi 3。xAI 使用 Colossus 集群(约 20 万块 GPU)进行训练。AI模型GrokxAI2万亿参数推荐理由:xAI 的 Grok 4.6 参数飙升到 2 万亿,下周就练完了,据说能超 Kimi 3,看看它和 GPT 比到底咋样。原文稍后读已读值得跟进有用关注 Grok
22:49IT之家(博客/媒体)精选京东在 2026 年 WAIC 上推出 JoyAI-Talker 实时语音交互模型,具备低延迟对话、情绪理解和声纹识别功能。同时发布 JoyAI-Video-Edit 视频编辑模型,支持通过自然语言增删物体、替换人物等流式编辑。京东还开源了行业最大的人类视角数据集 EgoLive。AI模型JoyAI-TalkerJoyAI-Video-Edit京东推荐理由:京东一口气发了两个 AI 模型,一个能实时语音聊天还能认声纹,另一个视频编辑可以边看边改,挺实用的。原文稍后读已读值得跟进有用关注 JoyAI-Talker
18:39官方账号Decoder@Matthias Bastian英国AI安全研究所报告指出,GLM-5.2和DeepSeek V4-Pro等开放权重模型在网络攻击能力上已接近四个月前封闭前沿模型的水平。目前差距缩小至4到7个月,而2025年初这一差距为6到10个月。报告同时发现开放模型的安全防护措施基本无效,防御者准备时间被压缩。AI模型GLM-5.2DeepSeek V4-Pro开放权重模型4 个信源在谈事件专题推荐理由:英国AI安全所发现,GLM-5.2和DeepSeek V4-Pro的网络能力快追上封闭模型了,但安全防护基本没用,值得关注。原文稍后读已读值得跟进有用关注 GLM-5.2
18:33IT之家(博客/媒体)商汤科技发布日日新SenseNova U1 Pro图片创作模型,支持最高8K原生分辨率输出,画幅放大后文字、线条仍清晰。该模型通过内生图文交错思维链提升内容准确性,文字渲染出错率极低。图像生成从细节逼真推进到专业设计美感,宣称告别AI味。同时支持长程Agentic Generation Loop,可围绕复杂目标进行数十轮智能体生成循环,实现局部文本同步精准编辑。AI模型商汤科技日日新U1 Pro8K推荐理由:商汤新出的U1 Pro能直接生成8K高清图片,设计感专业,文字不乱码,还能反复修改,比很多海外模型都实用。原文稍后读已读值得跟进有用关注 商汤科技
16:45官方一手pandaily@contact@pandaily.com (Pandaily)73°Moonshot AI推出Kimi K3,这是继DeepSeek和Manus后第三次中国AI冲击波。Kimi K3定价为每百万token 3至15美元,相比美国主流模型显著降低。该模型迫使全球市场重新评估美国AI的溢价定价和高估值是否可持续。Kimi K3标志着中国AI从廉价路线转向高端能力。AI模型Kimi K3Moonshot AI定价10 个信源在谈事件专题推荐理由:Kimi K3定价$3-15/M token,比美国模型便宜很多,看看Moonshot怎么用低价倒逼市场。原文稍后读已读值得跟进有用关注 Kimi K3
14:42官方一手marktechpost@Asif Razzaq精选Sakana AI 提出 Error Diffusion 方法,可训练符合 Dale 原则的双流兴奋/抑制网络,无需依赖反向传播。在 MNIST 基准上达到 96.7% 准确率,在 CIFAR-10 上达到 61.7% 准确率。该方法通过模数误差路由将训练规则从 MNIST 扩展到 CIFAR-10 及强化学习场景。消融实验显示,不同任务所依赖的机制具有特定性。AI模型Sakana AIError DiffusionDale's principle1 个信源在谈事件专题推荐理由:Sakana AI 搞出了不用反向传播也能训练的网络,MNIST 和 CIFAR-10 成绩还不错,研究生物合理学习的人可以看看。原文稍后读已读值得跟进有用关注 Sakana AI
12:13IT之家(博客/媒体)Anthropic 于7月18日宣布,7月20日起Max和Team Premium订阅用户可使用Claude Fable 5,但限额为50%。Pro和Team Standard用户后续通过用量积分调用,官方一次性赠送100美元积分。该模型在软件工程、知识工作等领域表现卓越,但用户反馈“降智”且安全护栏严苛。有网友认为Kimi K3每月39美元且无额度限制,可能比50%限额的Claude Fable 5更好用。AI模型Claude Fable 5AnthropicKimi K310 个信源在谈事件专题推荐理由:Anthropic给Claude Fable 5加了50%限额,网友直接拿Kimi K3来比。你要是纠结订阅选哪个,这篇信息很关键。原文稍后读已读值得跟进有用关注 Claude Fable 5
10:42IT之家(博客/媒体)精选在2026世界人工智能大会(WAIC 2026)上,东方算芯首次展出全球首颗软件定义近存计算3D AI芯片DF1000,并荣获2026 SAIL奖。DF1000算力达520 TFLOPS@BF16,采用14nm工艺和全国产供应链。该芯片通过3D混合键合技术实现晶圆级堆叠,拥有自主编程框架和软件生态,破解高端算力芯片发展瓶颈。AI模型DF1000东方算芯AI芯片1 个信源在谈事件专题推荐理由:东方算芯的新AI芯片DF1000,算力520 TFLOPS,14nm工艺下做到这个水平,全国产供应链,3D堆叠近存计算,技术路线挺有意思,可以看看怎么实现的。原文稍后读已读值得跟进有用关注 DF1000
09:45SuperTechFans(博客/媒体)79°Claude Fable 5和GPT-5.6 Sol在100美元预算下各自制作Bruno Mars《Uptown Funk》音乐视频。Claude花费$48.60生成1920x1080视频,GPT花费$36.57并混合使用多个视频模型。两者作品可用但故事一致性差、对歌词理解过于字面。Claude的LLM token成本$16.99-$25.05,占总成本30-40%,远高于GPT的$3-4。AI模型Claude Fable 5GPT-5.6 Sol视频生成10 个信源在谈事件专题推荐理由:想看看两个顶级AI花100美元能做出什么视频?实验显示Claude Fable 5和GPT-5.6 Sol的作品都还行但不惊艳,而且Claude的token成本比GPT高出好几倍。原文稍后读已读值得跟进有用关注 Claude Fable 5
09:28官方一手pandaily@contact@pandaily.com (Pandaily)76°Moonshot AI将Kimi K3定价为每百万token 3-15美元,是此前K2.6价格的3-4倍。该定价为DeepSeek同类模型的3-15倍,成为当前中国最贵的大模型。此举标志着Moonshot AI从成本领先战略转向高价值复杂任务能力。国内计算生态系统的成熟为其提供支撑。AI模型Kimi K3Moonshot AIDeepSeek10 个信源在谈事件专题推荐理由:Moonshot AI出了个超贵模型Kimi K3,比DeepSeek贵3-15倍,但专攻复杂任务,不是打价格战。原文稍后读已读值得跟进有用关注 Kimi K3
07:24IT之家(博客/媒体)英伟达开源推出 Nemotron 3 Embed 系列,包含 8B、1B 及 1B-NVFP4 三个版本,均支持商业使用。8B 版在 RTEB 基准上以 78.5% 得分排名第一,在 MMTEB 检索中得分 75.5%。该系列配备 32K 上下文窗口,专为 AI 智能体和 RAG 场景优化,可减少重复检索并降低 Token 消耗。1B 版通过蒸馏获得,1B-NVFP4 面向 Blackwell 架构优化,吞吐量最高提升 2 倍。AI模型Nemotron 3 Embed英伟达RTEB推荐理由:英伟达发了三个检索模型,8B 版直接登顶 RTEB 榜首,适合做 RAG 和智能体,还能省 token。原文稍后读已读值得跟进有用关注 Nemotron 3 Embed
05:42官方一手marktechpost@Asif Razzaq精选Zyphra 于 2026 年 7 月 16 日发布 ZUNA1.1,采用 Apache 2.0 许可。该 380M 参数 masked diffusion autoencoder 能处理 0.5 至 30 秒的可变长度脑电图输入,而上一代 ZUNA1 仅支持固定 5 秒。模型支持任意通道布局下的重构、去噪和上采样,NMSE 指标保持不变或有所改善。AI模型ZyphraZUNA1.1脑电图推荐理由:Zyphra 把 EEG 模型输入从固定5秒扩展到0.5-30秒,还开源了 Apache 2.0,搞脑电研究的可以直接上手。原文稍后读已读值得跟进有用关注 Zyphra
03:40官方账号Decoder@Matthias Bastian73°Moonshot AI 发布 Kimi K3 模型,初步评估表现匹配 Anthropic 的 Opus 4.8。该模型由仅 300 人团队开发,OpenAI 战略师 Dean W. Ball 评价其“非常好”。Ball 同时警告开源权重模型主导将导致“AI 共产主义”,重新引发关于算力重要性及美国出口管制有效性的讨论。AI模型Kimi K3Moonshot AIAnthropic10 个信源在谈事件专题推荐理由:Kimi K3 用 300 人就追上 Anthropic 顶配,OpenAI 的人还吐槽开源是 AI 共产主义,值得看算力是否真的重要。原文稍后读已读值得跟进有用关注 Kimi K3
22:21官方账号Simon Willison’s Weblog(博客/媒体)Kimi K3 在用户要求泄露系统提示时,回答“有什么可以帮你的吗?”并拒绝透露。该模型由月之暗面开发,显示其在安全对齐上的设计。这一行为引发对 AI 个性与指令保护机制的讨论。事件源自 Simon Willison 的博客记录。AI模型Kimi K3AI个性提示词安全10 个信源在谈事件专题推荐理由:看看 Kimi K3 是怎么机智回避敏感问题的,挺有意思的交互设计原文稍后读已读值得跟进有用关注 Kimi K3
19:16量子位@量子位的朋友们精选上海AI Lab在WAIC 2026上发布科学智能体新基座模型Mobius,参数量为397B,性能追平万亿参数模型。Mobius采用非Transformer架构,专攻科学领域任务,不做泛化通用问答。该模型在多个科学基准上达到SOTA,例如在MoleculeNet数据集上准确率提升12%。AI模型Mobius上海AI Lab397B参数推荐理由:上海AI Lab用397B参数的非Transformer架构Mobius,追平了万亿模型,专攻科学智能体,不是通用问答那一套。原文稍后读已读值得跟进有用关注 Mobius
19:14量子位@杰西卡文远发布了物理AI大模型WITT。该模型在单卡上每天可处理1万分钟视频数据。这有助于提升自动驾驶等场景的数据处理效率。AI模型文远WITT物理AI推荐理由:文远新模型WITT单卡就能日处理1万分钟视频,对自动驾驶研发超实用。原文稍后读已读值得跟进有用关注 文远
16:42官方一手Pandaily@contact@pandaily.com (Pandaily)WeRide推出物理AI基础模型WITT,该模型通过最小物理事实单元统一多模态场景理解。WITT可同时处理视觉、激光雷达等多传感器数据,为自动驾驶和机器人提供通用感知基础。官方表示,WITT在多个自动驾驶基准测试中取得领先成绩,并已集成到WeRide的L4级自动驾驶系统中。AI模型WITTWeRide自动驾驶推荐理由:WeRide搞了个新模型WITT,用最小物理事实做多模态理解,开车和机器人都能通用,性能挺猛。原文稍后读已读值得跟进有用关注 WITT
16:06IT之家(博客/媒体)阿里通义实验室发布 Wan-Streamer v0.2 模型,端到端响应延迟仅 550ms(含 350ms 网络延迟)。输出分辨率从 v0.1 的 192×336 提升至 640×368@25FPS,微表情清晰可见。模型采用“Thinker+Performer”双架构,Thinker 单卡处理感知与理解,Performer 多卡并行生成高清视频。Wan-Streamer 将文本、音频、视频输入统一映射到因果时间线,每 160ms 完成一次感知-理解-生成-解码循环。相比常见实时语音对话模型,Wan-Streamer 支持全双工视频交互且延迟控制在 1 秒内。AI模型Wan-Streamer阿里通义多模态推荐理由:阿里发了 Wan-Streamer v0.2,视频电话延迟才 550ms,画质从模糊到高清,还能边听边看边回应,挺有意思。原文稍后读已读值得跟进有用关注 Wan-Streamer
15:57官方一手marktechpost@Asif Razzaq73°NVIDIA 于 2026 年 7 月 15-16 日发布 Nemotron 3 Embed 系列,包含三个开源检查点:8B-BF16、1B-BF16 和 1B-NVFP4。8B 模型在 RTEB 基准上以 78.46 平均 NDCG@10 排名第一。1B 模型通过 ModelOpt NAS 剪枝和 COS+MSE 蒸馏从 8B 教师模型获得。NVFP4 量化版本在 Blackwell 上吞吐量提升 2 倍,同时保留超过 99% 的 BF16 检索精度。所有检查点支持 32,768 token 输入,基于 OpenMDW-1.1 协议。AI模型Nemotron-3-EmbedNVIDIARTEB10 个信源在谈事件专题推荐理由:NVIDIA 开源了三个嵌入模型,8B 的 RTEB 第一,1B 的量化版速度翻倍还能保持 99% 精度,适合做检索和 RAG。原文稍后读已读值得跟进有用关注 Nemotron-3-Embed
15:34IT之家(博客/媒体)精选中国气象局在WAIC气象专会上发布全球首个千亿参数级开源气象大语言模型“风和”,并启动全球开源计划。该模型基于地球系统数据基座,训练了5000万tokens高质量气象服务语料,已备案生成式人工智能。目前“风和”国际版已上线,融入“妈祖”预警方案,支持中英文智能问答。中国气象局已在GitHub和Hugging Face开放完整模型权重及API接口,允许全球用户部署。AI模型风和中国气象局气象大模型推荐理由:中国气象局开源了千亿参数的气象大模型“风和”,能直接用于天气分析、风险预警,还在GitHub和Hugging Face上给了完整代码和API,开发者可以自己接入。原文稍后读已读值得跟进有用关注 风和
15:24IT之家(博客/媒体)77°腾讯 Robotics X 实验室、福田实验室联合腾讯混元发布第二代具身 VLM 基座模型 Hy-Embodied-VLM-1.0。在覆盖 37 个评测任务的评测体系中,该模型综合平均得分 65.6,其中物理状态理解 68.6 分、动作-变化推理 64.1 分、时序与自适应推理 57.4 分。模型采用 A3B 规模,整体性能接近上一代 A32B 旗舰模型,并优于同等规模的 Qwen3.6-A3B、Cosmos 3-8B、Embodied-R1。该模型从物理空间状态理解、动作-变化理解、时序和自适应推理三个层次构建能力,支持场景感知、动作规划、导航等长时程任务。AI模型腾讯Hy-Embodied-VLM-1.0A3B推荐理由:腾讯新出的具身模型 Hy-Embodied-VLM-1.0,只用 A3B 参数量就接近 A32B 的效果,37 个任务平均 65.6 分,还开源了。搞具身智能的朋友可以试试。原文稍后读已读值得跟进有用关注 腾讯
15:03IT之家(博客/媒体)精选文远知行WeRide发布自研物理AI认知基础大模型WeRide WITT,首次引入“最小物理事实单元”概念,能拆解真实场景为可验证的事实单元。WITT具备事实提取、推理、验证、编排四大能力,在自动驾驶垂类场景中平均每片段事实错误率仅为通用大模型的三分之一。相比百B级参数通用大模型,WITT可节省98%的Token成本,单卡单日处理1万分钟视频,效率提升200倍。WITT与世界模型GENESIS协同驱动物理AI飞轮,提高自动驾驶模型训练效率。AI模型文远知行WITT物理AI推荐理由:文远知行发了物理AI大模型WITT,能把雨天视频拆成一个个事实单元来理解,比通用大模型事实错误率低三分之二,成本还省98%。原文稍后读已读值得跟进有用关注 文远知行
11:06IT之家(博客/媒体)72°月之暗面在 Kimi K3 技术博客中展示了其芯片设计能力,K3 模型在 48 小时内基于 Nangate 45nm 库完成专用芯片的构建、优化和验证。该芯片集成 146 万个标准单元、0.277MB SRAM 和 INT4 MAC 阵列,面积仅 4 mm²,在 100 MHz 频率下仿真解码吞吐量超 8700 Token/s。这体现了 K3 具备长远规划的智能体能力。AI模型Kimi K3月之暗面芯片设计10 个信源在谈事件专题推荐理由:月之暗面用 Kimi K3 自己设计了一个芯片,48 小时搞定,性能还挺猛。想看看 AI 怎么自己造芯片的可以点进去。原文稍后读已读值得跟进有用关注 Kimi K3
10:12官方一手Pandaily@contact@pandaily.com (Pandaily)精选73°商汤科技开源了统一视觉模型SenseNova-Vision,该模型将检测、分割、深度预测和3D重建任务整合在单一模型中。在HuggingFace Any-to-Any排行榜上,SenseNova-Vision凭借其性能登顶全球第一。此举标志着“拼接怪兽”时代的终结,为计算机视觉领域提供更简洁高效的统一方案。AI模型SenseNova-VisionSenseTime视觉模型推荐理由:商汤把检测、分割、深度预测、3D重建全塞进一个开源模型,还在HuggingFace拿了第一,做视觉的兄弟可以试试。原文稍后读已读值得跟进有用关注 SenseNova-Vision
10:09官方一手pandaily@contact@pandaily.com (Pandaily)Moonshot AI发布了Kimi K3模型,参数量达2.8万亿。该模型在开源权重模型中排名全球第三,仅次于Fable 5和GPT-5.6 Sol。Kimi K3宣称具备'寓言级'的感受力。同时提供开源权重和API服务。AI模型Kimi K3Moonshot AI开源模型10 个信源在谈事件专题推荐理由:Kimi K3的2.8万亿参数开源模型性能强悍,全球第三,比很多闭源模型都强,值得上手试试。原文稍后读已读值得跟进有用关注 Kimi K3
08:00IT之家(博客/媒体)73°谷歌旗舰AI模型Gemini 3.5 Pro延期数月,原计划未按时推出。谷歌希望提升编程能力,但更换训练数据后测试结果未达预期。内部不同派系争夺主导权,部分员工不满并加入Anthropic。OpenAI和Meta已在AI编程上拉开与谷歌现有产品的差距。AI模型Gemini 3.5 ProGoogle编程能力10 个信源在谈事件专题推荐理由:谷歌Gemini 3.5 Pro延期了,编程能力没达标,内部还乱成一团。和OpenAI、Anthropic比差距更大了。原文稍后读已读值得跟进有用关注 Gemini 3.5 Pro
07:54官方一手marktechpost@Asif Razzaq83°2026年7月16日,Moonshot AI 发布了 Kimi K3 模型,参数规模达2.8万亿。该模型采用 MoE 架构,包含896个专家,每次推理激活其中16个。Kimi K3 引入了 Kimi Delta Attention 和 Attention Residuals 机制,支持100万token的上下文窗口。模型以开源形式发布。AI模型Kimi K3Moonshot AIMoE10 个信源在谈事件专题推荐理由:Moonshot AI 把 2.8 万亿参数的 Kimi K3 开源了,用了新注意力机制,还有 1M 上下文,直接看技术细节就对了。原文稍后读已读值得跟进有用关注 Kimi K3
06:48IT之家(博客/媒体)73°月之暗面于7月16日发布Kimi K3模型,参数规模达2.8万亿,支持100万tokens上下文,面向长程编程与知识工作。价格方面,缓存命中输入每百万tokens 2元,未命中20元,输出100元。架构基于Kimi混合线性注意力机制和注意力残差技术,原生支持视觉理解。在Frontend Code Arena基准测试中,Kimi K3以1679分超越Claude Fable 5登顶,并在7个领域中的6个获得第一。AI模型Kimi K3月之暗面Frontend Code Arena10 个信源在谈事件专题推荐理由:Kimi K3参数2.8万亿,前端编码跑分直接第一,价格还比Claude便宜,写代码的值得试试。原文稍后读已读值得跟进有用关注 Kimi K3
04:57官方账号Simon Willison’s Weblog(博客/媒体)73°Moonshot AI发布Kimi K3模型,参数规模达2.8万亿,自称首个开放权重3T级模型。在自报基准中,K3多数指标超过Claude Opus 4.8和GPT-5.5 high,但输给Claude Fable 5和GPT-5.6 Sol。Artificial Analysis报告显示,K3在长时知识工作评测中Elo为1547,比K2.6提升732点,每任务成本0.94美元,低于Opus 4.8的1.80美元。该模型在Arena.ai前端代码竞技场排名第一,超越Claude Fable 5。定价为输入3美元/百万tokens、输出15美元/百万tokens,为中国AI实验室最贵模型。AI模型Kimi K3Moonshot AI开放权重10 个信源在谈事件专题推荐理由:Moonshot发了2.8万亿参数Kimi K3,前端代码超越Fable 5,开放权重版月底就能用,价格虽高但看齐Claude Sonnet。原文稍后读已读值得跟进有用关注 Kimi K3
04:00官方账号Decoder@Matthias BastianKimi发布名为K3的多模态开放权重模型,拥有2.8万亿参数和100万token上下文。在自有基准测试中,K3接近GPT-5.6 Sol和Claude Fable 5,并显著超过Opus 4.8和GLM 5.2。该模型定价大幅高于前代,标志着中国AI低价时代可能结束。完整权重计划于7月27日前公开发布。AI模型KimiK3GPT-5.6 Sol10 个信源在谈事件专题推荐理由:Kimi搞了个2.8万亿参数的开源模型K3,性能追平GPT-5.6 Sol和Claude Fable 5,不过价格也上去了,中国AI要涨钱了。原文稍后读已读值得跟进有用关注 Kimi
03:39官方一手AWS Machine Learning Blog@Melanie LiGrok 4.3现已上线Amazon Bedrock。该模型支持可配置的推理努力(reasoning effort)、工具调用(tool calling)和结构化输出。它还能处理图像输入并支持有状态的多轮对话。这些能力使其适用于智能体和企业级工作负载。AI模型GrokAmazon Bedrock智能体推荐理由:Grok 4.3上Bedrock了,支持工具调用和图像输入,做智能体应用很顺手。原文稍后读已读值得跟进有用关注 Grok
02:53官方一手marktechpost@Asif Razzaq77°OpenAI 训练了内部自动红队模型 GPT-Red,采用自我对弈强化学习对抗防御模型。在间接提示注入基准测试中,GPT-Red 以 84% 对 13% 的胜率击败人类红队。它还发现了一种新型攻击类别 "Fake Chain-of-Thought"。在 OpenAI 最难的直接注入基准上,GPT-Red 将 GPT-5.6 Sol 的失败次数减少了 6 倍。不过,OpenAI 承认该模型在多轮对话和基于图像的攻击方面仍有不足。AI模型GPT-RedOpenAIGPT-5.6 Sol10 个信源在谈事件专题推荐理由:OpenAI 搞了个 GPT-Red 自动红队模型,提示注入赢人类 84% 对 13%,还发现了 Fake Chain-of-Thought 攻击。原文稍后读已读值得跟进有用关注 GPT-Red