08:59IT之家(博客/媒体)精选腾讯混元于 7 月 6 日开源 Hy3 模型,该模型采用 MoE 架构,总参数 295B,激活参数 21B,最大支持 256K 上下文长度。7 月 8 日上午 10 时起,算力资源消耗达峰值,排队率一度超 50%。官方已第一时间调度资源完成扩容。Hy3 在推理、智能体、长上下文等任务上显著进步,效果比肩参数规模 2-5 倍的更大模型。AI模型Hy3WorkBuddy腾讯混元推荐理由:腾讯开源了 Hy3,295B 参数只有 21B 激活,推理和智能体能力很强,还支持 256K 上下文,现在调用太多刚扩容完。原文稍后读已读值得跟进有用关注 Hy3
08:57IT之家(博客/媒体)75°英伟达宣布其 Nemotron 3 Ultra 模型在 LangChain 的 Deep Agents 基准测试中取得开源模型最高准确率。该基准测试评估智能体系统的多步推理、工具调用和任务编排能力。调优后的 Nemotron 3 Ultra 每次推理成本仅为顶级闭源模型的 1/10,同时实现更高吞吐量。在业务任务能力上,该模型通过优化模型周围环境达到顶尖闭源模型水平。AI模型Nemotron 3 Ultra英伟达Deep Agents3 个信源在谈事件专题推荐理由:英伟达开源模型 Nemotron 3 Ultra 在智能体测试中准确率最高,成本只有闭源模型的十分之一,适合想低成本构建企业智能体的团队。原文稍后读已读值得跟进有用关注 Nemotron 3 Ultra
08:15官方一手marktechpost@Asif Razzaq76°蚂蚁集团Robbyant发布LingBot-VLA 2.0,一个6B参数的开源视觉-语言-动作模型(Apache-2.0许可证)。该模型在约6万小时数据上预训练,包括5万小时20种机器人配置的轨迹和1万小时人类视频。它使用55维规范动作空间统一不同形态,并采用无辅助损失的MoE动作专家扩展容量。在GM-100通用基准上,LingBot-VLA 2.0分别超过π0.5和上一代LingBot-VLA-1.0。AI模型LingBot-VLA 2.0Robbyant蚂蚁集团2 个信源在谈事件专题推荐理由:蚂蚁开源了6B的VLA模型LingBot-VLA 2.0,用6万小时数据训练,在GM-100上超过π0.5,做跨形态机器人操作很划算。原文稍后读已读值得跟进有用关注 LingBot-VLA 2.0
08:02官方一手marktechpost@Michal SutterSpaceXAI推出Grok 4.5,该模型使用Cursor进行训练,专为编程、智能体任务和知识工作设计。推理速度达80 TPS,成本为每百万输入token $2、输出token $6。在Harvey法律智能体基准测试中排名第一。AI模型Grok 4.5SpaceXAICursor10 个信源在谈事件专题推荐理由:Grok 4.5用Cursor训练,编程和智能体任务表现强,法律基准第一,性价比不错。原文稍后读已读值得跟进有用关注 Grok 4.5
08:01官方账号Simon Willison’s Weblog(博客/媒体)72°OpenAI推出GPT‑Live,升级ChatGPT语音模式,新模型基于GPT-5.5。它能在对话中实时将网页搜索、深度推理等复杂任务委托给GPT-5.5处理,同时保持对话流畅。作者在iPhone app预览数周,最长使用一小时,交互体验显著优于此前基于GPT-4o的旧版语音模式。作者还反馈了一个打断笑声的bug,OpenAI已调整修复。AI模型GPT‑LiveGPT-5.5OpenAI10 个信源在谈事件专题推荐理由:OpenAI把ChatGPT语音模式升级成GPT-Live了,能边聊边调GPT-5.5干活,比老版聪明太多,值得体验。原文稍后读已读值得跟进有用关注 GPT‑Live
06:55IT之家(博客/媒体)72°SpaceXAI 推出首个编程智能体模型 Grok 4.5,与 Cursor 联合训练,在数万个 NVIDIA GB300 GPU 上完成训练。该模型单个任务 Token 消耗仅为同级模型一半,每秒输出 80 TPS,单次任务步骤数少一半。定价每百万输入 Token 2 美元、每百万输出 Token 6 美元,成本不到同类可比模型的一半。Grok 4.5 可处理跨仓库长时间任务,还能构建复杂 Excel 模型和 PowerPoint 图表,在 Rust、C/C++ 等任务中表现高效。AI模型Grok 4.5CursorSpaceXAI10 个信源在谈事件专题推荐理由:SpaceXAI 发了首个编程智能体 Grok 4.5,和 Cursor 联训,Token 省一半、价格打对折,写代码做报表都能干。原文稍后读已读值得跟进有用关注 Grok 4.5
06:43IT之家(博客/媒体)74°OpenAI 发布 GPT-Live 系列全双工语音模型,包括 GPT-Live-1 和 GPT-Live-1 mini 两个版本。该模型可同时聆听与说话,每秒多次判断是否说话、打断或调用工具。复杂任务会委托给 GPT-5.5 系列后台执行。相比 Advanced Voice Mode,在 5-10 分钟对话中 GPT-Live-1 偏好得分更高。每周超 1.5 亿人使用 ChatGPT 语音交互。AI模型GPT-Live-1GPT-Live-1 miniOpenAI10 个信源在谈事件专题推荐理由:OpenAI 这次把语音交互做得更自然了,GPT-Live 系列能边听边说,还能打断和调用工具,比以前的 Advanced Voice Mode 流畅很多。原文稍后读已读值得跟进有用关注 GPT-Live-1
03:39techcrunch@Lucas Ropek马斯克的SpaceXAI于2026年7月8日发布Grok 4.5,马斯克称其性能达到Opus级别。该模型定位为更便宜、更高效的替代方案,与Claude Opus等高端模型竞争。Grok 4.5的成本和效率优化使其面向更广泛用户。AI模型Grok 4.5SpaceXAIElon Musk推荐理由:马斯克又发新模型Grok 4.5了,说是Opus级别的但更便宜,想省钱又想用顶级模型可以看看。原文稍后读已读值得跟进有用关注 Grok 4.5
03:25techcrunch@Rebecca BellanGeneral Intuition计划使用数百万小时的视频游戏数据来训练机器人基础模型,减少对真实世界数据的需求。该公司认为这种方法能像ChatGPT改变语言AI一样改变物理AI。其目标是通过模拟环境中的海量数据,让机器人学习通用技能,然后在少量真实数据下快速适应新任务。目前该方向仍处于早期阶段,但已吸引投资者关注。AI模型General Intuition视频游戏数据机器人推荐理由:这家初创公司想用游戏数据训练机器人,让它们学得更快更省钱,思路挺有意思,可能改变整个行业。原文稍后读已读值得跟进有用关注 General Intuition
03:19官方一手NVIDIA AI Blog@Adel El Hallak精选NVIDIA Nemotron 3 Ultra 在 LangChain 的 Deep Agents 框架上取得开放模型最高准确率。它完成更多任务且吞吐量更高,运行速度提升10倍。其成本低于顶级闭源模型。这使得 Nemotron 3 Ultra 成为构建 AI 智能体的高性价比选择。AI模型NVIDIANemotron 3 UltraLangChain10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3 Ultra 和 LangChain 合作,以更低成本跑出比闭源模型快10倍的成绩,做智能体首选。原文稍后读已读值得跟进有用关注 NVIDIA
03:16官方账号Decoder@Matthias Bastian精选xAI发布Grok 4.5,模型基于数万块Nvidia GB300 GPU训练。在编码基准上,Grok 4.5落后于Fable 5和GPT-5.5,但相比Opus 4.8,token消耗减少4.2倍。Grok 4.5定价每百万输入token仅2美元,远低于竞品。欧盟市场预计7月中旬可用。AI模型Grok 4.5xAIFable 510 个信源在谈事件专题推荐理由:Grok 4.5每百万token才2美元,编码虽不如Fable 5但便宜到可以忽略差距,性价比碾压。原文稍后读已读值得跟进有用关注 Grok 4.5
02:18官方账号OpenAI@OpenAI (@OpenAI)73°OpenAI 推出 GPT-Live 语音模型,专为提升人机交互自然度而设计。该模型即日起在 ChatGPT 中逐步上线,支持更流畅的对话体验。官方演示视频展示了其逼真的语音响应和情感表达能力。推文获得超 5200 次点赞和 34 万次观看。AI模型GPT-LiveOpenAIChatGPT10 个信源在谈事件专题推荐理由:OpenAI 出了个新语音模型 GPT-Live,今天就能在 ChatGPT 里用,说话更自然更像真人,快去试试吧原文稍后读已读值得跟进有用关注 GPT-Live
02:16官方一手marktechpost@Michal Sutter73°OpenAI 推出新一代语音模型 GPT-Live 和 GPT-Live-1 mini,用于 ChatGPT Voice。GPT-Live 采用全双工架构,能够同时听和说。该模型将搜索与推理任务委托给 GPT-5.5 处理。GPT-Live-1 mini 是轻量版本。AI模型GPT-LiveGPT-Live-1 miniGPT-5.510 个信源在谈事件专题推荐理由:OpenAI 用 GPT-Live 把语音交互做到实时全双工,还能让 GPT-5.5 处理复杂推理,听说是你聊天的好帮手。原文稍后读已读值得跟进有用关注 GPT-Live
01:49官方账号Decoder@Matthias Bastian73°Mistral 发布了 Robostral Navigate,一个 8B 参数的机器人导航模型。该模型仅依靠单个 RGB 摄像头即可在未知环境中引导机器人。它在模拟中训练并通过强化学习方法 CISPO 优化。在 R2R-CE 基准上,Robostral Navigate 达到了 76.6% 的准确率。Mistral 尚未公布该模型的发布时间。AI模型MistralRobostral Navigate机器人导航1 个信源在谈事件专题推荐理由:Mistral 出了机器人模型 Robostral Navigate,8B 参数用单摄像头就能导航,R2R-CE 上 76.6%,轻巧实用。原文稍后读已读值得跟进有用关注 Mistral
01:15官方一手AWS Machine Learning Blog@Jasmine Rasheed SyedAWS博客介绍了基于图的检索增强生成(GraphRAG)技术,通过结合知识图谱(BYOKG)与生成式AI来加速科学研究。该方法利用图数据库存储实体关系,并在药物研发中实现精准信息检索。GraphRAG在回答复杂科学问题时,比传统RAG更擅长处理多跳推理。BYOKG允许研究人员使用自有知识图谱,无需依赖外部数据源。该方案已应用于药物靶点发现等场景,提升了实验效率。AI模型GraphRAGBYOKGAWS推荐理由:AWS这篇博客讲的是用图数据库+知识图谱做检索增强生成,专门帮药物研发团队加速查找科学文献和挖掘靶点关系,比传统RAG更能处理复杂问题。原文稍后读已读值得跟进有用关注 GraphRAG
01:04官方一手OpenAI Blog(博客/媒体)73°OpenAI 发布了新一代语音模型 GPT-Live。该模型专门用于自然的人机语音交互。目前 GPT-Live 已应用于 ChatGPT Voice。它提升了语音对话的流畅度和响应速度。AI模型GPT-LiveOpenAIChatGPT Voice10 个信源在谈事件专题推荐理由:OpenAI 出了新语音模型 GPT-Live,ChatGPT 语音对话更自然了,赶紧试试吧。原文稍后读已读值得跟进有用关注 GPT-Live
00:22官方账号Decoder@Matthias BastianAnthropic 的 Claude Fable 5 在 Artificial Analysis 发布的六个新行业基准(金融、法律、医学)中全部获得最高分。在 Strategy & Ops Index 中,Fable 5 单次任务成本 3.48 美元,是 DeepSeek V4 Pro 的 0.03 美元的 100 倍以上,但分数仅领先 12 分。这表明顶级推理性能以极高的使用成本为代价。AI模型Claude Fable 5AnthropicDeepSeek V4 Pro10 个信源在谈事件专题推荐理由:Claude 5 性能确实最强,但用一次要三块多,比 DeepSeek 贵百倍,分数只高一点,性价比要好好掂量。原文稍后读已读值得跟进有用关注 Claude Fable 5
22:25量子位@思邈RoboDojo新基准测试发布,人类表现100分,最强AI模型仅获12.8分。该基准包含200个具身智能任务,覆盖抓取、导航、操作等场景。当前模型在长时序任务和细粒度控制上明显落后于人类。测试揭示了机器人在泛化能力和物理交互方面的核心瓶颈。AI模型RoboDojo具身智能基准测试推荐理由:RoboDojo这个新基准把人类和模型放到同一考场,人类满分100,最强模型才12.8,差距大到离谱,值得看看模型到底在哪栽跟头。原文稍后读已读值得跟进有用关注 RoboDojo
21:37IT之家(博客/媒体)73°字节跳动今日发布多模态图像创作模型 Seedream 5.0 Pro。相比之前版本,该模型在图文匹配、结构合理性、文字渲染与画面美感等基础能力上全面提升。它支持复杂信息可视化,能将数据、概念与密集文字准确转化为专业排版。还支持交互式精准编辑,基于空间位置与区域语义实现点选、圈选、图层分离等可控编辑。目前 Seedream 5.0 Pro 已上线火山方舟体验中心,并即将在豆包、即梦上线。AI模型Seedream 5.0 Pro字节跳动火山方舟3 个信源在谈事件专题推荐理由:字节新出的 Seedream 5.0 Pro 能一键生成复杂信息图,还能像修图一样精准编辑图像,图文匹配和质感都更强了。原文稍后读已读值得跟进有用关注 Seedream 5.0 Pro
20:57官方账号Decoder@Maximilian Schreiner中国AI初创公司MiniMax正在开发一个拥有2.7万亿参数的大型语言模型。该公司计划在今年晚些时候将该模型开源。如果成功,这将是开源社区中参数规模最大的模型之一。AI模型MiniMax开源模型2.7万亿参数推荐理由:MiniMax要开源一个2.7万亿参数的模型,比很多闭源模型还大,搞AI的可以蹲一波。原文稍后读已读值得跟进有用关注 MiniMax
19:31官方账号Decoder@Maximilian Schreiner71°Meta旗下Superintelligence Labs推出首个图像生成模型Muse Image。该模型类似OpenAI的GPT Image 2,能通过代码执行和网页搜索等工具自主优化生成结果。其@-mention功能允许用户基于他人公开的Instagram照片生成图像,无需对方同意。这种opt-out模式可能违反GDPR和欧盟AI法案。技术亮点与隐私争议并存。AI模型Muse ImageMetaInstagram10 个信源在谈事件专题推荐理由:Meta新出的Muse Image能像GPT Image 2一样调用工具自动改图,但争议点在于它能拿你Insta照片生成别人头像,隐私风险很大。原文稍后读已读值得跟进有用关注 Muse Image
18:35IT之家(博客/媒体)7月8日Momenta在港交所挂牌上市,代码6880.HK。凯迪拉克同日宣布,将行业首发量产Momenta R7强化学习世界模型。该模型分为预训练、仿真、强化学习三层,通过海量真实驾驶数据压缩物理规律。目前搭载Momenta系统的量产车辆突破100万台,交付超100款车型,累计定点超210款。AI模型MomentaR7凯迪拉克推荐理由:凯迪拉克要首发量产Momenta的R7世界模型了,这个模型能通过强化学习理解物理规律,让自动驾驶更靠谱。原文稍后读已读值得跟进有用关注 Momenta
18:19量子位@思邈精选智源研究院提出悟界·Orca方法,改变大模型训练顺序,先让模型学习世界动态变化规律。该方法旨在避免AI直接进入任务执行。相关论文入选Hugging Face论文月榜第一。AI模型悟界·Orca智源研究院Hugging Face推荐理由:智源搞了个新训练法Orca,不让AI一上来就干杂活,先学世界怎么变。论文上了Hugging Face月榜第一,值得看看他们的思路。原文稍后读已读值得跟进有用关注 悟界·Orca
17:16量子位@听雨翁荔在最新博客中提出AI自进化应首先构建Harness框架。DeepSeek成员崔添翼转发该博客并评论称该方向容易出成果。Harness可能作为系统化工具简化自进化流程,引发行业关注。AI模型翁荔HarnessDeepSeek推荐理由:翁荔给自进化指了条新路:先搭Harness。DeepSeek的崔添翼都说容易出成果,搞自进化的可以看看。原文稍后读已读值得跟进有用关注 翁荔
16:56IT之家(博客/媒体)稀宇科技 MiniMax 计划推出 2.7 万亿参数规模的新一代大模型,该模型尚未正式发布。此前于6月15日,MiniMax 开源了旗舰模型 M3,总参数 428B(4280 亿),激活参数 23B。M3 在编码与智能体评测中达到行业顶尖水平,具备自主任务拆解、工具调用与多步推理能力。MiniMax 已为超过 200 个国家和地区的 3 亿个人用户及 100 万企业客户提供服务。AI模型MiniMax稀宇科技M3推荐理由:稀宇科技要推 2.7 万亿参数的大模型,比之前开源的 M3(428B)大了一个数量级,想了解国产模型天花板可以关注。原文稍后读已读值得跟进有用关注 MiniMax
16:32IT之家(博客/媒体)精选73°蚂蚁灵波科技发布并全面开源新一代具身基座模型 LingBot-VLA 2.0,数据量从 9 万小时清洗出 5 万小时真机数据,加上从 2 万小时第一视角数据中提炼的 1 万小时,预训练数据总计 6 万小时。模型支持 17 个品牌的 20 种机器人构型,覆盖单臂/双臂、双足/轮式等多种形态。在 GM-100 评测中,LingBot-VLA 2.0 在 AgileX Cobot Magic 和 Galaxea R1 Pro 平台上的平均任务进度分和成功率均领先于 π0.5 与 GR00T N1.7。后训练版本在 RTX 4090 上推理耗时控制在 130 毫秒以内。AI模型LingBot-VLA 2.0蚂蚁灵波具身智能2 个信源在谈事件专题推荐理由:蚂蚁灵波开源了新一代具身模型 LingBot-VLA 2.0,在 20 种机器人构型上泛化,GM-100 评测中全面领先 π0.5 和 GR00T N1.7,而且推理速度很快,适合开发者试玩。原文稍后读已读值得跟进有用关注 LingBot-VLA 2.0
16:20官方一手pandaily@contact@pandaily.com (Pandaily)美团发布LongCat-2.0,一个参数量达1.6万亿的AI模型,所有训练均使用国产AI芯片完成。该模型利用美团外卖配送数据驱动,表明生活服务场景也能支撑前沿大模型研究。模型规模超过OpenAI GPT-3的1750亿参数约9倍,但训练成本因国产芯片而受到关注。LongCat-2.0现已在内部用于配送调度等业务,未公开计划开源。AI模型MeituanLongCat-2.0万亿参数模型10 个信源在谈事件专题推荐理由:美团用外卖数据训出1.6万亿参数大模型,而且全用国产芯片,技术路线和落地场景都很有意思。原文稍后读已读值得跟进有用关注 Meituan
16:07官方账号Decoder@Matthias Bastian91°OpenAI 将于周四推出 GPT-5.6,此前因美国政府要求额外测试而延迟。该模型代号 Sol,在编码基准上以约一半的成本超越 Anthropic 的 Claude Mythos 5。目前尚无模型审批的绑定标准。AI模型GPT-5.6OpenAISol10 个信源在谈事件专题推荐理由:OpenAI 的 GPT-5.6 来了,代号 Sol,编码能力比 Claude Mythos 5 强,成本还低一半,值得看看。原文稍后读已读值得跟进有用关注 GPT-5.6
14:43IT之家(博客/媒体)71°马斯克确认 SpaceXAI 将于当地时间 7 月 8 日或 9 日向公众开放 Grok 4.5 模型。该模型基于 1.5T 参数的 V9 基础模型,补充训练中加入了 Cursor 数据。声称对标 Anthropic Opus 级别,速度更快、Token 效率更高、成本更低。AI模型Grok 4.5SpaceXAIElon Musk10 个信源在谈事件专题推荐理由:马斯克说 SpaceXAI 明天就放 Grok 4.5 了,对标 Opus 还更快更省钱,想尝鲜的可以关注。原文稍后读已读值得跟进有用关注 Grok 4.5
14:28IT之家(博客/媒体)精选73°OpenAI 推出 gpt-realtime-2.1 和 gpt-realtime-2.1-mini 两款模型,专为低延迟语音智能体与多模态交互设计。官方表示通过优化缓存机制,p95 延迟至少下降 25%。gpt-realtime-2.1-mini 支持实时音频、文本输入、工具调用与函数调用,并可配置推理强度(minimal、low、medium、high、xhigh 五档)。gpt-realtime-2.1 增强字母数字识别、静音与噪声处理、中断处理等能力。定价方面,gpt-realtime-2.1 文本输入每百万 Tokens 4 美元,音频输入 32 美元;mini 版文本输入仅 0.6 美元。AI模型OpenAIgpt-realtime-2.1gpt-realtime-2.1-mini10 个信源在谈事件专题推荐理由:OpenAI 的 Realtime 2.1 延迟更低,价格也更友好,做语音代理的直接换这个,体验提升明显。原文稍后读已读值得跟进有用关注 OpenAI
13:56IT之家(博客/媒体)73°英伟达于6月发布Audex(Nemotron-Labs-Audex-30B-A3B)统一音频-文本大模型,总参数量30B,激活参数3B。该模型以Nemotron-Cascade-2-30B-A3B为骨干,采用52层混合Mamba-Transformer结构,128个可路由专家。音频编码使用AF-Whisper,语音输出用X-Codec2,非语音音频用X-Codec。文本评测中,Audex在MMLU-Redux上得分86.4(高于骨干86.3),在IMO AnswerBench上81.1(高于79.3),但在MMLU-Pro和GPQA-Diamond上小幅下降。AI模型AudexNemotron英伟达2 个信源在谈事件专题推荐理由:英伟达出了个Audex,30B参数但只激活3B,能听能说还不掉文本能力,MMLU-Redux得分86.4比原来还高一点。原文稍后读已读值得跟进有用关注 Audex
11:34IT之家(博客/媒体)92°美国商务部正式批准OpenAI大规模发布GPT-5.6。此前该模型因国家安全考量仅获准向经政府批准的有限实体分阶段发布。如今限制解除,OpenAI预计本周内向公众推出。测试工作由美国商务部下属AI标准与创新中心负责,OpenAI派出技术团队驻扎华盛顿配合。美国最新AI行政令即将出台,旨在建立正式评估框架。AI模型GPT-5.6OpenAI美国商务部10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6终于全面获批了,之前只能小范围用,现在所有人很快就能用上。原文稍后读已读值得跟进有用关注 GPT-5.6
11:07官方一手marktechpost@Asif Razzaq精选蚂蚁集团旗下Robbyant团队开源了LingBot-Vision,一个1B参数的边界中心视觉基础模型。该模型使用掩码边界建模(Masked Boundary Modeling),将图像边界作为原生训练信号。在密集空间感知任务中,1B骨干网络匹配或超越更大规模的模型。LingBot-Vision还作为初始化权重用于LingBot-Depth 2.0深度估计模型。AI模型LingBot-VisionRobbyant视觉基础模型推荐理由:蚂蚁Robbyant开源了1B参数的视觉模型LingBot-Vision,聚焦边界感知,能直接初始化深度模型,性能不输更大模型。原文稍后读已读值得跟进有用关注 LingBot-Vision
10:16官方一手pandaily@contact@pandaily.com (Pandaily)字节跳动的 Seedance 2.0 成为中国首个在视频生成领域占主导地位的模型,毛利率达 70-90%。该模型在多个基准测试中超越竞品,包括在 VideoBench 上领先 15% 以上。Seedance 2.0 改变了 AI 商业模式,通过高效的训练和推理架构实现了高利润率。其成功也标志着中国视频生成技术在全球竞争中的转折点。AI模型Seedance 2.0ByteDance视频生成2 个信源在谈事件专题推荐理由:字节跳动这个视频模型毛利率能到90%,比很多软件公司还赚钱,而且技术上领先竞品一大截,值得一看它是怎么做到的。原文稍后读已读值得跟进有用关注 Seedance 2.0
09:04IT之家(博客/媒体)72°SpaceXAI与Cursor联合开发的AI模型最快当地时间今日面世,部分性能可与Anthropic Claude Opus 4.8或OpenAI GPT-5.5相媲美。双方尚未完成600亿美元收购交易,但开发人员已展开技术合作。马斯克透露Grok 4.5基于1.5T V9基座模型,已在其旗下企业测试。Cursor首席执行官称正使用SpaceXAI Colossus数据中心从零训练模型,欲与Anthropic和OpenAI直接竞争。AI模型SpaceXAICursorGPT-5.510 个信源在谈事件专题推荐理由:马斯克的SpaceXAI联手Cursor搞了个新模型,据说能跟GPT-5.5和Claude Opus 4.8掰手腕,可以看看。原文稍后读已读值得跟进有用关注 SpaceXAI
08:54官方一手marktechpost@Asif RazzaqNVIDIA发布了Nemotron-Labs-Audex-30B-A3B(Audex)模型,这是一个混合专家(MoE)架构,统一了音频理解、语音识别、翻译、文本转语音和音频生成五种能力。该模型以Nemotron-Cascade-2为骨干,仅在音频任务上产生边际的性能回归。Audex在30B总参数中仅有3B活跃参数,高效实现了多模态融合。AI模型AudexNVIDIA多模态10 个信源在谈事件专题推荐理由:NVIDIA发了款新模型Audex,能同时搞定音频理解、语音识别、翻译、TTS和音频生成,而且几乎没牺牲原有文本模型的性能。原文稍后读已读值得跟进有用关注 Audex
08:49IT之家(博客/媒体)SpaceXAI与Cursor计划最早7月10日推出联合开发的首款AI模型,原定周三发布因效率提升推迟。该模型部分性能对标Anthropic Opus 4.8和OpenAI GPT 5.5。今年6月SpaceX以600亿美元全股票交易收购Cursor。新模型强调信息处理速度,企业AI工具市场竞争加剧。AI模型SpaceXAICursorGPT 5.510 个信源在谈事件专题推荐理由:SpaceXAI和Cursor联手搞了个新模型,据说能跟GPT 5.5和Opus 4.8打平手,好奇到底多强,可以看看评测。原文稍后读已读值得跟进有用关注 SpaceXAI
07:21IT之家(博客/媒体)73°Meta 于 2025 年 7 月 7 日发布其超级智能实验室首个自研 AI 图像生成模型 Muse Image,免费提供于 Meta AI 应用并同步登陆 Instagram 和 WhatsApp。该模型支持通过对话式语言描述生成高质量图像,能一键修复老照片、生成可用二维码,并在画面中清晰渲染文字。Muse Image 与 Muse Spark 协作进行多步骤规划,包括布局安排和实时网页信息查找,还提供超过 30 种 AI 特效用于 Instagram Stories。未来将扩展至 Facebook、Messenger 等平台,广告主可通过 Advantage+ creative 调用该模型。AI模型Muse ImageMetaInstagram推荐理由:Meta 发了新模型 Muse Image,免费在 Instagram 和 WhatsApp 上用,能生成二维码、修老照片,还能和 Facebook Marketplace 联动装修房间。原文稍后读已读值得跟进有用关注 Muse Image
06:21techcrunch@Lucas RopekMeta发布了名为Muse的新型AI图像生成模型。该模型可应用于广告设计、装饰和创作者内容生成。目前Muse的具体性能参数和开源状态尚未公开。AI模型MuseMeta图像生成推荐理由:Meta出了个新图像生成器Muse,能帮你快速做广告图、装饰图和创作素材,实用性强。原文稍后读已读值得跟进有用关注 Muse
02:09官方账号Decoder@Matthias BastianCohere发布了开源模型Transcribe Arabic,拥有20亿参数,专为阿拉伯语方言、代码切换和阿拉伯语-英语双语语音识别优化。该模型在多项测试中性能超过Whisper和OmniASR。模型已上传至Hugging Face,采用Apache 2.0许可证。AI模型CohereTranscribe ArabicWhisper推荐理由:Cohere搞了个阿拉伯语语音模型,20亿参数,专门对付方言和双语,据说比Whisper还牛,搞语音识别的快试试。原文稍后读已读值得跟进有用关注 Cohere