11:48IT之家(博客/媒体)76°阿里巴巴千问发布Qwen-AgentWorld,这是首个原生语言世界模型。提供两种规模(35B-A3B与397B-A17B)。模型能同时模拟文本类和GUI类环境,覆盖七大领域。通过三阶段训练(CPT、SFT、RL)构建世界建模能力。在Tool Decathlon、MCPMark和WideSearch基准上验证了可控模拟效果。AgentWorldBench已在Hugging Face发布。AI模型Qwen-AgentWorld阿里千问智能体推荐理由:阿里千问发布的这个Qwen-AgentWorld模型,能模拟智能体在七个领域的交互环境,还能当环境模拟器或智能体基础模型,挺有意思的。原文稍后读已读值得跟进有用关注 Qwen-AgentWorld
09:45IT之家(博客/媒体)71°火山引擎发布豆包音频生成模型1.0(Doubao-Seed-Audio 1.0),首次支持将文本、音频等多模态输入端到端生成目标音频。该模型能在长时生成中保持多角色音色一致性,减少后期修音工作。单条Prompt可编排角色对白、情绪语气、背景音乐等,直接产出完整音频作品。火山方舟已开启API邀测,个人用户可体验30分钟创作额度。AI模型豆包音频生成模型1.0火山引擎音频生成5 个信源在谈事件专题推荐理由:火山引擎新模型能一次编排对白、音效、配乐,还能保持10分钟的角色音色一致,省掉后期对轨修音,音频创作者值得一试。原文稍后读已读值得跟进有用关注 豆包音频生成模型1.0
08:24SuperTechFans(博客/媒体)精选Mistral于2026年6月24日发布OCR 4模型,新增边界框、区块分类和置信度分数。该模型在内部盲评和公开基准测试中性能领先,支持170种语言,可自托管部署。AI模型MistralOCR 4多模态推荐理由:Mistral新出的OCR 4能自己部署,支持170种语言,还带边界框和置信度分数,识别效果领先,做文档处理很合适。原文稍后读已读值得跟进有用关注 Mistral
07:48官方一手marktechpost@Asif Razzaq精选Mistral AI 于2026年6月23日发布 OCR 4,从纯文本提取升级为结构化文档输出。每个文本块返回边界框、类型分类以及每页和每词的置信度分数。该模型支持170种语言,可在单个自托管容器中运行,通过单一API端点向RAG、智能体和企业搜索管道提供可引用的输入。AI模型MistralOCR 4RAG推荐理由:Mistral 出了 OCR 4,能提取带边界框和置信度的结构化内容,方便直接用于 RAG 和搜索,支持170种语言还自托管,很实用。原文稍后读已读值得跟进有用关注 Mistral
03:42官方一手marktechpost@Asif Razzaq精选Datalab发布了lift,一个9B参数的开源视觉模型。该模型能将PDF与图像转换为符合给定schema的JSON结构。它使用schema约束解码确保输出有效,并训练弃权机制避免幻觉,在225份文档的基准上达到90.2%的字段准确率。AI模型Datalablift视觉模型推荐理由:Datalab的lift模型能自动把PDF转成你需要的JSON格式,准确率90.2%,还不会瞎编字段。原文稍后读已读值得跟进有用关注 Datalab
01:08官方一手OpenAI Blog(博客/媒体)GPT-5 Pro协助免疫学家Derya Unutmaz破解了持续3年的T细胞行为之谜,为癌症和自身免疫疾病研究提供新线索。该模型通过分析复杂免疫数据,识别出此前未知的T细胞激活模式。研究成果被OpenAI以案例形式发布,展示了大模型在基础科学中的应用潜力。AI模型GPT-5OpenAI免疫学9 个信源在谈事件专题推荐理由:OpenAI用GPT-5 Pro帮科学家搞定了3年没解的免疫难题,不是画饼是真能干活,科研党可以看看怎么用的。原文稍后读已读值得跟进有用关注 GPT-5
23:00量子位@十三73°字节跳动发布豆包2.1,其Agent可在18小时内自动完成芯片设计代码编写。在编程基准测试中,豆包2.1的表现比肩Opus 4.7。该版本强化了自主编程和长时任务执行能力,适用于复杂工程场景。AI模型豆包2.1字节跳动智能体推荐理由:豆包2.1的Agent太能干了,独自跑18小时写出芯片代码,编程水平还追上了Opus 4.7,做硬件的可以关注下。原文稍后读已读值得跟进有用关注 豆包2.1
20:33官方账号Decoder@Maximilian Schreiner74°字节跳动在火山引擎FORCE大会上发布了五款新AI模型,其中Seedance 2.5视频模型计划于7月初上线。Seedance 2.5将AI视频生成时长从行业常见的十几秒提升至30秒,支持更高分辨率和一致性。该模型基于扩散架构,有望在短视频创作和广告领域应用。AI模型SeedanceByteDance视频生成2 个信源在谈事件专题推荐理由:字节跳动新发布的Seedance 2.5视频模型能直接生成30秒视频,比之前模型长一倍,做短视频创作者可以试试。原文稍后读已读值得跟进有用关注 Seedance
19:06官方账号Decoder@Matthias Bastian精选OpenAI 通过其 Daybreak 网络安全计划推出了更新版 Codex Security 插件和完整的 GPT-5.5-Cyber 模型,同时宣布与超过 25 家安全公司及多个政府合作。新模型专注于从发现漏洞转向自动修补漏洞。在网络安全基准测试中,GPT-5.5-Cyber 的性能超过了 Anthropic 的 Mythos 模型。AI模型GPT-5.5-CyberAnthropicMythos10 个信源在谈事件专题推荐理由:OpenAI 新出的 GPT-5.5-Cyber 专攻网络安全,能自动修补漏洞,基准测试里已经跑赢了 Anthropic 的 Mythos。原文稍后读已读值得跟进有用关注 GPT-5.5-Cyber
19:03IT之家(博客/媒体)网易有道发布Confucius4-TTS,这是业内首个支持14种语言跨语种无口音的开源TTS模型。用户仅需提供3秒音频素材,无需参考文本即可完成零样本语音克隆,克隆音色与原声相似度超85%,准确度达97%。模型采用GPT式语义大模型搭配Flow Matching流匹配生成框架,支持音频Prompt情感克隆迁移,可跨语种保留语调韵律。全量开源(Apache协议),提供54GB完整资源包,商用无限制,适用于多语种内容生成、数字人配音等场景。AI模型Confucius4-TTS网易有道语音克隆推荐理由:网易新开源Confucius4-TTS,3秒克隆你的声音,还能用这个声音说14种外语没口音,全开源随便用,做配音超方便。原文稍后读已读值得跟进有用关注 Confucius4-TTS
16:21官方一手Pandaily@contact@pandaily.com (Pandaily)百度推出Unlimited-OCR技术,核心是Constant KV Cache方法,专为超长文档设计。该技术在长文档OCR任务上取得SOTA性能,解决了传统KV缓存随文档长度线性增长的问题。Constant KV Cache将缓存大小保持常数,显著降低内存占用和推理延迟。AI模型Unlimited-OCRConstant KV Cache百度8 个信源在谈事件专题推荐理由:百度搞了个Unlimited-OCR,用Constant KV Cache解决长文档识别,缓存不爆炸,性能还最强,适合处理几百页的合同或文献。原文稍后读已读值得跟进有用关注 Unlimited-OCR
15:48官方账号OpenAI@OpenAI (@OpenAI)OpenAI推出了GPT-5.5-Cyber,这是其最强大的网络模型,专注于高级授权防御任务。该模型能够追溯脆弱代码、验证漏洞、开发补丁,并为人工审查准备证据。这是开源模型在基准测试中首次达到GPT-3.5水平,仅用1/10的计算量。AI模型GPT-5.5-CyberOpenAI网络安全10 个信源在谈事件专题推荐理由:OpenAI搞了个专门搞网络安全的模型GPT-5.5-Cyber,能自动找漏洞、打补丁,干活比人快还准,安全团队有福了。原文稍后读已读值得跟进有用关注 GPT-5.5-Cyber
15:21IT之家(博客/媒体)精选73°OpenAI于6月22日发布GPT-5.5-Cyber网络安全专用模型,面向Daybreak项目有限开放。该模型在CyberGym测试中取得85.6%的得分,超过Claude Mythos 5的83.8%和GPT-5.5的81.8%。在ExploitGym测试中得分为39.5%,而GPT-5.5为25.95%。在SEC-bench Pro测试中得分69.8%,GPT-5.5为63.1%。AI模型GPT-5.5-CyberOpenAIClaude Mythos 510 个信源在谈事件专题推荐理由:OpenAI新出的网络安全大模型GPT-5.5-Cyber挺猛,CyberGym跑分超了Claude Mythos 5,安全团队可以关注一下。原文稍后读已读值得跟进有用关注 GPT-5.5-Cyber
14:21IT之家(博客/媒体)Sakana AI 推出多智能体编排系统 Sakana Fugu,它是一个语言模型,可根据任务智能调用包括自身在内的最适模型,并封装为单一 API。初始提供平衡型 Fugu 和面向复杂问题的 Fugu Ultra 两种版本。Sakana AI 宣称 Fugu Ultra 在部分工程、科学和推理基准测试中可提供与 Anthropic Fable 5 / Mythos Preview 相当甚至更优的性能。该系统帮助用户避免对单一供应商的依赖。AI模型Sakana FuguSakana AIAnthropic10 个信源在谈事件专题推荐理由:日本 Sakana AI 搞了个 Fugu 系统,能自动选最好的模型干活,Fugu Ultra 在某些测试上比 Anthropic Fable 5 还强,值得看看。原文稍后读已读值得跟进有用关注 Sakana Fugu
12:27IT之家(博客/媒体)72°Seedance 2.5 是字节跳动最新的视频生成模型,支持单段原生 30 秒视频直接生成,并可同时导入最多 50 个全模态参考素材,提升可控性。该模型目前处于企业内测阶段,预计 7 月初上线。前代 Seedance 2.0 已升级具备原生 4K 视频生成能力。字节还发布了 AI 版权商业化平台,周星驰成为首批合作对象,用户可基于官方授权模板对经典电影片段进行二次创作,当日创作量已突破十万次。AI模型豆包Seedance 2.5视频生成4 个信源在谈事件专题推荐理由:字节跳动新视频模型 Seedance 2.5 能直接生成 30 秒长视频,还支持 50 个全模态素材输入,马上 7 月就能用上了。周星驰经典片段也能用 AI 二次创作,挺有意思。原文稍后读已读值得跟进有用关注 豆包
10:06IT之家(博客/媒体)字节跳动发布的豆包Seed 2.1系列包括Pro和Turbo两个版本,Pro面向高复杂度任务,Turbo面向大规模生产。该系列在Coding工程交付、Agent长链路任务执行和多模态理解三大方向实现升级。价格方面,Pro模型推理输入6元/百万tokens(缓存命中1.2元),推理输出30元/百万tokens;Turbo模型推理输入3元/百万tokens(缓存命中0.6元),推理输出15元/百万tokens。同时发布了每周至少更新一次版本的Seed-Evolving模型和面向泛娱乐的角色模型Character。AI模型豆包Seed 2.1字节跳动推理模型4 个信源在谈事件专题推荐理由:字节新出的豆包Seed 2.1 Pro和Turbo,专门优化编程、智能体和多模态任务,Pro适合高难度场景,Turbo便宜且效率高,很适合接项目用。原文稍后读已读值得跟进有用关注 豆包Seed 2.1
02:51官方一手marktechpost@Asif Razzaq精选73°Sakana AI 推出 Sakana Fugu,一种编排模型,可将用户任务动态路由至可替换的前沿 LLM 池。其增强版 Fugu Ultra 在多个编码、推理和智能体基准测试中取得领先成绩。该模型通过选择最适合的模型来提升任务效率,无需用户手动切换。AI模型Sakana AISakana Fugu编排模型1 个信源在谈事件专题推荐理由:Sakana AI 搞了个 Fugu 编排模型,能自动在多个前沿 LLM 之间切换最优选择,在编码和推理基准上表现很突出。原文稍后读已读值得跟进有用关注 Sakana AI
00:48官方一手AWS Machine Learning Blog@Gilbert V Lepadatu精选AWS博客介绍了基于Amazon Bedrock和OpenSearch Serverless构建的可搜索航空影像系统架构。团队使用OpenStreetMap地面实况数据设计了四项实验,对比了嵌入模型、融合策略、字幕生成和搜索方法。其中Amazon Nova Multimodal Embeddings在基准查询中取得了最高的F1分数。该系统最终演变为Vexcel Intelligence产品,为地理空间语义搜索提供了实用指导。AI模型Amazon Nova Multimodal EmbeddingsAmazon BedrockOpenSearch Serverless推荐理由:AWS用Amazon Nova做航空影像搜索,F1分数最高,想搞地理空间搜索的可以参考他们的实验设计。原文稍后读已读值得跟进有用关注 Amazon Nova Multimodal Embeddings
23:51官方账号Nathan Lambert: Interconnects@Nathan LambertGLM-5.2 是智谱AI推出的新模型,重点提升开放智能体场景下的表现。该模型在工具调用和多步推理任务上取得进展。GLM-5.2 在多项智能体相关基准上展现了更强的自主决策能力。AI模型GLM-5.2Zhipu AI智能体1 个信源在谈事件专题推荐理由:GLM-5.2 把开放智能体的能力又推了一步,想看智能体怎么进化的可以瞄一眼。原文稍后读已读值得跟进有用关注 GLM-5.2
21:30IT之家(博客/媒体)生数科技的新一代视频生成大模型 Vidu Q3 上线华为云 MaaS,支持文生视频和图生视频一体化成片。该模型是全球首个“为剧而生”的视频大模型,可生成 16 秒 1080P 画质内容,并实现声画同出、多镜头叙事。Vidu Q3 推出两个版本:Turbo 极速版优化推理速度与成本,适合快速创意打样;Pro 专业版支持 4K 分辨率,面向广告大片等专业场景。模型还具备多国语言文字渲染及多语言输出功能,可用于漫剧、短剧和影视创作。AI模型Vidu Q3华为云生数科技推荐理由:生数 Vidu Q3 上线华为云,能一键文/图生视频,支持 16 秒 1080P 和 4K,还有专为剧集设计的镜头叙事能力,做短视频或专业视频都合适。原文稍后读已读值得跟进有用关注 Vidu Q3
17:15IT之家(博客/媒体)百川智能与清华大学联合发布医疗增强大模型 Baichuan-M4。该模型在 HealthBench 综合得分 68.6,超越 GPT-5.5 超 10 分,幻觉率低至 3.3%。在 SCAN-bench 动态问诊评测中初诊 79.0、复诊 74.7,均领先 GPT-5.5、DeepSeek-V4-Pro 和 Claude Opus 4.7。M4 还具备全病程记忆功能,长上下文临床记忆得分 86.9,较上一代 M3 提升 21.1 分。其证据锚定机制使循证引用精度达到 90.0,远超 GPT-5.5 的 54.7。AI模型Baichuan-M4百川智能HealthBench10 个信源在谈事件专题推荐理由:百川发了医疗增强大模型 M4,在 HealthBench 碾压 GPT-5.5,幻觉率仅 3.3%,看病问诊更靠谱。原文稍后读已读值得跟进有用关注 Baichuan-M4
17:03量子位@量子位的朋友们阿里发布了视频生成模型HappyHorse 1.1,在分辨率、时长、运动一致性、视觉质量和推理速度五个维度进行了升级。新版本较上一代在生成稳定性和细节表现上有所提升。该模型面向创意视频制作场景,可生成更流畅的长视频片段。具体升级幅度和对比数据尚未公布。AI模型HappyHorse阿里视频生成模型推荐理由:阿里刚发了HappyHorse 1.1,视频生成模型又升级了,想知道具体提升了哪些方面可以看看。原文稍后读已读值得跟进有用关注 HappyHorse
16:45IT之家(博客/媒体)71°京东发布并开源了实时视频视觉语言交互模型JoyAI-VL-Interaction,这是全球首个全栈开源的interaction模型和系统,获得vLLM-Omni的day-0原生支持。该模型能持续观察视频流,自主判断何时响应,而非被动等待用户提问。在58个真人盲评案例中,JoyAI-VL-Interaction对比豆包视频通话助手胜率77.6%,对比Gemini视频通话助手胜率87.9%。它支持摄像头、直播流、监控流等多种视频输入,并具备后台智能体委托能力。AI模型JoyAI-VL-Interaction京东多模态推荐理由:京东开源了JoyAI-VL-Interaction,能实时看视频主动说话,安防、直播都能用,盲评胜率比豆包和Gemini高一大截。原文稍后读已读值得跟进有用关注 JoyAI-VL-Interaction
16:33官方账号Decoder@Matthias BastianSakana AI推出了Fugu系统,该系统能动态协调多个大型语言模型(如GPT-4、Claude等),在Fable和Mythos基准测试上达到与Anthropic的Fable 5相当的性能。Fugu通过实时路由和模型组合,减少了对单一AI提供商的依赖。测试中,Fugu在Fable基准上得分超过Anthropic的Fable 5,并在Mythos基准上表现出色。AI模型Sakana AIFuguAnthropic10 个信源在谈事件专题推荐理由:日本AI公司Sakana AI搞了个新系统叫Fugu,能让不同模型一起干活,不用只靠一家供应商。效果还跟Anthropic的Fable 5差不多,值得看看怎么做到的。原文稍后读已读值得跟进有用关注 Sakana AI
15:18官方一手marktechpost@Asif Razzaq精选MoonMath AI 开源了一个基于 HIP 的注意力内核,针对 AMD MI300X GPU 进行了优化。该内核采用单指令汇编包装器和八波流水线架构,在所有形状和舍入模式下均击败了 AMD 官方实现的 AITER v3。基准测试结果显示,新内核在 MI300X 上的性能显著领先,未出现任何退化情况。AI模型MoonMathAMD MI300XHIP推荐理由:MoonMath 开源了一个注意力内核,能在 AMD MI300X 上全面碾压官方 AITER v3,速度更快,所有形状都更强,值得跑推理的人试试。原文稍后读已读值得跟进有用关注 MoonMath
15:06IT之家(博客/媒体)72°特斯拉Semi电动重卡在加州森尼韦尔被拍到搭载基准真值校验设备(ground truth validation)。该设备用于监督式算法训练,旨在为8级纯电动重卡完善FSD模型。特斯拉此前在Cybertruck上因摄像头高度异常,FSD功能延迟部署,一周前才推送智能召唤(ASS)功能。Semi的FSD若能落地,将缓解法规对卡车司机驾驶时长的限制,提升物流效率,但技术挑战类似Cybertruck。AI模型特斯拉SemiFSD推荐理由:特斯拉正在给Semi重卡刷FSD,用专业校准设备训练,比乘用车版更难搞,搞定了能解决卡车司机疲劳问题。原文稍后读已读值得跟进有用关注 特斯拉
14:57IT之家(博客/媒体)阿里巴巴今日发布视频生成模型 HappyHorse 1.1,较 1.0 版本在动态表现力、主体一致性、指令遵循等维度系统性升级。模型单次生成时长 3 到 15 秒,支持 720p 和 1080p 分辨率和自由宽高比。官方同步宣布联合虎鲸文娱集团举办 “Horsepower” AI 影像大赛,优胜者获百万商单合作,导演张纪中担任评委。即日起可通过 HappyHorse 官网、阿里云百炼和千问云使用最新版本。AI模型HappyHorse阿里巴巴视频生成推荐理由:阿里刚发了视频生成模型 HappyHorse 1.1,动态和一致性更强了,还搭了百万大奖的比赛,玩 AI 视频的可以试试。原文稍后读已读值得跟进有用关注 HappyHorse
14:09IT之家(博客/媒体)郭明錤透露,谷歌在 TPU v9(Humufish)基础上推出升级改款 Triggerfish,针对 AI 推理优化,由联发科独家代工。Triggerfish 片内 SRAM 缓存规模为 Humufish 的 2~3 倍,可降低数据传输开销;片外 DRAM 从 HBM4 升级至 HBM4E。该芯片旨在缓解“CPU 墙”与“内存墙”问题,预计2027年底投产,2028年底放量,生命周期出货 100~200 万颗,单价较 Humufish 高出约三成。还引入“simulation die”,可能用于本地 TPU 管理、训推切换等功能。AI模型谷歌TPU v9联发科推荐理由:谷歌和联发科联手要做 TPU v9 推理升级版 Triggerfish,缓存翻倍、内存升级,2027 年就能看到成品了。原文稍后读已读值得跟进有用关注 谷歌
12:54量子位@思邈清华大学团队开源的空间智能模型被ECCV 2026接收。该模型在空间理解基准上得分超过Gemini。它能够处理120分钟的长视频并保持上下文。模型权重和代码已开源。AI模型空间模型ECCV2026清华推荐理由:清华这套空间模型在ECCV 2026上把Gemini比下去了,还能边看两小时长视频边记,玩空间理解的同学可以试试。原文稍后读已读值得跟进有用关注 空间模型
10:48官方一手Pandaily@contact@pandaily.com (Pandaily)ByteDance Seed与学术合作伙伴提出SpatialTree,这是一个分层框架,旨在重新定义多模态大模型(MLLM)对空间的理解与推理能力。该工作已被计算机视觉顶级会议CVPR 2026接收。SpatialTree通过层级结构显著提升MLLM在空间任务上的表现。AI模型SpatialTreeByteDance SeedCVPR 20264 个信源在谈事件专题推荐理由:字节跳动Seed搞了个SpatialTree框架,专门提升多模态模型的空间推理能力,还被CVPR 2026接受了,值得一看。原文稍后读已读值得跟进有用关注 SpatialTree
09:30IT之家(博客/媒体)精选闪迪新专利(US 12,430,274 B2)提出将搭载CMOS键合阵列的NAND闪存存储裸片堆叠在主计算裸片下方,主计算裸片可为AI加速器或GPU。与HBM DRAM共存于同一中介层,HBM负责低延迟高优先任务,NAND闪存承担大容量读写。单组HBF堆叠容量最高4TB,而HBM单堆仅32~64GB。宽通道互联降低传输延迟、硬件成本和功耗。该架构尚在专利阶段,量产面临功耗和制造成本挑战。AI模型闪迪NAND闪存HBM推荐理由:闪迪把海量NAND闪存直接堆到GPU底下,单堆容量冲到4TB,比HBM大几十倍,延迟还低,存储瓶颈的新解法来了。原文稍后读已读值得跟进有用关注 闪迪
07:12官方一手marktechpost@Asif Razzaq精选Cisco Foundation AI开源FAPO,由Claude Code驱动,自动优化多步骤LLM流水线。FAPO评估整个链条,在步骤级别归因失败原因,并提出提示、参数和链结构层面的变体。在18个模型-基准对比中,FAPO击败GEPA 15次。每个变体经独立审批评证后集成到优化循环中。AI模型FAPOClaude CodeCisco推荐理由:Cisco开源了FAPO,能自动修多步LLM管线的提示,比GEPA强在15/18个测试里,想搞提示优化的快去试试。原文稍后读已读值得跟进有用关注 FAPO
05:58官方一手marktechpost@Michal SutterNous Research为其开源智能体框架Hermes Agent新增了Blank Slate模式。该模式默认仅启用provider、model、File Operations和Terminal四项基础功能。用户通过platform_toolsets.cli和disabled_toolsets命令行接口手动添加其他工具集,实现从零开始配置。这种设计避免了预装过多工具,提升了Agent的灵活性和可控性。AI模型Hermes AgentNous Research智能体推荐理由:想精细控制Agent工具?Nous Research给Hermes Agent加了Blank Slate模式,从零选工具,不预装一堆,清爽又可控。原文稍后读已读值得跟进有用关注 Hermes Agent
19:56量子位@听雨由三位00后开发者耗时两个月打造的流式音视频社交模型,在推理速度上达到SOTA水平。相比谷歌的Veo 3,其速度提升7倍,成本降低至1/2000。模型支持实时音视频交互,适用于社交场景。AI模型Veo 3流式模型音视频社交推荐理由:三个00后做的音视频社交模型,速度比谷歌Veo 3快7倍,成本低到吓人,适合实时互动场景。原文稍后读已读值得跟进有用关注 Veo 3
17:42IT之家(博客/媒体)74°LM Studio 与苹果在 WWDC 2026 期间合作,用四台 Mac Studio 集群成功运行月之暗面万亿参数大模型 Kimi K2.6。Kimi K2.6 总参数达 1 万亿,采用 MoE 架构,激活参数 320 亿,支持长上下文、多模态输入和智能体任务。四台 Mac Studio 通过 Thunderbolt 5 RDMA 内存共享形成约 1.5TB 统一内存,实现模型推理。演示还展示 LM Link 功能,用户可从 MacBook Neo 或 iPhone 安全远程访问集群模型,数据保持本地处理。在类似配置下,模型生成速度约 28 tokens/s,功耗低于传统 GPU 集群。AI模型Kimi K2.6LM StudioMac Studio推荐理由:LM Studio 用四台 Mac Studio 跑起万亿参数的 Kimi K2.6,还能用 iPhone 远程调用,给消费级本地部署开了个好头。原文稍后读已读值得跟进有用关注 Kimi K2.6
16:46官方一手Pandaily@contact@pandaily.com (Pandaily)智谱AI的GLM 5.2在Design Arena的HTML网页设计基准测试中超越Claude Fable 5,获得第一名。该模型在第三方库利用方面表现更优,同时具备成本优势。Design Arena基准专门评估AI生成HTML代码的设计质量和功能性。AI模型GLM 5.2Claude Fable 5Zhipu AI7 个信源在谈事件专题推荐理由:智谱AI的GLM 5.2在网页设计上干掉了Claude Fable 5,库支持更好还更省钱。原文稍后读已读值得跟进有用关注 GLM 5.2
16:21IT之家(博客/媒体)上海交通大学等机构在arXiv发布研究,提出BabelTele压缩方法。该方法将文本压缩至原大小的27.9%,仍保持99.5%的语义准确性。人类阅读压缩文本后问答准确率显著下降,但Gemini 3.1 Pro准确率稳定。在MeetingBank和QuALITY基准上,同等压缩率下BabelTele优于LLMLingua-2。多智能体通信测试中,减少约40%通信Token,任务完成度超过96%。AI模型BabelTeleGemini 3.1 Pro文本压缩推荐理由:上海交大团队搞了个BabelTele,AI之间能说人类看不懂的语言,压缩四分之三文本还差不多全对,省token神器。原文稍后读已读值得跟进有用关注 BabelTele
14:30IT之家(博客/媒体)82°OpenAI 预计下周发布 GPT-5.6 系列,涵盖 mini、标准版和 Pro 版。部分 Pro 订阅用户已可访问 GPT-5.6 Pro,输出质量提升明显。上下文窗口从 100 万 tokens 扩展至 150 万 tokens,优化了长周期编码和 Codex 响应速度。消息称在智能体编码工作中,GPT-5.6 已超越 Anthropic 的 Mythos 系列。定价方面,OpenAI 当前 token 价格约为 Anthropic 的一半,计划进一步降价。AI模型GPT-5.6OpenAIMythos10 个信源在谈事件专题推荐理由:OpenAI 要发 GPT-5.6 了,上下文拉到 150 万 tokens,编码能力还干翻了 Anthropic 的 Mythos,价格还更便宜,开发者可以关注一下。原文稍后读已读值得跟进有用关注 GPT-5.6
11:09IT之家(博客/媒体)x86生态系统咨询小组(EAG)于2024年由英特尔和AMD联合成立,旨在统一x86架构演进。EAG近日发布ACE规范1.15版本,定义了一套针对AI计算的指令集,核心优化矩阵乘法运算和低精度数据格式处理。ACE支持INT8、FP16、BF16、FP8等多种数据格式,并引入图块寄存器(tile register)状态。AMD明确Zen 6将添加新AI数据类型支持,Zen 7配备新矩阵引擎与AI数据格式扩展。AI模型英特尔AMDACE推荐理由:英特尔和AMD联手推出了ACE规范1.15,专门给x86芯片加AI加速指令,未来Zen 6和Zen 7都会用上,搞深度学习的朋友可以关注。原文稍后读已读值得跟进有用关注 英特尔
10:18官方一手pandaily@contact@pandaily.com (Pandaily)小米发布并开源了Miloco 2.0全屋AI系统,具备多模态感知能力,可识别用户行为和场景。该系统支持主动智能,能预测需求并执行持续任务,如自动调节灯光温度。Miloco 2.0拥有家庭记忆功能,可记住家庭成员的偏好和习惯。该系统被比作钢铁侠的JARVIS管家,面向中国家庭提供个性化服务。AI模型小米Miloco 2.0智能家居推荐理由:小米开源了Miloco 2.0,一个像JARVIS一样有记忆能主动帮忙的智能家居AI,多模态和家庭记忆功能很实用。原文稍后读已读值得跟进有用关注 小米