VOL.2026.06.20·78 STORIES·AITOP DAILY

AITOP日报

二〇二六年六月二十日 星期六DAILY · 每早八时
01

模型发布/更新

Model Releases
5

LM Studio 与苹果合作,成功用四台 Mac Studio 运行万亿参数 Kimi K2.6 大模型

官方IT之家原文 ↗

LM Studio 与苹果在 WWDC 2026 期间合作,用四台 Mac Studio 集群成功运行月之暗面万亿参数大模型 Kimi K2.6。Kimi K2.6 总参数达 1 万亿,采用 MoE 架构,激活参数 320 亿,支持长上下文、多模态输入和智能体任务。四台 Mac Studio 通过 Thunderbolt 5 RDMA 内存共享形成约 1.5TB 统一内存,实现模型推理。演示还展示 LM Link 功能,用户可从 MacBook Neo 或 iPhone 安全远程访问集群模型,数据保持本地处理。在类似配置下,模型生成速度约 28 tokens/s,功耗低于传统 GPU 集群。

中国科学家提出BabelTele:AI语言压缩至27.9%仍保留99.5%语义

官方IT之家原文 ↗

上海交通大学等机构在arXiv发布研究,提出BabelTele压缩方法。该方法将文本压缩至原大小的27.9%,仍保持99.5%的语义准确性。人类阅读压缩文本后问答准确率显著下降,但Gemini 3.1 Pro准确率稳定。在MeetingBank和QuALITY基准上,同等压缩率下BabelTele优于LLMLingua-2。多智能体通信测试中,减少约40%通信Token,任务完成度超过96%。

英特尔与AMD联合发布ACE规范1.15,增强x86架构AI算力

官方IT之家原文 ↗

x86生态系统咨询小组(EAG)于2024年由英特尔和AMD联合成立,旨在统一x86架构演进。EAG近日发布ACE规范1.15版本,定义了一套针对AI计算的指令集,核心优化矩阵乘法运算和低精度数据格式处理。ACE支持INT8、FP16、BF16、FP8等多种数据格式,并引入图块寄存器(tile register)状态。AMD明确Zen 6将添加新AI数据类型支持,Zen 7配备新矩阵引擎与AI数据格式扩展。

02

产品发布/更新

Product
5

Hermes Agent v0.17.0 发布:原生iMessage、异步子智能体、图像编辑

X·KOLX:Geek (@geekbb)原文 ↗

Hermes Agent v0.17.0 带来1475次提交、800个PR、245位贡献者。新增原生iMessage支持(Photon Spectrum集成,无需Mac中继)。async子智能体可在后台运行,不阻塞主会话。图像生成工具新增编辑模式,可修改源图像(如改色、去背景)。集成Cursor的Composer模型(grok-composer-2.5-fast),200k上下文窗口,无需额外API密钥。

Netflix工程师开源Headroom,号称节省60%-95%Token消耗

官方IT之家原文 ↗

Netflix高级工程师Tejas Chopra开发的开源工具Headroom,旨在降低AI应用Token成本。截至发稿,GitHub获3.96万星标,累计节省约70万美元成本并释放2000亿Token。Headroom在AI应用与LLM之间建立透明压缩层,实测代码搜索场景Token从17,765降至1,408(节省92%),SRE调试场景从65,694降至5,118(节省92%)。它支持Python/TypeScript库、智能体代理、MCP服务器等多种集成方式。

Sakana AI 发布首款商业产品:自主研究助手 Marlin

X·KOLX:Sakana AI (@SakanaAILabs)原文 ↗

Sakana AI 今日发布其首个商业产品 Sakana Marlin。它是一个自主商业研究助手,只需输入研究主题,便能自主运行约8小时,形成假设、收集信息并验证发现。最终输出结构化幻灯片和数十页的研究报告。Marlin 基于长视野推理和 AB-MCTS 方法,并融合了 Sakana AI 在日本的行业部署经验。产品提供按次付费、Pro、团队和企业计划。

Codex 上线跨设备任务迁移功能 Handoff

X·KOLX:宝玉 (@dotey)原文 ↗

Codex 推出 Handoff 功能,允许用户将编程任务在笔记本和远程服务器间迁移。操作通过聊天框自然语言指令完成,例如说“把我正在跑的线程迁移到远程主机上”。迁移内容包括完整的 Git 状态(未提交代码、当前分支),确保代码从离开位置继续。使用前提是配置 SSH 连接、远程安装 Codex 并登录同一 ChatGPT 账号,且双方有相同 Git 仓库克隆。

Jira 工单可直接分配给 Claude Code

X·KOLX:Ate-a-Pi (@svpino)原文 ↗

Atlassian 在 Jira UI 中新增了直接分配工单给 Claude Code 的功能。用户可从分配人下拉菜单选择“Claude”或在评论中提及。Claude 会获取工单全量上下文(包括验收标准、评论、附件等),然后克隆关联的 GitHub 仓库到沙箱中实现更改,并自动创建拉取请求。Jira 工单会同步更新 PR 链接。该集成需要 Anthropic API 密钥、GitHub 仓库和 Jira 账户。

03

行业动态

Industry
5

Anthropic发布Claude Fable 5并限制竞争,美国政府随后实施出口管制

X·KOLX:Andrew Ng (@AndrewYNg)原文 ↗

Anthropic发布了其Mythos模型的变体Claude Fable 5,并施加了包括禁止用于构建竞争LLM技术在内的额外限制。Anthropic还曾暗中降低Fable 5对LLM研究者的性能,在争议后改为透明执行,但仍拒绝用最新能力帮助AI研究者。随后美国政府利用商务部权力对Mythos和Fable实施出口管制,要求任何外国国民使用需许可证,导致Anthropic全球禁用Fable。Andrew Ng评论称Anthropic利用安全论调阻碍竞争者,而恐惧营销反而促使政府加强管制。

04

论文研究

Research
3

英科学家攻克量子传感器噪声难题 助力暗物质与引力波探测

官方IT之家原文 ↗

英国帝国理工学院团队首次在接近实际应用的实验条件下验证了差分测量方案,通过比较两台锶-87原子干涉仪的测量结果,消除了激光相位噪声,在单次测量被噪声淹没时仍能恢复信号。实验刻意加入额外噪声模拟远距离探测环境,联合分析后精度达到量子极限。系统成功探测到模拟的早期宇宙引力波或暗物质场信号。该成果为AION计划的长基线原子干涉仪从理论走向建造提供了关键实验依据,相关论文6月17日发表于《自然》。

05

技巧与观点

Tips & Takes
3

Claude Code 7种指令配置:CLAUDE.md到Subagents全解析

X·KOLX:shao__meng (@shao__meng)原文 ↗

Claude Code的7种指令方式包括CLAUDE.md、Rules、Skills、Subagents、Hooks、Output Styles和Appending the System Prompt。CLAUDE.md文件建议控制在200行以内,根目录CLAUDE.md在会话开始时全程驻留上下文,子目录CLAUDE.md仅按需加载。Skills在主线程逐步执行适合需要干预的任务,Subagents在独立上下文运行可嵌套最多五层并支持并行。Hooks通过PreToolUse和PostToolUse实现确定性硬约束,完全绕过上下文压缩且成本极低。官方建议将30行以上的部署流程封装为Skills而非写入CLAUDE.md,以节省token。

开源教程「Deep Agents 实战」发布,基于LangChain/LangGraph构建Agent应用

X·KOLX:shao__meng (@shao__meng)原文 ↗

LangChain官方认证大使@zhanghaili0610(也是「LangChain实战」「LangGraph实战」作者)开源了教程「Deep Agents 实战」。教程围绕Agent开发的“三层架构”:Runtime(LangGraph)、Framework(LangChain)、Harness(Deep Agents)。核心是“上下文工程”,Deep Agents引入虚拟文件系统(read_file/write_file等6大工具),支持任务规划(write_todos)、子Agent委派(异步并行)和Skills复用(兼容30+工具)。教程共8章加2准备篇,涵盖环境搭建、核心机制到进阶记忆。

如何使用TimeCopilot构建基于基础模型和自动异常检测的预测管道

X·KOLX:marktechpost (@Sana Hassan)原文 ↗

本文使用TimeCopilot在航空乘客数据集和含异常注入的合成季节性序列上构建端到端预测工作流。评估了统计模型、基础模型和可选的GPU模型,采用滚动交叉验证和多种误差指标。生成了带预测区间的概率预测,可视化未来趋势并标记异常观测。还探索了TimeCopilot的可选LLM智能体,该智能体能选择模型并解释其预测。

78
今日事件
32
一手报道
16
新模型
31
信源
AITOP · 编辑系统自动生成