6月10日
16:03
16:03官方一手pandaily@contact@pandaily.com (Pandaily)
72°
由清华和哈佛校友创立的 Acorn Robot 团队开发出一款无需任何训练数据即可学习物理操作的机器人。该机器人仅依靠触觉传感器和基于本能的试错机制,就能完成如捡起平放信用卡等复杂任务。这一突破颠覆了传统机器人依赖大量标注数据的训练模式,展示了通过简单感知和反馈实现自主学习的可能性。对于机器人领域而言,这标志着向更通用、更自主的智能体迈出了重要一步。

推荐理由:做机器人或具身智能的团队终于有了一个无需海量数据就能自主学习的方案——Acorn Robot 的零数据本能学习法,直接解决了数据采集成本高、泛化难的问题,值得关注其后续开源或合作机会。
14:30
14:30IT之家博客/媒体
华为HDC 2026开发者大会将于6月12日至14日举行,议程显示JetBrains IntelliJ部门负责人将在鸿蒙电脑开发者论坛发布关于“JetBrains IDEs on HarmonyOS”的内容。目前JetBrains旗下热门IDE仅支持Windows、macOS和Linux,尚未原生适配鸿蒙电脑。这一议题暗示JetBrains IDE有望登陆鸿蒙系统,为鸿蒙生态的开发者工具链带来重要补充。
事件专题

推荐理由:鸿蒙电脑生态终于迎来关键开发者工具——JetBrains IDE原生适配将解决鸿蒙开发者缺乏专业编程环境的痛点,做Java、Kotlin等开发的团队可以直接关注大会发布。
12:17
12:17官方账号Simon Willison’s Weblog博客/媒体
精选
Simon Willison 发布了 llm 0.32a3 版本,该版本的代码几乎完全由 Anthropic 的新模型 Claude Fable 5 编写。这标志着 AI 辅助编程进入新阶段,开发者只需描述需求即可获得完整实现。Simon 在博客中详细记录了这一过程,展示了 AI 生成代码的质量和效率。对于使用 llm 工具或关注 AI 编程的开发者来说,这是一个值得关注的里程碑。
事件专题

推荐理由:Simon Willison 用实践证明了 Claude Fable 5 的代码生成能力,做工具开发或 AI 编程的团队可以看看 AI 如何独立完成一个完整项目,值得点开了解细节。
09:48
09:48IT之家博客/媒体
小红书宣布向创作者开放“RED Skill”功能,允许在笔记中嵌入 AI Skill 组件。用户点击组件即可一键复制口令,安装到自己的 Agent 中使用,无需跳转第三方平台。创作者需满足粉丝量≥1000、注册时长≥6个月等条件才能申请权限。该功能降低了 AI 技能的分发门槛,让小红书成为 AI 技能的社交传播平台。

推荐理由:小红书把 AI 技能做成了可嵌入笔记的组件,创作者和 AI 爱好者可以直接在平台内传播和获取技能,省去跳转麻烦。做内容或 AI 工具分发的团队值得关注这个新渠道。
05:15
05:15官方一手GitHub Blog@Natalie Guevara
GitHub 推出 Copilot CLI 的自定义智能体功能,允许开发者将终端中的一次性提示转化为可重复、可审查的工作流。该功能让 Copilot 理解你的技术栈和团队流程,从而更精准地执行任务。通过自定义智能体,团队可以共享和复用最佳实践,提升开发效率。这对于需要标准化操作流程的团队尤其有用,减少了重复劳动和错误。
推荐理由:GitHub 把 Copilot 从“问一句答一句”升级成“懂你团队流程”的智能体,做 DevOps 或需要标准化终端操作的开发者可以直接用起来,省去反复写相同命令的麻烦。
04:31
04:31官方一手OpenAI Blog博客/媒体
Nextdoor 的工程师利用 OpenAI 的 Codex 模型(基于 GPT-5.5)来调查难以复现的问题、跨平台构建应用,并专注于产品成果。Codex 帮助他们自动化调试流程,减少重复劳动,从而将更多精力放在创新和用户体验上。这一实践展示了 AI 编程助手在真实生产环境中的价值,尤其适合处理复杂、跨平台的工程挑战。
事件专题

推荐理由:做全栈或跨平台开发的团队,如果被难复现的 bug 和平台适配折磨,可以看看 Nextdoor 怎么用 Codex 提效——直接复用他们的思路,能省下大量调试时间。
01:33
01:33官方账号Decoder@Matthias Bastian
Google 发布了 Gemini 3.5 Live Translate,这是一个音频模型,支持超过70种语言的实时语音翻译。系统无需等待句子结束即可连续翻译,并声称能保留说话者的语调、语速和音高。在 Google Meet 中,语言支持从5种跃升至70多种。这标志着实时翻译技术的重要进步,尤其对跨国会议和多语言沟通场景有重大影响。
事件专题

推荐理由:跨国团队和频繁开会的用户终于有了靠谱的实时翻译工具——Gemini 3.5 不仅支持70+语言,还能保留说话者的语气和节奏,建议在 Google Meet 中直接体验。
00:02
00:02官方一手Google DeepMind: Blog博客/媒体
76°
Google DeepMind 推出 Gemini 3.5 Live Translate,将自然流畅的实时语音翻译集成到 Google AI Studio、Google Translate 和 Google Meet 中。该技术基于 Gemini 3.5 模型,能够实现近乎实时的语音翻译,保留语气和情感,提升跨语言沟通体验。这一更新解决了传统机器翻译生硬、延迟高的问题,对跨国会议、旅行和内容创作场景意义重大。
事件专题

推荐理由:跨国团队和频繁使用翻译工具的用户终于有了更自然的实时语音翻译——Gemini 3.5 Live Translate 在 Google Meet 和 Translate 中直接可用,建议开会或旅行时试试。
6月9日
23:32
23:32官方一手pandaily@contact@pandaily.com (Pandaily)
76°
红杉资本支持的 AI 初创公司 Floatboat 发布了一款名为“Proactive Agent OS”的智能体操作系统,其核心特点是利用用户的日历事件自动触发工作流程。系统能根据会议安排自动生成简报、跟进事项、收集文档并执行重复性任务。其内置的 FloatIM 界面将 AI 智能体视为群聊中的团队成员,支持多个智能体自主协作。该平台已接入超过 3500 个应用,并集成了飞书和微信,同时支持 DeepSeek 和 Kimi 等模型。

推荐理由:对于被会议和重复性事务淹没的职场人来说,Floatboat 的日历驱动智能体直接解决了“手动触发”的痛点,让 AI 主动为你干活。建议经常使用飞书或微信办公的团队点开看看,这可能是提升协作效率的新方式。
08:12
08:12官方账号Simon Willison’s Weblog博客/媒体
精选
苹果在WWDC 2026上发布了新版Siri AI,采用基于Gemini的定制模型,运行在私有云上。新Siri利用视觉大模型从用户屏幕提取信息,无需应用单独适配。苹果还推出了Core AI库,支持PyTorch模型在苹果硬件上运行。iOS 27开发者测试版已包含新功能,但需排队等待使用。
事件专题

推荐理由:苹果终于用视觉LLM绕开了应用适配难题,做iOS开发或关注AI助手的开发者值得关注,新Core AI库也让本地模型部署更简单。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。