8月12日
17:10
17:10AI Will@FinanceYF5
Grok Bot 为每个机器人配备独立电脑,能学习用户工作流并使用现有应用。该机器人可自主执行任务,在用户睡眠时持续工作,相当于 24/7 的 AI 员工。此功能可能冲击依赖人工操作的初创企业,引发行业关注。
推荐理由:Grok Bot 给每个机器人配了台电脑,能学你干活、用你的应用,睡觉时还在工作,像多了个 24 小时员工。
8月8日
16:46
16:46官方账号Decoder@Matthias Bastian
xAI发布新一代图像生成模型Imagine Image 2.0,现已集成到Grok中。该模型在Arena基准上排名第二,仅次于OpenAI的GPT-Image-2。新增Magic Wand和Multi-Ref Editing等编辑工具,同时提供预配置模板。这些功能主要面向实际的创意工作流。
事件专题

推荐理由:xAI出Imagine Image 2.0了,Arena排名仅次GPT-Image-2,还有Magic Wand编辑工具,可以试试。
8月7日
02:45
02:45向阳乔木@vista8
用户实测bb Agent框架,安装后无需任何配置即可自动识别本机装有的Codex cli、Grok Build cli、Claude Code cli和PI Agent。该框架支持在多个模型之间自由切换,官网宣称其IDE具备“自进化”能力。用户对产品经理的设计表示认可。

推荐理由:朋友,bb这个Agent框架装完就能自动认出你电脑里的Codex、Claude Code这些CLI,模型随便切,连设置都不用,有点东西。
8月5日
07:38
07:38IT之家博客/媒体
72°
马斯克在 SpaceX 财报电话会议上预告,Grok 4.6 将于下周发布,总参数量为 1.5 万亿。该模型重点改进监督微调(SFT)和强化学习(RL)技术。他还透露未来 3~4 周将推出 Grok 4.7,参数量达 2.1 万亿。

推荐理由:马斯克说 Grok 4.6 下周就来,1.5 万亿参数,重点改了监督微调和强化学习,可以先蹲一波。
7月29日
18:38
12:27
12:27官方一手歸藏(guizang.ai)@op7418
精选
Codepilot 推出了 Subagent 功能,允许用户在一个聊天中启用多个由不同模型驱动的子智能体。例如可用 Grok 检索 Twitter 信息、DeepSeek 生成文案、K3 生成网页、GLM 5.2 统筹。该设计旨在发挥各模型长处,同时减少昂贵模型的消耗,降低使用成本。

推荐理由:Codepilot 这个 Subagent 功能真香,一个聊天里混用 Grok、DeepSeek、GLM 5.2 等模型,各取所长还省钱,试试看。
12:26
12:26官方一手歸藏(guizang.ai)@op7418
作者使用 Codepilot 的一条提示词,让 Grok 爬取 Twitter 信息、Kimi 生成网页、DeepSeek 撰写文案,并由 GLM 5.2 统筹。该 workflow 成功完成昨天 AI 热点事件统计,时效性与人工搜集相当,甚至补充了漏掉的信息。通过分模型调用,降低了昂贵模型的消耗。

推荐理由:想用最少的成本让不同模型干各自擅长的事?参考这个 workflow:Grok 爬推文、DeepSeek 写文案、Kimi 做网页、GLM 5.2 调度。
12:25
12:25官方一手歸藏(guizang.ai)@op7418
用户通过一句提示词,调用 Grok 进行 Twitter 热点事件信息爬取,Kimi 生成网页,DeepSeek 撰写文案。三个模型分工协作,完成了昨日 AI 热点事件的统计,结果与手动搜集高度一致,并补充了遗漏信息。展示了多模型组合工作流的实际效果。
推荐理由:用一句提示词让 Grok、Kimi、DeepSeek 各司其职,自动统计 Twitter 热点,省时又全面,适合想提升信息搜集效率的人。
7月28日
15:20
15:20AI Will@FinanceYF5
一条推特用户观点指出,Claude过去在“用起来舒服”方面是强项,但现在已被Grok和Kimi超越。该用户目前最喜欢Grok,并认为Kimi也不差。他观察到Anthropic和OpenAI正在降低RLHF的优先级,转而押注更容易规模化的RL方法。
事件专题

推荐理由:有个用户觉得Claude没以前好用了,现在更喜欢Grok和Kimi,还发现Anthropic和OpenAI都在押注RL而不是RLHF,挺有意思的观察。
12:03
12:03官方一手arXiv: DeepSeek@Bartol Bućan, Nikola Sočec, Sarah Isufi, Morena Granić, Luka Hobor, Agneza Krajna, Mihael Kovac, Mario Brcic
76°
该研究对GPT-5、Claude、Grok、Gemini、DeepSeek、Kimi、Qwen共7个主流模型进行了基于政治轴的可控性压力测试,使用12种意识形态角色提示和70个政治指南针项目,共收集63,700条回答。结果发现,上下文框架解释了经济和社会轴上约88%-93%的方差,而模型自身身份的影响不到3%。在威权提示下,不同模型在相同问题上表现出相似偏移。研究强调需要进行可操控性审计,报告分散性、对称性、饱和度和拒绝底线。数据集和代码已开源。
推荐理由:这篇论文用70道政治题+12种人格提示,测了GPT-5、Claude、Grok等7个模型,发现提示词比模型本身更能左右回答方向。想了解AI怎么被‘带节奏’的可以看看。
7月25日
04:32
7月21日
15:19
7月19日
09:53
09:53AI Will@FinanceYF5
Grok 4.5 模型参数规模为 1.5T,远低于 Kimi K3 的 2.8T 参数。但 Kimi K3 每次任务成本比 Grok 4.5 高出 3 倍。SpaceXAI 宣称在智能效率上实现突破,暗示参数更小但性能更优。若 Grok 扩至 3T 参数,效率优势可能进一步放大。
推荐理由:SpaceXAI 的 Grok 4.5 用 1.5T 参数就挑战了 2.8T 的 Kimi K3,成本还低 3 倍,看看参数效率和成本怎么平衡的。