DeepSeek DSpark 提速85%,Grok 4.5 内测
2026年6月29日,AI领域迎来多项重大进展。DeepSeek 开源 DSpark 推测解码框架,将生成速度提升60-85%,无需重新训练;Grok 4.5 基于1.5万亿参数模型在SpaceX和Tesla内测,性能接近Opus;Coinbase 转向中国AI模型GLM 5.2和Kimi 2.7,成本减半而token用量持续增长,引发行业对定价压力的关注。同时,北大与DeepSeek 联合开源 DSpark,新浪 的 VibeThinker-3B 以30亿参数匹配千亿模型性能,显示小模型推理能力的突破。
模型发布/更新
5 篇百度开源了Unlimited-OCR,在vLLM上跑,能一次性解析整本书,内存不涨,比DeepSeek-OCR快35%,做文档OCR的好东西。
Grok 4.5 用了 1.5 万亿参数和 Cursor 数据,内部测试已接近 Opus,想了解马斯克最新大模型进展可以看这篇。
Nous Research 让 Agent 在不同时刻自动切换不同模型,比单一模型更强,新基准上比 Opus 4.8 高8%、比 GPT 5.5 高11%。
产品发布/更新
5 篇Anthropic 搞了个新玩法,在 Slack 里 @ Claude 就能让 AI 干活,Karpathy 说这是第三代 LLM 交互。你可以看看它是怎么改变团队协作的。
RepoPrompt 的作者被 OpenAI 招安,工具直接开源了,现在免费还支持 MCP server 调度多个 agent,做上下文工程省心很多。
开鸿数字把 M-Robots OS 捐给开源基金会了,国内首个开源鸿蒙机器人系统,时延比 Fast-DDS 低 42%,迁移成本降 80%,很实用。
行业动态
5 篇Coinbase用GLM 5.2和Kimi 2.7替换了西方模型,成本砍半,缓存命中率翻了12倍。想知道为什么中国模型更便宜?
中国自研超算 Lingsheng 219 EFLOPS 重新夺冠,比 Frontier 快 1.5 倍,值得关注国产架构进展。
OpenClaw市场23个伪装官方技能的插件被揪出来了,Manifold Security发现的命名空间抢注漏洞,ClawHub已经修复,小心供应链投毒。
论文研究
3 篇技巧与观点
5 篇Coinbase创始人Brian Armstrong分享了一套实际操作方案:用更便宜的默认模型、优化缓存和路由,能把AI成本砍半。开源模型GLM 5.2和Kimi 2.7是主角,缓存命中率从5%跳到60%。
宝玉分享了两个超实用的技巧:fork分支对话和/btw侧边提问,让Codex和Claude Code用得更顺,强烈建议试试。
Jon Udell 换了个角度聊 AI 工作流:别让代理做黑箱,让它们当团队助手,人类还是舵手。
手把手教你用 Colab 搞定 Fable 5 Traces 数据,从解析到审计再到训练基线,全流程避坑实战。