Gemini 3.5 Flash 价格翻倍但谷歌全线铺开,做 AI 应用开发的团队需要评估成本变化,建议点开看看定价对比和 API 新特性。
全部动态
速度翻倍意味着更低的延迟和更高的吞吐量,做实时 AI 应用或大规模推理的开发者值得关注,可以直接用起来提升效率。
人形机器人开发者终于有了一个4亿参数级别的开源控制模型,零样本就能迁移舞蹈、搬箱子等复杂动作,做全身控制的团队可以直接拿来用。
Imec 的 3D CCD 方案直击 AI 推理的“内存墙”痛点,做 AI 硬件或内存架构的开发者值得关注,虽然离量产尚远,但技术方向有启发。
千问新模型在数学和编程榜单上冲进前十,做技术选型或对比评测的开发者值得关注,可以直接去 Arena AI 体验。
开源模型一个月内连发五款旗舰,做模型选型或研究的团队可以直接参考 CAISI 的 V4 评估对比,省去自己跑 benchmark 的时间。
万亿级思考模型开源,可调节推理强度让开发者按需平衡效果与成本,做 Agent 工作流或复杂推理的团队可以直接上手试。
小米把 VLA 和世界模型统一到一套框架,解决了自动驾驶多模型协同的痛点,做自动驾驶或具身智能的开发者可以直接用开源代码试试,性能还刷新了基准。
量子计算研究者或关注前沿科技的读者,这是光量子计算里程碑式突破——九章四号将算力提升到超经典计算机10^54倍,直接刷新世界纪录,值得深入了解其技术细节。
自动驾驶研究者终于有了一个统一 VLA 与世界模型的开源方案——OneVL 在精度和速度上均优于现有方法,做端到端驾驶或世界模型开发的团队可以直接拿来用。
此发布将前沿的智能体能力带入低功耗设备,为边缘AI应用(如本地化助手和离线自动化)提供了新的可能性,对开发者社区和物联网领域具有实际参考价值。
对需要跨模态语义搜索和智能体构建的开发者而言,Gemini Embedding 2 的统一嵌入能力可简化架构并提升检索质量,值得关注其在实际部署中的表现。
这一工作展示了扩散式推测解码在TPU上的实际落地价值,突破传统推测解码的顺序瓶颈,尤其利好大规模LLM推理场景。开源集成至vLLM有助于行业快速采用。