Google 一口气更新了 3.8 Flash TTS、Live Avatar 和 Notebook 语音聊天,还有个把 TPU 送上太空的卫星计划,一次看全。
三大头部实验室要自己定安全规则,不带你玩政府。这对整个行业的监管走向影响很大,看看它们打算怎么管模型测试和审计。
高盛算了一笔账:五巨头 2027 年要砸 1.2 万亿美元建 AI 基建,这笔钱每年波动 2500 亿就能撼动标普 500 整体盈利增速 6 个点。
Google 刚发了两个 TTS 模型,能用 30 秒音频克隆音色、支持 100 多种语言,做游戏配音或有声书可以试试
Google 把 TPU 送上太空了,太阳能是地面 8 倍,2027 年还要测试卫星激光组网,脑洞很大但逻辑说得通。
YouTube Music 上了两个 AI 功能:能对 3 亿首歌直接提问、推荐歌单,Premium 用户还能听 AI 总结的本周播客摘要。
Google 真在琢磨把 TPU 塞进卫星上天,太阳能发电效率是地面的 8 倍,原型都要搭 SpaceX 火箭发射了,脑洞和工程细节都值得看看。
Google 要把 TPU 装上卫星送上天,验证太空建数据中心的可行性,明年 10 月就发射,整个思路挺大胆的。
Google 开源了个专门管 Agent 的编排框架 AX,用 YAML 声明任务就能在集群里跑,还支持自然语言生成环境,做 Agent 基建的开发者可以看看。
Google 把 4 块 TPU 塞进卫星,下周发射。看它能不能在太空跑 Gemini,也看太空数据中心这算盘打不打得响。
谷歌给 Gemini 3.8 Live 加了虚拟人功能,能实时唇形同步、切换 97 种语言,做客服虚拟形象的企业可以直接看 API 文档上手了。
Google 要把 TPU 发上太空,2027 年两颗卫星用 800Gbps 激光链路组网,SpaceX 负责发射,脑洞挺大。
Google 给 Gemini 加了个会说话的表情虚拟形象,对话时口型和表情实时同步,不过现在只有 Enterprise 客户能用。
Google 要把数据中心搬上天,10 月 1 日发射首颗实验卫星,一颗冰箱大小,对标 1 吉瓦地面机房得一万颗。
博主 berryxia 爆料 Google 这几天可能放出 Nano Banana 2.5,还吐槽它只敢发 flash 和 Lite,不敢上 Pro 版。
Google 老将 John Platt 聊了 AI 怎么用于科研:减飞机尾迹、FireSat 卫星测火,还有用 Gemini 加蒙特卡洛树搜索拿下 CDC 疫情预测基准第一。
Google 这篇论文拆了 serverless CPU 跑量化小模型的延迟构成,55-70% 耗在加载权重,加内存到 8 GB 就能让推理快近一倍,部署前值得看。
The Information 传 Gemini 4 快训练完了,发布可能比年底早很多,盯着 OpenAI 的朋友可以留意下 Google 这边的时间线。
Philipp Schmid 演示了 Gemini 3.8 TTS 怎么用 20 秒录音复刻你的声音,或者用提示词造一个全新音色,流程就三步。
Google 给 Gemini 加了代打电话功能,Pixel 11 美国用户订阅后就能让 AI 替你给商家打电话订东西,有点像 Siri 打 reservations 那个思路。
Google 官宣 Gemini 4 进入 post-training 了,初步版本很快就来,盯着 OpenAI 那边的朋友可以对照看看进度。
Google 这篇论文把 agent harness 蒸馏进模型,移除专用 harness 后成功率反而从 23.3% 涨到 44.3%,比带 harness 还高,做 agent 的都该看看。
医疗AI工具OpenEvidence被医生用得比Google还勤,每人每天查5次,8月查询量破4200万,数据很能说明问题。
Google 的 Gemini 4 据说要这两天就发,The Information 爆料的,感兴趣的可以先蹲一下官方消息。
Gemini 3.8 的语音合成变便宜了,能一次生成多人对话,2000 多种声音可选还能克隆,Simon Willison 已经拿来做 demo 玩了。
Google 新出的 Gemini 3.8 Flash TTS 能用一句话描述就造出音色,还能一段剧本生成双人对话,做播客和配音的可以试试。
Google 在 Gemini API 里开放了逐行调语气的语音生成,能控制节奏、情绪甚至笑声停顿,还自带 SynthID 水印,做语音产品的可以去 AI Studio 试试。
Google 新出的 Gemini 3.8 Flash 语音模型,2000 多个音色支持 100 种语言,还能克隆声音,Hume 基准第一名。
谷歌新出的两款 TTS 模型能逐行控制台词语气,还能用 30 秒录音复制声音,做播客有声书的朋友可以去 AI Studio 试试。