Google 一口气发了好几样:SynthID 检测工具全球能用了,Nano Banana 2.1 修图能只改局部,EmbeddingGemma 2 还能在手机上跑多模态嵌入,做开发的可以看看。
Google 这个 Gemini Agent 给每个任务单独一台电脑,还能像员工一样挂邮箱进公司通讯录,模型还能在 Gemini 和 Claude 之间随便换,挺有意思。
Google 的 Gemini Agent 要接入 Claude Opus 5 和 Sonnet 5.5 了,Claude 首次出现在 Gemini 上,企业用户一个平台能用两家模型。
Google 把 SynthID 检测工具开放成免费网站了,图片、视频、音频都能传上去查是不是 AI 做的,遇到可疑素材可以先验一下。
Google 把图像生成和编辑塞进一个模型,价格砍半还上榜 AA 榜第 4,做图成本党可以直接换。
Google 的 Logan Kilpatrick 发了条推,说 AI 很快会同样改变物理世界,可以看看他的说法。
Google 发了个能跨应用干活的 Gemini 智能体,装在 Gemini Enterprise 里,一个窗口就能派活给它,做企业任务的可以看看。
Google 在 COLM 2026 现场演示 EnvHarness,一个给 Agent 环境做动态改造的插件架构,做强化学习的可以看看思路。
Google 把 SynthID 检测器开放给所有人了,180 亿条图片视频音频都能查是不是 AI 生成的,不过只能识别带它自家水印的内容。
Google 把 SynthID 水印检测开放给所有人了,去 synthid.com 就能查图和音频是不是 AI 生成的,OpenAI 和 NVIDIA 的内容也能识别。
Google 新上了个 Playground,打字就能做小游戏,背后靠 Gemini 和 Nano Banana 出图出音乐,不会编程也能玩。
Google 把语音助手那套转写接力砍掉了,Gemini 3.8 Live 一个模型直接听直接答,还便宜到每小时 0.84 美元。
谷歌出了个免费 Mac 应用,用 EmbeddingGemma 2 在本地跑,不开网也能把会议录音加笔记整理成纪要,还能边开会边提问。
谷歌 Fitbit Edge 爆料来了:179 欧元,带 Gemini 教练能帮你定制健身计划,续航 7 天,比 Charge 6 贵 20 欧但屏幕更大。
Google 开源了个 7.4 亿参数的嵌入模型,一句话就能在手机上搜照片视频和录音,还不用联网,免费商用,做本地搜索的可以去试试。
Google 把 270M 参数的多模态 embedding 模型开源了,手机离线就能搜相册、搜语音,不用传云端,隐私党可以试试。
Ben Affleck 居然会写 Python、讲得清 CNN 和张量,还靠刷脸进了 Google 和 OpenAI 看视频模型,反差挺大的。
Google 把 EmbeddingGemma 2 用 Apache 2.0 开源了,做 RAG 存几百万条向量的朋友值得看看这篇讲为什么别用闭源 embedding 的分析。
Google 给 Gemini App 加了 Guided Vision,能帮人找东西、读小字、描述周围环境,对老人和视障用户挺实用。
Google 的 Nano Banana 2.1 上 OpenRouter 了,出图速度是 Flash 级,蒙版编辑和主体一致性比上一代强不少,做图的可以试试。
Google 开源了 EmbeddingGemma 2,一个模型同时嵌入文本、图片、音频和视频,还支持维度裁剪,做 RAG 检索的可以直接试试。