Recraft 的 V4.1 Flash 在 OpenRouter 能直接调了,一张图 1.3 秒才 7 厘美分,批量出图做 logo、概念稿都挺合适。
全部动态
LangChain 在自家大会发布了 LangSmith Engine v2,能提前揪出 Agent 的问题,做 Agent 监控的可以看看。
Interrupt 大会日程出炉了:摩根大通讲怎么搭 Jarvis 智能体,还有 Apollo 用 Deep Agents 重做 GTM 助手的实战分享。
LangChain 的 LangSmith Engine v2 来了,能给你的 Agent 做红队测试,还会自动验证修复方案,写 Agent 的可以看看。
DeepSeek Harness 出了官方客户端,Windows 和 Mac 都有,不用再敲命令行装环境了,想试的可以直接下载。
Tencent Cloud 把数据库数据做成可以像代码一样 fork 的分支,PB 级数据 1 秒克隆,跑并行实验不用再复制数据了。
腾讯云演示了怎么把现有 REST API 零代码转成 MCP 工具,还带鉴权和配额治理,做智能体接入企业系统的可以看看这套做法。
腾讯云演示了自家 AI Gateway,把模型认证、限流、审计和一个入口管完,还兼容 OpenAI 协议,企业自建私有云的可以看看这套做法。
腾讯的 Hy Image3.5 预览版开放了四个入口,Miora 免费 to Oct 7,还能在 VOD 里直接生图,做图的可以试试文字渲染效果。
Together 开源了一个基于 Qwen3.5 4B 的分类器,训练只花了 $17,还把数据配方和微调教程一起放出来了。
今天各家都在发东西:Meta 把 VR 做成眼镜,ChatGPT 语音能调插件了,Claude 开了应用市场,Qwen 的手机智能体真机成功率有 90%。
Meta 出了个叫 Muse Charm 的 AI 别针,别身上随时喊你的 Muse 智能体,12 月就发货,比 Humane Pin 那波靠谱多少得看看。
Meta Connect 快开了,传闻要开源 Muse Spark、上 Muse Video API,还有 Meta Glasses 版 Muse,消息量不小。
语音模式终于能装插件了,还换上了 GPT 6,直接在 ChatGPT Work 里用嘴干活,不用再开桌面 Remote session。
Google 把 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 开放进 AI Studio 和 API 了,能自定义声音、写剧本让两个角色对话,做配音的可以去试试。
OpenAI 拉了 80 多位心理医生做了个心理健康对话基准,GPT-6 Astra 考了 57.3 分,GPT-4o 只有 32.1,想看模型心理对话靠谱程度可以关注这套评测。
Anthropic 让 949 个 Claude 智能体自己跑 21 小时,扫了 19 亿蛋白簇,真挖出一个类似 CRISPR 的新酶系统,AI 做科研这回是真落地了。
OpenAI 给手机版 ChatGPT 加了语音智能体,Plus 和 Pro 用户能用 Work 页写文档、发邮件、总结 Slack 消息,还能建网站和幻灯片。
Anthropic 拿出湿实验室的首个成果,950 个 Claude agent 跑 21 小时真发现了一种噬菌体新酶,AI 做科学这事有实锤了。
OnSolo 出了个视频生成工具 Solo Video,一次能出 15 秒,主打开降低失败率,重试少花钱也少,比只拼时长的实在。
VoiceArena 搞了个 diarization 评测榜,12 款系统同题同规则比拼,还能看时间容差一变分数差多大,做语音的可以去看看。
有人分享了个后台小模型,发邮件或 Slack 消息前自动检查有没有违反公司政策,支持 Gmail 和 Teams,写错话之前先拦住你。
Google 官宣 Gemini 4 进入 post-training 了,初步版本很快就来,盯着 OpenAI 那边的朋友可以对照看看进度。
TSMC 拉上 Synopsys 和 Cadence,把 agentic AI 工具直接塞进先进制程的芯片设计流程,还带认证 UALink IP,做芯片的可以关注。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档