AITP
精选全部 AI 动态AI 日报Agent 接入关于更新日志信源提报反馈
登录 / 注册
AITOP
全部 AI 动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
标签:MiniCPM-o 4.5×
6月16日
20:46
AITOP6月16日 20:46
600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI
6月12日
12:57
AITOP6月12日 12:57
Claude代码里藏了个20260612,18个月后的AI记忆革命已经开始倒计时
6月11日
15:28
AITOP6月11日 15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
DiffusionGemma颠覆文本生成?自回归模型的“统治”要结束了
15:07
AITOP6月11日 15:07
每秒1107个token,Google开源的扩散模型为什么能改变本地推理格局?
5月18日
02:34
02:34rohanpaul_ai@rohanpaul_ai
78°
OpenBMB 发布 MiniCPM-o 4.5,一个 9B 参数的全双工多模态模型,能同时看、听、说。它基于 Omni-Flow 框架,将交互视为连续时间流,打破传统轮询式对话,实现实时感知与响应。该模型在语音生成质量上超越 Qwen3-Omni-30B-A3B,且支持 12GB RAM 边缘部署。这标志着 AI 交互层从“对讲机”模式迈向自然对话的关键一步。
AI模型MiniCPM-o 4.5全双工多模态开源/仓库实时交互

推荐理由:做多模态 AI 交互的开发者终于有了可部署的全双工开源方案——MiniCPM-o 4.5 把实时语音视频对话从概念变成 9B 模型,值得直接上手试。
原文
5月16日
17:57
17:57Paul Couvert@itsPaulAi
Thinking Machines 展示了其模型 MiniCPM-o 4.5 的全双工交互能力,能同时处理音频、视觉和文本流数据。模型将连续数据流分割为固定长度片段,并按时间戳精确对齐融合,实现实时看、听、说。该设计模仿人类同时对话、观察和思考的方式,交互体验接近真人。早期结果和演示视频已公开,展示了 AI 与人类实时协作的新范式。
AI模型MiniCPM-o 4.5全双工交互实时流处理Thinking Machines多模态

推荐理由:全双工实时交互解决了 AI 对话中“轮流说话”的延迟痛点,做语音助手或实时交互系统的开发者可以直接看演示和设计思路。
原文
精选全部日报登录