模型Agent 与开发者官方一手78°13:05蚂蚁集团开源Ling-3.0-flash-VL多模态模型蚂蚁开源了带视觉反馈循环的124B MoE多模态模型,专为GUI和医疗任务优化。#Ling-3.0-flash-VL#蚂蚁集团#多模态#MoE官方一手pandaily@[email protected] (Pandaily)原文稍后读已读值得跟进有用关注 Ling-3.0-flash-VL
模型Agent 与开发者12:53DeepSeek 4.1 Flash 测试结果DeepSeek 推出了号称更快更强的 4.1 Flash,但实测网页开发任务耗时三小时,效率低下。#DeepSeek#4.1 Flash#多模态#网页开发掘金本周最热@甲维斯原文稍后读已读值得跟进有用关注 DeepSeek
模型Agent 与开发者多源确认73°11:54OpenAI发布GPT-4o架构细节OpenAI公开了GPT-4o的技术架构,开发者能了解其工作原理和性能优势。#GPT-4o#OpenAI#多模态#推理模型10 个信源在谈事件专题小互@imxiaohu11 个信源在谈原文稍后读已读值得跟进有用关注 GPT-4o
产品Agent 与开发者10:47Suno v6发布:支持多模态音乐生成Suno出了v6,能根据文本、音频、图片、视频生成音乐,还和华纳、BMG合作了。#Suno#AI音乐#多模态#华纳向阳乔木@vista8原文稍后读已读值得跟进有用关注 Suno
论文Agent 与开发者精选73°09:38VIP-Router实现视觉标记自适应剪裁VIP-Router让MLLMs根据不同图像自动选择最佳剪裁策略,不修改底层算法,参数仅占骨干模型的0.017%。#MLLMs#VIP-Router#视觉标记剪裁#多模态aarXiv cs.AI@Haiji Liang 等 6 人原文稍后读已读值得跟进有用关注 MLLMs
论文Agent 与开发者精选09:32OmniMed-FL:多模态联邦学习临床诊断框架医疗AI新框架OmniMed-FL,用联邦学习解决医疗数据隐私问题,多模态融合效果提升明显。#OmniMed-FL#联邦学习#多模态#医疗AIaarXiv cs.LG@Ayush Debnath 等 3 人原文稍后读已读值得跟进有用关注 OmniMed-FL
论文Agent 与开发者精选73°09:24多模态上下文学习中的推理路径对齐研究这篇论文提出了一个新框架,让多模态大模型通过对比学习超越表面模仿,在VQA等任务上表现更好。#多模态#上下文学习#推理路径#MLLMaarXiv cs.AI@Mingbo Yang 等 7 人原文稍后读已读值得跟进有用关注 多模态
产品Agent 与开发者73°23:57华纳音乐与Suno合作开发AI音乐模型Suno v6能改写单句歌词、组合不同歌曲元素,还推出了艺术家分成模式,华纳从对手变伙伴。#Suno#华纳音乐#AI音乐#v6The Rundown AI@therundownai原文稍后读已读值得跟进有用关注 Suno
模型中美对照官方一手精选18:00DeepSeek 推出限时 V4.1 Flash 测试版DeepSeek 推出了限时 V4.1 Flash 测试版,原生支持多模态,定价与 V4 Flash 相同。#DeepSeek#V4.1 Flash#多模态官方一手pandaily@[email protected] (Pandaily)原文稍后读已读值得跟进有用关注 DeepSeek
产品Agent 与开发者17:37Suno 发布 v6 系列 AI 音乐模型Suno 新发布的 v6 系列能快速生成各种风格音乐,还支持从图片和其他音频生成歌曲,免费用户也能用 mini 版本。#Suno#v6#AI音乐#多模态IIT之家原文稍后读已读值得跟进有用关注 Suno
产品Agent 与开发者精选73°17:17万勋科技发布NOVA2.0柔性具身大脑万勋NOVA2.0柔性具身大脑来了,能适配多种机器人构型,20ms极速反应,已落地1000万次真实场景作业。#NOVA2.0#万勋科技#具身智能#柔性大脑IIT之家原文稍后读已读值得跟进有用关注 NOVA2.0
模型Agent 与开发者73°15:22DeepSeek 将发布 V4.1 Flash 模型DeepSeek 即将发布 V4.1 Flash,性能全面超越 V4 Pro,价格更优,速度更快。#DeepSeek#V4.1 Flash#V4 Pro#多模态IIT之家原文稍后读已读值得跟进有用关注 DeepSeek
模型Agent 与开发者多源确认精选73°13:22GPT-6 Astra创建V8引擎交互式可视化看看GPT-6 Astra如何把复杂的V8发动机变成交互式3D可视化,效果很惊艳。#GPT-6#Astra#V8引擎#多模态10 个信源在谈事件专题AI Will@FinanceYF511 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
模型Agent 与开发者多源确认73°13:21GPT-6 Astra创建可操作V8发动机3D课堂GPT-6 Astra把复杂发动机拆成可交互3D模型,比传统教学直观多了。#GPT-6#Astra#3D可视化#多模态10 个信源在谈事件专题AI Will@FinanceYF511 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
论文Agent 与开发者精选73°12:16NOAH模型:全患者旅程纵向多模态预测NOAH模型能处理医疗图像、时间序列、数值信号等多种医疗数据,实现患者状态预测和反事实干预模拟。#NOAH#医疗AI#多模态#预测模型aarXiv cs.AI@Tobias Susetzky 等 8 人原文稍后读已读值得跟进有用关注 NOAH
产品Agent 与开发者11:43华为新手机支持本地大模型下载部署华为新手机能在无网状态下运行本地大模型,支持图像生成和复杂任务处理。#华为#Pura X View#Mate XT 2#端侧AI1 个信源在谈事件专题IIT之家2 个信源在谈原文稍后读已读值得跟进有用关注 华为
模型Agent 与开发者官方一手73°11:17GPT-image-2.5 图像生成模型发布OpenAI 推出了 GPT-image-2.5,图像生成速度更快,一致性更好,还能通过评论编辑,价格还和原来一样。#GPT-image-2.5#OpenAI#图像生成#多模态10 个信源在谈事件专题官方一手歸藏(guizang.ai)@op741811 个信源在谈原文稍后读已读值得跟进有用关注 GPT-image-2.5
模型Agent 与开发者多源确认10:45GPT-6 Astra学会控制机器人绘画GPT-6 Astra自己学会控制机器人画画,每次尝试都在进步,看看AI如何从数字世界走向物理世界。#GPT-6#Astra#机器人#绘画10 个信源在谈事件专题AI Will@FinanceYF511 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
模型Agent 与开发者多源确认精选73°10:33DeepSeek-V4 长上下文服务系统 RedKnot-MLA 发布DeepSeek 推出了 RedKnot-MLA 系统,能显著提升长上下文服务的速度和效率,在多个基准测试中表现优异。#DeepSeek-V4#RedKnot-MLA#长上下文#多模态3 个信源在谈事件专题aarXiv: DeepSeek@Yang Liu 等 13 人4 个信源在谈原文稍后读已读值得跟进有用关注 DeepSeek-V4
模型Agent 与开发者多源确认10:17Astra机器人学会绘画金门大桥看看Astra如何控制机器人完成现实绘画任务,进步过程很惊艳。#Astra#机器人#绘画#多模态10 个信源在谈事件专题AI Will@FinanceYF511 个信源在谈原文稍后读已读值得跟进有用关注 Astra
模型Agent 与开发者精选73°09:27蚂蚁百灵Ling-3.0-flash-VL开源发布蚂蚁开源了支持图像、文本、视频的多模态大模型,能自我修正执行结果,在医疗报告解读和GUI自动化场景表现出色。#Ling-3.0-flash-VL#蚂蚁#多模态#开源模型IIT之家原文稍后读已读值得跟进有用关注 Ling-3.0-flash-VL
产品Agent 与开发者73°09:15GPT-Image 2.5 升级精准图像编辑能力GPT-Image 2.5 能通过文字精确控制图像编辑,15种场景提示词可直接复制使用,比传统工具更高效。#GPT-Image#图像编辑#提示词#多模态小互@imxiaohu原文稍后读已读值得跟进有用关注 GPT-Image
模型Agent 与开发者多源确认07:27Astra机器人现场绘制金门大桥Sama展示Astra机器人现场绘画,从零开始学会控制机器人完成复杂任务。#Astra#机器人#金门大桥#多模态10 个信源在谈事件专题官方账号Sam Altman@sama11 个信源在谈原文稍后读已读值得跟进有用关注 Astra
模型Agent 与开发者06:13Nex-N2.5-Pro 支持图文输入OpenRouter 发布的 Nex-N2.5-Pro 能处理图文输入,通过 API 实现视觉反馈,比纯文本模型更强大。#Nex-N2.5-Pro#Nex-AGI#OpenRouter#多模态OpenRouter@OpenRouterAI原文稍后读已读值得跟进有用关注 Nex-N2.5-Pro
产品Agent 与开发者官方一手03:38OpenAI发布GPT-Image-2.5图像编辑功能OpenAI新出的GPT-Image-2.5能精准编辑图像,换衣服换背景都不跑位,电商和设计师必备。#GPT-Image-2.5#OpenAI#图像编辑#多模态10 个信源在谈事件专题官方一手@OpenAIDevs@OpenAIDevs11 个信源在谈原文稍后读已读值得跟进有用关注 GPT-Image-2.5
模型Agent 与开发者多源确认73°00:43GPT-6 Astra构建人体解剖模型GPT-6 Astra能构建复杂3D人体模型,支持个性化交互,展示了强大的研究和原型开发能力。#GPT-6#Astra#Three.js#人体解剖10 个信源在谈事件专题elvis@omarsar011 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
产品Agent 与开发者精选22:07Weaviate推出创意资产搜索系统Weaviate让创意团队能通过内容描述而非文件名查找资产,搜索'白色兔子草地场景'能找到相关素材。#Weaviate#创意资产#语义搜索#多模态Weaviate@weaviate_io原文稍后读已读值得跟进有用关注 Weaviate
模型Agent 与开发者精选73°17:28DeepSeek V4.1 Flash开启内测DeepSeek发布了V4.1 Flash内测版,换了新架构还支持多模态,和V4 Flash价格一样并发数还更多。#DeepSeek#V4.1#多模态#Flash1 个信源在谈事件专题向阳乔木@vista82 个信源在谈原文稍后读已读值得跟进有用关注 DeepSeek
产品Agent 与开发者精选16:12小米 MiMo 桌面客户端开放邀测小米新出的桌面 AI 客户端 MiMo 能直接处理多种文件格式,还能自己控制浏览器帮你干活,不用自己折腾前端环境。#MiMo#小米#桌面客户端#AI助手IIT之家原文稍后读已读值得跟进有用关注 MiMo
模型Agent 与开发者16:08DeepSeek V4.1 Flash 中间版本内测发布DeepSeek 推出了 V4.1 Flash 中间版本,新结构带来更强性能和更低成本,看看能否替代现有 V4 Pro。#DeepSeek#V4.1 Flash#多模态#模型结构IIT之家原文稍后读已读值得跟进有用关注 DeepSeek
模型中美对照官方一手16:08DeepSeek V4.1 Flash 发布DeepSeek 推出了 V4.1 Flash,多模态能力更强,调用方式简单。#DeepSeek#V4.1 Flash#GL5.3Flash#多模态官方一手歸藏(guizang.ai)@op7418原文稍后读已读值得跟进有用关注 DeepSeek
论文Agent 与开发者精选15:35TARGET-AI研究揭示顺序门控是受限的多模态融合TARGET-AI团队发表新研究,揭示了顺序门控与多模态融合的关系,对AI模型设计有重要参考价值。#TARGET-AI#多模态#顺序门控#NEJM AINEJM AI@Chin Lin and Kai-Chieh Chen原文稍后读已读值得跟进有用关注 TARGET-AI
模型Agent 与开发者多源确认15:06GPT-6 Astra 展示多领域应用能力看看GPT-6 Astra怎么玩游戏、设计蛋白质和构建3D世界,比之前的模型强在哪。#GPT-6#Astra#多模态#蛋白质设计10 个信源在谈事件专题AI Will@FinanceYF511 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
模型Agent 与开发者73°09:06微信 WeMM-Embedding 多模态模型已开源微信开源了能同时理解文字、图片和视频的 WeMM-Embedding 模型,每天被调用 10 亿次,性能还拿了全球第一。#WeMM-Embedding#微信#多模态#开源模型IIT之家原文稍后读已读值得跟进有用关注 WeMM-Embedding
模型Agent 与开发者多源确认02:32GPT-6 Astra可视化AI论文GPT-6 Astra能把AI论文变成可交互的可视化,让研究更直观易懂。#GPT-6#Astra#Transformer#论文可视化10 个信源在谈事件专题elvis@omarsar011 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
模型Agent 与开发者多源确认73°23:11OpenAI GPT-6 Astra 自主通关《传送门》OpenAI 新旗舰模型 GPT-6 Astra 花费 24 小时、571 美元自主通关 3D 游戏《传送门》,展示了多模态 AI 的进步。#GPT-6#Astra#OpenAI#传送门10 个信源在谈事件专题IIT之家11 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
模型Agent 与开发者多源确认精选73°15:45GPT-6 Astra打造可交互V8发动机看看GPT-6 Astra如何把复杂的V8发动机变成可交互的3D模型,这可视化效果真不错。#GPT-6#Astra#V8发动机#可视化10 个信源在谈事件专题AI Will@FinanceYF511 个信源在谈原文稍后读已读值得跟进有用关注 GPT-6
行业Agent 与开发者官方一手09:59中国AI宠物智能设备全球热销中国AI宠物设备正以多模态技术打入全球市场,增长迅速,值得关注。#宠物科技#多模态#智能设备#中国制造官方一手pandaily@[email protected] (Pandaily)原文稍后读已读值得跟进有用关注 宠物科技
论文73°09:28SMILE:医疗诊断自解释多模态信息瓶颈医学AI可解释性新方法SMILE,在多模态诊断中表现优异,比现有方法准确率高9.1%,还能解释诊断依据。#SMILE#医疗AI#多模态#信息瓶颈aarXiv cs.LG@Yuqing Yang 等 6 人原文稍后读已读值得跟进有用关注 SMILE
模型Agent 与开发者73°01:22Meta发布AIRA₃系统多领域泛化能力Meta的AIRA₃不仅能翻译古文字,还能优化GPU性能,系统可自我积累知识。#AIRA₃#Meta#Kaggle#GPU优化官方账号Meta AI@AIatMeta原文稍后读已读值得跟进有用关注 AIRA₃