论文10:40TempCloze评测视频大模型时间推理能力新基准测试揭示视频大模型在时间对齐上的短板,比语义理解更弱。#Video-LLMs#TempCloze#时间推理#基准测试aarXiv cs.AI@Wenqi Pei 等 7 人原文稍后读已读值得跟进有用关注 Video-LLMs
论文12:09视频语言模型在简单事件计数上失准,研究揭示时间推理瓶颈用可执行真值逐帧审计视频模型计数,发现Gemini 3.6 Flash处理瞬时事件几乎失效,加帧只虚涨分数,值得看。#Gemini 3.6 Flash#视频语言模型#事件计数#时间推理1 个信源在谈事件专题aarXiv cs.AI@Sarvesh Baskar 等 8 人2 个信源在谈原文稍后读已读值得跟进有用关注 Gemini 3.6 Flash
论文精选11:21TempGlitch:评估视觉语言模型在游戏视频中的时间性故障检测能力游戏QA团队和VLM研究者终于有了专门测试时间性故障的基准——当前模型表现接近随机,说明这是个硬骨头,做自动化测试的值得关注。#视觉语言模型#游戏QA#故障检测#时间推理aarXiv cs.AI@Yakun Yu 等 7 人原文稍后读已读值得跟进有用关注 视觉语言模型
产品Agent 与开发者16:04Mem0 更新算法:默认开启时间推理,支持记忆衰减做智能体或长期记忆系统的开发者,Mem0 这次更新直接解决了记忆时效性问题,默认开启时间推理意味着更精准的上下文召回,建议直接拿免费 API 试试。#Mem0#记忆系统#时间推理#记忆衰减mem0@mem0ai原文稍后读已读值得跟进有用关注 Mem0
产品精选15:18Mem0 四月算法更新:单次提取与分层检索,时间感知记忆管理做 AI 记忆系统和长期上下文管理的开发者,这个算法更新直接解决了记忆时效性和检索效率的痛点,值得关注并尝试集成。#记忆系统#Mem0#时间推理#检索优化mem0@mem0ai原文稍后读已读值得跟进有用关注 记忆系统