10:53Justine Moore@venturetwins一位用户过去一年半用同一图灵测试提示词试遍了 AI 视频模型,无一成功。MiniMax 3 成为首个通过该测试的模型,能在黑板上写出"Hi"。该模型由 Hailuo AI 团队发布,已开源。这标志着视频生成模型在指令遵循和文字书写能力上的显著进展。AI模型MiniMax 3Hailuo AI视频生成推荐理由:MiniMax 3 居然能真在黑板上写 Hi,之前所有视频模型都做不到,还开源了,快去试试。原文稍后读已读值得跟进有用关注 MiniMax 3
22:50techcrunch@Marina TemkinSmallest.ai 宣布完成1300万美元融资。该公司正在研发超低延迟的语音模型,目标是让AI打电话时听起来像真人。其技术试图让AI语音通过图灵测试,即人类无法分辨对话对象是机器。这笔资金将用于扩大团队并加速语音模型的迭代。行业Smallest.ai语音模型图灵测试推荐理由:Smallest.ai拿了1300万美元做超快语音AI,目标是让AI打电话像真人一样,连图灵测试都要过,挺有意思。原文稍后读已读值得跟进有用关注 Smallest.ai
09:28IT之家(博客/媒体)83°加州大学圣地亚哥分校的研究首次提供实证,证明现代 AI 能通过经典图灵测试。在实验中,GPT-4.5 有 73% 被裁判判定为人类,频率甚至高于真实人类。LLaMa-3.1-405B 也有 56% 被判定为人类,与真人无显著差异。研究强调,模型通过模仿人类的语气、幽默和易错性而非展示知识来获胜,但需要精心设计的提示词才能伪装成功。该发现对网络信任构成挑战,提示人们应降低对线上陌生人身份的确定性。AI模型GPT-4.5图灵测试LLaMa-3.1推荐理由:这项研究首次用实证数据证明 AI 能通过图灵测试,对关注 AI 社会影响和网络安全的人意义重大——做 AI 伦理或在线身份验证的团队值得仔细看,它会让你重新思考“像人”意味着什么。原文稍后读已读值得跟进有用关注 GPT-4.5
19:11官方账号arXiv cs.AI@Daniel Mitropolsky, Susan S. Hong, Riccardo Neumarker, Emanuele Rimoldi, Tomaso PoggioarXiv论文提出广义图灵测试,通过不可区分性构建代理间智能比较形式化框架。该框架无需预设数据集或任务,可对任意两个智能体进行能力排序。研究分析了传递性条件并定义多类变体,在当代模型上的实验验证了其与传统排名的一致性。论文图灵测试智能评估AI安全推荐理由:这项工作为智能评估提供了统一理论基础,可能影响未来模型训练与评测标准的设计方向。原文稍后读已读值得跟进有用关注 图灵测试