19:50IT之家(博客/媒体)DeepSeek于7月31日发布V4-Flash正式版API,跑分显示其单任务成本比GPT-5.6 Luna低约60%。OpenRouter周度统计中,V4-Flash以7.22万亿Token调用量位居全球第一。荣耀CMO关海涛称这是“法拉利的性能,电动小摩托的价格”。该模型引发的“行业生死线”讨论,已倒逼OpenAI等巨头大幅降价并提升入门级模型能力,Kimi K3等国产模型同样加剧了竞争。AI模型DeepSeek-V4-FlashGPT-5.6 LunaOpenRouter10 个信源在谈事件专题推荐理由:DeepSeek-V4-Flash比GPT-5.6 Luna便宜六成,一周调用7.22万亿Token登顶,逼得硅谷连夜降价,你要不要看看?原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
16:43官方一手pandaily@contact@pandaily.com (Pandaily)Moonshot AI的Kimi K3、阿里Qwen3.8-Max和字节Doubao-Seed-2.1均采用原生多模态训练,而DeepSeek、智谱和腾讯混元仍坚持纯文本路线。在长程智能体任务中,视觉信息的实时参与成为决定性因素。这一差异将影响下一代模型在复杂环境中的表现。AI模型Kimi K3DeepSeek V4多模态6 个信源在谈事件专题推荐理由:Kimi K3和DeepSeek V4现在走了两条路:一个搞原生多模态,一个纯文本硬扛。长任务里能不能看懂画面,差距会越来越大。原文稍后读已读值得跟进有用关注 Kimi K3
16:26IT之家(博客/媒体)腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 融合语音识别与语义理解。该模型在开源评测集中中文普通话 WER 为 3.34%,英语为 2.62%,粤语为 3.12%。在自建评测集上,通用识别、方言、上下文理解等场景 WER 保持较低水平。腾讯元宝已首发接入该模型,支持方言识别与上下文纠错,并免费开放。Hy ASR 3.0 preview 已上线腾讯云 API 服务。AI模型腾讯混元Hy ASR 3.0元宝推荐理由:腾讯混元出了新语音识别模型 Hy ASR 3.0,粤语英语 WER 都压到 3% 左右,元宝里已经能免费用了。原文稍后读已读值得跟进有用关注 腾讯混元
13:38官方账号Latent Space (swyx)(博客/媒体)Qwen发布了两个新开源模型:Qwen 3.8 Max,参数规模2.4T,以及27B版本。两个模型都面向编程和协作场景,权重已经开放。开发者可以基于这些权重进行本地部署或微调。这延续了Qwen在开源模型上的发布节奏。AI模型QwenQwen 3.8 Max开源模型推荐理由:Qwen这次一口气放了2.4T和27B两个开源权重模型,专攻编程和协作用途,想自己部署或微调的直接看就行。原文稍后读已读值得跟进有用关注 Qwen
10:38官方一手Pandaily@contact@pandaily.com (Pandaily)82°华为开源openPangu-2.0-Pro,发布模型权重、推理代码和技术报告。该模型拥有5050亿参数,推理时稀疏激活1800亿参数,上下文窗口达到512K。华为称它是首个完全在昇腾NPU上训练的前沿模型,也是首个完全不依赖NVIDIA硬件的500B以上开源模型。余承东此前曾表示要让盘古成为世界第一。AI模型openPangu-2.0-Pro华为盘古10 个信源在谈事件专题推荐理由:华为把500B级大模型开源了,权重代码报告都给了,还是在昇腾上训的,不用N卡也能跑。原文稍后读已读值得跟进有用关注 openPangu-2.0-Pro
08:17IT之家(博客/媒体)微软正测试其首款原生实时语音模型MAI Realtime,采用全双工交互,可同步聆听和回应,不必等用户说完。该模型支持中文等16种语言,提供Victoria和Grant两种语音风格。测试在MAI Playground平台进行,尚未上线Microsoft Foundry。相比Copilot现有语音模式更自然,但定位仍是对话系统,不支持唱歌或音效。AI模型MAI Realtime微软全双工语音推荐理由:微软弄了个能边听边说的语音模型MAI Realtime,支持16种语言,还能中途换语言,比Copilot现在的语音更自然。原文稍后读已读值得跟进有用关注 MAI Realtime
04:30官方一手OpenAI Blog(博客/媒体)OpenAI用六个月构建了GPT-Live实时语音系统。GPT-Live采用无轮次语音模型,实现了连续语音交互。低延迟架构使得对话响应更迅速,更接近自然交流。OpenAI官方博客公开了这套系统的构建方法与技术细节。AI模型OpenAIGPT-Live语音交互10 个信源在谈事件专题推荐理由:OpenAI搞了个GPT-Live,能连续对话不用等你说完,延迟更低,比传统语音助手自然多了。原文稍后读已读值得跟进有用关注 OpenAI
03:15官方账号OpenAI@OpenAI (@OpenAI)82°OpenAI在X平台宣布,其下一代旗舰模型的内部版本在数学和理论计算机科学领域的10个长期开放问题上取得了新结果。该模型运行消耗的token价值约2000美元,按GPT-5.6 Sol API费率计算。推文附带的视频展示了部分求解过程,目前该模型尚未公开发布。AI模型OpenAIGPT-5.6推理模型9 个信源在谈事件专题推荐理由:OpenAI说下一代模型内部版才花2000美元token就解了10个数学老难题,按GPT-5.6 Sol API费率算的,很猛。原文稍后读已读值得跟进有用关注 OpenAI
22:15官方账号Decoder@Maximilian SchreinerMiniMax发布H3视频模型权重,这是开源模型首次登顶AI视频排行榜。H3在视频生成领域超越此前领先的闭源模型,成绩排名第一。该模型权重现已开放下载,开发者可以自由使用和改进。这一结果标志着开源视频模型在基准评测中首次处于领先位置。AI模型MiniMaxH3视频生成推荐理由:MiniMax把H3权重开源了,直接冲到视频榜第一,开源党可以下载来玩了。原文稍后读已读值得跟进有用关注 MiniMax
21:27量子位@十三商汤预览了SenseNova U1.5 Lite。这款开源的图像生成模型支持4K分辨率直出。SenseNova U1.5 Lite是国产自研模型,面向高清生图场景。AI模型SenseNova商汤图像生成推荐理由:商汤出了个开源生图模型,能直接出4K图,还是国产的,玩高清生成的话可以围观一下。原文稍后读已读值得跟进有用关注 SenseNova
20:20官方账号Decoder@Maximilian SchreinerOpenAI 联合创始人 Andrej Karpathy 将《指环王》开头一段输入 Claude Opus 5,模型生成了 5500 行代码,构建出一个可在浏览器中运行的 3D 场景。这次测试是 Karpathy 寻找 AI 氛围测试(vibe test)的一部分,展示了大模型从文本直接生成可交互视觉场景的能力。结果在社交平台引发讨论,重点集中在 Claude Opus 5 的代码生成质量和空间理解水平。AI模型Claude Opus 5Karpathy编程助手10 个信源在谈事件专题推荐理由:看 Karpathy 拿 Claude Opus 5 把小说开头变成能跑的 3D 场景,5500 行代码一次生成,挺有意思。原文稍后读已读值得跟进有用关注 Claude Opus 5
19:21官方账号Decoder@Jonathan Kemper74°阿里巴巴发布旗舰模型Qwen3.8-Max,总参数达2.4万亿。该模型可自主执行跨数天的复杂任务,包括复现研究论文和设计芯片。与常见闭源模型不同,Qwen3.8-Max采用开放权重,团队计划下周公布权重文件。AI模型Qwen3.8-MaxAlibaba智能体推荐理由:阿里那个2.4万亿参数的Qwen3.8-Max要开源了,能自己搞芯片设计,下周放权重,想玩长任务的盯紧点。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
19:20官方账号Decoder@Matthias Bastian两支研究团队独立使用OpenAI的GPT-5.6 Sol Ultra解决了同一量子密码学开放问题,论文提交时间仅相隔三小时。其中一位研究者表示,遇到开放问题时首先会尝试让GPT解决。这一事件引发了对“独立发现”定义的讨论:当所有人都使用相同模型时,成果的独立性如何界定。AI模型GPT-5.6OpenAI量子密码学10 个信源在谈事件专题推荐理由:GPT-5.6刚出,就有两队用它解同一量子密码难题,还是三小时内撞车,值得看看。原文稍后读已读值得跟进有用关注 GPT-5.6
16:39官方一手marktechpost@Asif Razzaq76°阿里Qwen团队将Qwen3.8-Max从预览转为正式可用,并公布了按token计费的价格。该模型为2.4万亿参数的MoE架构,支持文本、图像和视频输入,上下文窗口为100万token。官方尚未公布基准测试结果,开放权重预计下周发布。AI模型Qwen3.8-MaxAlibaba多模态推荐理由:Qwen3.8-Max正式上线,2.4T参数MoE,能看视频,上下文100万token,权重下周开源。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
16:19IT之家(博客/媒体)Arena平台发布2026年第31周AI大模型排行榜。阿里qwen3.8-max以1496分位列综合榜第5,距榜首claude-fable-5仅差13分。月之暗面kimi-k3-max以1485分排综合榜第13。代码榜中,kimi-k3-max和qwen3.8-max分别以1531分和1530分进入Top10。前端开发榜kimi-k3-max以1676分排第二,字节seedream-5.0-pro进入AI生图榜第6名。AI模型qwen3.8-maxclaude-fable-5kimi-k3-max3 个信源在谈事件专题推荐理由:阿里新模型qwen3.8-max一上榜就冲到综合第五,只比榜首Claude差13分;kimi-k3-max代码也进了前十,国产模型进步挺明显,榜单值得翻翻。原文稍后读已读值得跟进有用关注 qwen3.8-max
16:14IT之家(博客/媒体)商汤科技开源轻量级统一多模态模型 SenseNova U1.5-Lite-Preview。该模型仅有 8B-MoT 参数规模,原生支持 4K 图像生成。在多项主流生成与编辑质量评测基准上,其表现显著超越前代 U1。官方称其图像生成与编辑效果可比肩商用闭源模型。此外,该模型在中英文文字生成、复杂版式组织以及视觉指令遵循方面均有提升。AI模型SenseNova商汤科技多模态推荐理由:商汤开源了新多模态模型,8B参数就能生成4K图,编辑效果还追上闭源大厂,想玩图像生成的可以试试。原文稍后读已读值得跟进有用关注 SenseNova
16:01官方一手pandaily@contact@pandaily.com (Pandaily)77°中国智能体InAgent在OSWorld基准上取得90.2%任务成功率,成为首个突破90%的计算机操作智能体。它在系统级任务上达到100%完成率。这一成绩超过OpenAI、Google和Anthropic此前保持的纪录。报道还提到,Harness工程正成为AI竞赛的新前沿。AI模型InAgentOSWorld智能体10 个信源在谈事件专题推荐理由:InAgent在OSWorld刷到90.2%,系统级任务100%,比OpenAI、谷歌、Anthropic都高,快看。原文稍后读已读值得跟进有用关注 InAgent
16:00官方一手pandaily@contact@pandaily.com (Pandaily)79°阿里巴巴发布Qwen3.8-Max正式版,参数量达2.4万亿。该模型支持1M上下文窗口,可执行长时间运行的智能体任务。官方称其编码与办公能力显著提升,跻身全球第一梯队。开源权重预计一周内公布,开发者可下载使用。AI模型Qwen3.8-MaxAlibaba智能体推荐理由:阿里发了Qwen3.8-Max,2.4T参数加1M上下文,做长任务Agent很强,而且下周就开源了,能直接玩。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
15:59官方一手pandaily@contact@pandaily.com (Pandaily)MiniMax 在 HuggingFace 上开源 H3-Base 权重,采用 33B 参数的稠密单流 Omni-Transformer 架构。该模型配备 16 倍空间和 4 倍时间压缩 VAE,本地运行只需两张 RTX 5090 显卡。其 API 定价仅为 Seedance 2.0 的三分之一。H3 在基准测试中直接对标 Seedance 2.0,展示了开源视频生成模型的竞争力。AI模型MiniMaxH3Seedance 2.0推荐理由:MiniMax 把 H3 开源了,33B 参数,两张 RTX 5090 就能本地跑,API 价格只有 Seedance 2.0 的三分之一,想玩视频生成的可以试试。原文稍后读已读值得跟进有用关注 MiniMax
15:32官方一手marktechpost@Michal SutterCogent AI发布VR-1,一款专为网络安全后训练的推理模型。它配套推出IntrusionBench基准,用于评估智能体完成企业入侵任务的能力。还包括Cogent AI Harness,一个治理型安全智能体运行环境。VR-1能组合并验证企业攻击路径,而非依赖通用编码能力的附带效果。AI模型VR-1Cogent AIIntrusionBench推荐理由:搞安全的可以看看VR-1,它专门练过攻防推理,还有配套基准和运行环境。原文稍后读已读值得跟进有用关注 VR-1
15:29IT之家(博客/媒体)英特尔今日宣布为开源多模态视频模型 MiniMax H3 提供 Day 0 首发支持,锐炫 Pro B70 已率先完成适配。团队实现多卡 GPU 部署方案,Encoder 采用 8 卡张量并行,DiT 采用 8 卡 USP 并结合 Layer-wise Offloading,VAE 部署于 B70 GPU。相比纯 8 卡 USP,新方案还开发了 2TP×4USP 混合并行,将 USP 并行度降至 4 并引入 2 路张量并行,以减少通信开销。该方案还结合 llm-scaler-omni 项目的 XPU Kernel 优化,对矩阵乘法、注意力等算子进行持续优化。AI模型MiniMax H3Intel锐炫Pro B707 个信源在谈事件专题推荐理由:英特尔把 MiniMax H3 跑在多卡 GPU 上,锐炫 Pro B70 首发支持,还搞了 2TP×4USP 混合并行,视频生成部署有参考了。原文稍后读已读值得跟进有用关注 MiniMax H3
15:14量子位@梦瑶阿里发布Qwen3.8-Max。Qwen3.8-Max在编程、专业工作、长程任务、多模态分析等场景表现突出。其综合能力进入全球第一梯队,与Claude表现相近。AI模型Qwen3.8-MaxClaude阿里推荐理由:阿里发了Qwen3.8-Max,编程和多模态都强,据说能跟Claude掰手腕,想升级的可以关注。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
14:39量子位@量子位的朋友们阿里巴巴正式发布新一代基座大模型Qwen3.8,官方称整体性能处于全球大模型第一梯队。该模型在编程与办公场景下推理更快更稳定。Qwen3.8-Max预计下周开源,同时还将开源Qwen3.8-27B。AI模型Qwen3.8阿里巴巴Qwen3.8-Max推荐理由:阿里发了Qwen3.8,性能进第一梯队,Max版下周开源,想试新模型的可以蹲一下。原文稍后读已读值得跟进有用关注 Qwen3.8
13:27IT之家(博客/媒体)MiniMax H3 于 8 月 3 日正式开源,支持文本、图片、音频和视频的多元输入,可直出 2K 分辨率、最长 15 秒的原生音画内容。该模型在 Artificial Analysis 视频模型榜单中拿下视频编辑能力全球第一,2K 分辨率视频生成价格低至 0.8 元/秒。摩尔线程基于 MTT S5000 与 MUSA 软件栈,仅用 3 小时就完成 H3 的完整适配与稳定运行。H3 支持企业本地化部署和自有数据定制,降低了多模态生成的应用门槛。AI模型MiniMaxH3摩尔线程推荐理由:MiniMax H3 开源当天就被摩尔线程国产卡接住了,2K 视频生成一秒钟才 8 毛钱,视频编辑能力还排全球第一。原文稍后读已读值得跟进有用关注 MiniMax
13:09量子位@梦晨华为诺亚方舟实验室开源了MindMemOS,一个面向AI Agent的记忆操作层。它主打可迁移与自演进,解决Agent对话结束后记忆丢失的问题。MindMemOS打通记忆与Skill,让Agent把经验沉淀为可复用技能。开源版本已发布,开发者可将其集成到智能体系统中。AI模型MindMemOS华为诺亚智能体推荐理由:华为诺亚开源了MindMemOS,给AI Agent配上能自进化的记忆,经验还能沉淀成技能,做智能体的可以研究下。原文稍后读已读值得跟进有用关注 MindMemOS
11:56IT之家(博客/媒体)72°自变量机器人发布并开源HOST框架,让机器人仅观察29秒人类视频即可学习新技能,成功率达62%,超过零样本基线45%。相比Pi-0.5加微调方案,HOST所需数据量减少50倍,学习速度提升500倍。HOST采用双专家MoT架构,将视觉预测与动作生成分离,并通过动态时间规整按任务进度对齐人类视频与机器人操作。研究论文和代码已全部开源。AI模型HOST自变量机器人机器人学习推荐理由:自变量开源了HOST框架,机器人看一段几十秒的人类视频就能学新技能,成功率62%,比微调方案省50倍数据。原文稍后读已读值得跟进有用关注 HOST
10:57IT之家(博客/媒体)MiniMax 于 8 月 3 日开源新一代通用视频模型 H3,支持文本、图像、视频、音频统一理解与生成。H3 可输出最高 2K 分辨率、15 秒时长、32kHz 立体声音频的视频,帧率为 24 FPS。其输入规格包含 H3-Base-FL2VA 首尾帧模式和 H3-Base-Ref2VA 全模态参考模式,后者最多支持 9 张图像与 3 段视频。H3 稳定支持中英阿法等 11 种语言,完整系统由 H3-Context-IR、H3-Base 和 H3-Regenerate-2K 三模块组成。AI模型MiniMaxH3视频生成推荐理由:MiniMax 把能处理多模态上下文的视频模型直接开源了,最长生成 15 秒 2K 带立体声的视频,比一般文生视频强在能看懂图片、音频和视频混合输入。原文稍后读已读值得跟进有用关注 MiniMax
10:47SuperTechFans(博客/媒体)字节跳动发布新一代视频生成模型 Seedance 2.5,单次可生成最长 30 秒视频。Seedance 2.5 支持多模态引用,可参考图片和视频素材进行创作。该模型还提供高级编辑功能,方便用户调整生成内容。目前 Seedance 2.5 已上线多个平台,官方表示 API 即将推出。AI模型Seedance 2.5字节跳动视频生成3 个信源在谈事件专题推荐理由:字节跳动发布了 Seedance 2.5,一次能生成 30 秒视频,还能参考多模态素材,API 也快出了。原文稍后读已读值得跟进有用关注 Seedance 2.5
10:35IT之家(博客/媒体)阿里巴巴今日发布千问 Qwen3.8-Max,参数规模达 2.4 万亿。官方称其在编程、真实办公、长程任务与多模态智能体方面实现提升。该模型能以极少人工介入端到端完成复杂开放目标。模型权重将于下周开源。AI模型Qwen3.8-Max阿里巴巴智能体推荐理由:千问新模型 Qwen3.8-Max 有 2.4 万亿参数,编程办公更强,端到端自主干活,下周还开源。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
09:54官方一手pandaily@contact@pandaily.com (Pandaily)清华团队开源VeriLoop Coder-E1,基于Qwen3.6-27B模型。模型在SWE-bench Verified获得85.20分,SWE-bench Pro为62.38分,Terminal-Bench 2.0达76.40分,DeepSWE为33.63分。该模型采用窄领域PEFT和Self-Harness技术,实现仓库级代码修复的可验证递归自改进。AI模型VeriLoop Coder-E1Qwen3.6-27B开源模型推荐理由:清华开源了个能自己改代码的模型VeriLoop Coder-E1,SWE-bench拿85.2分,比很多大模型都强,想搞代码修复的可以试试。原文稍后读已读值得跟进有用关注 VeriLoop Coder-E1
09:48官方一手pandaily@contact@pandaily.com (Pandaily)71°DeepSeek-V4-Flash-0731正式发布并开源,参数量304B,性能评分82.7。该模型超越V4-Pro预览版,定价为0.14/0.28美元。在VulcanBench基准上位列第一,HuggingFace热度榜第二。官方称其表现媲美Claude Opus-4.8。AI模型DeepSeekV4-Flash开源模型10 个信源在谈事件专题推荐理由:DeepSeek把304B的V4-Flash开源了,性能打平Claude Opus-4.8,价格还便宜,快去试试。原文稍后读已读值得跟进有用关注 DeepSeek
08:53官方一手marktechpost@Michal Sutter旧金山搜索与发现公司Onton发布神经符号模型Ontology 1,服务于复杂、对话式、多模态商品搜索。在由三个独立LLM评委评分的90条查询基准上,Ontology 1的mean precision@10达0.630,Google Shopping为0.543,Amazon为0.469。该模型仅索引约1%的商品数据。Onton称其比全球最佳电商搜索引擎准确率高2.7倍。AI模型OntonOntology 1神经符号推荐理由:Onton发布了搜索模型Ontology 1,90条查询上precision@10到0.630,压过Google Shopping和Amazon,而且只用了1%索引数据。做搜索的可以看看。原文稍后读已读值得跟进有用关注 Onton
22:17官方账号Nathan Lambert: Interconnects@Florian Brand开放模型系列第23期介绍了Laguna S2.1、Inkling和Kimi K3。这三个模型展示了开源权重在帕累托前沿上的竞争力,兼顾性能与效率。文中指出,训练强模型的能力正在快速扩散到更多团队。AI模型Laguna S2.1InklingKimi K37 个信源在谈事件专题推荐理由:三个新开源模型:Laguna S2.1、Inkling和Kimi K3,这期合集讲清楚了它们好在哪。原文稍后读已读值得跟进有用关注 Laguna S2.1
21:10官方账号Decoder@Jonathan KemperMeta AI用双智能体架构解决长任务中的记忆问题:独立的记忆代理维护结构化记忆库,决定何时提醒主代理、何时保持沉默。该系统能避免智能体重复已诊断的错误和失败步骤。在两项基准测试中,得分最高提升8.3个百分点。AI模型Meta AI智能体多智能体推荐理由:Meta AI给长任务配了记忆教练,提醒主代理别犯重复错,基准分提升8.3点。原文稍后读已读值得跟进有用关注 Meta AI
17:14官方账号Decoder@Gregor KobsikClaude Opus 5 能用单一提示词生成完整 3D 游戏,包括第一人称射击、卡丁车赛车和《我的世界》克隆,全程不依赖任何外部资源。几何、纹理、物理乃至部分音乐均以代码形式生成,并在浏览器中直接运行。与 GPT-5.6 Sol 和 Kimi K3 的并排对比中,Opus 5 产出细节明显更丰富。AI模型Claude Opus 5AnthropicGPT-5.6 Sol10 个信源在谈事件专题推荐理由:想用一句话生成游戏?Claude Opus 5 能直接做出带物理和音乐的3D完整原型,比 GPT-5.6 Sol 更精细。原文稍后读已读值得跟进有用关注 Claude Opus 5
15:44IT之家(博客/媒体)7月31日,DeepSeek 发布 DeepSeek-V4-Flash 正式版(DeepSeek-V4-Flash-0731)API,并开启公测。国家超算互联网同步上线该模型的 API 调用服务和模型文件。新版经过大量后训练,智能体与指令遵循能力大幅增强,官方称性能可媲美最强闭源模型。超算互联网 AI 社区已汇集 1700 余款开源大模型,并成为全国首个十万卡级超智融合算力资源池。AI模型DeepSeek-V4-FlashDeepSeek国家超算互联网10 个信源在谈事件专题推荐理由:想用 DeepSeek-V4-Flash 的话,超算互联网已经上线了,不用自己配环境,一键就能调 API,试试它的智能体能力。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
03:08官方一手marktechpost@Asif RazzaqAMD推出Instella-MoE-16B-A3B,这是一个完全开源的混合专家语言模型,总参数16B,每个token仅激活2.8B。模型采用Gated MLA与FarSkip-Collective架构,在Instinct MI300X和MI325X GPU上从零训练。AMD已发布所有训练阶段的权重,并公开数据混合、配置和推理代码。AI模型Instella-MoE-16B-A3BAMDInstinct推荐理由:想用AMD显卡跑大模型的可以看看,AMD把16B总参数、2.8B激活的MoE模型全开源了,连训练配置和数据配方都给了。原文稍后读已读值得跟进有用关注 Instella-MoE-16B-A3B
00:20官方账号Decoder@Matthias Bastian76°OpenAI用AI反驳了单位距离猜想,引发数学界关注。菲尔兹奖得主Timothy Gowers表示,GPT-5.6 Pro首次尝试就解决了他长期研究过的两个问题。他警告这可能造成数学文化消亡,因为数学家不再构建理解结果所需的知识。另一些研究者则把AI视为提升效率的工具。AI模型OpenAIGPT-5.6 Pro单位距离猜想10 个信源在谈事件专题推荐理由:菲尔兹奖得主自己说GPT-5.6 Pro一次就解出他头疼的问题,还警告数学文化危险,这篇值得看。原文稍后读已读值得跟进有用关注 OpenAI
22:53官方账号Decoder@Jonathan Kemper精选OpenAI 与学术合作伙伴发布实地报告,用 AI 编程智能体改造被忽视的研究软件,部分任务提速最高 60 倍。参与者警告,这些系统“口齿伶俐、有说服力,但错误时自信十足且难以察觉”。人类工作重心从写代码转向耗时耗力的科学正确性验证。报告显示,智能体能高效处理代码现代化,但无法判断研究本身的科学对错。AI模型OpenAI编程助手代码现代化10 个信源在谈事件专题推荐理由:OpenAI 实测:编程智能体能把老代码提速 60 倍,但科学对错还得靠人盯。原文稍后读已读值得跟进有用关注 OpenAI
21:56官方账号Decoder@Gregor Kobsik72°字节跳动发布AI视频模型Seedance 2.5,可同时生成视频与音频。单段片段最长30秒,是谷歌Gemini Omni Flash输出时长的三倍。用户可输入数十张图片、视频和音频文件作为参考。对广告团队而言,这省去了逐段拼接短片的流程。AI模型Seedance 2.5ByteDance视频生成1 个信源在谈事件专题推荐理由:字节Seedance2.5生成30秒带声视频,是Gemini Omni Flash的三倍,广告剪辑省事。原文稍后读已读值得跟进有用关注 Seedance 2.5