6月17日
13:43
13:43orange.ai@oran_ge
精选76°
智谱 AI 今日正式开源 GLM 5.2 模型。该模型在编程 coding 能力上达到与 Claude 3 Opus 相当的水平,是首个实现这一成就的开源模型。GLM 5.2 已作为 beta 模型接入 Cola 平台供用户测试,定价与官方版本相同。
事件专题

推荐理由:智谱把编程能力比肩 Opus 的 GLM 5.2 开源了,还接入了 Cola 让大家免费试。
11:36
11:36量子位@十三
智谱AI于2026年6月开源了GLM-5.2模型,支持1M上下文长度。该模型在AI编程评测基准上取得第一,超过此前领先的Fable-5。基于GLM架构的持续优化,GLM-5.2在代码生成任务中展现出更强能力。开源版本已发布在GitHub。
事件专题

推荐理由:智谱开源了GLM-5.2,1M超长上下文,编程能力直接拿下第一,想换编程模型的话可以试试。
11:35
11:35官方账号arXiv cs.LG@Ahmed Ryan, Saad Sakib Noor, Md Erfan, Shaswata Mitra, Sudip Mittal, Md Rayhanur Rahman
该研究构建了包含2076条人工标注句子的数据集(1281条正样本、795条负样本),来自83份复杂的非结构化CTI报告,映射到114种ATT&CK技术。评估了7个开源LLM(参数规模8B至236B),最高micro-F1得分为0.22。参数大小与F1得分呈显著正相关,提示策略和温度设置无显著影响。结果表明当前开源LLM尚无法用于生产级ATT&CK分类。
推荐理由:这篇论文造了2076条人工标注的CTI数据,测了7个开源大模型,结果最好的F1才0.22,说明开源模型在安全情报分析上还不够用。
04:01
03:38
03:04
03:04OpenRouter@OpenRouterAI
精选
Z.ai 发布 GLM-5.2 模型,采用 MIT 开源许可。该模型在编码和智能体任务上有显著提升,支持最长 1M 标记的上下文窗口。提供两种推理强度:GLM-5.2 (max) 追求极限性能,GLM-5.2 (high) 平衡性能与 token 效率。API 定价与 GLM-5.1 保持一致。
推荐理由:Z.ai 新出的 GLM-5.2 模型,编码和智能体能力大幅增强,还有 1M 超大上下文,而且开源!API 价格没涨,值得试试。
00:10
00:10Justine Moore@venturetwins
Ideogram 发布了名为 Ideogram 2.0 的开源权重图像模型,宣称在开放权重类别中排名第一。该模型体积足够小,可在消费级 GPU 上运行,但在设计任务上与 Nano Banana 和 GPT Image 竞争。研究团队由 @mo_norouzi 领导,分享了技术细节和观点。
推荐理由:Ideogram 这个开源权重图像模型能在普通显卡上跑,还能和 GPT Image 掰手腕,适合不想烧钱又想要好效果的人。
6月16日
14:05
11:21
11:21官方账号arXiv cs.AI@Dongbin Na, Chanwoo Kim, Soonbin Rho, Giyun Choi, Gangbok Lee, Dooyoung Hong
BinTrack是一种全开源的空间定位智能体,利用机器人轨迹的时间顺序进行二进制搜索。在SpaceLocQA基准的全局类别上,BinTrack将准确率提升22.8%,甚至匹配了GPT-4o的闭源模型结果。其推理策略带来超过1.5倍的加速。论文还发布了GangnamLoop,一个在真实街道上用四足机器人采集的多行程室外基准数据集。
推荐理由:想让你家机器人找到干洗店?BinTrack用开源VLM做空间问答,性能追平GPT-4o还更快,代码数据全公开。
01:58
01:58官方账号EleutherAI@AiEleuther
EleutherAI 启动 Summer of AI Research 2026 申请,活动周期为 7 月 13 日至 8 月 16 日。该项目为完全在线形式,面向研究经验较少的参与者。入选者将在资深研究员的指导下为开源 AI 研究项目做贡献。申请目前已开放。
推荐理由:EleutherAI 搞了个暑期研究项目,没经验也能参加,导师带着你做开源AI,7月13号到8月16号,赶紧去申请看看。
01:39
01:39kimmonismus@kimmonismus
里约热内卢市政府IT公司发布了开源模型 Rio 3.5 Open 397B,参数量达 397B。该模型在多项基准测试中达到开源 SOTA,甚至超越此前领先的 Qwen 3.7。这一成果来自此前并不知名的团队,引发业界关注。
事件专题

推荐理由:里约市政府搞了个 397B 的开源模型,居然跑赢了 Qwen 3.7,挺意外的,建议看看。
6月15日
16:13