8月24日
11:34
8月23日
17:59
17:59官方一手歸藏(guizang.ai)@op7418
Ox Alpha 模型、DeepSeek V4 Flash、Vision EXP 模型和 Claude Fable 5 模型进行对比,Claude Fable 5 在排版细节和色散处理上表现更佳;Ox Alpha 模型在多模态和代码能力上表现出色,可还原 3D 玻璃材质质感。
事件专题

推荐理由:看看 Claude Fable 5 在排版和色散处理上的优势,以及 Ox Alpha 模型的多模态和代码能力,和其它模型有何不同。
8月21日
06:40
8月15日
8月14日
13:11
13:11shao__meng@shao__meng
精选76°
DeepSeek Harness开源发布,开发者可自行安装体验。一位用户使用DeepSeek V4 Flash模型,消耗1390万Token、耗时30多分钟生成一个网站。生成结果不理想,该用户认为远不如Codex搭配GPT-5.6的组合。帖子当前获得729次浏览和4条回复。
事件专题

推荐理由:DeepSeek Harness开源了,但有人试完说生成的网站不如Codex+GPT-5.6,你装之前先看看这个。
10:54
8月8日
19:29
8月7日
16:16
16:16Geek@geekbb
Alec Fong 在单台 GB300 DGX Station 上部署 DeepSeek V4 Flash,测得聚合峰值吞吐 1875 tok/s,单流 300 tok/s,128k 上下文下首 token 延迟 5 秒。推文感叹能在家部署该模型的人相当于 80 年代万元户,令人羡慕。
事件专题

推荐理由:有人晒了 DeepSeek V4 Flash 在 DGX Station 上的实测数据,单机每秒能跑 1875 个 token,128k 上下文首字只要 5 秒,你可以拿这个数去衡量本地部署值不值。
01:41
01:41官方账号Decoder@Matthias Bastian
Composio在30个真实任务上测试了DeepSeek V4 Flash在四个agent框架中的表现。各框架成功率相近,但成本相差近3倍。OpenCode每任务成本最低,为$0.073,而Claude Code高达$0.195。Claude Code使用最少的工具调用和输出token,但价格最高。框架选择主要取决于价格和速度。
事件专题

推荐理由:实测四个框架,OpenCode每任务只要7美分,Claude Code要19美分但速度最快。想省钱选OpenCode,追求速度就选Claude Code。
8月6日
16:43
16:43官方一手Pandaily@contact@pandaily.com (Pandaily)
DeepSeek V4 Flash 在 OpenRouter 周度 token 榜登顶,处理量达 7.22 万亿 token。DeepSeek 正准备对 V4 Flash 的 API 进行迄今最大幅度的价格上调。此前降价之后,OpenRouter 上这一热门模型的调用成本将明显上升。
事件专题

推荐理由:刚拿下OpenRouter周榜第一的DeepSeek V4 Flash要最大幅涨价,官方提到成本压力,在用的人盯紧价格。
10:29
10:29官方一手pandaily@contact@pandaily.com (Pandaily)
81°
DeepSeek V4 Flash以7.1万亿token登顶OpenRouter周度token使用量榜首。榜单前五名中已有四款中国模型,OpenAI随即把GPT-5.6 Luna的价格下调80%。梁文锋的“硬汉”表情包在社交网络走红,进一步放大了外界对中国大模型全球竞争力的关注。
事件专题

推荐理由:中国模型前五占四,DeepSeek V4 Flash一周跑7.1万亿token,OpenAI直接砍价80%,这仗打得真热闹。
8月5日
23:39
8月2日
02:39
02:39andrew chen@andrewchen
精选
Bleys Goodson发布了面向DGX Spark的量化单节点版DeepSeek V4 Flash。该版本对应DeepSeek V4 Flash 07-31,参数规模284B。在单台DGX Spark上,prefill速度达1000 tok/s,多智能体服务速度59 tok/s。整个安装只需一条命令。
事件专题

推荐理由:DGX Spark用户别错过,一条命令跑284B的DeepSeek V4 Flash,prefill有1000 tok/s,多智能体也有59 tok/s。
01:35
7月31日
18:08
18:08orange.ai@oran_ge
DeepSeek V4 Flash 已上架 Cola 平台,支持 Token Plan 和积分模型两种计费方式。该模型的智能表现被描述为超过 GLM 5.2,接近 GPT 5.6 Luna。目前用户可通过 colaos.ai 免费体验这一模型。
事件专题

推荐理由:DeepSeek V4 Flash 在 Cola 上线了,免费就能玩,智能比 GLM 5.2 强,都快赶上 GPT 5.6 Luna了。
7月30日
10:09
10:09官方一手Pandaily@contact@pandaily.com (Pandaily)
蚂蚁集团旗下Ant Bailing推出Ling-3.0-flash执行模型,总参数量124B,激活参数仅5.1B。该模型在12个基准测试中,以12%的参数量在11项上超越万亿参数模型Ring-2.6。在34个评估维度中,Ling-3.0-flash获得15个第一、19个第二,与DeepSeek V4 Flash并列平均最高分。
事件专题

推荐理由:蚂蚁百灵的新模型Ling-3.0-flash参数量只有124B,却在大多数基准测试里干翻了万亿参数的Ring-2.6,还和DeepSeek V4 Flash并列第一,小模型也能这么猛。
7月29日
11:35
11:35Fireworks AI@FireworksAI_HQ
精选
Fireworks为DeepSeek V4 Flash新增微调能力,支持监督微调、偏好调优和组合偏好优化。用户可通过训练API进行强化学习,面向编码代理和高吞吐量生产场景。企业现可联系Fireworks(fireworks.ai/contact-traini…)使用该功能。
事件专题

推荐理由:Fireworks给DeepSeek V4 Flash加了全套微调,监督、偏好、RL都能用,专为编码场景设计,快去试试。