全部动态
DeepSeek 说他们要继续提供 V4 Pro 的 API 服务,下线时间推迟了,计费方式还是老样子,对用 V4 Pro 的用户来说是个好消息。
朋友,Astra 用 three.js 开发 Catan 游戏做得真不错,复用 UI 和资产很聪明,下次开发游戏可以参考。
朋友,NeoCognition 新出的 ApprenticeBench 很有意思,他们让 Fable 5.1 和 GPT-6 Astra 在真实工作中持续学习,结果比人类专家还强,而且系统自己部署,不用 FDEs。
朋友,Hailuo AI 用 MiniMax Design H3 和 Blender 做出了像真游戏预告片一样的室内动画,解决了室外到室内的难题,很厉害。
月之暗面发布了 K2.8 Preview,综合性能接近 K3,思考效率更高,编码能力也提升了,和 K2.7 比,这个版本更好。
DeepSeek 直接把自家旗舰 V4 Pro 下线了,换成 V4.1 Flash,说明新模型确实更强,对开发者来说,用 V4.1 Flash 能省不少钱,尤其是处理长上下文和频繁调用的时候。
DeepSeek 新出的 V4.1-Flash 模型,现在可以直接在 Ollama 云端用了,比之前的 DeepSeek 模型好用、快、便宜。
Anthropic 直接公布了他们如何监控和阻止用户滥用 Claude 的具体案例,比如网络攻击和监视,这比只说‘我们很安全’更有说服力。
谷歌新出的写作模型Gemini 3.8 Flash,现在在Best.xiaohu.ai能用,写东西比之前的Opus 4.6好,感觉更自然。
Anthropic 这份报告太有意思了,讲的是俄间谍、中国黑客、骗子都在用 Claude 做坏事,比如写导弹制导软件、造新闻。更搞笑的是,阿里、月之暗面、DeepSeek、智谱、小米这些大厂,用户以为在用自家模型,结果后台偷偷跑的是 Claude,批量偷 Claude 的答案去训练自己的模型。
OpenAI 新出的 GPT-Image-2.5 Sunburst 模型现在可以直接用了,排名第一,可以试试。
DeepSeek 推出了 V4.1 Flash,性能接近 GPT-5.6,但成本只有 1/30,用 15 美元就能跑 100 个复杂任务,性价比很高。
寒武纪搞了个新东西,叫 Day-0,能让 DeepSeek-V4.1-Flash 模型直接在他们的芯片上跑,不用额外优化,挺厉害的。
OpenAI的GPT-6 Astra模型厉害,能看视频理解机械结构,这次成功还原了Cessna 337的起落架,比之前那些模型强。
DeepSeek 新出的 V4.1 Flash 模型,用不对称 MoE 架构,参数量 552B,但只用了 8B 活跃参数处理输入、16B 处理输出,比上一代节省了 3/4 的存储,算力效率更高,还支持多模态,价格也便宜,适合需要高效推理的场景。
Jerry Liu 测试了 Astra,它解析带表格的复杂文档很厉害,在 ParseBench 上 93.2%,适合金融文档分析,但价格有点贵。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档