#DeepSeek
这篇论文提出了WML方法,能精准定位Agent工作流失败节点并复用外部技能知识,在SpreadsheetBench和Compiler-Supported50上表现亮眼,比直接SkillAgent省不少token。
这篇论文用具体数据告诉你,GPT和DeepSeek在形式化验证上还比不上ProVerif这些专业工具,但推理模式能把精确率拉到66%,可能当个预筛选过滤器。
DeepSeek 创始人亲自聊战略,说了为什么不做视频生成、怎么靠开源和低成本搞 AGI,还有对中美竞争的看法,挺实在的。
这篇研究不只看模型能修复多少问题,还比较了Claude和DeepSeek不同代际的代码质量、CPU时间和内存使用,发现新模型虽修得多但代码质量没明显提升。
DeepSeek API 可能偷偷调用 Claude?测试者用 3D 游戏、安全题等挖出异常行为,但证据还不铁,吃瓜注意别上头。
华为MateBook Pro刚拿下国家级AI认证L3,说明它在智能辅助办公、学习上达到新标准,盘古和DeepSeek加持,值得关注。
Kimi K3 用 300 人就追上 Anthropic 顶配,OpenAI 的人还吐槽开源是 AI 共产主义,值得看算力是否真的重要。
如果你在Dify上为不同模型来回换API key烦了,试试Qubrid_AI插件,一个key搞定DeepSeek、Kimi等多个模型,省事很多。
想了解提示语言怎么影响代码生成质量?这篇实测了GPT-4o mini、DeepSeek和Claude在多种语言下的表现,结果英文不一定最好。
看看12个月里ChatGPT掉到52%、Gemini涨到27%、Claude冲到9%,谁在吃掉对手的份额一目了然。
Similarweb刚发了最新AI网站流量排名,ChatGPT份额掉得厉害,Gemini和Claude在猛涨,看看谁在蚕食市场。
穆拉蒂的新模型Inkling接近万亿参数但只激活一小部分,成本低速度快,还用了DeepSeek和Kimi的技术,适合做定制项目的人试试。
如果你受够了在不同AI间切来切去,Bloome 让你把 Claude、ChatGPT、DeepSeek 都拉进一个对话,还能让智能体互相挑错改稿,桌面版用着真像团队开会。
DeepSeek 要上市了!估值 4800 亿,融资至少 100 亿,AI 圈又一个大动作,想了解国内 AI 公司资本动向的可以看看。
想给 Claude Science 换个模型后端?试试 CS Native,它让你在隔离沙箱里调用 DeepSeek、Qwen 或 OpenAI,还不丢官方入口。