有人开源了一套 PR Agent 的 Skills 合集,30 多个技能直接复用,还带 newsjack.sh 这种追热点脚本,做公关运营的可以拿来玩玩。
#开源模型
极摩客出了台 192GB 内存的迷你工作站,搭载 AMD 锐龙 AI Max+ PRO 495,号称能本地跑 320B 的模型,早鸟 6599 美元,想在家玩大模型可以看看。
华为把 openPangu-2.0 从预训练到 RL 的训练代码全开源了,配昇腾 MoE 栈,之前 Pro 505B 和 Flash 92B 权重也能配上完整流程。
StepFun 这个 Step 5 Preview 有 1M 上下文,主打长程智能体任务,权重月底开源,可以等开源后自己跑一跑。
NaiveAI 放出了 MIT 协议的 309B MoE 开源模型,激活参数只有 15.5B,还能吃下 1M 上下文,做长代码分析可以试试自己部署。
Meta 这次没走 self-distillation 老路,用 DCE 加 SRCL 就把 Qwen3-8B 从 30% 拉到 66%,方法细节可以看看。
阿里这次没发新模型,而是让 Qwen3.8-Max 自己训自己,33 轮迭代后成绩追上 Claude 和 GPT,还顺手把多模态价格砍了九成。
一篇讲 LoRA 技能怎么叠加不互相干扰的论文,思路是把新适配器设计成只读旧技能的输入,合并进基座权重还零推理开销,SuperGLUE 比现有方法高了 20 多分。
Bloomberg 开源了 LUCID,专治时间序列里隐变量混杂导致的假因果边,F1 比最强基线高出 46%,做因果推断的可以试试。
Tw93 开源的 Mac 终端 Kaku,装完不用配置就能用,专门照顾 AI 编程场景,已经迭代了 21 个版本,Mac 用户可以装来试试。
一个开源框架能让 Claude Code 和 Codex 组队干活,跟 lead agent 说结果就行,做开发工作流的可以试试。
Fireworks 拿 Kimi K3 改了个 Ember-1,推理 token 少用 40% 还不掉分,省钱党可以看看。
一个年付 Devin 十万刀的团队,因为不让按季付款,两天用开源 Hermes 自己搭了替代品,成本只要四分之一,过程细节很实在。
巴西团队用 104 美元训了个分类模型 Julia-1,还开源了。如果你在搭 agent 框架,可以试试分类器加推理模型混合调度这个思路。
Interfaze 开源了 lev,用 Qwen-3.5 4B 做底座,一次前向就能批改判断题、选择题和打分题,做自动测评的可以看看。
Anthropic 和 OpenAI 都在降价,企业客户说花了更少的钱效果还不差,现场聊了不少实际用法,做采购的可以看看。
GrokBot 能让 Muse 帮它打电话还汇报结果,Instinct 和 Claude Code 也能接入,代码全开源,感兴趣的可以自己搭着玩。
yetone 的 Magpie 更新了,能自动识别 Routing Group,本地给 Agent 做模型路由切换特别顺,搞多模型的可以试试。
Jared Palmer 的 Kev 4B 上 OpenRouter 了,输出免费、输入每百万 token 才 $0.042,传状态进去就能拿到结构化的回答,做小任务很便宜。
OpenCode 把 DeepSeek V4.1 Flash 的 60 美元额度从限时改成永久了,写代码跑模型可以白嫖一笔。
有人在GitHub开源了个叫Colibrì的玩法,不用GPU,把SSD当显存就能在笔记本上跑GLM的7000亿参数模型,感兴趣的可以照着README敲6行命令试试。
用 Claude Opus 5.5 生成的 1000 多个视频被整理成了一份带链接的清单,想看这模型实际能做出什么画面的可以去翻翻。