Mira Murati 的新实验室发布了 Inkling,975B 参数的 Apache-2.0 多模态开源模型,专门为微调设计,想折腾的开发者可以试试。
#多模态
thinkymachines开源了一个超大MoE模型Inkling,总参975B但只激活41B,还支持1M上下文和图文音频理解,已经可以在SGLang上跑了,想玩大模型的朋友可以试试。
Dify 和 AMD 办比赛了!3 万美元奖金,还能免费用 AMD 显卡搞智能体、多模态或物理 AI,想练手的快去报名。
前OpenAI CTO Mira Murati的初创公司推出了9750亿参数的开放权重模型Inkling,性能领先美国同类但不及中国领先模型,适合做微调基础,价格明确。
Thinky发了首个模型Inkling,975B参数开源,Apache 2.0协议,据说是美国开源最强。关注开源大模型可以看看。
Mira Murati 新公司出了开源多模态模型,近 1T 参数但只激活 41B,支持 1M 上下文,还能自己微调,值得试试。
Thinking Machines 发了 Inkling,一个能看图文听音频的推理模型,而且权重全开放,能自己微调,还能在 Playground 试玩。
Mira Murati团队开源了多模态模型Inkling,975B参数,比Nemotron和Kimi K2.5强,指令遵循甚至超Claude,值得一试。
Inkling 让你能控制模型思考深度,975B 参数但只激活 41B,适合做定制化基础模型。
Thinky Machines 开源了 975B MoE 多模态模型 Inkling,Apache 2.0 随便用,适合微调,直接在 Fireworks 上跑。
Thinking Machines 出了个新模型 Inkling,能同时处理文字、图片和音频,还在 Agent Arena 上测了长期任务能力。现在能免费下载权重自己微调,可以试试。
Thinking Machines出了个真开源的多模态模型Inkling,41B参数能和GPT-5.6 Sol掰手腕,还准备出12B小版,赶紧试试。
Thinking Machines开源了975B参数的MoE模型Inkling,支持多模态和64K/256K长上下文,还能在Tinker上微调,值得试试。
Thinking Machines 刚发了 Inkling,一个开源的多模态推理模型,能处理文本、图像、音频,还给了完整权重可以微调,NVFP4 检查点直接下。
阿里新模型Qwen-Audio-3.0-Realtime能实时语音对话、调用工具、感知情绪,语音指令和综合排名都超过了GPT-Realtime-2。
想要自动生成带精确几何图形的数学题?FormalAnalyticGeo 用 CDL 形式语言和 SDF 渲染,造出了 7000+ 带标注的解析几何题目,误差不到 1%。
他们挑战了多模态情感模型必须大的假设,用知识蒸馏搞出<1B的Light-MER,9个基准超了大模型还更快,做部署的可以看看。
PrismML搞了个Bonsai 27B,在手机上就能跑27B多模态模型,压缩到3.9GB性能还能保留90%,挺牛的,还开源了,可以试试。
手机能跑 27B 模型了?PrismML 的 Bonsai 27B 实际做到了——体积最小 3.9GB,速度还不慢,开源免费。想本地用大模型又嫌大的可以看。
Salesforce AI Research 发布了 E-VQA 任务和 ST-Evidence 基准,解决了视频问答无法验证视觉证据的问题。如果你想理解视频模型真正“看到”了什么,这篇论文值得一读。
想提升音频模型对语气、情感等非语义信息的识别?试试IAAN,在不重训模型的情况下,通过对编码器内部特定神经元做微调就能显著提分,多模型实测有效。
Google 的新模型 Gemini 3.5 本周就要来了,内部测试居然超过了 GPT-5.6 和 Fable 5,比前代 Pro 版强不少。