模型多源确认

微软发布 Microsoft-Decision-1 决策模型,准确率超 GPT-6 Luna Decision

精选理由

微软把 Qwen3.5-9B 改成小决策模型,分类任务准确率干到 83.5%,跑分类便宜 200 倍,做内容审核的可以试试。

微软发布决策模型 Microsoft-Decision-1,平均准确率 83.5%,高于 OpenAI GPT-6 Luna Decision 的 79.4%。该模型基于 Qwen3.5-9B 改造而来,与 Cloudflare Clef 采用相同做法,未来可能换用 MAI 或 OpenAI 的基座模型。在 Xbox 团队对社交媒体评论做分类的实测中,质量接近 GPT-6 Sol,但速度快 14 倍、运行成本低 200 倍。模型已通过 Microsoft Foundry 和 OpenRouter 开放使用,输入价格为每百万 token 0.042 美元,输出免费。

原文 · Blognone

เปิดตัว Microsoft-Decision-1 โมเดลตัดสินใจ ทำงานเร็วกว่า แม่นยำกว่า Jev Body ไมโครซอฟท์เปิดตัว Microsoft-Decision-1 โมเดลตัดสินใจแบบเดียวกับ Jev แต่โฆษณาว่าทำงานเร็วกว่า Jev และมีความแม่นยำเฉลี่ย 83.5% สูงกว่าโมเดลตัดสินใจตัวอื่นๆ ทุกตัว รวมถึง OpenAI GPT-6 Luna Decision ที่ทำได้ 79.4% ความน่าสนใจคือ Microsoft-Decision-1 เป็นการดัดแปลงจากโมเดล Qwen3.5-9B (ท่าเดียวกับ Cloudflare Clef ) แต่ก็บอกว่าในอนาคตจะเปลี่ยนไปใช้ฐานโมเดลอื่น ทั้งโมเดลของ Microsoft AI (MAI) เองและโมเดลจาก OpenAI (โมเดลนี้เป็นผลงานของไมโครซอฟท์ทีมหลัก ไม่ได้มาจาก Microsoft AI) วิธีการเทรนออกแบบให้โฟกัสทั้งเรื่องความเร็ว และการทำงานหลากหลาย ทดสอบกับเบนช์มาร์คหลายตัว เพื่อไม่ให้โมเดลเก่งไปแค่ทางเดียว โมเดลนี้ถูกนำไปใช้งานกับทีม Xbox เอาความเห็นในโซเชียลไปแยกแยะ (classification) แล้วพบว่าได้คุณภาพใกล้เคียงกับโมเดลรุ่นใหญ่ GPT-6 Sol แต่ทำงานเร็วกว่า 14 เท่า และต้นทุนการรันถูกกว่า 200 เท่า โมเดล Microsoft-Decision-1 เปิดให้ใช้งานแล้วผ่าน Microsoft Foundry และ OpenRouter ค่ารันอยู่ที่ 0.042 ดอลลาร์ต่อ 1 ล้านโทเคนอินพุต ส่วนฝั่งเอาท์พุตไม่คิดเงิน ที่มา - Microsoft mk Sat, 10/10/2026 - 09:20