微软也下场做决策模型了

微软最近发布了自家的决策模型 Decision-1,正式挤进这个才火了一个多月的新赛道。它和 OpenAI、Cloudflare 以及最早带起这波风潮的 Jev 做的是一类东西:专门用来做快速、结构化的决策,比如分类、评估和路由判断。微软的说法是,这个模型有潜力去引导和控制 agent 在复杂环境里跑任务。

技术底子上,Decision-1 是基于 Qwen3.5-9B 微调的。微软宣称它在 36 项基准、接近 15 万个问题上是最准的,速度还比第二名 H2O-Lightning-4B 快 2.5 倍。官方对比图里它拿到 83.5% 的准确率和 85 毫秒延迟,压过了 Jev 1.13.0。不过要注意,同样基于 Qwen 的 Cloudflare 开源 Clef 系列并没有被纳入这次对比,所以这个「第一」的含金量得打个问号。价格是这次比较有意思的地方。Decision-1 已经上了 Microsoft Foundry 和 OpenRouter,输入 token 每百万只要 0.042 美元,输出 token 直接免费。这个定价基本是把决策模型当引流入口在做,靠云平台和生态去赚钱,而不是靠模型调用本身。对 Jev 来说,这几周估计不太好过。它在九月中旬把这波趋势带起来,想法很快被验证,但技术也很快被大厂用开源小模型追上甚至反超。这其实是小团队做模型层的经典困境:你教育了市场,最后收割的却是算力和渠道都在自己手里的巨头。我的判断是,决策模型正在快速变成一种基础设施,而不是差异化产品。当输入价格压到近乎为零,真正值钱的就变成了谁能让 agent 稳定接入、谁有企业客户和分发渠道。对做应用的人来说,这反而是好事,选型时多了一个便宜且够用的选项,但别指望靠换模型建立壁垒。
4

评论

登录后即可发表评论

参与讨论,和出海同行交流想法与经验

还没有评论,来抢沙发吧

说说你的看法,第一条评论最显眼