|
9 月 16 日消息,Mozilla 昨日(9 月 15 日)发布第二版《开源 AI 现状》报告,报道称中国公司最佳开放权重模型与美国科技公司的前沿闭源模型,能力差距已缩至 4.4 个月。
相比较今年 7 月发布的第一版《开源 AI 现状》报告,第二版报告把宏观判断进一步落到了具体模型、具体任务时长和单任务成本上。
第二版报告重点提及了月之暗面的 Kimi K3 模型,在 Artificial Analysis 智能指数上的得分仅比 Anthropic 的 Fable 5 低三分,而成本却仅为后者的约 30%。
在能力范围方面,METR 以模型可靠完成任务的时长衡量“时间范围”,可靠成功率标准为 50%。目前,最佳闭源模型可完成的任务时长,是最佳开放模型的 1.7 倍。开放模型可处理 7 小时任务,闭源模型可处理约 12 小时任务。
Mozilla 首席技术官 Raffi Krikorian 将这一差异定性为取决于具体任务场景:闭源模型的溢价主要体现在需要 8 到 12 小时才能完成的专业型任务上,而开源模型则能以极低的价格处理日常工作。 Krikorian 称,4 个月后开放模型可处理 12 小时任务,闭源模型可处理约 20 小时任务。目前,8 至 12 小时任务通常仍是闭源模型可完成、开放模型尚难处理的区间。 这一转变已经开始重塑企业的使用行为。DoorDash 目前已采用 Kimi 处理日常任务,同时将 Fable 保留用于更复杂的工作。2026 年 8 月,路由平台 OpenRouter 上按 token 用量排名前十的模型中,有八个为开源模型。 我们附上参考地址 相关阅读:
AI 解读 能力差距缩到4.4个月意味着什么
对普通用户来说,最直接的变化是:日常写东西、查资料、做表格这类几小时内能搞定的活,用开放模型已经够用,而且便宜很多。企业也开始这么干,比如把日常任务交给便宜的开源模型,只在特别复杂的任务上才花钱用闭源。 但差距还没消失。需要连续干8到12小时的专业任务,闭源模型仍然更靠得住。报告里提到,再过4个月,开放模型可能追上现在闭源模型12小时的水平,而闭源会往20小时走。也就是说,开放模型一直在追,但追的是闭源昨天的位置。 另一个值得留意的数字是收入。开放模型承担了约三分之一的实际使用量,却只拿到4%的钱。这说明便宜好用不等于能赚钱,大部分商业价值还是被闭源模型拿走了。 日常任务可以优先考虑开放模型,复杂长任务再为闭源付费。 以上内容由 AI 依据原文补充生成,不代表本站观点,仅供参考。 |
© 2013-2016 Discuz Team. Powered by Discuz! X3.5