这个推文讨论的大佬很多,我们来看看。
"闭源最好的几个模型的token占60-90%经济价值"。如果我是开源模型必胜派,最刺眼的是这一句:"只占15-25%的token量,却拿走60-90%的经济价值。"看来有人把开源定位成"底层劳力",干那些便宜、简单、不出错也没人夸的活儿,而真正值钱的活儿留给闭源。
第一,62%这个数字来自Vercel也就是在上做网页开发的人调用模型的流量。这是一个切片:偏应用层、偏成本敏感、偏高频简单任务。它肯定不能代表企业市场。也就是说不全面,那些能自己部署、能审计权重、能在断网环境里跑、能不把数据交给第三方的份额没有在图表里,也就是说,对医院、银行、政府、以及任何不想把命脉托付给一家AI公司的机构的没有在图表里。开源真正的卖点不是便宜,而是谁部署,谁说了算。
第二,把价值全部记在模型头上,是一种记账偏差。同一个模型,配上好的检索、好的工具链、好的评估循环,产出天差地别。开源的意义恰恰是让价值可以留在应用层和使用者手里,而不是被模型这一层抽走。
第三,"体量层和价值层"的划分不是钉死的,一条会上移的线,线以下的东西开源会持续吃掉。开源模型在这简单层几乎必然获胜,因为它足够好且便宜。而顶层是价值层就是那些难做的,长周期编程、复杂推理、智能体自主决策。在这种场景下,能力差距的价值远超价格差距。能力差距会持续存在。它的成立条件是:前沿模型持续拉开身位,且困难任务的比例不下降。
还有一点,也许token不是一个可比单位。近用token算份额,就像仅用"字数"衡量一篇文章价值。