第四百一十章 以为是ToB,其实是ToC (4/5)
因为模型公司们都指着企业业务赚钱呢,a服务并不是一个在消费端很赚钱的业务,大部分人用用免费版就够了,并不考虑为它付费。
汤圆hat的注册用户都快两亿了,真交钱订阅的才几百万人。
只有在企业用户这里,花出去的钱能成倍地变成赚回来的钱,企业才愿意真金白银地付费。
所以大家都会说,我们不会用企业用户的数据来训练。
当然,私底下是不是真的训练,从外面是看不到的。
忽然,但韩路一偏偏看不惯这种“一切向钱看”的商业逻辑,凭什么个人用户就不看重隐私了?
不如直接在价格上体现好了。
“那样不是正好吗?不愿意共享数据的,付不共享数据的价钱;愿意共享数据的,付共享数据的价钱。折扣就当是我们买数据的成本了。”韩路一说道。
“那这个买数据的成本可不低。”
苏念念最后说了一句,但她被韩路一说服了。
上次高管会议的时候赵文渊就提过,汤圆现在的表现不错但是主要是基于后训练的水平高,实际上汤圆预训练的规模和数据源在主流模型中都不算出彩。
:
紧接着,规模自然是因为算力不够,即使当时用了鼎盛的算力,也只是堪堪达到业内一般水平而已。
数据源则是因为当时受限于预算,韩路一和赵文渊选择了使用网络上的开源数据。
这些数据虽然不少,但是人类还有很多知识是不在互联网上的,或者不在公共互联网上。
前者比如某些生僻的古籍,没人上传,这些本身就不在互联网上。
后者则是很多商业或者社交等垂直领域的数据,比如鼎盛的电商数据肯定就很丰富,这些数据都不在互联网上。
汤圆想在下一代的模型中更进一步,就需要更大的模型,更多的预训练数据,不管有多少人选择共享的方式,在ap调用中能拿到的数据质量一般是比较高的,毕竟每一次调用都是真金白银的付钱。
至于算力——那就是另一个待解决的难题了。
回顾一下现状,韩路一又觉不安了起来。
章节报错
请简要描述您遇到的问题(如:内容缺失、章节错乱、文字乱码等)