一个多月,DeepSeek R1在美国区和中国区的App Store均拿到了第一名,超越了字节系的豆包和红果等应用。
春节前,是大厂集中投放阶段,但是DS没有市场部,没搞任何市场投放,完全依靠口碑。
背后的原因是,DeepSeek的开源+高性价比,个人用户免费,API价格只有闭源的GPT o1模型的1/27。
你可能会有疑问,为啥成本会大幅下降,是因为DS的R1 Zero跳过了监督微调(SFT)阶段,直接采用强化学习(RL)进行训练。
说人话就是,它具备了自己学习进化的能力,就像是张无忌学会了九阳神功,学啥都快,而别的人,需要不断找武林秘籍。
Deppseek横空出世,AI彻底开启从训练到自学习的iphone时代。
再看看人家成本有多低?
在马斯克构建庞大的十万卡集群的时候,DeepSeek V3 仅仅使用了 2048 张卡。
算力行业将会一片哀嚎,但是正因为此,AI也会迎来应用大爆发的iphone时刻。
如果说过去的2年,AI是中美两个超级大国的角逐,那未来是中国引领世界AI的风向。
R1这个模型,我用了大概一周时间,我的第二期AI公众号爆文的很多学员,不少也正在用Deepseek替代Claude自动化写爆文。
R1是目前唯一一个可以联网搜索的推理模型,像OpenAI的o1、Google的gemini 2.0 flash thinking都是不支持联网的。
这对于需要实时信息的需求极其有效,比如金融行业、自动化驾驶等等。
还有,从12月我开始用Deepseek开始,就被它的思维链所震惊,它会一步步演示解决或思考问题的过程。
而这正是学习的元能力,也是教师和学生模型蒸馏技术带来的成本大幅度下降。
另外我发现,相比之前的Claude和ChatGPT这样的训练类模型,对指令要求特别高。
R1这样的推理模型横空出世后,我发现我基本都没用过什么复杂的结构化指令,只需要说清楚我的需求就好了。
AI对指令的要求会越来越低,对工作流和人类的审美的要求越来越高,就像是智能手机的傻瓜式操作,才会真正让AI普惠世界,让每个人都用得上都会用。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。