观点网讯:2月6日消息,美国斯坦福大学和华盛顿大学研究人员李飞飞团队宣布,以低于50美元的云计算成本训练出人工智能推理模型s1-32B。
该模型在数学及编码测试中表现与OpenAI的o1、DeepSeek的R1等尖端模型相当,引发行业关注。
据媒体报道,s1-32B实为基于阿里云通义千问Qwen2.5-32B-Instruct开源模型的微调产物。
报道称,阿里云证实,该团队以阿里通义千问Qwen2.5-32B-Instruct开源模型为底座,在16块H100GPU上监督微调26分钟,训练出新模型s1-32B,取得了与OpenAI的o1和DeepSeek的R1等尖端推理模型数学及编码能力相当的效果,甚至在竞赛数学问题上的表现比o1-preview高出27%。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
转载请注明来自石家庄天鲲化工设备有限公司 ,本文标题:《阿里云回应李飞飞团队50美元训练出AI模型》
百度分享代码,如果开启HTTPS请参考李洋个人博客
每一天,每一秒,你所做的决定都会改变你的人生!
还没有评论,来说两句吧...