观点网讯:2月6日消息,美国斯坦福大学和华盛顿大学研究人员李飞飞团队宣布,以低于50美元的云计算成本训练出人工智能推理模型s1-32B。
该模型在数学及编码测试中表现与OpenAI的o1、DeepSeek的R1等尖端模型相当,引发行业关注。
据媒体报道,s1-32B实为基于阿里云通义千问Qwen2.5-32B-Instruct开源模型的微调产物。
报道称,阿里云证实,该团队以阿里通义千问Qwen2.5-32B-Instruct开源模型为底座,在16块H100GPU上监督微调26分钟,训练出新模型s1-32B,取得了与OpenAI的o1和DeepSeek的R1等尖端推理模型数学及编码能力相当的效果,甚至在竞赛数学问题上的表现比o1-preview高出27%。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开 

全部评论
机会情报
- 锂矿巨头业绩迎来爆发式增长 机构看好行业高盈利周期延续(附概念股)
- “十五五”油气规划落地+国际油价走高 油气股迎来催化(附概念股)
- AI硬件大幅拉升,长鑫科技市值突破4万亿元!科技巨头持续加码AI基建
- AI轻资产企业打开创新融资通道,四类企业或最为受益
- 湖南“2030年智能机器人营收力争突破2000亿元”,助力机器人产业高成长
- 液冷成为AI算力时代刚需底座,从0-1迈入1-N导入期
- 固态变压器迎来产业化元年,两大产业链环节企业最为受益
- 我国首部数据中心液冷国标发布,2026年成为液冷放量元年
- 《微短剧发展管理办法》9月1日起施行 文生视频模型迭代驱动内容全链路价值重估(附概念股)
- 腾讯算力采购大增,单季资本开支528亿元同比升176%
