观点网讯:2月6日消息,美国斯坦福大学和华盛顿大学研究人员李飞飞团队宣布,以低于50美元的云计算成本训练出人工智能推理模型s1-32B。
该模型在数学及编码测试中表现与OpenAI的o1、DeepSeek的R1等尖端模型相当,引发行业关注。
据媒体报道,s1-32B实为基于阿里云通义千问Qwen2.5-32B-Instruct开源模型的微调产物。
报道称,阿里云证实,该团队以阿里通义千问Qwen2.5-32B-Instruct开源模型为底座,在16块H100GPU上监督微调26分钟,训练出新模型s1-32B,取得了与OpenAI的o1和DeepSeek的R1等尖端推理模型数学及编码能力相当的效果,甚至在竞赛数学问题上的表现比o1-preview高出27%。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开 

全部评论
机会情报
- 增资3600亿元,八大金融央企补充核心一级资本!金融板块将受何影响?
- 折叠屏手机迎“超级发布周”,产业链三大增量环节受关注
- 金刚石散热正处于从0到1的产业化拐点 具备高壁垒与高弹性双重优势
- 猪周期大拐点临近 机构布局养殖板块(附概念股)
- AI算力扩张遭遇电力硬约束,算电协同打开绿电重估空间
- 26年上半年中国新船订单接近2023年全年,头部船厂满产,行业高景气持续
- AIPC利好!英伟达Rtx Spark Windows个人电脑将于下月上市
- AI玩具赛道成为资本追逐的新风口,市场规模未来有望突破千亿
- 2026年铜产量或下降 市场看好铜业股业绩提升(附概念股)
- 智驾渗透率逆势攀升,行业迎来业绩兑现窗口期
