蚂蚁百灵发布万亿级思考模型,双模式推理主攻Agent场景

5月9日,蚂蚁集团旗下inclusionAI团队正式发布万亿级旗舰思考模型Ring-2.6-1T。该模型专为Agent、工程开发与科研分析等复杂真实任务场景设计,核心创新在于引入可调节Reasoning Effort机制。

官方评测数据显示,模型提供high与xhigh两种推理强度。high模式面向高频Agent工作流,在真实任务执行评测PinchBench中取得87.60分,高于GPT-5.4x High、Gemini-3.1-Pro high与Claude-Opus-4.7x high;ClawEval得分63.82,Tau2-Bench Telecom达到95.32。xhigh模式聚焦数学、科研等高难任务,ARC-AGI-V2得分77.78,AIME 26达95.83,GPQA Diamond为88.27,高难推理能力与Gemini-3.1-Pro high和Claude-Opus-4.7x high处于同一水位。

两种推理强度的差异体现在调用成本与思考深度上。high模式强调低Token开销与快速多步执行,适配任务拆解、工具协作与生产级默认调用;xhigh模式则为复杂逻辑分析与多路径探索提供更充分的推理空间。

目前,Ring-2.6-1T已上线OpenRouter平台,开放一周免费体验通道。

在产品定位上,蚂蚁百灵将Ring-2.6-1T标注为“思考模型”。与市场上的通用对话模型路线不同,百灵将这一产品方向聚焦于Agent场景中的执行稳定性与推理可靠性。

蚂蚁方面表示,模型后续将正式开源,具体时间和开源协议尚未公布。

市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

关键词阅读:科技财经资讯风格

责任编辑:磐石
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开
精彩推荐
加载更多
全部评论
热榜
关闭 下载金融界app
金融界App
金融界微博
金融界公众号