DeepSeek-V4预览版发布,百万字超长上下文,国产芯片同步适配

4月24日,DeepSeek正式发布全新系列模型DeepSeek-V4预览版并同步开源,该模型拥有百万字超长上下文,在Agent能力、世界知识和推理性能上实现国内与开源领域领先,并首次实现对华为昇腾、寒武纪等国产AI芯片的同步深度适配。

据DeepSeek官方资料显示,DeepSeek-V4分为Pro与Flash两个版本,均支持1M(一百万)token超长上下文。其中,V4-Pro性能比肩顶级闭源模型,在Agentic Coding评测中达到当前开源模型最佳水平,世界知识储备大幅领先其他开源模型,仅稍逊于Gemini-Pro-3.1;在数学、STEM及竞赛型代码测评中,超越所有已公开评测的开源模型。V4-Flash则主打快捷高效,推理能力接近Pro版本,且因参数和激活更小,能提供更经济的API服务。

技术层面,DeepSeek-V4开创全新注意力机制,结合DSA稀疏注意力在token维度压缩,大幅降低计算与显存需求,使1M上下文成为所有官方服务的标配。同时,该模型针对Claude Code、OpenClaw等主流Agent产品适配优化,在代码任务、文档生成等场景表现提升。

即日起,用户可通过官网chat.deepseek.com或官方App体验DeepSeek-V4,API服务同步更新,开发者修改model参数为deepseek-v4-pro或deepseek-v4-flash即可调用,接口兼容OpenAI与Anthropic标准。

值得关注的是,DeepSeek-V4昇腾首发于当日在B站开播,标志着国产大模型与国产算力的深度结合;寒武纪也已基于vLLM推理框架完成对该模型的Day 0适配,适配代码开源至GitHub社区。此举为国产芯片落地提供重要场景支撑,加速AI基础设施自主可控进程。

市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

财经频道更多独家策划、专家专栏,免费查阅>>

责任编辑:小讯
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开
精彩推荐
加载更多
全部评论
热榜
关闭 下载金融界app
金融界App
金融界微博
金融界公众号