Newswire
Newswire
Newswire 登入
Newsletter|Newswire Newsletter 联络我们|Newswire 联络我们 登广告|Newswire 登广告 关于我们|Newswire 关于我们 活动|Newswire 活动
快讯
Newswirer 登广告 互动区 |
下载APP
|

ADVERTISEMENT

ADVERTISEMENT

国际

|

即时国际

donation
发布: 12:19pm 24/04/2026

人工智能

AI

生成式AI

大型语言模型

语言模型

DeepSeek

人工智能

AI

生成式AI

大型语言模型

语言模型

DeepSeek

DeepSeekV4预览版正式发布:迈入百万上下文普惠时代

DeepSeekV4预览版正式发布:迈入百万上下文普惠时代
深度求索公司推出全新系列模型DeepSeek-V4的预览版本。(互联照片)

(北京24日综合电)深度求索公司推出全新系列模型-V4的预览版本且同步开源,标志着大模型正式迈入百万上下文普惠时代。

ADVERTISEMENT

hidden

DeepSeek-V4采用创新的注意力机制,在Token维度进行压缩,结合DSA稀疏注意力技术,实现了全球领先的百万字超长上下文处理能力,同时大幅降低了对计算和显存的需求。

模型分为两个版本:DeepSeek-V4-Pro拥有1.6万亿参数,在Agent能力、世界知识和推理性能上均达到国内与开源领域的领先水平;DeepSeek-V4-Flash则以更小的参数量提供接近的推理能力,成为更快捷、经济的选择。

在性能表现上,V4-Pro在Agentic Coding评测中已达到当前开源模型最佳水平,使用体验优于Sonnet 4.5,交付质量接近Opus 4.6非思考模式。在世界知识测评中大幅领先其他开源模型,在数学、STEM、竞赛型代码推理任务中超越所有已公开评测的开源模型,比肩世界顶级闭源模型。

API服务已同步更新,支持Open ChatCompletions与Anthropic接口。V4-Pro和V4-Flash皆支持1M上下文长度,提供非思考模式与思考模式。值得注意的是,旧有API接口的deepseek-chat与deepseek-reasoner模型名将于2026年7月24日停止使用。

hidden

此次开源包括模型权重和技术报告,开发者可通过Hugging Face和ModelScope平台获取。

DeepSeekV4预览版正式发布:迈入百万上下文普惠时代
模型细节。(互联网照片)

DeepSeek-V4的推出不仅展示了中国在AI大模型领域的技术实力,更为开发者社区提供了强大的工具,有望推动AI应用向更复杂、更专业的场景拓展。

在DeepSeekV4预览版本上线当天,DeepSeek官方团队指出:“感谢每一位用户的信任与支持,大家的肯定、建议和期许,是我们不竭探索、持续进步的动力,也让我们始终坚守初心,专注于不懈的创新。我们将始终秉持长期主义的原则理念,在尝试与思考中踏实前行,努力向实现AGI的目标不断靠近。”

V4-Pro在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型Gemini-Pro-3.1。

相比V4-Pro,V4-Flash在世界知识储备方面稍逊一筹,不过展现出了接近的推理能力。由于模型参数和激活更小,相比之下V4-Flash能够提供更加快捷、经济的API服务。在Agent测评中,DeepSeek-V4-Flash在简单任务上与DeepSeek-V4-Pro旗鼓相当,仅在高难度任务上仍有差距。

DeepSeek-V4针对ClaudeCode、OpenClaw、OpenCode、CodeBuddy这些主流的Agent产品进行了适配和优化,在代码任务、文档生成任务方面表现均有提升。

V4-Pro与V4-Flash最大上下文长度为1M(100万),均同时支持非思考模式与思考模式,其中思考模式支持reasoning_effort 参数设置思考强度(high/max)。对于复杂的Agent场景建议使用思考模式,并设置强度为max。

DeepSeek在去年春节的现象级走红,曾一度被捧上神坛,不过,伴随国产AI的竞速加剧,来自智谱、MiniMax、Kimi大模型公司的迅速迭代,DeepSeek目前面临激烈竞争。

打开全文
支持优质新闻或评论,欢迎送上一杯咖啡。

ADVERTISEMENT

热门新闻

百格视频

ADVERTISEMENT

点击 可阅读下一则新闻
Close

ADVERTISEMENT