当前位置:   article > 正文

击败GPT4-Turbo,最强开源代码模型DeepSeek-Coder-V2问世_deepseek-coder-v2 16b

deepseek-coder-v2 16b

0b9221f9df71897e5124d32f3204b1cf.png

6月17日,深度求索正式开源了DeepSeek-Coder-V2模型。

根据相关评测榜单,这是全球首个在代码、数学能力上超越GPT-4-Turbo、Claude3-Opus、Gemini-1.5Pro等的开源代码大模型。DeepSeek-Coder-V2包含236B与16B两种参数规模,对编程语言的支持从86种扩展到338种。

据官方博客介绍,DeepSeek-Coder-V2沿用DeepSeek-V2的MoE模型结构,总参数236B,激活参数21B,在代码、数学的多个榜单上位居全球第二,介于最强闭源模型 GPT-4o和GPT-4-Turbo之间。

dae7dd04c7e0dd9f136c0e2e93e926f0.png

在拥有世界前列的代码、数学能力的同时,DeepSeek-Coder-V2还具有良好的通用性能,在中英通用能力上位列国内第一梯队。

3367eb23bce6dd906f4c56a8ff03034d.png

虽然DeepSeek-Coder-V2相比DeepSeek-V2在评测中综合得分更高,但在实际应用中,两个模型各有所长。DeepSeek-V2是精通文本创作、角色扮演等能力的“文科生”,DeepSeek-Coder-V2是精通代码生成、数学计算等能力的“理科生”。

62cf445c96a46aeee65c39fd9e1e2791.png

一如既往,继DeepSeek V2之后,硅基流动团队第一时间在云服务平台SiliconCloud上线了DeepSeek-Coder-V2(236B)开源模型。

欢迎来玩儿:

https://cloud.siliconflow.cn/models/text/chat/17885302528

289d80953d2e854266d253fdbe390e77.gif

目前,SiliconCloud已上架包括DeepSeek-Coder-V2、Stable Diffusion 3 MediumQwen2GLM-4-9B-Chat、DeepSeek V2、SDXL、InstantID在内的多种开源大语言模型、图片生成模型,支持用户自由切换符合不同应用场景的模型。同时,SiliconCloud提供开箱即用的大模型推理加速服务,为生成式AI应用带来更高效的用户体验。

f9d64b3a360e5ecffe36107bf760b7f6.png

真正在乎大模型推理性能和成本的开发者,绝不会错过SiliconCloud。

更何况,从现在起,新用户还送1亿token。

快试试吧www.siliconflow.cn/zh-cn/siliconcloud

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/天景科技苑/article/detail/850277
推荐阅读
相关标签
  

闽ICP备14008679号