当前位置:   article > 正文

阿里千问Qwen-72 b在中文测试中击败了GPT-3.5_qwen-72b

qwen-72b

2023.11.30 我们在 ModelScope 和 Hugging Face 上发布了Qwen-72B和Qwen-72B-Chat,它们在 3T 令牌上进行训练并支持 32k 上下文,以及Qwen-1.8B和Qwen-1.8B-Chat 。

我们还增强了 Qwen-72B-Chat 和 Qwen-1.8B-Chat 的系统提示功能,请参阅示例文档

另外,支持Ascend 910和Hygon DCU上的推理。检查ascend-support并dcu-support了解更多详细信息。

网友讨论:

  • Qwen 在所有测试中击败 GPT-4 的都是中文。虽然这对开源来说是个好消息,但 Qwen-72B 的最大性能看起来与 GPT-3.5 不相上下。
  • 到目前为止,所有这些基准都是普通话的。在英语中它仍然落后于 GPT4。尽管如此:与 175b GPT4 相比,70b LLM 有多好!
  • 为什么击败 GPT 4 如此困难且花费如此长的时间?
  • 更令人印象深刻的是,这是在制裁下通过拆解 4090 显卡下实现的。

https://www.jdon.com/70415.html

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/盐析白兔/article/detail/705643
推荐阅读
相关标签
  

闽ICP备14008679号