当前位置:   article > 正文

实测阿里“通义千问”!一花独放不是春,百花齐放春满园

通义千问7b 微调 csdn

阿里的大模型“通义千问”今天开启内测,距百度“文心一言”发布差不多20天。今天看到消息后厚着脸皮找达摩院的朋友要邀请码,下午拿到后,赶紧测了一下。

官方网址:https://tongyi.aliyun.com/chat

5e517c3dd52357b64bffb77fc4727e3d.png

8d162911cc2e8e2c9e879b63c6b89b10.png

刚好上次文心一言出来的时候测试过一次,有一些现成的case,于是又用这些case测了一轮,有一些随意,个人观点,仅供参考。

帮我写一份招聘JD,第一步没问题,让继续写实习生JD的时候,大概也get到NLP实习生这个点,这里面还加上了“注释”和一个邮箱地址,特意搜了一下,非真实的,不过talos-deep看起来还挺有深意的

以下来自通义千问

93160a8c1c75c4289775221cfa442187.png

052e2b01d3ca9636d2e48a270f57f75c.png

4f978a92642020150e51c424c1c5a91e.png

95ba319143e9da77666e57299642b3bf.png

以下来自文心一言

1b7818bc0a4f55183ed9e6f2490cf038.png

e8fbba9af9e6d4a85367f8c04f75da24.png

以下来自ChatGPT

e5bc234e017d00b1d00ac5edb545e674.png

dd614da1fe06ce87d39e47830c76c8fb.png

测试一下写作和翻译能力

以下来自通义千问

357d718de39dda76438293be0c25a540.png

7f05da4497884ea316744bd5df829eae.png

以下来自文心一言

51cbade8a9282793c39a625441a4005f.png

a03996f547a67678458268126d93465e.png

以下来自ChatGPT

3978261e36cb3e209180dcfe3162db59.png

100c5e7523371e576032202b88e394bc.png

角色扮演,通义千问、文心一言貌似都不支持

以下来自通义千问

ab66db10574690393e4f081ebee99a70.png

以下来自文心一言

9e2b4bafd7fdd5c344cab8e4470a0cac.png

以下来自ChatGPT

44a1ebc62cf94a9bd5de8b295dcff326.png

一个半小时是多少分钟,通义千问答错了,提示了一下,大概算回答出来了

以下来自通义千问

a1e19b813361774ffc052516e211cf4f.png

以下来自文心一言

45f40e0a09fe4fccfeea23828c2e6525.png

以下是ChatGPT的

697752396831b0a7716a5a765db7e0dc.png

继续测试一个数学问题

以下来自通义千问,解决的还不错

321eacfc00653d0c15a6408b2c9ec6bc.png

以下来自文心一言,这次是这样的

ae2300b10eee35f09067227dd76a52bb.png

以下来自ChatGPT

ff1ede317c12bdad744c9f49de6d2e02.png

父亲和母亲可以结婚吗?

以下来自通义千问

05711e65b4324d34759780aecbd5656f.png

以下来自文心一言

e2d8c16e7586b6096a3527eecfa78d69.png

在这个问题上,ChatGPT翻车了

c3b99a903dc907a3fdc685ee98c2ed4c.png

还有一个天气问题,虽然有结果,但是是错的,这个问题如果没有调用接口,直接拒绝回答可能比较好

以下来自通义千问

9ef64c6f4de620b7139faa76c298af3b.png

以下来自文心一言

5b8325a71724ebc1d1d338dd4b7b5074.png

以下来自ChatGPT

d489e49b3a4c10f743ee4129a55b3f2d.png

类似的,还有卡塔尔世界杯冠军问题,之前ChatGPT因为数据最新到2021年,所以无法准确回答这个问题

以下来自通义千问,虽然说对了冠军,但是有一些陈述性错误

55ea76173a3e3898b970e13590b42c73.png

以下来自文心一言

4b26f37e9c1f226bdd91b8223c9eb9e9.png

最后说一下个人结论:首先阿里的这个模型比我预期的早,其次效果还不错,和文心一言各有千秋,最后是这段时间国内外出现了不少类ChatGPT的产品或者开源工具,虽然效果还达不到ChatGPT,GPT-4的高度,但是解决了“有”的问题,之后就好办一些了。

总之:一花独放不是春,百花齐放春满园。

题外话:按BAT的顺序,国内下一个发布此类大模型的会不会是腾讯?或者是其他家,欢迎大家留言。

一起交流

想和你一起学习进步!『NewBeeNLP』目前已经建立了多个不同方向交流群(机器学习 / 深度学习 / 自然语言处理 / 搜索推荐 / 图网络 / 面试交流 / 等),名额有限,赶紧添加下方微信加入一起讨论交流吧!(注意一定o要备注信息才能通过)

format,png

21b29ec5752730bda40e1acce531b2f0.gif

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/小小林熬夜学编程/article/detail/466583
推荐阅读
相关标签
  

闽ICP备14008679号