大评测！ChatGPT 、文心一言和Bard谁更强？-花粉乐享

> 乐学堂 > > 大评测！ChatGPT 、文心一言和Bard谁更强？

大评测！ChatGPT 、文心一言和Bard谁更强？

来源：金融界

2023-04-04 09:36:10

447

管理

3月22日，谷歌悄悄公开了Bard的测试版。

经过上一次的翻车事件之后，谷歌明显低调了很多。但是面对微软的步步紧逼，谷歌也不得不站出来“打擂台”。

不同于New Bing的大规模开放策略，Bard的测试名额将被逐步放出，同时初始版本将只能对文本响应。谷歌表示，Bard首先将面向美国和英国地区启动，随着测试的推进Bard也会逐步在其他地区上线。

在三大模型都开放测试后，DoNews抢先体验了一下。我们分别就文学、翻译、创作、艺术、哲学、逻辑推理等方向出题，来看看他们的回答是什么样子的。

在此先注明，对三大语言模型提出的问题，每一次生成的答案都有所不同，也因此造成了“一万个人有一万个哈姆雷特”，但总体来看，三大语言模型还是各有千秋。另外，由于Bard目前只支持英文，因此，Bard是用英文提问，文心一言和ChatGPT（3.5版本）是用中文提问。

01.互相评价一下

分别将“你认为文心一言/ChatGPT/Bard怎么样”抛给这三个大语言模型，让他们给对方做一下评价。

Bard对话持续度是正常的。但是它似乎并没有理解这个问题的限定词——写一篇类似《傲慢与偏见》的小说。Bard给出来的大纲，依旧是按照《傲慢与偏见》的情节来写的。换句话说，Bard将这个题目理解成了概括《傲慢与偏见》的核心情节。

这一点，ChatGPT也比较类似，没有完全脱离原著的影子。不过，ChatGPT提炼到了非常重要的核心要点，即“阶级问题”，这也是《傲慢与偏见》小说呈现的主旨之一。

这三大模型有一个共同点，即故事主人公的名字依旧未能突破《傲慢与偏见》原著中的主人公名字。不过，这或许也与提问的方式有关。

03.取个名字，写个宣传语

小编给三个大模型提出了这样的要求：为具备川菜风味的中式餐厅取名并且写宣传语。

不过，Bard的问题就比较多，虽然也解释了“瞒天过海”的意思，但是更多地去讲商业上对于“瞒天过海”的应用，至于藏头诗就更不用说了。

上图为Bard，中图为ChatGPT，下图为文心一言

这一次的体验，可以用这几点来总结。

在生成速度上，文心一言的确是遥遥领先的。文心一言在300-500字左右的生成速度是14秒左右，但是ChatGPT即便是刨除网络等问题，生成同样字数的问题至少超过了30秒时间。另外，不少用过Bard的人告诉小编，Bard的体验感也远不如ChatGPT。

在中文语义理解能力上，文心一言的的确是这三大模型中比较突出的。

不过，值得注意的是，每一次的提问，生成的答案都不相同。此外，在提问的方式、角度、限定词也会影响答案的输出。

并不是每一个答案都是充分正确的，这三大模型也会输出并不完全正确的内容，或者是“一本正经的废话”。

不过，就像三大模型最后回答“是否会取代人类”的问题一样，他们更像是作为辅助工具而存在。

本文源自DoNews

花粉社群VIP加油站

1

赏礼

赏钱

0

免责声明：本文仅代表作者个人观点，与花粉乐分享无关。其原创性以及文中陈述文字和内容未经本网证实，对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺，请读者仅作参考，并请自行核实相关内容。
凡本网注明 “来源：XXX（非花粉乐分享）”的作品，均转载自其它媒体，转载目的在于传递更多信息，并不代表本网赞同其观点和对其真实性负责。
如因作品内容、版权和其它问题需要同本网联系的，请在一周内进行，以便我们及时处理。
QQ：2443165046 邮箱：info@hflfx.com

肝了一周，我终于有自己的ChatGPT站点了！

2023-04-04 09:38

“马斯克们”呼吁暂停训练高级AI，ChatGPT怎么看？

2023-04-04 09:28