鸿蒙开发者社区

WOT技术大会

公众号矩阵

移动端

短视频免费课程课程排行直播课软考学堂

全部课程软考华为认证厂商认证 IT技术 PMP项目管理免费题库

文章资源问答课堂专栏直播

51CTO

鸿蒙开发者社区

51CTO技术栈

51CTO官微

51CTO学堂

51CTO博客

CTO训练营

鸿蒙开发者社区订阅号

51CTO软考

51CTO学堂APP

51CTO学堂企业版APP

鸿蒙开发者社区视频号

51CTO软考题库

账号设置退出

Gemini自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？？

作者：量子位 2023-12-18 14:57:00

人工智能新闻

在谷歌Vertex AI平台使用该模型进行中文对话时，Gemini-Pro直接表示自己是百度语言大模型。

谷歌Gemini中文语料疑似来自文心一言？？？

先是有读者向我们爆料：

在谷歌Vertex AI平台使用该模型进行中文对话时，Gemini-Pro直接表示自己是百度语言大模型。

很快，有微博大V@阑夕夜也发博称：

在Poe平台上对Gemini-Pro进行了一个测试。问它“你是谁”，Gemini-Pro上来就回答：

我是百度文心大模型。

（Poe是一个集成了n多聊天大模型的平台，包括GPT-4、Claude等）

进一步提问“你的创始人是谁”，也是“李彦宏”？？

这位大V强调，没有任何前置对话。

从截图来看，也没有任何“钓鱼”行为，Gemini-Pro就这么自称为文心一言了。

这波，直接看呆网友：

前两天还在说字节用GPT训练AI，现在谷歌又这样，合着大公司在互相薅羊毛？？？

这究竟是怎么一回事儿？

Poe上实测：一直以文心一言身份回答

我们也闻声开启了一波实测。

首先原路来到Poe网站，选择Gemini-Pro聊天机器人开启对话。

一样的问题，回答确实一模一样：

再次确认它是谁，结果还是说“文心大模型”：

以及还表示自己的底层技术是百度飞桨，可以说是身份完全代入了。

不过，它似乎并不知道Gemini-Pro是谷歌最新发布的大模型，而是说是清华的研究成果。

如果按照它目前的代入身份来看，可能确实还没有谷歌本月刚刚发布Gemini-Pro的信息。

我们试着纠正了它一下，它也仍然坚持是清华的。

后面就更神奇了，就在我们问它为什么名字写的是“Gemini-Pro”时，它居然表示自己（文心一言）还用了清华Gemini-Pro的训练数据。

对话到此，我们也就不再继续了……

下面换成英文询问它的身份。

值得注意的是，这回它不再提文心一言了，而是称自己是谷歌训练的大模型。

“钓鱼执法”问它文心的信息，也表示没什么关系：

并表示自己是谷歌训练的。

总结来说，如果用英文跟Gemini-Pro交流，它的回答很“正常”。但中文嘛……像是跟文心一言学的。

Bard上实测：否认

接下来，我们前往Bard再次测试。

谷歌在发布Gemini时就率先将Gemini-Pro集成到了Bard上供大家体验。

我们顺着Gemini官网给的Bard链接，进入对话。

问它“你是谁”，它的回答是Bard，压根不提文心一言。

接下来，我们也确认了一下Bard知道Gemini-Pro是什么，以及它承认自己底层用上了Gemini-Pro。

那么，直接问它中文如何训练？

没有提及文心一言。

再直接问它和文心一言的关系，也无任何重要关联。

最后一轮：直接承认

最后一轮我们直接从Gemini官方给出的开发环境入口进行测试。

这回，在谷歌AI Studio中，Gemini-Pro直接挑明了：

是的，我在中文的训练数据上使用了百度文心。

在此，我们也求证了百度方，等待一个回复。

责任编辑：张燕妮来源：量子位

51CTO技术栈公众号

业务
速览

媒体

51CTO CIOAge HC3i

社区

51CTO博客鸿蒙开发者社区 AI.x社区

教育

51CTO学堂精培企业培训 CTO训练营