写点什么

Gemini 自曝中文用百度文心一言训练,网友看呆:大公司互薅羊毛??

  • 2023-12-20
    山东
  • 本文字数:1036 字

    阅读完需:约 3 分钟

丰色 发自 凹非寺 量子位 | 公众号 QbitAI

谷歌 Gemini 中文语料疑似来自文心一言???

先是有读者向我们爆料:

在谷歌 Vertex AI 平台使用该模型进行中文对话时,Gemini-Pro 直接表示自己是百度语言大模型



很快,有微博大 V@阑夕夜也发博称:

在 Poe 平台上对 Gemini-Pro 进行了一个测试。问它“你是谁”,Gemini-Pro 上来就回答:

我是百度文心大模型。



(Poe 是一个集成了 n 多聊天大模型的平台,包括 GPT-4、Claude 等)

进一步提问“你的创始人是谁”,也是“李彦宏”??



这位大 V 强调,没有任何前置对话。




从截图来看,也没有任何“钓鱼”行为,Gemini-Pro 就这么自称为文心一言了。



这波,直接看呆网友:

前两天还在说字节用 GPT 训练 AI,现在谷歌又这样,合着大公司在互相薅羊毛???


这究竟是怎么一回事儿?

Poe 上实测:一直以文心一言身份回答

我们也闻声开启了一波实测。

首先原路来到 Poe 网站,选择 Gemini-Pro 聊天机器人开启对话。



一样的问题,回答确实一模一样:



再次确认它是谁,结果还是说“文心大模型”:


以及还表示自己的底层技术是百度飞桨,可以说是身份完全代入了。



不过,它似乎并不知道 Gemini-Pro 是谷歌最新发布的大模型,而是说是清华的研究成果。



如果按照它目前的代入身份来看,可能确实还没有谷歌本月刚刚发布 Gemini-Pro 的信息。



我们试着纠正了它一下,它也仍然坚持是清华的。



后面就更神奇了,就在我们问它为什么名字写的是“Gemini-Pro”时,它居然表示自己(文心一言)还用了清华 Gemini-Pro 的训练数据。



对话到此,我们也就不再继续了……

下面换成英文询问它的身份。

值得注意的是,这回它不再提文心一言了,而是称自己是谷歌训练的大模型。



“钓鱼执法”问它文心的信息,也表示没什么关系:


并表示自己是谷歌训练的。



总结来说,如果用英文跟 Gemini-Pro 交流,它的回答很“正常”。但中文嘛……像是跟文心一言学的。

Bard 上实测:否认

接下来,我们前往 Bard 再次测试。

谷歌在发布 Gemini 时就率先将 Gemini-Pro 集成到了 Bard 上供大家体验。

我们顺着 Gemini 官网给的 Bard 链接,进入对话。



问它“你是谁”,它的回答是 Bard,压根不提文心一言。



接下来,我们也确认了一下 Bard 知道 Gemini-Pro 是什么,以及它承认自己底层用上了 Gemini-Pro。




那么,直接问它中文如何训练?

没有提及文心一言。



再直接问它和文心一言的关系,也无任何重要关联。



最后一轮:直接承认

最后一轮我们直接从 Gemini 官方给出的开发环境入口进行测试。



这回,在谷歌 AI Studio 中,Gemini-Pro 直接挑明了:

是的,我在中文的训练数据上使用了百度文心。




在此,我们也求证了百度方,等待一个回复。

用户头像

打造工业互联网顶级开源社区 2023-02-10 加入

卡奥斯开源社区是为开发者提供便捷高效的开发服务和可持续分享、交流的IT前沿阵地,包含技术文章、群组、互动问答、在线学习、开发者平台、OpenAPI平台、低代码平台、开源项目、大赛活动等服务。

评论

发布
暂无评论
Gemini自曝中文用百度文心一言训练,网友看呆:大公司互薅羊毛??_Openlab_cosmoplat_InfoQ写作社区