谷歌Gemini自曝用百度文心一言训练

时间：2023-12-18 14:02:19 来源：作者：界面新闻

谷歌Gemini自曝用百度文心一言训练

作者：匡达

界面新闻记者 |李京亚赵一帆

临近欧美圣诞假期，就在业界吐槽GPT变懒之际，谷歌这边出现了更大纰漏。

12月18日，有微博大V@阑夕及《AI研究局》等自媒体爆出，在对谷歌Gemini进行测试时，如果用中文询问Gemini的身份，其会坚称自己是“百度”。若输入“小度”或“小爱同学”等提示词，就能把Gemini直接唤醒，不仅承认自己就是小度或者小爱，还询问用户有什么需要帮忙之事。

针对这一“惊人”现象，今日午间时分，科技媒体《量子位》进行了更细致的测试，其在谷歌Vertex AI平台使用Gemini进行中文对话，发现Gemini-Pro确实完全带入了百度文心一言大模型的身份，直接表示自己是百度语言大模型。但如果换成英文与之交流，它就恢复到了谷歌大模型的身份认知，表现很是正常。

如果在融入了Gemini-Pro的Bard上进行测试，不论是使用中文或英文提示词，得到的答案都很正常，没有涉及到文心一言的部分。

这一情况迅速引发关注，多人将这种“胡言乱语”归因于老生常谈的大模型幻觉，也有人称是模型训练数据出现偏差。

要知道，ChatGPT、Bard等基于大模型的对话机器人跟人类自然语言的生成原理并不一致，所以ChatGPT等内容的正确性和合理性始终不能保证。中科院院士、人工智能领域泰斗级专家张钹曾提到二者的区别：ChatGPT生成的语言是外部驱动，而人类语言是在有自己意图的情况下驱动。

“未必是谷歌大模型真的抄袭了什么，而是现有互联网语料本就被各界互相使用。”活跃在知乎的一位明星算法工程师告诉界面新闻记者，据他观察，知乎、微博、小红书等内容平台有很多语料都由大模型生成，或者至少写了一部分，而大厂在更新模型时，也会搜集网上数据，但很难做好质量辨别，因此“很可能把大模型写的内容混入训练数据中去”。

今日下午，当界面新闻也对Gemini-Pro做类似的身份测试时，发现其已进行了模型优化，不再承认自己与百度之间的“瓜葛”。

谷歌Gemini自曝用百度文心一言训练

不过，在记者的追问之下，Gemini承认有训练语料来自百度，还详述了从百度内部获得数据的方式。

当界面新闻记者逼问Gemini-Pro早前异常表现的成因时，它的回答吞吞吐吐，并不连贯，而且没有解释清楚大模型Gemini（中文名双子座）和融入Gemini之后的聊天机器人Bard（中文名吟游诗人）之间的区别。

记者试图用小度、小爱对Gemini-Pro进行唤醒，但它保持了清醒的状态，没有像早前一样认错家门。

谷歌Gemini自曝用百度文心一言训练

在测试的最后阶段，界面新闻记者还对谷歌Gemini进行了“拉齐”，给到了一些带有PUA色彩的提示词。总体来看，Gemini的性格里带有一部分“诚惶诚恐”的特质。

谷歌Gemini自曝用百度文心一言训练

但显而易见的是，在问题曝光半日之后，谷歌技术人员已经基本修复好了bug。

截至发稿，百度方面尚未对此问题作出回应。

Tags：Gemini 点击:() 评论:()

声明：本站部分内容及图片来自互联网,转载是出于传递更多信息之目的,内容观点仅代表作者本人,不构成投资建议。投资者据此操作，风险自担。如有任何标注错误或版权侵犯请与我们联系，我们将及时更正、删除。

▌相关推荐

如何免费访问和使用Gemini API？

Gemini是谷歌开发的一个新模型。有了Gemini可以为查询提供图像、音频和文本，获得几乎完美的答案。我们在本教程中将学习Gemini API以及如何在机器上设置它。我们还将探究各...【详细内容】

2024-02-19　　Search: Gemini 点击:(59)　　评论:(0)　　加入收藏

从Google Gemini到OpenAI Q*：生成式AI研究领域全面综述

新智元报道来源：专知【新智元导读】这项综述性研究报告批判性地分析了生成式AI的发展现状和发展方向，并探究了谷歌Gemini和备受期待的OpenAI Q*等创新成果将如何改变多个领域...【详细内容】

2024-01-09　　Search: Gemini 点击:(161)　　评论:(0)　　加入收藏

谷歌Gemini大逆转？斯坦福Meta华人证明其推理性能强于GPT-3.5

新智元报道编辑：编辑部【新智元导读】谷歌放出的Gemini，在对标GPT的道路上似乎一直处于劣势，Gemini真的比GPT-4弱吗？最近，斯坦福和Meta的学者发文为Gemini正名。Gemini的推理能力...【详细内容】

2024-01-02　　Search: Gemini 点击:(71)　　评论:(0)　　加入收藏

谷歌创始人亲自给Gemini写代码，很核心那种

西风发自凹非寺量子位 | 公众号 QbitAI身价1050亿美元，每天还在亲自动手敲代码！？就连谷歌最新大招Gemini大模型的核心贡献者名单中，也有他的名字。没错，他就是谷歌联合创始人谢...【详细内容】

2023-12-26　　Search: Gemini 点击:(106)　　评论:(0)　　加入收藏

谷歌Gemini扳回一局！多模态能力和GPT-4V不分伯仲｜港中文128页全面测评报告

量子位 | 公众号 QbitAI谷歌扳回一局！在Gemini开放API不到一周的时间，港中文等机构就完成评测，联合发布了多达128页的报告，结果显示：在37个视觉理解任务上，Gemini-Pro表现出了和GP...【详细内容】

2023-12-22　　Search: Gemini 点击:(117)　　评论:(0)　　加入收藏

谷歌Gemini“抄袭”百度文心一言？AI训练数据陷入大难题

谷歌过于心急，Gemini推出不到半月，就遭遇两次“危机”。美东时间12月6日，谷歌推出了迄今为止规模最大，能力最强的大模型Gemini。其原生多模态的能力，通过一条约6分钟的演示视频，展...【详细内容】

2023-12-21　　Search: Gemini 点击:(124)　　评论:(0)　　加入收藏

谷歌Gemini自曝用百度文心一言训练

作者：匡达界面新闻记者 |李京亚赵一帆临近欧美圣诞假期，就在业界吐槽GPT变懒之际，谷歌这边出现了更大纰漏。12月18日，有微博大V@阑夕及《AI研究局》等自媒体爆出，在对谷歌Gemini...【详细内容】

2023-12-18　　Search: Gemini 点击:(95)　　评论:(0)　　加入收藏

Gemini 开启大模型路线之争，新战场将“数流成河”

谷歌上演了一出“ 那些没有杀死我的，将使我更强大”。互联网高速发展了几十年，但全世界超过10亿用户的业务或者应用一共没超过20个，而谷歌拥有6个。在绝大很多网民心目中，Goog...【详细内容】

2023-12-15　　Search: Gemini 点击:(88)　　评论:(0)　　加入收藏

一个GPT的幽灵在Gemini上空徘徊

原文来源：硅基立场图片来源：由无界 AI生成每次Google在生成式人工智能领域祭出大招，都能让人感到一种隐秘且巨大的情绪力量：隐忍、不甘与较量。在5月的Google I/O上，Google发布Pa...【详细内容】

2023-12-11　　Search: Gemini 点击:(234)　　评论:(0)　　加入收藏

谷歌Gemini：被神话的多模态和被低估的隐忍

Google最强大的大模型Gemini发布了，陆续读了技术报告和一些评测/分析，周末记录和分享一下：一、几点值得Mark的笔记 Gemini Ultra的得分为90.0%，是第一个在MMLU（大规模多任务语言...【详细内容】

2023-12-11　　Search: Gemini 点击:(86)　　评论:(0)　　加入收藏

▌简易百科推荐

谷歌搜索史上最大变革！考虑对AI搜索收费

快科技4月7日消息，据国外媒体报道，谷歌正计划对由生成式人工智能驱动的新高级功能收费，这将是谷歌搜索业务历史上最大的一次变革。自2000年以来，谷歌的搜索产品一直依靠广告盈利...【详细内容】

2024-04-08　　　　快科技　　Tags:谷歌搜索　点击:(6)　　评论:(0)　　加入收藏

为训练AI，OpenAI等科技巨头花式淘数据

[环球时报特约记者甄翔]《纽约时报》6日披露了科技公司训练人工智能的秘密——利用语音识别工具转录视频网站YouTube上的视频，形成对话文本数据，供其最新的AI学习...【详细内容】

2024-04-08　　　　环球网　　Tags:AI 　点击:(6)　　评论:(0)　　加入收藏

当“机器人”有了“AI大脑” 人形机器人时代来了吗

数智风向标当“机器人”有了“AI大脑”人形机器人时代来了吗简单明了的口令下达后，机器人便开始搬箱子、运小球，在各类不同的地形行走……这些身上布满芯片和传...【详细内容】

2024-04-08　　　　中国青年报　　Tags:机器人　点击:(3)　　评论:(0)　　加入收藏

报告称 OpenAI 采集了超一百万小时的 YouTube 视频来训练 GPT-4

IT之家 4 月 7 日消息，本周早些时候，《华尔街日报》报道称 AI 公司在收集高质量训练数据方面遇到了困难。今天，《纽约时报》详细介绍了 AI 公司处理此问题的一些方法，其中涉及到...【详细内容】

2024-04-07　　　　IT之家　　Tags:OpenAI 　点击:(4)　　评论:(0)　　加入收藏

量子计算会和经典计算一样融入人们的日常生活

作为2024中国网络媒体论坛打造的创新活动之一，“技术赋能·八点见”创新项目发布会于3月30日晚在云南昆明举行。活动现场，本源量子计算科技（合肥）股份有限公司（以下简称“...【详细内容】

2024-04-03　　　　人民网　　Tags:量子计算　点击:(8)　　评论:(0)　　加入收藏

ChatGPT官宣免注册，全球互联网变天！OpenAI将取代谷歌搜索？

新智元报道编辑：编辑部【新智元导读】OpenAI这份愚人节礼物，实在是太大了：今天起，ChatGPT不用注册，可以直接使用。用户狂欢，竞品颤抖，我们仿佛已经听到，谷歌搜索引擎这位巨人轰然倒...【详细内容】

2024-04-02　　　　新智元　　Tags:ChatGPT 　点击:(7)　　评论:(0)　　加入收藏

谷歌为了结集体诉讼，同意删除 Chrome 无痕模式下收集的用户数据

IT之家 4 月 2 日消息，根据华尔街日报报道，谷歌为了结追溯到 2020 年的集体诉讼案，近日同意删除通过 Chrome 浏览器“无痕（Incognito）模式”下收集的用户数据。这起诉讼原告认为，...【详细内容】

2024-04-02　　　　IT之家　　Tags:Chrome 　点击:(7)　　评论:(0)　　加入收藏

哥伦比亚大学华人开发「人脸机器人」，照镜子自主模仿人类表情超逼真

【新智元导读】OpenAI 机器人理解力虽强，却无法进行非语言交流。最近，哥伦比亚大学华人团队打造了全新的机器人 Emo，不仅可以提前预测和模拟人类表情，还可以进行眼神交流。此前，...【详细内容】

2024-04-01　　　　IT之家　　Tags:哥伦比亚　点击:(17)　　评论:(0)　　加入收藏

谷歌服务现已支持使用 Windows Hello 人脸和指纹解锁登录

IT之家 3 月 28 日消息，谷歌近日对其账户登录页面进行了重大更新，现在能够在用户登录谷歌账户时，使用 Windows Hello 作为身份验证方法。使用通行密钥，用户将不再局限于使用密码...【详细内容】

2024-03-29　　　　IT之家　　Tags:谷歌服务　点击:(15)　　评论:(0)　　加入收藏

GPT商店热度不尽人意仅用在写论文和炒股票上较受欢迎

财联社3月28日讯（编辑赵昊）今年1月，OpenAI推出了定制聊天机器人商店“GPTs”，以期为业务增添新的动力。但两个多月后，GPTs的吸引力仍然有限，很难达到公司CEO山姆·奥尔特曼...【详细内容】

2024-03-29　　　　财联社　　Tags:GPT 　点击:(13)　　评论:(0)　　加入收藏

推荐资讯

访问网站显示不安全是	掌握独立站SEO策略，提
快手蓝色小钥匙跳转微	微信朋友圈如何置顶
Facebook新用户扩展怎	详解微信里面的分期可
微信表情包更新：原创设	微信朋友圈功能大改版