关闭广告

谷歌百人“复仇者联盟”出击!将发对标GPT-4的大模型

智东西10317人阅读

本文系网易新闻•网易号特色内容激励计划签约账号【智东西】原创内容,未经账号授权,禁止随意转载。



编译 | 香草
编辑 |李水青

谷歌“复仇者联盟”要面向OpenAI全军出击了!

智东西8月16日消息,据The Information独家报道,谷歌于4月新合并的AI SWAT团队正在为秋季大型发布会做准备,将发布代号为Gemini的大模型,反击OpenAI的GPT-4。

多位开发人员爆料了Gemini的跨模态文本生成图像能力,及图表分析、文字或语音指令等多种功能,并称其有望为聊天机器人Bard等其他业务提供动力,从而与GPT-4的系列应用形成对垒。

背后,为了该项目冰释前嫌的DeepMind和谷歌大脑,也被传出在代码合并、软件使用及远程办公政策等方面面临各种“联姻”带来的次生问题,一些项目磨合的细节也被曝出。

谷歌的“复仇者联盟”版图已经逐渐完整。The Information首次明确了该团队中的小组分工及各小组主管,如下表格所示,来自两个团队的26位主管的信息被搜集梳理了出来。



▲Gemini各小组分工及领导人(图源:The Information)

一、Gemini具备多模态能力,基于YouTube内容训练

今年4月,Alphabet首席执行官桑达尔·皮查伊(Sundar Pichai)采取了一项不同寻常的举措:将两个拥有不同文化和代码的大型AI团队,谷歌大脑和DeepMind合并,以迎头赶上OpenAI和其他竞争对手。(AGI复仇者联盟!谷歌大脑与DeepMind官宣合体)

现在,对这一努力的考验即将到来。该公司有史以来投入最大的产品之一——大型机器学习模型Gemini即将在今年秋天发布。开发人士称,Gemini不仅会配备类似GPT-4的文本生成能力,还结合了文本生成图像的能力,类似于AI图像生成器Midjourney和Stable Diffusion,有望使谷歌在打造产品方面的能力胜过其竞争对手。

谷歌员工还谈到了Gemini的一些其他功能,如分析图表、创建带有文字描述的图形,及使用文字或语音指令控制软件。

谷歌希望通过Gemini为多个服务提供动力,包括与ChatGPT对标的Bard聊天机器人,以及Google Docs和Slides等企业应用。盈利方面,谷歌计划通过谷歌云(Google Cloud)服务器租用部门,向应用程序开发者收取Gemini的使用费。

“这将是有模型能与GPT-4旗鼓相当的第一个迹象。”彭博社风投分支Bloomberg Beta的AI初创企业投资人詹姆斯·查姆(James Cham)谈道,“我认为,在过去的九个月中,也许每个人都在问:什么时候才会有人看起来能赶上OpenAI?”

据The Information于6月14日的报道,谷歌在大量的YouTube视频转录语料上对Gemini进行训练,同时也可以将视频和音频集成到Gemini中,使其具备目前被认为是AI下一个前沿领域的多模态能力。

例如,通过YouTube视频训练出的模型可以辅助工程师根据视频诊断汽车维修问题,也可以根据用户想创建的网站或应用程序的草图来生成软件代码。OpenAI已经预告了这种功能,但尚未推出。



▲通过YouTube视频来训练机器学习模型(图源:Shutterstock)

使用YouTube内容进行训练还能帮助谷歌开发更为先进的文本视频软件,可以根据用户想看的内容描述自动生成详细的视频。好莱坞和内容创作者正在密切关注这类软件的发展。

二、DeepMind放弃原有项目,与谷歌大脑合研Gemini

谷歌大脑于2011年成立,旨在利用AI改进谷歌搜索结果、广告定位和Gmail辅助完成邮件等功能。DeepMind则于2014年被谷歌收购,此后一直独立运营。

2022年11月,OpenAI发布了ChatGPT,几周内用户数量激增至数千万,几个月内营收达到数亿美元。与此同时,谷歌正面临着一系列离职潮。其多名研究人员流失到OpenAI,并在ChatGPT的开发过程中发挥了重要作用。

在合并之前,谷歌大脑和DeepMind也曾分别开发了针对ChatGPT的项目。谷歌大脑在今年3月利用现有模型推出了Bard,但被一些用户批评只是对ChatGPT的有限模仿;DeepMind开展了一个代号为Goodall的项目,利用一种名为Chipmunk的未公开模型的变体来开发ChatGPT的对手。最终,DeepMind停止了这项工作,转而与谷歌大脑合作开发Gemini,尽管这两个AI团队之间存在着长期的竞争关系。

合并后的谷歌DeepMind由DeepMind联合创始人戴密斯·哈萨比斯(Demis Hassabis)担任CEO。知情人士称,DeepMind的两位高管奥里奥尔·维尼亚尔斯(Oriol Vinyals)和科拉伊·卡夫丘格鲁(Koray Kavukcuoglu)将与曾领导过谷歌大脑的资深高管杰夫·迪恩(Jeff Dean)一起负责Gemini。



▲谷歌DeepMind首席执行官戴密斯·哈萨比斯在纽约(图源:盖蒂图片社)

三、“联姻”弊端:代码合并、软件使用、远程办公政策等争议多

两个部门合并后,如何平衡从合并代码到确定远程工作政策等各个方面成为重要的问题。与DeepMind相比,谷歌大脑在远程工作方面要宽松得多。

在开发过程中,工程师们是使用谷歌的软件,还是使用DeepMind的软件也引发争议,因为这两个部门拥有完全独立的代码库。

该项目最终的决定是,在模型开发的早期预训练阶段,使用谷歌大脑用于训练机器学习模型的软件Pax;在后期阶段,使用DeepMind开发模型的软件Core Model Strike。参与该项目的人士说,这一决定安抚了每个小组的研究人员,但也惹恼了一部分人,因为他们不想使用不熟悉的软件。

除了机构合并,该团队在发展过程上也一直面临着诸多挑战,包括如何确定可以在哪些数据上对模型进行训练等。

谷歌的律师一直在密切评估训练。据称,他们让研究人员删除了来自教科书的训练数据,因为担心会涉及侵权。

开发人员称,谷歌联合创始人谢尔盖·布林(Sergey Brin)一直在对模型进行评估,并协助模型的培训。在团队发现Gemini被训练成具有潜在攻击性的模型后,布林也参与了重新训练模型的技术决策。

谷歌发言人对此不予置评。

四、Gemini团队数百人,由二十多位主管共同管理

谷歌大脑和DeepMind公司的前主管共同管理监督Gemini的大部分小组,已曝光的图表中共26位主管。The Information首次明确了他们在此项目中的角色。



▲Gemini各小组分工及领导人(图源:The Information)

表中三位团队总体主管有两位来自DeepMind。科拉伊·卡夫丘格鲁(Koray Kavukcuoglu)自2012年起便在DeepMind就职,目前担任谷歌DeepMind研究与技术副总裁,奥里奥尔·维尼亚尔斯(Oriol Vinyals)则担任研究与深度学习副总裁。另一位总体主管杰夫·迪恩(Jeff Dean)来自谷歌大脑,自1999年起便在谷歌就职,目前担任谷歌DeepMind和谷歌研究院首席科学家。

Gemini将团队划分为约十个小组,分别负责预训练、数据、基础设施、模型微调、模型评估、代码库、多模态、强化学习、工具使用以及人工标注数据。

詹姆斯·莫洛伊(James Molloy)和汤姆·亨尼根(Tom Hennigan)都曾在DeepMind工作过,与谷歌高级研究员保罗·巴勒姆(Paul Barham)等一起负责基础设施建设。蒂莫西·利利克拉普(Timothy Lillicrap)曾参与DeepMind国际象棋和围棋相关系统的工作,他和谷歌大脑研究员艾米丽·皮特勒(Emily Pitler)负责管理一个小组,该小组的工作重点是赋予大型语言模型(LLM)处理数学或网络搜索等专业任务的能力。

结语:谷歌计划通过Gemini来赶超OpenAI

谷歌或将于秋季发布会推出Gemini,这是其用来挑战OpenAI目前在AI领域地位的重要举措。The Information披露了该项目最新的进展,包括其多模态能力、训练数据等,且首次明确了该团队的小组分工及主管。

Gemini项目的合并过程并不容易,涉及到两个独立团队的磨合。谷歌既要推出新技术,又不能削弱其核心搜索业务,且必须控制训练Gemini可能产生的巨额服务器成本。Gemini的表现将会如何,让我们期待谷歌的秋季发布会。

来源:The Information

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

全球核武库变化趋势报告出炉 中国又"背锅"

枢密院十号 浏览 12381

身高1.8米丹麦女王退位 被称为"中国人民的老朋友"

极目新闻 浏览 56811

张丹峰洪欣合体逛内衣店秀恩爱 目的是直播带货

传媒一班 浏览 11573

内娱最疯红毯,评出“年度抠门艺人”榜单

Yuki女人故事 浏览 9010

媒体:美国最新一轮对台军售不同以往 中方将进行反制

政知新媒体 浏览 52522

热火G3惨败掘金!仅靠巴特勒,阿德巴约喜忧参半,2射+洛瑞全崩

篮球资讯达人 浏览 12666

记者:湖人近期很活跃,和开拓者、爵士、篮网等队有潜在交易

懂球帝 浏览 6644

上海抽检奶茶店全部存在问题,这些奶茶以后你还敢喝吗?

趣看热点 浏览 128828

错过就要等12年!这些龙年限定太美了

LinkFashion 浏览 8816

台媒:解放军军机突破"最后防线" 台空防遭直接威胁

环球网资讯 浏览 11447

柯文哲称要发展网军"瘫痪大陆高铁系统"国台办回应

环球网资讯 浏览 12271

日本歌手滨崎步成为新冠密切接触者,跨年演唱会宣布紧急取消

趣看热点 浏览 22428

在加拿大失踪大半年后 17岁中国留学生的遗体被发现

新民周刊 浏览 71341

来自日产的中大型SUV,日产探陆预售23.98万起

天天汽车 浏览 8592

我永远不会买黄金,更不会投资黄金!

浏览 120

Tiktok在美再遇围剿?弹窗动员1.7亿用户反击,电话轰炸国会办公室

蓝鲸财经 浏览 8173

引用《道德经》,谈大国分歧,Sam Altman:AI安全始于足下

极客公园 浏览 12651

俄胜利日阅兵装备:基本是非前线作战武器

环球网资讯 浏览 14417

小加索尔签约湖人,所有的卫冕拼图已尽在湖人掌控

趣看热点 浏览 21844

中国经济,连创多个“全球最大”!

国是直通车 浏览 8830

会穿西装的女人气质都不差 这样搭又美又飒

八只爪的猫 浏览 15241
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
沪ICP备20017958号-1