来源" 机器之心
谷歌内部文件又泄露了,这次是谷歌新一代大模型 PaLM 2 的训练细节: 训练数据量是前代的近 5 倍、参数量是前代的三分之二左右。
【资料图】
上周四,在 2023 谷歌 I/O 大会上,谷歌 CEO 皮查伊宣布推出 对标 GPT-4 的大模型 PaLM2 ,并正式发布预览版本,改进了数学、代码、推理、多语言翻译和自然语言生成能力。
PaLM 2 模型提供了不同尺寸规模的四个版本,从小到大依次为 Gecko、Otter、Bison 和 Unicorn,更易于针对各种用例进行部署。其中轻量级的 Gecko 模型可以在移动设备上运行,速度非常快,不联网也能在设备上运行出色的交互式应用程序。
不过会上,谷歌并没有给出有关 PaLM 2 的具体技术细节,只说明了它是构建在谷歌最新 JAX 和 TPU v4 之上。
昨日,据外媒 CNBC 看到的内部文件称, PaLM 2 是在 3.6 万亿个 token 上训练 。作为对比,上代 PaLM 接受了 7800 亿 token 的训练。
此外,谷歌之前表示 PaLM 2 比以前的 LLM 规模更小,这意味着在完成更复杂任务的同时变得更加高效。这一点也在内部文件中得到了验证, PaLM 2 的训练参数量为 3400 亿 ,远小于 PaLM 的 5400 亿。
PaLM 2 的训练 token 和参数量与其他家的 LLM 相比如何呢?作为对比,Meta 在 2 月发布的 LLaMA 接受了 1.4 万亿 token 的训练。OpenAI 1750 亿参数的 GPT-3 是在 3000 亿 token 上训练的。
虽然谷歌一直渴望展示其 AI 技术的强大能力以及如何嵌入到搜索、电子邮件、文件处理和电子表格中,但也不愿公布其训练数据的大小或其他细节。其实这样做的不只谷歌一家,OpenAI 也缄口不言其最新多模态大模型 GPT-4 的细节。他们都表示不披露细节是源于业务的竞争属性。
不过,随着 AI 军备竞赛的持续升温,研究界越来越要求提高透明度。并且在前段时间泄露的一份谷歌内部文件中,谷歌内部研究人员表达了这样一种观点:虽然表面看起来 OpenAI 和谷歌在 AI 大模型上你追我赶,但真正的赢家未必会从这两家中产生,因为第三方力量「开源」正在悄然崛起。
目前,这份内部文件的真实性尚未得到验证,谷歌也并未对相关内容置评。
网友评论
在官宣 PaLM 2 之初,就有网友根据 Chinchilla 定律预测其参数量,ta 预测 PaLM 2 模型家族的参数结果为 80B / 90B / 100B 不等,和这次爆料的 340B 还是差距很大的。
还有人对 PaLM 2 的训练成本进行了一波预测,根据历代大模型的发展来看,这位网友表示,打造 PaLM 2 需要耗资 1 亿美元。
PaLM 2 参数都泄密了,可以试着推测 Bard 了,这位网友表示:
随着 PaLM 2 token 数的泄露,网友不禁疑问,在 AGI 到来之前,多少 token 才能迎来一次大转折?
标签:
训练数据量是前代的近5倍、参数量是前代的三分之二左右。
近期,位于山东省聊城市冠县兰沃乡的万亩梨园内繁花似雪、游人如织...
总投资221亿元!8GW异质结电池片、20GW组件等5个新能源项目签约内蒙...
大家好,这里是罗易斯,橘小柚的开发者。因为最近资金比较紧张,只...
对被征收住宅房屋价值的补偿,按照房屋征收决定公告之日被征收房屋...
1、大部分专业学费16000一年,住宿费用1100或1200,包括其他费用大...
想必现在有很多小伙伴对于轻钢别墅怎么样?适合农村建吗 r方面的...
直播吧5月19日讯据名记斯基拉报道,曼城中场京多安正在考虑自己的未...
1、最经济实惠的方法,就是开窗通风。如果新车贴膜,头几天无法开窗...
今天来聊聊关于西安贴吧新闻,西安贴吧的文章,现在就为大家来简单...
盛源控股(00851)公布,于本公告日期,所有转换条件已达成。建议转换...
(李丹)18日,在长春市仁大医养中心(长春市仁大医院),护理人员推...
如不能正常浏览请选用IE浏览器 天津北方网讯:今天,来自中国工...
盘面解析金融护盘市场做多积极性增高德讯证顾观点:两市有分化调整...
营收净利双降,股东大幅减持……最近“非洲手机之王”传音控股的烦...
铃木、Daihatsu和丰田联手共同开发的轻型商用厢式电动车,此原型车...
5月17日,笔者从市工信局获悉,在近日河南省工业和信息化厅公布的20...
1、第一集:《白狼》讲述了解放前川东一个小县城的富婆月如何从一个...
而随着ChatGPT的火热,必应将差异化价值押注在AI大模型上,不过,...
根据《2023年度泰安市属事业单位初级综合类岗位公开招聘工作人员简...
@北京公交集团发布出行提示:5月21日(周日)上午6时30分至11时在大...
1、众所周知:日本留学IT专业、工科专业、动漫专业、机械制造专业是...
为进一步巩固餐饮业油烟污染治理成效,改善大气环境质量,5月18日上...
1、狗,形状大小各一;颜色、品种都很丰富;而且生性灵活,是惹人喜...
医保甲类和乙类的区别报销比例是多少?医保的缴费比例是多少下面跟...
覆盖XBB 1 5的疫苗是目前最有希望成为针对奥密克戎变异株的通用型...
【品种观点】散户抗价情绪松动,规模场季节性降体重,养殖端出栏量...
随着互联网与生活的深度融合,在线娱乐成为了群众生活中的重要娱乐...
鹤壁作为一个资源型城市,现在我们需要做的是转型升级,特别是在未...
在使用圆通快递时,有时候会遇到服务态度不好的派件员或者是物流长...