陈默看着屏幕,没有掩饰眼中的满意。
OpenAI成立时间不长。
团队能够进展如此迅速,一部分来自不计成本的算力和人才投入。
更重要的是,他们没有沿着2015年最流行的路线,为每一种任务单独搭建模型。
陈默从成立之初便提出,大量无标注数据、自监督训练、统一表示与跨任务迁移,才是通往更强人工智能的关键。
他虽然不会写代码,但却能让团队避开未来数年已经被证明价值有限的岔路。
马斯克靠向椅背,眼中难掩骄傲:“事实证明,正确的道路比多雇一千名谷歌工程师管用得多。”
“只能让我们暂时领先。”陈默没有被演示结果冲昏头脑,“谷歌一旦确认这条路线有效,很快便能调动比我们更多的算力和人员。”
“想把领先变成真正的优势,下一步需要将零散研究合并起来。”
他站起身,走向白板。
目前OpenAI内部仍将语言、图像、游戏和机器人视为几个相对独立的研究方向。
团队已经开始共享部分底层方法,却没有统一的长期定义。
陈默拿起笔,在白板中央写下四个字。
基础模型。
现场大部分人第一次看见这个词。
“未来最重要的人工智能,不会是只能下棋、识别人脸或者回答某一种问题的专用程序。”
“它应该先通过海量数据,学习语言、图像和现实世界中最基础的结构。”
“随后,只需要少量数据、指令或者环境反馈,便能适应不同任务。”
“它更接近一个承载智能能力的平台。”
Sam盯着白板:“如果彻底按这套逻辑走,现有两千张显卡连下一代架构的门槛都摸不到,算力开销每年会翻数倍。”
“这就是今天需要解决的第二个问题。”陈默重新坐下。
算力扩建方案被投到屏幕上。
OpenAI目前已经拥有两千余张GPU,并与几家云计算公司建立合作。
这套规模放在普通研究机构中堪称奢侈。
面对基础模型,却只能算第一步。
技术团队希望在未来十八个月将可用算力扩大四倍,同时搭建自己的分布式训练系统。
预计总投入超过三亿美元。
马斯克率先表态:“我支持。如果我们因为担心花钱而放慢速度,谷歌不会给我们第二次机会。”
陆静怡翻开预算:“钱可以解决。但三亿美元不是一次性支出。”
她看向Sam。
“OpenAI依靠发起人长期捐赠,能够支撑三年,未必能够支撑十年。”
“如果基础模型真的成为你们定义的平台,商业化迟早会发生。”
这也是桌面上第三份方案存在的原因。
完全依赖捐赠,OpenAI很难和谷歌、微软等公司进行长期算力竞争。
过早商业化,又可能让研究方向被收入和投资人控制。
杨植林想起清华饭局上的问题。
“如果未来需要商业化,哪些成果继续开放?”
“论文、代码、训练数据,还是完整模型?”
“全部开放,任何公司都可以拿走OpenAI投入数十亿美元训练的成果。”
“完全封闭,OpenAI又会变成另一家普通科技公司。”
Sam没有立即回答。
这正是他提交组织治理方案,却始终无法彻底解决的矛盾。
梁文丰第一次开口:“问题可能不在开放或者封闭。”
众人看向他。
“而在于我们将人工智能看成什么。”
梁文丰指向白板上的基础模型。
“如果它只是软件,最简单的方法就是卖许可证。”
“如果它真的会成为平台,那么模型能力、算力和数据会共同构成新的基础设施。”
“基础设施可以向外提供服务,但不能把所有底层控制权交给少数客户。”
他在量化市场中看到过相似情况。
单一策略可以出售。
完整交易系统一旦交出去,对方得到的便不再是一项产品,而是持续制造策略的能力。
陈默一锤定音:“论文、工具链与安全规范全面开源,核心参数与高风险能力闭门受控。”
“OpenAI不是一家公司,它是汇聚算力、高校与产业的神经中枢。”
“我们不需要把所有优秀人才都变成员工。”
“它可以成为一张研究网络。”
“大学、实验室和企业保留各自数据与知识产权,只在基础方法、算力工具和安全研究上合作。”
会议从下午持续到傍晚。
白板上的内容越来越多。
基础模型、长期记忆、跨任务迁移、人类反馈、工具使用、模型安全。
这些词在2015年大多还没有成为人工智能产业的共同语言。
今天,却第一次被放进同一张路线图中。
最终,发起人委员会通过下一阶段算力扩建计划。
三亿美元不会一次拨付。
第一阶段用于扩建GPU集群和分布式训练系统,后续资金根据模型能力、训练效率与安全评估逐步释放。
OpenAI—卡内基梅隆语言智能联合项目正式进入合同阶段。
深度求索被纳入合作研究网络,在国内建立独立AI研究节点。
至于最敏感的组织问题,众人没有强行在一天内得出答案。
陈默只推动通过了一份临时原则。
研究论文、通用工具和低风险代码保持开放。
完整模型参数、大规模训练数据与可能被滥用的能力,需要经过技术、安全和治理三方共同评估。
任何一名发起人、捐赠方或商业机构,都不能单独决定释放或者封存一项核心成果。
商业实体是否成立、资本回报如何限制、最终控制权归属哪里,留到下一阶段继续讨论。
马斯克看着那份临时原则,没有反对。
Sam也签下自己的名字。
可陈默知道,这场分歧并没有消失。
随着模型越来越强、投入越来越大,今天暂时放下的问题,迟早会重新回到所有人面前。
会议结束时,已经接近晚上七点。
其他人陆续离开会议室。
伊利亚却没有立即起身。
他重新播放了一遍下午的语言模型演示。
“陈。”
“有件事,正式报告里不适合写得太明确。”
陈默停下脚步。
“你说。”
“谷歌的整体实力依然远超我们。”
伊利亚望着屏幕上的回答。
“但只看统一预训练和跨任务迁移,这个原型已经超过我离开前见过的内部项目。”
“只要下一代训练能够成功,谷歌便不再是绝对领先者。”
陈默没有表现出意外。
“消息瞒不了多久,第一篇论文发布以后,他们便会知道。”
“所以我们只剩下一个办法。”
“什么?”
这时,马斯克推开会议室的门。
他已经换掉白天的外套,手里拿着一份刚刚送来的发射简报。
“各位,讨论人工智能的时间结束了。”
“佛罗里达的天气情况不错。”
“猎鹰九号将在明晚按计划发射。”
马斯克看向陈默,眼中带着掩饰不住的兴奋。
“现在,该去看看一枚火箭能不能自己回家了。”
OpenAI成立时间不长。
团队能够进展如此迅速,一部分来自不计成本的算力和人才投入。
更重要的是,他们没有沿着2015年最流行的路线,为每一种任务单独搭建模型。
陈默从成立之初便提出,大量无标注数据、自监督训练、统一表示与跨任务迁移,才是通往更强人工智能的关键。
他虽然不会写代码,但却能让团队避开未来数年已经被证明价值有限的岔路。
马斯克靠向椅背,眼中难掩骄傲:“事实证明,正确的道路比多雇一千名谷歌工程师管用得多。”
“只能让我们暂时领先。”陈默没有被演示结果冲昏头脑,“谷歌一旦确认这条路线有效,很快便能调动比我们更多的算力和人员。”
“想把领先变成真正的优势,下一步需要将零散研究合并起来。”
他站起身,走向白板。
目前OpenAI内部仍将语言、图像、游戏和机器人视为几个相对独立的研究方向。
团队已经开始共享部分底层方法,却没有统一的长期定义。
陈默拿起笔,在白板中央写下四个字。
基础模型。
现场大部分人第一次看见这个词。
“未来最重要的人工智能,不会是只能下棋、识别人脸或者回答某一种问题的专用程序。”
“它应该先通过海量数据,学习语言、图像和现实世界中最基础的结构。”
“随后,只需要少量数据、指令或者环境反馈,便能适应不同任务。”
“它更接近一个承载智能能力的平台。”
Sam盯着白板:“如果彻底按这套逻辑走,现有两千张显卡连下一代架构的门槛都摸不到,算力开销每年会翻数倍。”
“这就是今天需要解决的第二个问题。”陈默重新坐下。
算力扩建方案被投到屏幕上。
OpenAI目前已经拥有两千余张GPU,并与几家云计算公司建立合作。
这套规模放在普通研究机构中堪称奢侈。
面对基础模型,却只能算第一步。
技术团队希望在未来十八个月将可用算力扩大四倍,同时搭建自己的分布式训练系统。
预计总投入超过三亿美元。
马斯克率先表态:“我支持。如果我们因为担心花钱而放慢速度,谷歌不会给我们第二次机会。”
陆静怡翻开预算:“钱可以解决。但三亿美元不是一次性支出。”
她看向Sam。
“OpenAI依靠发起人长期捐赠,能够支撑三年,未必能够支撑十年。”
“如果基础模型真的成为你们定义的平台,商业化迟早会发生。”
这也是桌面上第三份方案存在的原因。
完全依赖捐赠,OpenAI很难和谷歌、微软等公司进行长期算力竞争。
过早商业化,又可能让研究方向被收入和投资人控制。
杨植林想起清华饭局上的问题。
“如果未来需要商业化,哪些成果继续开放?”
“论文、代码、训练数据,还是完整模型?”
“全部开放,任何公司都可以拿走OpenAI投入数十亿美元训练的成果。”
“完全封闭,OpenAI又会变成另一家普通科技公司。”
Sam没有立即回答。
这正是他提交组织治理方案,却始终无法彻底解决的矛盾。
梁文丰第一次开口:“问题可能不在开放或者封闭。”
众人看向他。
“而在于我们将人工智能看成什么。”
梁文丰指向白板上的基础模型。
“如果它只是软件,最简单的方法就是卖许可证。”
“如果它真的会成为平台,那么模型能力、算力和数据会共同构成新的基础设施。”
“基础设施可以向外提供服务,但不能把所有底层控制权交给少数客户。”
他在量化市场中看到过相似情况。
单一策略可以出售。
完整交易系统一旦交出去,对方得到的便不再是一项产品,而是持续制造策略的能力。
陈默一锤定音:“论文、工具链与安全规范全面开源,核心参数与高风险能力闭门受控。”
“OpenAI不是一家公司,它是汇聚算力、高校与产业的神经中枢。”
“我们不需要把所有优秀人才都变成员工。”
“它可以成为一张研究网络。”
“大学、实验室和企业保留各自数据与知识产权,只在基础方法、算力工具和安全研究上合作。”
会议从下午持续到傍晚。
白板上的内容越来越多。
基础模型、长期记忆、跨任务迁移、人类反馈、工具使用、模型安全。
这些词在2015年大多还没有成为人工智能产业的共同语言。
今天,却第一次被放进同一张路线图中。
最终,发起人委员会通过下一阶段算力扩建计划。
三亿美元不会一次拨付。
第一阶段用于扩建GPU集群和分布式训练系统,后续资金根据模型能力、训练效率与安全评估逐步释放。
OpenAI—卡内基梅隆语言智能联合项目正式进入合同阶段。
深度求索被纳入合作研究网络,在国内建立独立AI研究节点。
至于最敏感的组织问题,众人没有强行在一天内得出答案。
陈默只推动通过了一份临时原则。
研究论文、通用工具和低风险代码保持开放。
完整模型参数、大规模训练数据与可能被滥用的能力,需要经过技术、安全和治理三方共同评估。
任何一名发起人、捐赠方或商业机构,都不能单独决定释放或者封存一项核心成果。
商业实体是否成立、资本回报如何限制、最终控制权归属哪里,留到下一阶段继续讨论。
马斯克看着那份临时原则,没有反对。
Sam也签下自己的名字。
可陈默知道,这场分歧并没有消失。
随着模型越来越强、投入越来越大,今天暂时放下的问题,迟早会重新回到所有人面前。
会议结束时,已经接近晚上七点。
其他人陆续离开会议室。
伊利亚却没有立即起身。
他重新播放了一遍下午的语言模型演示。
“陈。”
“有件事,正式报告里不适合写得太明确。”
陈默停下脚步。
“你说。”
“谷歌的整体实力依然远超我们。”
伊利亚望着屏幕上的回答。
“但只看统一预训练和跨任务迁移,这个原型已经超过我离开前见过的内部项目。”
“只要下一代训练能够成功,谷歌便不再是绝对领先者。”
陈默没有表现出意外。
“消息瞒不了多久,第一篇论文发布以后,他们便会知道。”
“所以我们只剩下一个办法。”
“什么?”
这时,马斯克推开会议室的门。
他已经换掉白天的外套,手里拿着一份刚刚送来的发射简报。
“各位,讨论人工智能的时间结束了。”
“佛罗里达的天气情况不错。”
“猎鹰九号将在明晚按计划发射。”
马斯克看向陈默,眼中带着掩饰不住的兴奋。
“现在,该去看看一枚火箭能不能自己回家了。”
为更好的阅读体验,本站章节内容基于百度转码进行转码展示,如有问题请您到源站阅读, 转码声明。
圣墟小说网邀请您进入最专业的小说搜索网站阅读重返高三,满仓抄底狂赚百亿,重返高三,满仓抄底狂赚百亿最新章节,重返高三,满仓抄底狂赚百亿 圣墟小说网!
圣墟小说网邀请您进入最专业的小说搜索网站阅读重返高三,满仓抄底狂赚百亿,重返高三,满仓抄底狂赚百亿最新章节,重返高三,满仓抄底狂赚百亿 圣墟小说网!
