大模型不能只会开放闲聊——专访上海市数据科学重点实验室主任肖仰华

首页 > 科技

大模型不能只会开放闲聊——专访上海市数据科学重点实验室主任肖仰华

来源:西红柿 发布时间:2023-08-22 15:31

中国市场巨大、数据丰硕、应用场景丰硕,完全可以用完善的应用生态来带动底座大模型的提高,走一条“农村包抄城市”的路线。

《瞭望东方周刊》记者万宏蕾[gf]2003[/gf]编纂顾佳贇

7月7日,华为技术有限公司在华为开发者大会2023上正式发布人工智能(AI)大模型华为云盘古大模型 3.0 ( 陈宇轩/摄 )

自ChatGPT上线来,国际海内各大厂商纷纷跟进,投入了巨大研发资源来研发类似大模型。人工智能的发展,尤其到了通用人工智能阶段,可谓热门纷呈。

作为人工智能工业发展过程中的里程碑事件,ChatGPT代表通用人工智能技术的成熟,宣告人类社会技术提高有可能进入快速增长期,甚至一个指数发展期。在类ChatGPT大模型领域,中国尚处于起步阶段,需做进一步战略规划并统筹发展。就相关题目,《瞭望东方周刊》近日专访了上海市数据科学重点实验室主任、复旦大学教授肖仰华,探讨我国大模型工业的发展路径。

肖仰华

知识底座

《瞭望东方周刊》:通用大模型一定程度上刷新了我们对人工智能领域的认知,如何理解它带来的变革?或者说大模型有哪些能力?

肖仰华:大模型是人类文明所积累的海量知识容器,其所具备的通识能力,就是开放世界的理解能力。现在跟ChatGPT聊天,聊任何行业、学科的题目,它都能给出一个看起来不错的谜底,固然其仍可能犯一些事实错误、一些逻辑错误,但基本不会太偏离题目主旨——好比问出生日期却答出生地点。它还具备一定的“自知之明”能力,对于超出范围或者伦理敏感的题目,会拒绝回答。大模型这种对人类开放世界的理解力,已达到甚至超越普通人的水平。传统人工智能产品的“智障”题目已基本解决,这种开放世界的理解能力,对垂直领域(垂域)的认知非常枢纽,由于垂域应用是建立在通用大模型的通用认知能力基础之上的。

大模型有组合创新能力。我们在指令学习阶段让它学了A任务、B任务,它以后有可能泛化出求解A+B任务的能力。这种组合泛化,以前做不到,今天能做到,通用大模型让“举一反三”成为可能。

大模型有忠实的指令理解和执行能力,尤其是超大模型。只要给它指令、要求、约束、规范、规则,它就一定能够按照要求一步步完成任务。这本质上是一种情境化生成能力。我甚至以为,大模型智能本质就是情境化生成能力,由于大模型在提示越来越丰硕时,天生的效果越来越好。

大模型有复杂任务的分解能力和规划能力。现实中许多场景都是复杂任务,需要一步一步求解,先做什么,再做什么,按照顺序进行公道编排,这就是规划能力。

大模型还有强盛的符号推理能力。以前人们只是把大模型当做知识容器来看待,只期望其提供需要的知识。但今天不得不承认大模型也一定程度上具备类似知识库(知识图谱)所具备的推理能力,好比常识推理、数值推理等能力,当然这方面能力还需要进一步晋升。

《瞭望东方周刊》:为什么说单有通用大模型不足以解决行业领域许多题目,需要发展垂域大模型?

肖仰华:由于具有上述能力,通用大模型比如是一个宽阔的知识底座,但仍旧缺乏专业知识的深度,缺乏专业领域复杂应用的长程推理能力。ChatGPT这类大模型本质上只是实现了在开放环境下的人机对话,或者叫开放闲聊,但开放闲聊并不能帮我们解决实实在在的工作场景中的复杂决议计划任务,好比要做设备故障排查、疾病诊断,都是严厉复杂的决议计划场景。在这些场景中需要丰硕的专业知识、复杂的决议计划逻辑、宏观态势的研判能力、综合任务的拆解与规划能力、复杂约束的取舍能力、未见事物的预见能力、不确定场景的推理推断能力等。

大模型的开放闲聊过程中可能存在两个题目:一是“幻觉”题目。与ChatGPT聊天,有时它说得头头是道,但仔细分析,会发现它正在胡编乱造一些不存在的事实。同时由于其语言风格一本正经,让普通人很轻易相信它,即便是领域专家要从它有板有眼的文本中识别虚构和错误也是一件不易的事。

二是缺乏领域“忠实度”的题目。解决任何专业领域的题目都要求大模型不要自己根据通识去自由发挥,而要严格遵循这个领域的规范、用符合这个领域的知识体系来回答题目。但是我们去尝试了一些通用大模型,发现假如不做一些调教优化,它老是会超出你给定的领域文档自由发挥,进而出错。

所以,一个基本的判定是:单单利用现在的通用大模型不足以解决行业许多题目。实际应用需要的是事实准确、忠实于领域知识与文本的垂域大模型。从这个判定出发,当下我们要发展面向垂域的大模型,要发展通用大模型的外围插件,要采取大模型和知识图谱、传统知识库相结合的策略。

遇上差距

《瞭望东方周刊》:面对ChatGPT所引发的通用人工智能工业变革,海内企业应该如何捉住大模型工业机会?

肖仰华:大模型毫不是宣传案牍的噱头。我们正在见证由通用人工智能所带来的前所未有的技术革命。通用人工智能是人类历史上第一次关于智能本身的革命。历次技术突破都是人类智能的产物,而唯独通用人工智能是“智能”本身的革命。

大模型的诞生宣告了整个人工智能进入全新的重工业时代。回顾人类历史上的历次技术革命,多始于相对初级的手工作坊模式,经由漫长的发展周期,终极形成了成熟的重工业发展模式。重工业化的人工智能有三个光鲜的特征:大模型、大算力和大数据。

5月23日,工作人员在贵州大学省部共建公共大数据国家重点实验室算力中央 ( 刘续/摄 )

国外大模型工业已经形成了一个生态,而且发展非常迅速。反观海内,从表象上看热闹非凡、模型林立,但是剥开外壳从内里看,仍旧有不少题目,不免让人担忧。

一方面,几乎所有海内人工智能工业的重要企业与研发机构纷纷推出了自己的类ChatGPT大模型。这说明,大家都意识到大模型的战略意义,积极主动投入资源,这值得肯定。

另一方面,海内大模型工业发展已经泛起一些题目:一是技术路线同质化严峻,许多大模型都是用ChatGPT喂养自己的大模型,或是在国外开源通用大模型基础上进行指令微调;二是数据生态不完善,中文数据生态尤其重要,但现在较为欠缺;三是算力掣肘;四是模型立异有限,现在许多海内大模型都基于国外的开源社区模型。

总之,ChatGPT所引发的通用人工智能工业变革才刚刚开始,中国相关部分和企业要以深入的思索和扎实的实践抓住机遇,同时高度重视发展过程中泛起的题目。

《瞭望东方周刊》:具体来说,中国发展大模型工业目前面临哪些短板?

肖仰华:大模型工业的发展取决于多个因素:其一是模型,模型比如内功,模型越大,潜力越强。其二是算力,这是大模型的核心竞争力,大模型竞争归根结底是算力的竞争。其三是数据,只有高质量的数据,才能喂养出高水平的大模型。不外,这几个题目都不是中国大模型工业的真正短板所在。

与国际同行比拟,当前我国大模型工业发展在数据上有上风,在算力方面有基础,模型本身也不存在什么技术秘密,真正的短板在于我们对大模型“炼制”工艺的把握,包括数据配方、数据清洗和参数设置等等,这些从根本上决定了大模型的效果,是大模型工业发展的重要因素。这方面短期之内难以跟上或者超越,需要我们付出巨大代价进行试探。

实际上,上述的每一个详细模块,海内都知道怎么做,但是将它们整合在一起,总体效果和国外是存在差距的,不是0分和100分的差距,而是70分与100分的差距。我们要遇上最后这几十分,要不断试错、评测和改进。

从大模型题目引申来看,应用和集成立异,一直是我们的强项。但是跟美国比拟,我们缺少原始立异,原始立异甚至到了极度稀缺的程度。原始立异是怎么来的?可能来自科学家的奇思妙想,可能来自偏执甚至疯狂的设法。好比Open AI的CEO山姆·奥特曼(Sam Altman),他在2015年成立Open AI,2018年投入巨资研发大模型。而在2018年这个时间点,全世界没有多少科学家以为通用大模型这条路可以走通。

将来我们要实现引领,就一定要不断优化科研文化和科研生态,鼓励思辨、鼓励质疑,激发原始立异。

7月8日,2023世界人工智能大会在上海世博展览馆举行。蜜度信息,“文稿通”基于大模型的诗歌天生

战略定力

《瞭望东方周刊》:在大模型高潮之下,中国自己的大模型发展道路毕竟该怎么走?

肖仰华:国家有关部分要引导业界统一规划、合作协同、有序发展、健康发展。对此,我建议,可以从八个方面的应对措施推动我国大模型工业的发展:一是积极推动数据同盟(数据交易)的建设,促进优质数据的共享与传播;二是鼎力推动算力同盟建设,促进优质算力共享与协作;三是推动模型开源社区建设,完善国产大模型的开源生态;四是立异培养方式,培育大模型工业人才;五是建立大模型的诊断与应用评测体系,保障大模型工业健康发展;六是研究绿色可持续的大模型技术,降低大模型落地本钱;七是积极探索大模型的应用模式,丰硕大模型的应用场景;八是持续研究大模型练习与应用关键技术,完善大模型技术体系。

尤其要留意,在这波大模型的发展高潮之下,不能为了追随ChatGPT,忽略了其他热门,错失了下一个机遇。我们一定要有战略定力,对不断泛起的热门要有战略正视,但不能打乱既有部署。好比,许多传统小模型,该研究还得继承研究,数字化与智能化进程中的其他技术也得往前推进。

在方向上,或者说,只有底座大模型与垂域应用相结合,才能终极创造价值。好比,医疗领域但愿做能代替或部门解放医生的问诊机器人,投资领域但愿有投资参谋机器人,司法领域但愿有法律咨询机器人,这都属于垂域场景。在晋升通用大模型能力的同时,也期待相关企业能在大模型垂域应用上有所作为,把大模型的通识能力更好地与垂域的专业知识、专家经验、行业解决问题的思维方式相结合,去解决现实中的复杂题目。我们既要正视通用大模型,更要正视垂域应用,重模型轻应用或者重应用轻模型,都是不可取的。

中国市场巨大、数据丰硕、应用场景丰硕,完全可以用完善的应用生态来带动底座大模型的提高,走一条“农村包抄城市”的路线。也就说,先把我们擅长的外围应用和技术生态做好,不断去补齐通用大模型在数据、算力、模型和工艺等方面的短板,并在这一过程中试探有中国特色的大模型发展道路,形成独特上风,另辟大模型竞争赛道,进而形成核心竞争力,形成百花齐放、百家争鸣的繁荣生态。

总之,国产大模型绝不能停留在类ChatGPT的开放闲聊,要尽快晋升其解决千行百业实际题目的能力,切实把大模型发展成为推动我国各行业数字化转型与高质量发展的进步前辈生产力。

点击下方标题,阅读本组专题全部稿件

《竞逐“垂域大模型”》专题系列稿件

中国市场巨大、数据丰硕、应用场景丰硕,完全可以用完善的应用生态来带动底座大模型的提高,走一条“农村包抄城市”的路线。

《瞭望东方周刊》记者万宏蕾[gf]2003[/gf]编纂顾佳贇

7月7日,华为技术有限公司在华为开发者大会2023上正式发布人工智能(AI)大模型华为云盘古大模型 3.0 ( 陈宇轩/摄 )

自ChatGPT上线来,国际海内各大厂商纷纷跟进,投入了巨大研发资源来研发类似大模型。人工智能的发展,尤其到了通用人工智能阶段,可谓热门纷呈。

作为人工智能工业发展过程中的里程碑事件,ChatGPT代表通用人工智能技术的成熟,宣告人类社会技术提高有可能进入快速增长期,甚至一个指数发展期。在类ChatGPT大模型领域,中国尚处于起步阶段,需做进一步战略规划并统筹发展。就相关题目,《瞭望东方周刊》近日专访了上海市数据科学重点实验室主任、复旦大学教授肖仰华,探讨我国大模型工业的发展路径。

上一篇:武汉算力为全... 下一篇:iPhone15或将...
猜你喜欢
热门阅读
同类推荐