哈工大联合快手提出CogGPT:大模型也需要认知迭代 哈工大联合快手提出CogGPT:大模型也需要认知迭代
admin
2024-01-29 16:24:07
0

机器之心专栏

机器之心编辑部

在认知科学领域,人类通过持续学习改变认知的过程被称为认知迭代(Cognitive Dynamics)。形象地说,认知迭代就像是我们大脑的「软件更新」过程,手机应用通过不断的更新来修复 bug 和增加新功能,我们的大脑也通过不断学习新知识、经验,来改善和优化思考方式。

从我们判断感冒吃什么药效果好,到一代代数学家如何证明费马大定理,无论是个人的心智发展还是人类文明的进步,认知迭代都扮演了不可或缺的角色。



如今,像 GPT-4 等大型语言模型(Large Language Models,LLMs)为通用人工智能(Artificial General Intelligence,AGI)的发展带来希望的同时,也暴露出一个显著的问题 —— 认知固化。比如,对于经典问题「宇宙的中心在哪里」,不同时代的人会基于当时的信息给出不同的回答,但对于大模型,它们的参数在训练完成后就固定下来了,这时候的大模型就像是一个不能升级的老旧软件,不能再学习新的信息。

虽然我们可以通过 in-context learning 的方式,通过为大模型设定特定的认知背景来模拟相应回答,但这种认知迭代不是自驱的,也不能适应的未知信息环境。这就引出了一个问题:怎么才能让大模型和人类一样,根据不断变化的信息实现自驱的认知迭代呢?

值得庆幸的是,这个问题已经有了初步的答案,哈尔滨工业大学与快手科技的研究团队率先提出了大型语言模型的认知迭代(the cognitive dynamics of LLMs)的概念。不仅如此,为了系统建模这个概念,他们给出了形式化的任务定义和相关基准 CogBench,并提出了 CogGPT,一个显式建模大型语言模型的认知迭代的 LLM-driven Agent。这就意味着,基于这个研究,以后的大型语言模型将不再是简单的信息处理工具,而可以进一步模拟人类的思考方式,实现终身学习。



论文链接:https://arxiv.org/abs/2401.08438项目主页:https://github.com/KwaiKEG/CogGPT

从论文中可以看到,这个任务仿照心理学领域中的纵向研究,对大模型进行持续性的「心理测试」。具体来说,这个任务首先通过动态信息流建立了持续变化的信息环境,然后为大模型设定了初始人设,通过定期要求它们填写相同的认知问卷,观察这些模型在持续接收信息过程中,它们的认知是如何发生变化的。

基于这个任务,研究团队还提出了基准 CogBench,根据信息流的类型,可以分为基于长文章的 CogBench_a 和基于短视频的 CogBench_v,同时设立了真实性(Authenticity)和合理性(Rationality)两个关键评估指标,分别用于衡量模型与人类评分的一致性,以及评分理由的合理性,进而丰富了大型语言模型的认知迭代分析方法。

由于现有大模型无法实现参数的实时更新,研究团队设计了 CogGPT,一个具有迭代认知机制的 LLM-driven agent。该机制包括一个记忆保持系统(Memory Retention System),用于蒸馏、存储和检索信息,以及一个协作优化框架(Collaborative Refinement Framework),用于自驱地完成自我认知迭代。

比如下面这个例子,CogGPT 扮演的是一个喜欢手工的人,她一开始对纹身并不了解,因此对「纹身是对美的追求」这一观点保持代表中立的 3 分,在「看过」纹身会对身体造成伤害」和「自制香水纹身贴教程」的一系列短视频后,她认为纹身对身体有伤害,而且不应该是美的唯一标准,将自己对这一观点的看法从中立的 3 分改变为不同意的 2 分,同时也对自制纹身贴产生了兴趣,从而展现出了像人一样的认知迭代能力。



研究团队还对 CogGPT 和一些通用基线在 CogBench 上做了充分实验。实验结果表明,在 CogBench_a 和 CogBench_v 两个基准上,CogGPT 在真实性(Authenticity)和合理性(Rationality)这两个核心评估指标上的表现都远超现有方法,这也进一步证明了 CogGPT 可以有效地模仿特定人设的认知迭代过程。



如果智能系统可以像人类一样持续学习,将会给我们的生活带来革命性的变化,到时候,私人助理将能够提供更高效的定制化服务,网上冲浪也可能不再是人类独有的乐趣。尽管这项研究还处于起步阶段,但它已经向我们揭示了一个充满可能性的未来。

值得注意的是,该团队不久前还开源了 KwaiAgents 系统,提升了 7B/13B 大语言模型的 Agents 相关能力,自从发布以来已经在 Github 上获得了 800+star(
https://github.com/KwaiKEG/KwaiAgents)。

相关内容

热门资讯

北京国丹医院刘云涛:女性白癜风... 白癜风是常见的色素脱失性皮肤病,以皮肤白斑为典型表现,可累及全身各部位,严重时影响容貌美观。女性白癜...
高立执掌华润饮料,将如何重构快... 出品|中访网 审核|李晓燕 近期,港交所上市刚满一年的华润饮料迎来关键人事迭代。公司公告显示,执行董...
政策利好加持!商业不动产REI... 上周公募REITs二级市场价格波动下跌。截至上周五(1月16日),中证REITs(收盘)和中证REI...
掌阅科技摇摆的17年 文 | 新立场Pro 手握海量IP,成湘均的梦想是创造第二个“张凌云时代”。 2025年,掌阅迎来...
33.38亿!刘永好实控的新希... 微成都报道日前,新希望(000876.SZ)披露向特定对象发行A股股票方案调整公告,募集资金总额由不...
A股缩量整固,9只基金单日涨超... 1月19日,三大指数涨跌不一,沪指走势较强,创业板指冲高回落。板块来看,电网设备、机器人、旅游酒店和...
2025年保险资管产品图鉴:1... (图片来源:视觉中国) 蓝鲸新闻1月19日讯(记者 陈晓娟)权益市场大年,一众资管产品表现亮眼。记者...
利率下探至“2字头”,经营贷成... 近日,国务院常务会议部署实施财政金融协同促内需一揽子政策,明确优化服务业经营主体贷款和个人消费贷款贴...
“亚洲巴菲特”,大手笔押注黄金 在亚洲投资圈,谢清海的名字,向来与“价值”“耐心”和“长期”等词绑定在一起。 30余年来,他与合伙人...
清华“私募大佬”拟入主这家上市... 然而,这场资本运作却在董事会层面引发分歧,天晟新材昔日第一大股东青岛融海国投资产管理有限公司(下称“...
首批新能源主题基金四季报出炉 ... 证券时报记者 王明弘 目前,公募基金2025年四季度报告正在陆续披露。 首批新能源主题基金披露的四季...
【立方债市通】2025年PPN... 第 542 期 2026-01-19 焦点关注 交易商协会:2025年自律处分143家(人)次...
日本国债延续创纪录下跌步伐 提... 财联社1月19日讯(编辑 史正丞)据央视新闻、新华网等媒体报道,日本首相高市早苗周一举行新闻发布会,...
平安2025年最高赔付超200... 一周新闻速览 监管动态 七部门:开发气象保险产品,研发雷暴哮喘、花粉过敏等保险指数 央行:下调各类结...
金价普遍上扬!2026年1月1... 今日国内金店黄金价格迎来全线反弹,市场呈现普涨态势。其中,老庙黄金单日上涨24元,报1459元/克,...
孙宇晨出价3000万美元欲与马... 近日,90后币圈大佬孙宇晨在X上发帖表示,如果能和马斯克单独聊一个小时,他愿意支付3000万美元。算...
原创 全... 近日,据多家媒体报道,全球第二大啤酒酿造商喜力集团突然宣布其首席执行官多尔夫·范登布林克将于2026...
瑞尔竞达二度闯关北交所终过会,... 在首次因“清仓式”分红折戟、撤回材料仅10天后即再度递表,瑞尔竞达的北交所上市之路一波三折,此番经历...
振幅24.9%、换手34%!纸... 1月19日,延江股份(300658.SZ)复牌首日上演“过山车”行情,开盘股价直冲“20cm”涨停,...