文档详情

强化学习(多)智能体和大语言模型(多)智能体-2024全球机器学习技术大会.pdf

发布：2024-11-25约7.78万字共72页下载文档

文本预览下载声明

2024全球机器学习技术大会（北京站）主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12个热门专题，力求为全球开发者、研究人员、行业技术人员提供全方位、多角度的技术交流平台。

毛航宇

快手科技快意大模型知识增强研发负责人

现就职于快手科技，快意大模型知识增强研发负责人，同时兼任智能交互团队负责人。主要

关注Agent,RAG,Alignment,RL,LLM等技术，在ICLR及NeurIPS,ICML等CCF-A/B类

会议和期刊上发表论文30余篇，申请国际、国内专利十余项，相关研究在企业场景落地并

产生较大效益。曾担任上述国际会议的PC,SeniorPC,AreaChair，中国数据挖掘会议

（CCDM）的论坛主席，以及CCF多智能体学组的执行委员。本人和所带领的团队曾获全球

数字经济大会“人工智能大模型场景应用典型案例”、国际人工智能会议NeurIPS强化学习

竞赛冠军、中国计算机学会“多智能体研究优秀博士论文奖”、北京市“优秀(博士)毕业

生”、华为“创新先锋总裁奖”。

演讲主题：

从强化学习(多)智能体到大语言模型(多)智能体

1.强化学习(多)智能体到大语言模型(多)智能体十年研究脉络梳理

2.强化学习(多)智能体到大语言模型(多)智能体代表工作选讲

DeepRLAgent(DRL)

Transformer-basedRLAgent(TRL)

LLM-basedAIAgent

3.企业实践中的心得体会

BackgroundRLAgents

2024全球机器学习技术大会（北京站）主题涵盖大语言模型技术演进、多模态大模型前沿、大模型工程与架构、大模型应用开发实践、AI智能代理、代码大模型等12

显示全部

相似文档

强化学习(多)智能体 和 大语言模型(多)智能体-2024全球机器学习技术大会.pdf