美团-大模型后训练研究-北京/上海/广州/深圳/香港
【岗位职责】
1、参与架下一代多语言基座模型研究:专注于研究和解决多语言、少样本、跨文化价值观对齐等国际化场景下的核心挑战,构建真正具备全球视野的文本基座模型。
2.复杂推理与通用Agent系统构建:研发能够自主规划、调用工具、并与环境交互的端到端Agent系统,在任务型对话、智能外呼等场景下,实现对复杂任务的高效、自主解决。
3.多模态能力研究:研究并构建多模态基座模型,探索端到端语音技术以服务智能外呼等场景,并将多模态理解能力应用于全球数十个内容审核场景。
4.强化学习与可控生成:应用前沿强化学习范式,结合可控内容生成技术,确保模型在跨文化沟通中的精准性、可控性与同理心,满足多样化的业务目标。
5.核心业务场景赋能:将上述前沿研究成果,直接应用于已跑通PMF的国际化核心业务(智能客服、智能外呼、多模态智能审核等),形成从前沿技术到商业价值的快速闭环。
【任职要求】
1、计算机科学、人工智能等相关专业,具备扎实的机器学习理论与编码能力。
2.在以下至少一个领域有深入研究或项目经验,有顶会论文(NeurIPS、ICML、ICLR、ACL、EMNLP等)或知名开源贡献者优先: 大语言模型:预训练、微调、对齐、扩散语言模型等。 强化学习:RLHF、Agent训练、奖励模型设计等。 Agent系统:任务规划、工具使用、记忆机制等。
3.精通Python/C++,熟悉Pytorch、DeepSpeed、VLLM等主流大模型框架。
4.具备优秀的问题分析与解决能力,对用AI技术解决真实世界复杂问题充满热情。
5.加分项:ACM/ICPC、TopCoder、NOI/IOI、Kaggle等顶级竞赛获奖者。
【工作地点】
// 内推方式
-
简历直推企业HR、业务领导、高层、合伙人等,反馈透明快速
// 近期岗位推荐
可内推|中国人寿资产管理有限公司 | 跨境业务岗 | 北京
可内推|对冲基金PINPOINT | Analyst, Fundamental Research | 香港/上海
可内推|经纬创投 | ColdCall实习生 | 北京
招聘信息发布合作 | 实习&全职
▼
第一时间获取内推机会、招聘信息
欢迎关注Bei内推公众号