大数跨境

加入我们!一起来突破Scaling RL Environments for Agents的瓶颈!

加入我们!一起来突破Scaling RL Environments for Agents的瓶颈! CAMEL AI
2026-07-12
1
导读:Eigent.AI / CAMEL-AI.org 正在为全球领先的模型公司和研究实验室构建 Agent 强化学


Eigent.AI / CAMEL-AI.org 正在为全球领先的模型公司和研究实验室构建 Agent 强化学习(RL)训练环境数据,以及构建开源通用桌面端Cowork Agent产品。

我们的Mission是探索Agent的 Scaling Laws的三个核心维度:智能体的数量、环境,以及智能体的自我进化扩展。更多关于这一使命的思考,可以阅读我们的 Mission Blog:
https://www.camel-ai.org/blogs/mission-at-camel-ai-org-finding-the-scaling-laws-of-agents

早在 2025 年 3 月,我们就发布了一篇博客:在数据驱动的环境构建下一代智能体

当时我们提出一个核心判断:环境,是智能体训练中最关键、也最缺失的“数据”。

仅靠网页、文本和静态数据,并不足以训练真正能完成复杂任务的 Agent。智能体需要的是一个动态空间:可以尝试、失败、获得反馈、重新规划,并在长期交互中学习。

这也是我们一直在做的事情:Scaling RL Environments for Agents。

我们关注的问题包括:

  • 如何从真实工作流中抽象出可训练、可评测的 Agent 任务?
  • 如何定义环境接口、rubric、奖励函数和verifier?
  • 如何避免 reward hacking,让模型真的学会任务,而不是学会钻评测空子?
  • 如何构建高质量、多领域、可持续迭代的环境数据?
  • 如何把真实用户使用、失败案例、人工修正和评测结果变成数据飞轮?

现在,我们正在扩充团队,欢迎愿意在 Agent RL 环境、评测体系和数据飞轮上长期深耕的人加入。

公司正在招募以下几类岗位:以全职为主,开放少量实习机会;领域 LLM 数据标注专家可接受兼职 Contractor。Base 优先英国 / 美国,特别优秀者可远程:

1. RL 环境数据工程师/研究员

面向真实 Agent 任务场景,设计、构建和打磨可用于强化学习(RL)训练与评测的高质量环境数据。工作内容包括:从真实工作流中抽象任务,完成数据抓取、清洗、合成与版本管理;定义任务目标、环境接口、奖励函数、成功标准和评测指标;设计防止 reward hacking 的验证机制与对抗样例;通过模型后训练与评测实验分析环境有效性,持续迭代任务难度、数据质量和评测稳定性。要求:代码能力强,熟练使用 AI Coding 工具,具备良好的工程实现与实验分析能力,对 RL / Agent / LLM Evaluation / Benchmark 等方向有基础研究理解。加分项:有 RL / Agent / Eval 相关高影响力研究工作,参与过大规模数据、仿真环境、Benchmark 或开源项目建设与维护。

2. Agent 产品经理

负责通用 Agent 产品的功能定义、用户场景拆解和数据飞轮设计,连接真实用户需求、产品体验、Agent 能力边界。工作内容包括:调研和抽象高价值 Agent 使用场景,定义产品功能、交互流程、任务成功标准和优先级;将用户行为、失败案例、人工修正和评测结果转化为可持续生产的评测数据;设计数据采集、标注、反馈、质检和迭代机制,推动产品使用与模型能力提升形成闭环;与工程、研究、和运营团队协作,推动需求从 PRD、原型、实验到上线验证。要求:对 LLM / Agent / RL 有基础理解,具备清晰的产品判断、结构化拆解和跨团队推进能力,对通用 Agent 产品和数据飞轮建设有强热情。加分项:有 AI 产品、数据产品、开发者工具、自动化工具、B2B SaaS 或增长产品经验,熟悉模型评测、用户行为分析、数据标注流程、 AI Coding 工具。

3. 团队运营与人才项目经理(Base 英国)

负责团队在英国及全球远程协作场景下的日常运营、招聘支持和跨团队项目推进,是连接业务、人才、流程和交付的复合型角色。工作内容包括:协助招聘流程管理,跟进候选人沟通、面试安排、offer、入职和 contractor onboarding;维护团队运营节奏,推进会议、文档、流程、供应商和基础行政事务的高效运转;支持 Agent / RL 数据、产品和研究项目的进度管理,拆解 milestone、跟踪 owner、识别 bottleneck 并推动解决;协助管理外部专家、标注人员和合作方,确保沟通顺畅、交付清晰、质量可控。要求:Base 英国,英文沟通能力强,做事细致可靠,具备强执行力、owner 意识和结构化项目管理能力,能在快节奏创业团队中处理多线程事务。加分项:有初创公司运营、HR / Recruiting、项目管理、远程团队协作、AI / 数据项目或国际化团队经验。

4. 领域 LLM 数据标注专家(兼职 Contractor)

面向金融、法律、医疗、保险、半导体、制造业、能源、汽车、生物医药、电商零售等专业领域,参与 LLM / Agent 训练与评测数据的出题、标注、审核和质量评估。工作内容包括:基于真实专业场景设计高质量问题、案例任务和评测样例;判断模型回答的事实准确性、专业性、合规性与可执行性;撰写参考答案、评分理由和错误分析;协助完善标注规范、评测维度和质检标准,帮助模型在真实专业场景中表现得更可靠。要求:具备相关领域深度教育背景、研究经历、从业经验或专业资质,PhD 优先;能够严谨阅读和判断专业材料,有清晰的中文书面表达能力。加分项:有数据标注、模型评测、行业研究、咨询、审计、法务、医学写作、专业内容审核或高质量题库建设经验。

欢迎大家申请、转发、推荐!


具体JD和投递方式:https://www.eigent.ai/careers 

复制链接至浏览器打开,找到对应的岗位进行申请。


THE END


往期内容推荐:


CAMEL-AI.org


微信号 : CamelAIOrg

网站:www.camel-ai.org

▇ 扫码关注我们


【声明】内容源于网络
0
0
CAMEL AI
这里是CAMEL-AI开源社区官方公众号,希望让更多的中文开发者们了解最新的Agent行业资讯和CAMEL-AI的更新与改进。
内容 87
粉丝 0
CAMEL AI 这里是CAMEL-AI开源社区官方公众号,希望让更多的中文开发者们了解最新的Agent行业资讯和CAMEL-AI的更新与改进。
总阅读1.2k
粉丝0
内容87