LongCat - 基座agent评测分析算法研究员(生产力方向)
分享这个机会转给正在找工作的朋友
职位说明
核心本地商业-基础研发平台 负责围绕AI大模型算法的认知分析的研究工作,具体工作内容包括但不限于: 1. 深入理解大规模语言模型的模型结构、训练过程以及评测方式,根据模型的训练过程以及评测结果,对大语言模型存在的问题进行研究。 2. 深度参与通用生产力在claude code/OpenClaw等场景下的基座模型能力优化迭代,设计具有长路径、多步骤交互特征的评测任务集,实现从“单次问答”到“闭环任务”的评测转型。 3. 探索长周期下Agent在复杂任务的能力边界,涵盖工具调用、决策规划和记忆管理等方向,对前沿评测范式如基于沙盒环境的动态评测和多agent协同效率等进行深入研究. 1. 硕士及以上学历,计算机、数学或相关专业。熟悉Java/Python/C++等编程语言,良好的编码习惯和一定的工程能力 ; 2. 具有机器学习或深度学习算法的基础知识,熟练掌握自然语言处理、多模态或大模型相关算法和模型; 3. 具备工匠精神,对每一行代码负责,对业务方负责。有良好的沟通合作意识和较强的问题解决能力。
该职位来自企业官方集团招聘门户。当前归入品牌招聘入口展示,具体用人法律主体、签约主体和劳动关系请以投递页及录用材料为准。