北京三快在线科技 →

视觉Agent大模型算法专家

北京市、上海市算法社会招聘核心本地商业-基础研发平台官网 · HTML
分享这个机会转给正在找工作的朋友

SHARE POSTER

职位分享海报

长按图片可保存;二维码直达职位详情,并标记匿名分享渠道。


职位说明

核心本地商业-基础研发平台 1. 负责视觉Agent系统的全链路设计与开发,构建融合多模态感知、动态决策与自动化执行的视觉智能系统,推动复杂场景下的图文多模态/视频理解、交互与生成能力。 2. 负责视觉Agent核心算法的研发与优化,包括但不限于多模态大模型视觉感知、图像生成、多模态对齐(如文本-图像-视频)等方向,持续提升系统的鲁棒性与泛化能力。 3. 研发视觉Agent的协作机制,支持多智能体协同任务(如跨模态推理、工具调用),优化模型在实时性、资源效率及长上下文处理中的表现。 4. 研发大模型在业务场景下关键能力的应用研发,包括但不限于知识和指令遵循、分析诊断、深度推理、反思和评估等能力的优化和落地。 5. 结合业务场景设计并落地视觉Agent应用,赋能业务智能化升级。 6. 跟踪计算机视觉与大模型交叉领域的前沿技术,探索创新技术在实际场景中的落地路径。 1. 计算机科学、人工智能、电子工程等相关专业硕士及以上学历,具有计算机视觉或视觉Agent相关研发经验。 2. 扎实的算法基础,熟悉主流视觉模型及多模态大模型,具备模型调优与轻量化部署经验。 3. 深入理解主流Agent框架原理,在任务规划、工具调用、策略优化等方向有实际项目经验; 4. 优秀的分析和解决问题的能力,项目推动力和团队协作能力。

该职位来自企业官方集团招聘门户。当前归入品牌招聘入口展示,具体用人法律主体、签约主体和劳动关系请以投递页及录用材料为准。