工作职责:
-参与多模态大模型的算法方案调研、prompt工程,效果优化
-推动大模型智能体在结构化信息抽取、智慧招采等实际业务中的部署,设计面向具体任务的Agent工作流(如多轮交互、自主纠错、动态工具选择),确保智能体在真实场景中具备高可用性和可解释性,解决传统模型难以处理的复杂结构化问题。
-参与大模型的日常评估和开发工作,推动其持续改进和性能提升,提高训练和推理效率
-与团队成员紧密合作,协同解决开发过程中遇到的问题和技术挑战
任职要求:
-计算机或人工智能相关专业本科及以上学历
-熟悉计算机视觉和自然语言处理中的至少一个方向,有顶会论文可加分
-熟练掌握PyTorch等深度学习框架,有较强的编程能力
-熟悉开源多模态大模型原理,有多模态大模型调优、信息抽取项目经验者优先
-拥有一定工程能力,熟悉Flask,MySQL,Docker等技术;
-拥有大模型训练推经验,熟悉ms-swift训练套件,SFT、GRPO等训练方式以及VLLM推理部署者优先
