AI应用开发(模型/Agent / AIGC )
用人方:远程团队(名称在约面时告知)
岗位职责 一、Agent 与自动化流程 负责 Agent、Skill、AI 工作流的设计与落地,包括任务规划、工具调用、记忆、RAG、多 Agent 协作。 设计提示词结构、节点编排、异常处理与结果校验,实现业务自动化闭环。 负责 OpenClaw 、dify、脚本执行器或同类 Agent 平台的 Skill 接入、调试与部署。 统一封装 Claude、ChatGPT、Gemini、DeepSeek、Qwen、MiniMax 等模型 API,并打通 Agent 与业务系统、第三方接口、MCP、浏览器自动化工具的调用。 持续优化流程的稳定性、任务成功率、上下文管理与执行效率。 二、图像与视频生成 负责 Stable Diffusion / SDXL / FLUX 等模型的工程化应用,搭建文生图、图生图、局部重绘、参考图生成、角色一致性等工作流,并针对业务调优参数。 负责图生视频、文生视频等能力的接入与工作流建设,处理首尾帧、角色一致性、镜头与动作控制、多镜头连续生成等场景。 基于 FFmpeg 完成拼接、转码、字幕、音频、抽帧、补帧、超分等后处理。 三、开源模型部署与调试 负责开源大模型(DeepSeek、Qwen、Llama、GLM 等)的本地化部署、服务化与调优,基于 vLLM、SGLang、Ollama、TGI 等推理框架对外提供统一接口。 负责开源图像、视频模型权重的获取、版本管理与兼容性调试,处理依赖冲突、环境适配、节点与模型版本不匹配等问题。 负责模型效果的对比评测与选型,结合业务场景验证开源模型与商用 API 的效果差异。 跟进开源社区进展,持续引入新模型、新工作流并完成验证与落地。 四、ComfyUI 工程化与推理优化 负责复杂 ComfyUI 工作流的设计、调试与服务化,封装为 REST API / WebSocket 接入业务系统。 开发或改造自定义节点,管理模型、LoRA、VAE、ControlNet 等资源的动态加载。 负责 GPU 推理环境搭建,优化任务队列、并发控制、显存溢出恢复与失败重试。 分析显存占用、GPU 利用率、推理耗时,通过量化、并行等方式持续优化生成速度与质量。 五、业务系统与协作 开发配套的前端页面、后端接口与数据处理逻辑,对接第三方系统完成数据同步、消息通知、报表等集成。 配合产品、运营完成流程优化、问题排查、上线支持与效果迭代。 任职要求 计算机、人工智能、软件工程等相关专业,本科及以上学历优先。 5 年以上开发经验,熟练掌握 Python / Node.js / Java / Go 中至少一种,Python 熟练者优先;具备基础前端能力,能用 Vue / React 完成页面开发。 有真实的 LLM / Agent 项目开发经验,而非仅调用 Chat API;熟悉提示词工程、工具调用、结构化输出、RAG、记忆、工作流等核心技术。 熟悉至少一种 Agent 框架或平台:LangGraph / AutoGen / LlamaIndex / Spring AI / Dify / Coze / OpenClaw 等。 有开源模型的实际部署与调试经验,熟悉 PyTorch、CUDA 环境搭建,用过 vLLM / SGLang / Ollama / TGI 等推理框架或 Hugging Face 技术栈中的至少一种,能独立解决环境依赖、版本兼容、显存不足等问题。 熟练使用 ComfyUI,能独立设计和调试复杂工作流;有 LoRA、ControlNet、IP-Adapter、Inpainting 实际使用经验。
咨询时报上岗位编号 JD-0005,顺手附上简历,匹配更快。全程不收任何费用。