工作地点:
四川省-成都市
工作职责:
1. 需求分析与方案设计:深入业务场景,负责将模糊的业务需求转化为可落地的AI技术解决方案,完成技术选型、架构设计与实施路径规划。
2. AI应用开发与集成:负责将大语言模型、视觉、语音等AI能力集成到产品与业务流程中,完成从方案设计、开发调试、接口对接到部署运维的全流程工作,构建并持续维护相关产品、系统或服务。
3. 大模型工程化落地:负责大语言模型在实际产品中的工程化,包括模型部署与推理服务搭建、Prompt工程、RAG(检索增强生成)、Agent智能体工作流开发。
4. 性能优化与稳定性保障:针对显存占用、响应速度、并发吞吐等实际工程问题进行推理加速与调优(如模型量化、KV Cache优化等),保障应用稳定、高效、低成本运行。
5. 效果评估与持续迭代:搭建AI应用的效果评测体系与线上监控机制,跟踪业务反馈,持续优化模型效果、使用成本与用户体验。
6. 技术研究与沉淀:跟踪大模型等AI前沿技术动态,评估新模型、新框架的业务应用价值,沉淀技术方案与最佳实践。
任职资格:
基本要求
1. 教育背景:统招本科及以上学历(985、211优先),硕士优先;计算机科学、人工智能、软件工程、数学等相关专业。
2. 编程能力:扎实的编程功底和良好的数据结构与算法基础,熟练掌握 Python;了解 C/C++ 者优先(涉及推理优化等场景)。
3. AI技术基础:熟悉 PyTorch 等主流深度学习框架,理解 Transformer 架构与大模型基本原理;了解模型微调、部署、推理加速的常用方法与工具链。
4. 工程素养:熟悉 Linux 环境与 Git 协作流程,具备良好的代码规范与文档习惯;了解服务端开发、API设计、数据库等基础知识。
5. 综合素质:逻辑思维清晰,能独立分析和解决复杂问题;学习能力强,具备良好的沟通表达与团队协作意识,责任心强。
加分项
1. 有大模型应用完整落地经验(RAG、Agent、Prompt工程、模型微调、推理优化任一方向);
2. 熟悉 LangChain/LlamaIndex 等应用开发框架,或 vLLM/TensorRT-LLM/SGLang 等推理框架,了解向量数据库;
3. 有 Docker/K8s 等云原生技术实践经验;
4. 有相关技术竞赛获奖、开源社区贡献或学术论文发表。