AI技术负责人(远程)
1.招聘渠道:直招
2.薪资待遇:50K–80K/月 + 项目奖金;项目奖金可与扩编、阶段目标及年度成本目标挂钩,具体根据候选人能力及项目经验沟通。
3.工作时间:单休
4.人选性别:不限
5.人选年龄:40岁内
6.国籍要求:仅限中国籍
7.地区限制:回族、新疆籍、斯坦籍、埃及籍
8.学历要求:大专及以上
9.语言要求:中文,英文
不接受目前在迪的人选入职!
线上远程全职办公
确保能用纸飞机对接工作再推简历哦
岗位需求:
1. 8–12 年以上研发/架构相关经验,有较强的软件工程及系统架构能力。
2.2023 年以后至少 2 年大模型应用实际落地经验。
3.至少亲自负责过 1 个正式上线且具备一定规模的大模型系统,例如:
a.日对话量 ≥ 1 万;
b.或服务 ≥ 100 个企业/坐席;
c.或具有同等级别真实业务规模。
4.有完整的 RAG / Agent / 企业知识库 / 智能客服项目经验,不限于 Demo 或内部实验。
5.熟悉主流大模型及开源模型生态,具备模型选型、部署、推理优化能力。
6.有 vLLM、SGLang 等私有化部署经验,并能够实际核算显存、并发、吞吐量和延迟。
7.有 LoRA 等模型微调经验,理解微调的适用边界。
8.有较强的数据意识和成本意识,能够量化 AI 系统的效果与成本。
9.具备线上系统故障排查、性能优化及高并发系统经验。
10.仍保持较强的一线技术能力,能够亲自写代码、看代码、解决核心技术问题。
加分项
有以下经验优先:企微/SCRM 平台对接;抖音、小红书等开放平台对接;电商/零售/销售场景 AI 应用;AI Agent 生产环境落地;AI 评测体系建设;国产 GPU/国产算力适配经验。
岗位职责:
1.负责公司 AI 项目的整体技术架构设计及落地,包括知识库、RAG、Agent、智能客服、人机协同等系统。
2.负责大模型应用从 POC → 开发 → 上线 → 扩容 → 稳定运行 的完整技术链路。
3.根据业务需求选择合理的技术方案,判断哪些问题应通过 Prompt / RAG / Agent / LoRA 微调 / 程序规则解决。
4.负责开源大模型私有化部署及性能优化,包括 vLLM、SGLang 等推理框架。
5.负责模型推理性能、GPU 显存、并发量、响应延迟、吞吐量等指标的优化。
6.建立 AI 应用效果评测体系,对回答准确率、召回率、幻觉率、转人工率等核心指标持续优化。
7.处理线上 AI 系统故障、效果退化、知识库召回异常等问题,并建立监控和回归机制。
8.负责 AI 系统成本控制,包括 Token、GPU、模型调用及基础设施成本核算。
9.带领约 5–15 人技术团队,参与核心代码开发及 Code Review,对技术交付质量负责。
10.与产品、运营、销售等团队协作,将业务问题转化为可落地的 AI 技术方案。
办公区域:线上远程全职办公,严禁远程兼职
其他备注: 无bc经验
联系方式:@jtzzHR
Post #1529
1.07K