远程岗位:LLM 应用研发工程师 薪资范围:20-35K 岗位职责 1. AI 角色引擎与 Agent 开发 负责 AI 虚拟角色的全链路对话逻辑:Prompt 工程、多轮长短期记忆机制(基于"事件簿"的自动总结,解决长对话中记忆丢失、车轱辘话、人设崩坏)、情绪与好感度状态机,打造高沉浸、高情商的 AI 伴侣。将业务能力封装为 Agent 工具( Function Calling ),实现 AI 对话与计费、打赏、隐藏图集解锁等的无缝衔接,并保证工具调用的准确与容错。 2. 模型微调与人设优化 基于开源模型,使用 LoRA 等轻量级微调( SFT )结合自有聊天语料,持续优化模型的对话风格、人设稳定性与"不拒绝"能力( abliteration 去拒绝等)。沉淀私有微调模型,这是产品长期的核心竞争力。 3. 私域内容多模态 RAG 系统 将公司海量图文、视频及标签进行向量化( Embedding ),结合多模态打标(如 Qwen-VL / CLIP 对封面、关键帧打标),构建多模态内容检索库。优化检索策略(混合检索、Rerank ),让 AI 在与用户聊天时能结合语境"读懂空气",精准且自然地推送相关媒体资源。 4. 开源模型部署与推理优化 负责开源大模型( Qwen3 等主流模型)的本地 / 云端 GPU 服务器私有化部署,使用 vLLM 等推理加速框架优化并发与响应速度,并建立有效的 Token 成本控制机制( Prompt 压缩、KV Cache 等)。 5. 模型网关与可扩展架构 搭建统一推理网关( LiteLLM / one-api 等)作为模型抽象层,使后续更换或新增模型(文本 / 图像 / 语音)只需调整配置而不影响上层业务;实现降级、限速、灰度,保证模型迭代不影响线上服务。 6. 后端接口对接 使用 Python ( FastAPI / Flask )提供稳


  • 情报分类:工作价值
  • 命中依据:AI相关岗位招聘信息,实际工作机会
  • 来源:服务器 / V2EX
  • 原作者:Brand001
  • 发布时间:2026/9/12 12:29:00