DPO

与「DPO」相关的文章

共 2 篇文章

Forward Deployed Engineer (Inference & Post-Training) - Mandarin Speaking

本文是 Together AI 通过 Zero G Talent 发布的一份面向新加坡的招聘启事,岗位为会说普通话的前线部署工程师(Forward Deployed Engineer,FDE),专门负责推理(Inference)与后训练(Post-Training)方向。该职位不是简单的解决方案架构师替代品,而是定位于深度领域专家,需要与解决方案架构师协同工作。核心职责围绕推理引擎优化展开,涉及根据硬件配置、模型架构和负载特征选型、配置并优化主流推理引擎(如 vLLM、TensorRT-LLM、SGLang)。具体技术工作包括:调整 KV Cache、应用推测解码、确定最佳张量并行度与量化策略,以达成严苛的吞吐量和延迟指标。后训练方面,候选人需亲自执行 RL 训练任务并优化系统架构,指导客户完成 LoRA、SFT、DPO、RLHF 与 GRPO 等全流程管线搭建,助力客户从实验阶段跨入生产环境。此外,FDE 还需负责战略客户的长期技术健康度,确立客户入驻平台的基线配置以缩短价值实现时间,并代表一线经验反向驱动产品路线图的演进。申请者须具备 5 年以上技术经验,对开源大模型生态有广泛认知,具备专家级推理引擎实操和诊断能力,并拥有扎实的 Python 编码功底。文章强调 Together AI 是一家研究驱动型企业,致力于通过软硬件协同设计降低 AI 成本,其团队贡献了 FlashAttention 等知名技术。岗位要求为新加坡永久居民或公民,提供初创股权及远程灵活办公选项,发布时间为 2026 年 8 月 4 日。

阅读全文

Handshake 高级 AI 前部署工程师

本文是Handshake公司发布的“高级AI前线部署工程师”(Senior AI Forward Deployed Engineer)招聘启事。Handshake从大学生求职平台转型为AI数据服务巨头,在2025年启动Handshake AI业务,号称已成为史上增长最快的AI数据企业,年化营收约10亿美元,每月向超过3万名知识工作者支付约6,000万美元。该职位位于旧金山,采用混合办公模式,核心使命是嵌入前沿AI实验室等战略合作伙伴中,扮演应用AI研究与客户交付的桥梁角色。工程师需要将实验室模糊的后训练需求转化为具体的评估框架、标注管道和基准基础设施,并主导原型设计、实验迭代和团队指导。技术要求方面,候选人需有6年以上应用机器学习或AI研究工程经验,深度掌握强化学习后训练技术(RLHF、DPO、PPO),具备实际模型微调操作经验(LoRA、PEFT),并有ML数据管道和评估工具的使用背景。加分项包括LLM评估设计经验、已发表的研究成果、开源贡献或在高增长AI公司担任过前线部署类角色。该岗位旨在影响前沿模型的训练方式,反映了AI数据服务行业对兼具研究深度与工程交付能力的复合型人才的迫切需求。

阅读全文