招聘信息

AI部署工程师职位 - 迈阿密,佛罗里达州

Key takeaway: Robert Half 发布了一份位于美国佛罗里达州迈阿密的 AI Deployment Engineer 招聘信息,职位性质为合同制。该岗位的核心职责是将机器学习和生成式 AI 模型从原型阶段全面推向生产环境,要求工程师负责构建和维护 MLOps 管道,以实现训练、部署与版本管理的自动化。技术上,候选人需要掌握 Docker 和 Kubernetes 进行容器化与工作负载编排,并将模型及 API 集成到应用程序和业务工作流中。同时,该职位要求优化模型性能、延迟和基础设施成本,并实施生产环境的监控、日志与告警系统。任职资格方面,要求 3 年以上 ML 工程、MLOps 或 DevOps 相关经验,具备扎实的 Python 生产部署能力,并熟悉 AWS、Azure 或 Google Cloud Platform 等主流云平台,以及 CI/CD 管道和基础设施即代码。优先资格包括部署大语言模型经验、使用 LangChain 框架、熟悉向量数据库和检索增强生成技术,以及具备 MLflow、Amazon SageMaker 或 Vertex AI 等模型服务工具的实践经验。该职位强调 AI 系统的安全与治理标准,反映了企业级 AI 落地的可靠性、可扩展性与安全性要求逐渐成为部署工程师的核心评估标准。

Key Takeaways
  1. Robert Half 在迈阿密招聘 AI Deployment Engineer,负责将 ML 和生成式 AI 模型从原型推向生产环境。
  2. 职责涵盖构建 MLOps 管道、使用 Docker 和 Kubernetes 进行容器化编排,以及集成 API 到业务系统。
  3. 要求 3 年以上相关经验,具备 Python 生产部署能力,并熟悉 AWS/Azure/GCP 中至少一种主流云平台。
  4. 优先资格包括 LLM 部署经验、LangChain 框架、向量数据库、RAG 以及 MLflow、SageMaker、Vertex AI 等模型服务工具。
  5. 该职位为合同制,位于佛罗里达州迈阿密,要求候选人在美国拥有合法工作授权。
这篇文章来自 Robert Half 发布的 AI Deployment Engineer 招聘信息,清晰展示了当前美国市场(迈阿密地区)对 AI 部署工程人才的技能需求画像。对于 FDE(前线部署工程师)从业者或团队负责人而言,这是一份极具参考价值的行业样本:它明确要求候选人具备从模型原型到生产环境的全链路工程化能力,涵盖 MLOps 管道构建、容器化编排(Docker/Kubernetes)、云平台落地(AWS/Azure/GCP)以及 LLM 部署、RAG 和向量数据库等前沿技术栈。招聘信息不仅反映了企业对 AI 系统可靠性、可扩展性与安全性的重视,也点明了从 DevOps 向 AI 工程化转型的典型职业路径。无论你是正在评估自身技能栈的工程师,还是制定招聘标准的团队主管,这份 JD 都能提供一手的行业对标依据。

Robert Half 在迈阿密招聘 AI Deployment Engineer,负责将 ML 和生成式 AI 模型从原型推向生产环境。

—— 络石智能编辑部 · Editor's Pick

AI部署工程师职位 - 迈阿密,佛罗里达州

We are looking for an AI Deployment Engineer to take machine learning and AI models from prototype to production. This role owns the pipelines, infrastructure, and monitoring that make AI reliable, scalable, and secure in a real environment. Responsibilities Deploy, scale, and monitor machine learning and generative AI models in production Build and maintain MLOps pipelines for training, deployment, and versioning Containerize and orchestrate workloads using Docker and Kubernetes Integrate models and APIs into applications and business workflows Optimize model performance, latency, and infrastructure cost Implement monitoring, logging, and alerting for deployed models Collaborate with data scientists and engineers to productionize solutions Apply security and governance standards to AI systems and data

Required Qualifications 3 or more years in ML engineering, MLOps, DevOps, or a related field Strong Python skills and experience deploying models to production Hands on experience with Docker and Kubernetes Experience with a major cloud platform (AWS, Azure, or GCP) Familiarity with CI/CD pipelines and infrastructure as code Preferred Qualifications Experience deploying large language models or working with frameworks such as LangChain Familiarity with vector databases and retrieval augmented generation Experience with model serving tools such as MLflow, SageMaker, or Vertex AI

Technology Doesn't Change the World, People Do. ® Robert Half is the world’s first and largest specialized talent solutions firm that connects highly qualified job seekers to opportunities at great companies. We offer contract, temporary and permanent placement solutions for finance and accounting, technology, marketing and creative, legal, and administrative and customer support roles. Robert Half works to put you in the best position to succeed. We provide access to top jobs, competitive compensation and benefits, and free online training. Stay on top of every opportunity - whenever you choose - even on the go. Download the Robert Half app and get 1-tap apply, notifications of AI-matched jobs, and much more. All applicants applying for U.S. job openings must be legally authorized to work in the United States. Benefits are available to contract/temporary professionals, including medical, vision, dental, and life and disability insurance. Hired contract/temporary professionals are also eligible to enroll in our company 401(k) plan. Visit roberthalf.gobenefits.net for more information. © 2025 Robert Half. An Equal Opportunity Employer. M/F/Disability/Veterans. By clicking “Apply Now,” you’re agreeing to Robert Half’s Terms of Use and Privacy Notice.

Tags

Related Topics

Expert Comment

This article is curated by the editorial team from public sources for reference only.

FAQ

AI Deployment Engineer 的主要职责包括哪些?
AI Deployment Engineer 负责将机器学习和生成式 AI 模型从原型阶段推向生产环境,核心职责包括:构建和维护 MLOps 管道,使用 Docker 和 Kubernetes 进行容器化与编排,将模型与 API 集成到业务应用中,优化模型性能、延迟与基础设施成本,并为已部署模型实施监控、日志与告警系统,同时与数据科学家合作,确保 AI 系统符合安全与治理标准。
成为 AI Deployment Engineer 需要具备哪些技术栈和资格?
申请该职位通常需要 3 年以上 ML 工程、MLOps 或 DevOps 相关经验,具备扎实的 Python 编程能力与生产环境部署经验,熟练掌握 Docker 和 Kubernetes,并拥有 AWS、Azure 或 GCP 等主流云平台实践经验。优先考虑具有大语言模型部署、LangChain 框架、向量数据库、检索增强生成以及 MLflow、SageMaker、Vertex AI 等模型服务工具经验的候选人。
这个 AI Deployment Engineer 职位在哪里,属于什么工作性质?
该职位由 Robert Half 发布,工作地点位于美国佛罗里达州迈阿密,为合同/临时性质,要求候选人拥有在美国合法工作的授权,并提供包括医疗、牙科、视力保险及 401(k) 计划在内的福利。

Related Articles

AI现场工程师 - GenAI基础设施

2026年7月8日,一家匿名的 GenAI 基础设施公司(Stealth)发布招聘信息,寻找 AI 前线部署工程师(AI Field Engineer)。该职位旨在帮助企业将开源大模型从沙盒探索推向生产环境,职责包括确定概念验证范围、运行负载测试、执行 SFT/DPO/RFT 等模型微调,并直接在客户基础设施中交付生产集成,而非停留在咨询层面。公司推理平台已为 Uber、DoorDash、Notion 和 Cursor 等知名企业提供生产服务,推理速度达到闭源模型的 15 倍,并发量提升 4 倍。职位要求候选人具备 3 年以上客户现场 AI/ML 工程经验,深度掌握 LLM 推理与训练,熟练使用 vLLM、SGLang 或 TensorRT-LLM 等推理引擎,精通 Python 编程及 AWS、Azure、GCP 等 GPU 云基础设施,并具备 Kubernetes 实战能力。理想候选人拥有 Palantir FDE、BCG X 或 McKinsey QuantumBlack 等前线部署或专业服务背景。薪资范围为底薪 176,000–224,000 美元,总包 220,000–280,000 美元(80/20 拆分),10 年以上经验可上浮,并提供股权激励。工作方式为美国境内远程办公,需定期出差至客户现场,并支持 H-1B 转移和 TN 签证担保,O-1 签证视情况而定。该招聘突出强调了实战交付能力,明确拒绝仅有闭源 API 经验的候选人,反映出开源模型生产部署对 FDE 角色的硬核要求。

Read More

前期部署解决方案工程师

2026年6月27日,Hirequorum 平台发布了智能文档处理(IDP)领导者 Hyperscience 公司招聘“Forward Deployed Solutions Engineer”的职位信息。Hyperscience 被定位为2025年 Gartner 魔力象限的领导者,其核心产品 Hypercell 平台致力于将复杂文档转化为 LLM 和 RAG 就绪的数据,服务于 American Express、Charles Schwab、美国退伍军人事务部等大型客户,并获得 Bessemer Venture Partners 和 Tiger Global 等顶级机构投资。该职位被定义为一个关键的混合角色,要求将深度工程思维和成果导向融入销售流程,成为售前和售后支持的核心技术资源。候选人需具备5年以上客户面向前工程经验,精通 Python 编程,熟悉 AWS/Azure/GCP 等云架构以及 Docker/Kubernetes 容器化部署。其核心职责覆盖了从方案设计、POC原型代码开发、技术策略制定到售后合作伙伴关系维护及模型微调的全生命周期管理,旨在确保解决方案顺利部署并产生可衡量的业务成果。此外,该职位还承担着向产品团队反向输入市场情报的桥梁作用,并需管理技术范围、TCO 和集成策略以规避企业级风险。

Read More

前線部署工程師 | Forward Deployed Engineer (FDE)

十论科技股份有限公司(Tricuss CO., LTD.)发布前线部署工程师(Forward Deployed Engineer, FDE)招聘公告。公司旗舰产品“企业级Co-researcher AI Agent”融合Agentic AI、大数据与物理模拟,结合物理基础数字孪生(Physics-based Digital Twins),为地端(On-premise)与封闭网络(Air-gapped)高资安客户提供最高千倍加速和减少70%实体实验的研发解决方案,已与NVIDIA、Qualcomm、Intel及世界顶尖半导体与AI服务器供应链客户密切合作。FDE作为核心技术与客户间的桥梁,需深入理解客户研发痛点,利用平台设计并部署定制化AI代理与工作流,负责系统集成(如Hadoop/Iceberg大数据生态)、AI检索架构优化、Prompt策略与多代理协作调优、PoC验证及产品反馈。岗位要求具备大型语言模型API(OpenAI、Anthropic)实战经验、Agentic Framework与RAG部署经验,以及B2B SaaS技术咨询或FDE/Solutions Architect背景,熟悉Python或TypeScript、云平台(AWS、GCP、Azure)与容器化技术(Docker、Kubernetes),掌握LangGraph、CrewAI、AutoGen等Agentic框架者优先,薪资60万至200万新台币/年。该职位体现了AI 2B场景下对既懂技术又懂业务的复合型FDE的迫切需求,是AI工程化与垂直行业深度融合的典型案例。

Read More

前向部署 AI 工程师

本文是 Keyrus 集团于 2026 年 8 月 1 日发布的一份“Forward Deployed AI Engineer”(前线部署 AI 工程师)招聘启事。Keyrus 是一家拥有 30 年历史、在泛欧交易所上市的国际咨询集团,拥有 2800 名员工,业务遍布 28 个国家,核心理念是“Architected Intelligence”(架构设计的智能)——即 AI 本身不直接变革业务,通过将智能嵌入企业核心流程、构建企业级智能操作系统的工程化设计才能创造价值。该 FDE 角色定位于高级个人贡献者,核心任务是在客户一线,将模糊的 AI 应用意图在数周内转化为生产级、可衡量业务价值的解决方案,而非仅停留于实验性模型。文章详细列出了职责流程:从与利益相关者共创、获取数据,到使用 Python、LangChain、RAG、智能体工作流等技术栈构建应用,再到部署、监控和知识转移。候选人需具备 5-10 年 AI 工程或咨询经验,掌握 LLM、模型选择、嵌入与向量搜索、多云平台及 Docker/CI/CD 等生产部署技能,同时需具备在客户现场进行速度、质量、成本与安全权衡的架构判断力。Keyrus 还强调了其专有的“Human Orchestrated Model”方法论,将人类指挥的治理和性能引导融入智能基础中。此次远程全职招聘的流程简洁,包含技术交付挑战面试,旨在寻找能够连接数据、AI 与人类决策的“智能架构师”。

Read More

Turing前向部署AI工程师

本文是 Turing 公司发布的 Forward Deployed AI Engineer(前线部署 AI 工程师)招聘信息,工作地点位于印度马哈拉施特拉邦孟买,采用线下办公模式。Turing 总部位于美国加利福尼亚州旧金山,是全球领先的前沿 AI 实验室研究加速器及企业级 AI 系统部署合作伙伴,客户包括前沿 AI 研究机构与全球企业,公司曾被 Forbes、The Information 和 Fast Company 评为全球顶级创新企业,领导团队来自 Meta、Google、Microsoft、Apple、Amazon、McKinsey、Bain、Stanford、Caltech 和 MIT。该岗位要求候选人具备 4-8 年以上软件工程或解决方案工程经验,精通 Python、Langchain、LangGraph 和 SQL,拥有深厚的工程架构设计能力,包括 API、微服务和事件驱动系统,并具备将生成式 AI 应用部署到生产环境的成功经验。候选人需要熟练使用 AWS、GCP 或 Azure 等云平台,具备出色的沟通能力,能将复杂技术问题转化为面向客户的叙述。优先考虑熟悉 CI/CD、基础设施即代码(Terraform、Pulumi)、容器编排(Docker、Kubernetes)以及 LLM 微调、RAG 或 AI/ML 运维背景的人选。岗位核心职责包括领导面向客户的 GenAI 应用端到端部署、架构设计与实现可扩展解决方案、担任客户的技术顾问、与产品及工程团队协作推动平台能力建设。Turing 强调客户优先、创业速度和 AI 前瞻的价值观,提供协作支持的工作文化、灵活工作时间和有竞争力的薪酬。

Read More