Kubernetes

Articles related to "Kubernetes"

23 articles in total

前置部署工程师 — Agentforce 编排 - 柏林

本招聘信息由 Salesforce 发布于 myAbility.jobs 平台,工作地点包括柏林、杜塞尔多夫和斯图加特,职位为前线部署工程师(Forward Deployed Engineer),专门负责 Agentforce 编排与运营。该角色属于动手能力强的技术构建者,需在企业客户环境中设计、构建并部署企业级代理 AI 解决方案。Agentforce 负责驱动多智能体编排层,能将混乱的运营工作流、非结构化数据(如电子邮件、PDF、规格表)以及遗留 ERP 日志转化为具有人在回路(humans in the loop)的自主执行引擎。候选人将在敏捷部署小组中工作,与部署策略师和专业 AI 工程师合作,作为连接高级 AI 代理与更广泛企业技术格局的关键纽带。日常工作包括:编写生产代码、构建实时数据接地系统(采用 RAG、向量数据库和知识库)、进行提示工程管理、实施多智能体通信协议(含模型上下文协议 MCP),以及部署自动化供应链和后台工作流。要求具备三年以上软件工程或技术交付经验,并至少有一个生产级 AI、数据工程或企业集成系统成功部署;精通 Python、JavaScript/TypeScript、Java 或 Apex;具备 LLM 编排、RAG 管道、向量搜索索引及知识库检索器的实践经验;掌握 API 设计(REST/SOAP/Webhook)及现代代理协议;需有 25% 至 30% 的出差意愿。优先考虑具备供应链、制造或物流执行领域专业知识,或熟悉 Salesforce 生态系统(如 Agentforce Specialist、Data Cloud、Apex)的候选人。

Read More

FDE前沿部署工程师实战指南:从模型部署到AI Agent系统构建

本文是一份面向前沿部署工程师(FDE)的完整实战指南,系统拆解了 FDE 的核心内涵、技能树、项目实战和学习路径。文章指出 FDE 不是简单的“模型部署”,而是确保复杂 AI 能力(大语言模型、多模态模型、AI Agent、RAG)能够在真实生产系统中稳定、高效、可扩展且低成本地集成的全栈角色,其 40k 以上月薪是对“AI 应用最后一公里”复杂性的定价。核心技能体系覆盖 AI 基础(Transformer、Prompt 工程、RAG、Agent)、工程开发(Python、FastAPI 异步编程)、云原生(Docker、Kubernetes、Istio、Prometheus/Grafana)和系统设计。实战部分通过使用 vLLM 部署 Qwen2.5-7B-Instruct-AWQ 量化模型、构建 FastAPI 代理网关实现路由与监控、编写 Dockerfile 和 Kubernetes Deployment 文件完成容器化与编排,以及部署多智能体项目 My AI Town 来串联所有技能。文章还提供了常见故障排查清单(超时、OOM、推理慢、Agent 循环、Pod 重启)、最佳实践(IaC、配置分离、可观测性、成本优化、降级策略)及三阶段学习路径(基础巩固、核心技能、项目实战),并解析了面试考察的系统设计、故障排查和工程协作等方向,为求职者提供了从零到就业的路线图。

Read More

Sergio Illescas

Sergio Illescas 是一名前线部署工程师(Forward Deployed Engineer),目前就职于总部位于旧金山的 AI 通信公司 HappyRobot。HappyRobot 构建面向实体经济的 AI 原生操作系统,已获 5 轮共 6080 万美元融资,在 2026 年 8 月宣布完成由 Prysm Capital 领投、Eurazeo 联合领投的 1.5 亿美元 C 轮融资,估值达 12 亿美元,跻身独角兽行列。Sergio 在芝加哥工作,直接与客户合作部署 AI 智能体并确保其在真实环境中的可靠性。 此前,他在马德里理工大学参与由欧盟资助的 6Green 项目,开发基于 Python 的 MILP 优化模型评估 6G 网络可持续策略,将排放降低至基线的约 15%,并于 2025 年第 33 届 ITS 欧洲会议上发表了经同行评审的合著论文。在 Minsait 实习期间,他利用 Java、Spring Boot、Vue.js 和 OpenShift/Kubernetes 构建后端微服务与管理工具,将私有 5G 网络服务管理时间缩短约 40%。他还曾在伊利诺伊理工学院攻读应用数据科学与 AI 硕士,并自主开发了结合 OpenAI、Gemini LLM 与 ElevenLabs 等技术的 AI 面试模拟平台,在 72 小时内打造出原型,获得黑客松总冠军。

Read More

Forward Deployed Engineer(外派工程师)

本文是一则由软件公司 Akka 发布的 Forward Deployed Engineer (FDE) 前线部署工程师招聘启事,发布于 2026 年 8 月 4 日,工作地点为澳大利亚远程办公。该岗位的核心要求是兼具深厚的技术能力与顶级的客户沟通技巧,并非传统的后台开发或纯战略咨询角色。FDE 的核心职责包括三大部分:第一,通过举办技术研讨会、代码结对和架构指导,对客户开发团队进行技术赋能和培训;第二,引导客户实现 AI Agent 系统在生产环境中的成功落地,具体涵盖使用多智能体框架和 LLM 构建逻辑系统、设计策略阶梯和防护栏以确保 AI 安全,以及提供 SRE 和 DevOps 最佳实践指导,确保应用的可扩展性和弹性;第三,作为客户与 Akka 内部产品及工程团队之间的桥梁,影响产品路线图。候选人必须具备 Agentic AI 和逻辑系统的构建经验、AI 安全与防护栏设计能力、顶级的英语沟通表达能力、快速学习新技术的适应性、分布式计算基础、JVM 语言(如 Java)的专业技能,以及对 Kubernetes 等云原生技术的了解。Akka 强调透明、客户至上、创新和坚持不懈的企业价值观。

Read More

前部署工程师路线图 2026 — 将AI部署到客户身边 | Vibe Engines

本文是 Vibe Engines 发布的《Forward-Deployed Engineer Roadmap 2026》深度技能路线图,旨在定义和训练能够将 AI 落地到客户真实环境的工程师。文章将 Frontline Deployed Engineer(FDE)的能力划分为“技艺”、“现场”和“成果”三大轨道,共 18 个站点。在“技艺”轨道中,核心技能包括嵌入式工程思维、基于 48 小时快速原型和 Agentic Coding 的速度感、掌握 LLM 的生产级提示词与结构化输出、构建具备权限控制的企业级 RAG 系统、设计智能体与工作流,以及利用 API、Webhook 和 MCP 协议对接 Salesforce、SAP、SharePoint 等遗留系统的集成能力。在“现场”轨道中,重点涵盖客户工作流蹲点与范围界定、OCR 文档数据清洗、面对 VPC、断网或气隙环境的 Kubernetes 部署、应对 SOC 2、GDPR、HIPAA 安全合规审查与 PII 数据处理、基于真实数据的客户定制化评估体系,以及用客户真实数据进行售前演示的策略。在“成果”轨道中,文章深入探讨了干系人管理、试点转生产的硬化和 SLO 设定、借助特性开关和灰度发布构建可靠性体系、通过 ROI 指标和仪表盘证明价值,以及通过配置化而非代码分支实现规模化复制。路线图最后给出了 FDE 三栖融合的职业生涯路径,指出 2026 年市场将从解决方案架构师、产品经理和创业方向为这一角色给予高溢价。

Read More

Forward Deployed Engineers (FDE): 完整指南 (2026)

本文是 Kizzy Consulting 创始人兼 CEO Sanjeet Mahajan 撰写的 2026 年前线部署工程师(Forward Deployed Engineer, FDE)完整指南,系统阐述了 FDE 这一将深度全栈工程能力与客户现场咨询相结合的混合角色的定义、起源、架构职责、技术栈、技能要求和行业实践。文章指出,随着生成式 AI 和 Agentic AI 的普及,85% 的顶级 AI 企业已雇佣 FDE 进行实施交付,FDE 可将客户实现价值的速度提升 3 倍,中级 FDE 起薪超过 13 万美元,资深级别可达 30 万美元以上。FDE 角色源自 Palantir Technologies 的实践,现已拓展至 OpenAI、Anthropic、Databricks 等 AI 公司。文章深入分析了 FDE 在 Agentic AI 编排、Agentic RAG 架构、Model Context Protocol 等方面的具体工作,对比了 LangGraph、CrewAI、Semantic Kernel 等框架的适用场景,并提供了 90 天企业实施路线图和最佳实践,涵盖语义缓存、Human-in-the-Loop 安全护栏、混合搜索优化等关键策略。

Read More

AI部署工程师职位 - 迈阿密,佛罗里达州

Robert Half 发布了一份位于美国佛罗里达州迈阿密的 AI Deployment Engineer 招聘信息,职位性质为合同制。该岗位的核心职责是将机器学习和生成式 AI 模型从原型阶段全面推向生产环境,要求工程师负责构建和维护 MLOps 管道,以实现训练、部署与版本管理的自动化。技术上,候选人需要掌握 Docker 和 Kubernetes 进行容器化与工作负载编排,并将模型及 API 集成到应用程序和业务工作流中。同时,该职位要求优化模型性能、延迟和基础设施成本,并实施生产环境的监控、日志与告警系统。任职资格方面,要求 3 年以上 ML 工程、MLOps 或 DevOps 相关经验,具备扎实的 Python 生产部署能力,并熟悉 AWS、Azure 或 Google Cloud Platform 等主流云平台,以及 CI/CD 管道和基础设施即代码。优先资格包括部署大语言模型经验、使用 LangChain 框架、熟悉向量数据库和检索增强生成技术,以及具备 MLflow、Amazon SageMaker 或 Vertex AI 等模型服务工具的实践经验。该职位强调 AI 系统的安全与治理标准,反映了企业级 AI 落地的可靠性、可扩展性与安全性要求逐渐成为部署工程师的核心评估标准。

Read More

AI 部署工程师

本文是AI公司CrewAI发布的AI部署工程师(AI Deployment Engineer)职位招聘信息,发布日期为2026年7月9日,工作地点为美国远程。该岗位属于售后技术角色,核心职责是负责从签约到生产环境成功运行的端到端客户技术关系,包括技术实施与集成、部署与生产运营、客户成功与关系管理,以及文档编写与反馈闭环。关键职责包括:主导CrewAI平台与客户系统的技术集成,涉及API集成、数据管道、认证流程和自定义工作流;使用Python、Agentic AI Stack和云平台开发定制的智能体和工具;监控已部署解决方案的性能、可靠性和商业价值;作为主要技术联系人为企业客户提供培训和支持。岗位要求3年以上客户面向前沿部署工程师或类似经验,精通Python和容器化部署技术如Docker和Kubernetes,熟悉LLM、RAG模式和提示工程等AI/ML技术,具备解决分布式系统生产问题的能力。该角色需要与产品、工程、销售和客户成功团队紧密协作,考核指标包括项目成功率、客户满意度评分、净收入留存率等。这是一个面向Agentic AI企业级落地的实战岗位,反映了多智能体系统从实验走向规模化商业部署的行业趋势。

Read More

AI现场工程师 - GenAI基础设施

2026年7月8日,一家匿名的 GenAI 基础设施公司(Stealth)发布招聘信息,寻找 AI 前线部署工程师(AI Field Engineer)。该职位旨在帮助企业将开源大模型从沙盒探索推向生产环境,职责包括确定概念验证范围、运行负载测试、执行 SFT/DPO/RFT 等模型微调,并直接在客户基础设施中交付生产集成,而非停留在咨询层面。公司推理平台已为 Uber、DoorDash、Notion 和 Cursor 等知名企业提供生产服务,推理速度达到闭源模型的 15 倍,并发量提升 4 倍。职位要求候选人具备 3 年以上客户现场 AI/ML 工程经验,深度掌握 LLM 推理与训练,熟练使用 vLLM、SGLang 或 TensorRT-LLM 等推理引擎,精通 Python 编程及 AWS、Azure、GCP 等 GPU 云基础设施,并具备 Kubernetes 实战能力。理想候选人拥有 Palantir FDE、BCG X 或 McKinsey QuantumBlack 等前线部署或专业服务背景。薪资范围为底薪 176,000–224,000 美元,总包 220,000–280,000 美元(80/20 拆分),10 年以上经验可上浮,并提供股权激励。工作方式为美国境内远程办公,需定期出差至客户现场,并支持 H-1B 转移和 TN 签证担保,O-1 签证视情况而定。该招聘突出强调了实战交付能力,明确拒绝仅有闭源 API 经验的候选人,反映出开源模型生产部署对 FDE 角色的硬核要求。

Read More

Turing前向部署AI工程师

本文是 Turing 公司发布的 Forward Deployed AI Engineer(前线部署 AI 工程师)招聘信息,工作地点位于印度马哈拉施特拉邦孟买,采用线下办公模式。Turing 总部位于美国加利福尼亚州旧金山,是全球领先的前沿 AI 实验室研究加速器及企业级 AI 系统部署合作伙伴,客户包括前沿 AI 研究机构与全球企业,公司曾被 Forbes、The Information 和 Fast Company 评为全球顶级创新企业,领导团队来自 Meta、Google、Microsoft、Apple、Amazon、McKinsey、Bain、Stanford、Caltech 和 MIT。该岗位要求候选人具备 4-8 年以上软件工程或解决方案工程经验,精通 Python、Langchain、LangGraph 和 SQL,拥有深厚的工程架构设计能力,包括 API、微服务和事件驱动系统,并具备将生成式 AI 应用部署到生产环境的成功经验。候选人需要熟练使用 AWS、GCP 或 Azure 等云平台,具备出色的沟通能力,能将复杂技术问题转化为面向客户的叙述。优先考虑熟悉 CI/CD、基础设施即代码(Terraform、Pulumi)、容器编排(Docker、Kubernetes)以及 LLM 微调、RAG 或 AI/ML 运维背景的人选。岗位核心职责包括领导面向客户的 GenAI 应用端到端部署、架构设计与实现可扩展解决方案、担任客户的技术顾问、与产品及工程团队协作推动平台能力建设。Turing 强调客户优先、创业速度和 AI 前瞻的价值观,提供协作支持的工作文化、灵活工作时间和有竞争力的薪酬。

Read More

AWS的10亿美元押注前线部署工程师,标志着企业AI进入下一阶段

2026年7月,AWS宣布了一项10亿美元的巨额投资,计划构建一个专门的前向部署工程师(Forward Deployed Engineering, FDE)组织,将数千名AI工程师直接嵌入到客户组织内部,与客户团队合作构建生产级AI系统。作者Michael Preston指出,这一战略决策标志着企业AI领域的竞争重心,正从基础设施采购(如GPU、模型API)转向工程执行。文章分析认为,当前企业AI项目失败的根源,已不再是模型准确率问题,而是系统集成、工作流重塑、身份管理、安全合规与遗留系统对接等复杂的工程和组织挑战。AWS此举旨在销售“运营能力”而非单纯的技术,目标是在金融服务和政府等受监管行业建立客户独立自足的能力,而非长期依赖。在微软Azure、Google Cloud等基础设施能力日益同质化的背景下,文章进一步判断,难以被商品化的工程交付能力将成为云厂商新的差异化护城河。这也将改变企业AI的人才需求结构,促使市场需要更多集分布式系统、安全、数据工程于一体的复合型人才。这一战略对传统技术咨询市场也将产生深远影响,可能压缩其部分价值链。整个判断表明,企业AI正进入一个以执行和系统整合为核心的新阶段,未来赢家可能不只是拥有最强模型的公司,而是能持续将AI原型变为可靠生产系统的公司。

Read More

前期部署解决方案工程师

2026年6月27日,Hirequorum 平台发布了智能文档处理(IDP)领导者 Hyperscience 公司招聘“Forward Deployed Solutions Engineer”的职位信息。Hyperscience 被定位为2025年 Gartner 魔力象限的领导者,其核心产品 Hypercell 平台致力于将复杂文档转化为 LLM 和 RAG 就绪的数据,服务于 American Express、Charles Schwab、美国退伍军人事务部等大型客户,并获得 Bessemer Venture Partners 和 Tiger Global 等顶级机构投资。该职位被定义为一个关键的混合角色,要求将深度工程思维和成果导向融入销售流程,成为售前和售后支持的核心技术资源。候选人需具备5年以上客户面向前工程经验,精通 Python 编程,熟悉 AWS/Azure/GCP 等云架构以及 Docker/Kubernetes 容器化部署。其核心职责覆盖了从方案设计、POC原型代码开发、技术策略制定到售后合作伙伴关系维护及模型微调的全生命周期管理,旨在确保解决方案顺利部署并产生可衡量的业务成果。此外,该职位还承担着向产品团队反向输入市场情报的桥梁作用,并需管理技术范围、TCO 和集成策略以规避企业级风险。

Read More