Docker

Articles related to "Docker"

20 articles in total

Forward Deployed Engineer

本文是 Hirevector 平台上发布于 2026 年 7 月 2 日的招聘信息,由 AI 安全公司 Origin 发布,招聘 Forward Deployed Engineer(FDE,前线部署工程师)。Origin 公司由 Prelude 孵化,并获得了 Sequoia Capital、Brightmind Ventures 和 IA Ventures 等顶级投资机构的支持,致力于在 AI 代理和 LLM 驱动的语义时代,构建下一代端点安全解决方案,其核心理念是从传统的“已知恶意”检测转向“上下文意图”理解。该 FDE 岗位是连接 Origin 技术与客户之间的桥梁,职责要求工程师将 70% 的时间投入到客户现场的定制化构建中,包括集成新的遥测数据源、添加 AI 代理可观测性、针对特定环境扩展 Agent 功能、以及开发自定义仪表盘和自动化工作流。职位要求候选人具备 React、TypeScript、Rust、Python 等全栈工程能力,理解 Windows 和 macOS 操作系统底层原理,并具备较强的客户共情能力和商业敏锐度。此外,工作内容还涉及与研发团队协作,将现场洞察转化为产品功能,并支持客户进行部署、故障排除和优化。该职位为远程办公,包含约 20% 的出差频率,适合在快节奏创业环境中具备创造性解决问题能力的人才。

Read More

AI工程师 - Col

这是一则由Hirequorum为Simetrik公司发布的AI工程师招聘启事,发布日期为2026年6月27日。该岗位核心职责是加入Simetrik的AI Agent团队,设计、构建并部署面向客户和内部运营的生产级AI Agent,实现从概念到产品交付的全流程覆盖。职位要求候选人担任产品与客户交付的桥梁,直接与客户协作以理解业务需求并转化为技术方案,同时需在系统设计、安全性和代码质量上做出关键决策。 应聘者需拥有计算机科学、工程等相关学位,并具备3年以上软件工程、数据科学或机器学习经验,尤其看重全栈工程背景和工程与AI/数据结合的混合型能力。必备技能包括FastAPI或Flask等API开发经验,对OpenAI、Anthropic、Hugging Face、Cohere等大型语言模型(LLM)的实践经验,以及LangChain、LlamaIndex、CrewAI等LLM框架的应用能力。还需掌握RAG、工具使用和行为定制等AI Agent构建技术,熟悉MLflow、Weights & Biases等实验跟踪平台,以及Docker容器化应用和CI/CD流水线。优先考虑具备Pinecone等向量数据库、AWS等云服务、DVC数据版本管理及负责任AI原则知识的候选人。 该职位为100%远程工作,公司提供有竞争力的薪酬、学习津贴和医疗福利。本文揭示了AI工程化时代,企业对于能将大型语言模型实际落地为业务解决方案的复合型人才的迫切需求,并详细界定了这一角色的技能栈。

Read More

[远程] 首席应用人工智能工程师,金融

Genesys 公司发布了远程 Principal Applied AI Engineer(金融领域)职位,要求候选人主导设计和交付 AI 及预测模型,以变革财务决策,专注于生产级 AI 系统和智能自动化。核心职责包括:构建和领导开发 agentic AI 系统以自动化财务工作流(如预测、报告、决策支持),设计多智能体系统,利用 LLM、工具使用框架与编排模式(如 RAG、链式模型、动态提示),将前沿 LLM 和 agentic AI 研究转化为可扩展的生产解决方案,建立防护机制、评估框架与负责任 AI 实践;领导时间序列预测、客户流失预测等高级预测模型开发与部署;设计可扩展 AI/ML 系统,强调软件工程最佳实践(模块化设计、API、CI/CD、测试),推动现代工具采用(容器化、云原生架构),建立 MLOps 最佳实践;确保系统满足 SOX 等合规和审计要求。任职资格要求 8 年以上数据科学、软件工程、AI 工程经验,精通 Python、ML/AI 框架、云平台(优先 AWS)、分布式系统、LLM 微调与评估、生产级 agentic AI 框架、RAG 与向量数据库,以及模型护栏与偏差缓解。该职位反映出企业对将 agentic AI 和高级预测模型融入金融运营、强调生产工程和合规性的高端人才需求。

Read More

什么是前向部署工程师?完整指南

本文是一篇全面介绍FDE的指南。FDE是直接与客户合作,针对具体业务挑战设计、定制、部署和优化技术解决方案的软件工程师。该角色结合了软件工程、系统架构、产品管理、技术咨询和客户沟通等职责,是公司工程团队与客户之间的桥梁。FDE与传统的产品开发软件工程师不同,前者专注于在客户现场落地和实施定制化解决方案,后者专注于构建通用产品。文章指出,Palantir、OpenAI、Scale AI、Anduril等公司推广了这一角色。FDE的核心职责包括了解客户需求、设计技术架构、构建定制化集成以及支持部署。所需关键技能涵盖编程、云平台、系统设计、数据库、API、DevOps等,其中系统设计能力是区分优秀和普通候选人的关键。FDE的薪酬具有竞争力,职业发展路径可通往解决方案架构师、技术主管或产品领导等岗位。文章还提供了面试准备建议和学习路径,强调沟通和咨询技能与技术深度同等重要。随着AI和云计算发展,FDE在帮助企业将复杂技术转化为业务成果方面将发挥关键作用。

Read More

2026年机器学习模型部署最佳实践——完整MLOps指南

本文由资深Python开发者兼数据科学家Naeemah Aliya Small撰写,系统阐述了2026年机器学习模型部署的完整最佳实践与MLOps生命周期。文章指出,ML部署与传统软件部署的核心区别在于模型对数据统计属性的第三维依赖,导致其会产生静默退化而非显式报错,且需要A/B测试、影子部署和金丝雀发布等在线实验验证。指南覆盖从模型打包、服务API构建、Docker容器化到模型监控的完整链路:在打包阶段,推荐使用MLflow模型注册中心替代脆弱的Pickle文件,并可通过ONNX实现跨框架可移植性;在服务层,使用FastAPI搭配Pydantic实现类型安全的模型服务;在监控环节,强调必须同时覆盖基础设施监控、预测分布监控和数据漂移检测三个层次,避免仅监控CPU/内存而忽视模型精度退化至61%的静默故障。文章详细对比了FastAPI、BentoML、TorchServe、TensorFlow Serving、Seldon Core、Ray Serve、ONNX Runtime七种主流模型服务框架的优缺点,并总结了部署就绪检查清单,涵盖模型版本化、输入验证、预测分布监控、数据漂移检测、回滚预案和CI/CD验证等12条检查项。核心理念是:可靠部署ML的团队并非拥有最优模型,而是将部署视为一等工程问题,通过版本化、自动化、可观测和可回滚的基础设施来保障生产稳定性。

Read More

Qwen3-32B本地部署实战:LoRA微调+vLLM推理+Docker交付

本文是一份针对阿里巴巴通义千问系列开源大模型 Qwen3-32B 的本地化工程部署与微调实战指南。文章围绕“LoRA 微调 + vLLM 推理 + Docker 容器化交付”这一技术路径,详细记录了从环境准备、模型下载与格式转换、Docker 镜像构建、vLLM 高性能推理服务上线、到基于 Swift 框架的 LoRA 领域微调及效果验证的完整流程。核心观点强调 Qwen3-32B 作为“甜点规模”模型,在 A100-80G 单卡上即可完成推理,双卡可实现高吞吐服务,且 MMLU、CMMLU 等评测稳居开源第一梯队。技术选型深度对比了 vLLM 与 TGI 的架构差异,指出 PagedAttention 机制使 32K 长文本推理显存占用比 TGI 低 58%,吞吐量高出 2.8 倍。在 LoRA 配置上,通过梯度分析锁定 q_proj 和 v_proj 为核心目标模块,并给出 balanced 方案(q_proj+v_proj+gate_proj+down_proj,rank=8)在显存占用 31.5GB 下实现 ROUGE-L 提升 4.1 的实测数据。文章还重点描述了 Docker 从零构建的可复现策略、应对冷启动的预热技巧、QWEN 官方 AWQ 量化加速方案,以及显存溢出、模型加载失败等血泪教训。本文面向面临模型本地化、业务定制与生产环境落地的工程师,提供了可复现、可迭代、可交付的完整工作流,具有极强的工程参考价值。

Read More

前線部署工程師 | Forward Deployed Engineer (FDE)

十论科技股份有限公司(Tricuss CO., LTD.)发布前线部署工程师(Forward Deployed Engineer, FDE)招聘公告。公司旗舰产品“企业级Co-researcher AI Agent”融合Agentic AI、大数据与物理模拟,结合物理基础数字孪生(Physics-based Digital Twins),为地端(On-premise)与封闭网络(Air-gapped)高资安客户提供最高千倍加速和减少70%实体实验的研发解决方案,已与NVIDIA、Qualcomm、Intel及世界顶尖半导体与AI服务器供应链客户密切合作。FDE作为核心技术与客户间的桥梁,需深入理解客户研发痛点,利用平台设计并部署定制化AI代理与工作流,负责系统集成(如Hadoop/Iceberg大数据生态)、AI检索架构优化、Prompt策略与多代理协作调优、PoC验证及产品反馈。岗位要求具备大型语言模型API(OpenAI、Anthropic)实战经验、Agentic Framework与RAG部署经验,以及B2B SaaS技术咨询或FDE/Solutions Architect背景,熟悉Python或TypeScript、云平台(AWS、GCP、Azure)与容器化技术(Docker、Kubernetes),掌握LangGraph、CrewAI、AutoGen等Agentic框架者优先,薪资60万至200万新台币/年。该职位体现了AI 2B场景下对既懂技术又懂业务的复合型FDE的迫切需求,是AI工程化与垂直行业深度融合的典型案例。

Read More

AI圈最火的新岗位FDE,到底是做什么的?

本文系统介绍了AI行业新兴岗位FDE(Forward Deployed Engineer,前线部署工程师)的定义、工作内容、招聘趋势及能力要求。文章指出,FDE是集全栈工程师、技术顾问和产品经理于一身的复合型人才,核心职责是深入客户现场,将AI技术转化为可落地的业务解决方案,打通从产品到应用的“最后一公里”。当前招聘FDE的企业主要分为三类:以OpenAI、Anthropic、字节跳动(豆包、飞书)、智谱华章为代表的大模型与AI科技公司;以德勤、埃森哲、飞书为代表的企业服务与咨询公司;以及联想等正在内部推动AI转型的传统企业。薪资方面,字节跳动FDE月薪3.5万至7万元(15薪),OpenAI FDE底薪21万美元起,LinkedIn数据显示2023至2025两年内全球FDE岗位增长42倍。文章还探讨了“一人公司”模式,即独立顾问以项目制方式为客户提供AI落地服务。FDE的兴起反映了AI行业从“模型竞赛”转向“落地战争”的大趋势,其理念借用Palantir的生存法则:不卖软件,卖结果。上海市政府相关政策已将FDE视为推动产业数智化转型的关键人才。文章最后给出了从技术和业务两个维度系统提升FDE能力的路径建议。

Read More