大模型

Articles tagged "大模型"

10 articles in total

中国银河证券:FDE重构AI应用新范式 软件行业迎价值重估

中国银河证券发布研报,系统论述了前沿部署工程师(FDE)如何重构AI应用交付新范式,并推动软件行业价值重估。报告指出,FDE核心解决AI应用落地的“最后一公里”问题,本质上是将工程师前置部署到企业业务一线,通过现场探索与快速迭代将大模型等AI技术嵌入企业内部流程的新型深度交付体系,该模式最早由美国大数据公司Palantir提出,目前已被微软、OpenAI、Anthropic等大厂广泛采用。FDE兴起的产业背景包括:国产大模型如Kimi、DeepSeek持续迭代降低应用门槛,以及北京市于2026年7月出台《北京市关于加快智能体引领发展的若干措施》明确提出支持通过FDE等模式创新加速智能体应用落地。报告分析了FDE能解决的三个企业痛点:业务流程高非标化导致通用大模型无法适配、高敏感行业的数据安全与隐私壁垒、以及企业对大模型落地效果及投资回报率(ROI)的关注。最终研判认为,FDE将带来软件行业交付范式革命,推动商业模式从传统软件授权转向以ROI和使用效果为导向的全生命周期增量价值服务,使得行业know-how成为AI应用公司的护城河,部分软件公司将迎来价值体系重估并打开估值天花板。

Read More

FDE不是外包!Palantir净利润增长225%,带来了哪些希望?

2026年8月,Palantir发布二季度财报,营收19.35亿美元同比猛增93%,GAAP净利润10.62亿美元增长225%,Rule of 40达到惊人的155,一举打破企业软件低利润的刻板印象。本文深入拆解Palantir核心模式——FDE(Forward Deployed Engineer)并非外包,而是兼具咨询、实施与交付的驻场CTO角色,直接对业务效果负责。Palantir通过2023年发布的AIP平台和其内部Ontology本体论架构,将不同客户的定制需求沉淀为可复用的业务模板,让AI在严格安全护栏下直接执行决策,实现从token到经济价值的转化。获客上,Palantir以五天AIP Bootcamp工作坊实现“先看效果后签约”,累计超1300场,转化率近75%。文章还分析了其面临的威胁:Anthropic推出的Claude Cowork加上11款业务插件,从模型层向下直接调用SaaS数据和流程,与Palantir从数据层向上对抗的路径正面碰撞。CEO Alex Karp在股东信中尖锐批评模型公司意图夺取生产资料,强调企业AI主权。在Walgreens部署4000家门店AI工作流、Trinity Rail年省3000万美元、坦帕综合医院缩短脓毒症住院时间15%等案例证明,Palantir正将AI时代的企业服务做成高毛利高增速业务,但其高估值与中长期护城河可持续性仍充满争议。这对于国内模仿者如从模型转向FDE的百川智能,在缺少强模型生态的窗口下,提供了可借鉴的路径与警示。

Read More

前端部署工程师

该文章是 AI 自动化平台 Nanonets 发布的“前线部署工程师”招聘启事。Nanonets 专注于为金融、医疗、供应链等行业的业务流程提供基于人工智能的自动化解决方案,其客户包括 34% 的财富 500 强企业和超过 10000 家各类企业。该公司在 2024 年获得了由 Accel 领投、Elevation Capital 和 YCombinator 参投的 2900 万美元 B 轮融资,营收同比增长三倍。此次招聘的 Forward Deployed Engineer 将成为战略性 AI 初创客户的核心技术合伙人,贯穿从创意孵化、原型开发、生产环境部署到规模化扩展的全流程。具体职责包括:主动引导客户最大化基于 Nanonets 平台的业务价值,将客户需求转化为 PRD 和工作流等结构文档,与产品、工程和应用研究团队交叉协作确定优先级并监督交付,以及确保工作流在上线前通过端到端测试。岗位要求候选人拥有 5 年以上软件或机器学习工程经验,具备创业经历或创始人心态,精通 Python 和 JavaScript,深入理解人工智能与 LLM 最佳实践,能够基于 API 构建原型,并能端到端地解决复杂问题。这是一个远程职位,年薪范围在 8 万至 12 万欧元之间。该招聘启示不仅展示了 Nanonets 高速增长下的团队扩张需求,也具体描绘了 AI 部署工程师在技术与业务交汇处的真实职责画像。

Read More

在 JetPack 7.2 上部署 TensorRT Edge-LLM

本指南来自 Seeed Studio Wiki,完整记录在 NVIDIA JetPack 7.2 上部署 TensorRT Edge-LLM v0.9.1 的流程。TensorRT Edge-LLM 是 NVIDIA 面向嵌入式 Jetson 平台的大语言模型、视觉语言模型和多模态模型推理栈,本版本于 2026 年 7 月 31 日更新,官方支持 Jetson Orin 和 Jetson Thor。部署分两阶段:首先在 x86 GPU 主机(Ubuntu 22.04/24.04、CUDA 12.x/13.x、Ampere 以上 GPU)上克隆 TensorRT Edge-LLM v0.9.1,通过 `tensorrt-edgellm-export` 将 Hugging Face 上的 Qwen3-0.6B 检查点导出为 ONNX 计算图;随后将 ONNX 目录传输至 Jetson 设备,在 JetPack 7.2 与 CUDA 13.2 工具链下,使用 CMake 以 `jetson-orin` 或 `jetson-thor` 为目标构建 C++ 运行时和示例,然后运行 `llm_build` 从 ONNX 构建 TensorRT 引擎,并通过 `llm_inference` 进行推理,输出示例显示模型成功回答“The capital of the United States is Washington, D.C.”。指南详细说明了 Jetson Orin 支持的精度仅为 FP16、INT8、INT4,不支持 FP8 等更高精度,并强调 JetPack 6.2 的引擎不可直接复用。对于 INT4 量化,推荐使用 AWQ 或 GPTQ 预量化检查点并采用外部化权重选项以降低内存压力。此外,还提供了基准测试命令、与 JetPack 6.2 的差异对比以及常见故障(如 CMake

Read More

硅谷最热岗位落地中国,35岁程序员等来了黄金时代?

2026年7月发布的行业分析指出,硅谷最热的AI岗位——前沿部署工程师(FDE)正在加速落地中国,为35岁资深程序员带来职业转机。FDE负责把AI模型带入企业现场,将模糊的“用AI提效”需求翻译成可落地的智能体,要求既懂代码、系统、数据,又能理解业务和组织。硅谷方面,OpenAI和Anthropic均押注FDE模式并成立数十亿美元企业服务公司,LinkedIn数据显示2023年至2025年FDE岗位需求增长42倍。中国大厂迅速跟进:字节跳动“豆包AI大模型FDE”月薪3.5万至7万元,蚂蚁数科B端FDE月薪4万至6万元,智谱华章FDE负责人月薪6万至8万元。文章详细解读了Palantir作为FDE模式教父的运营机制,包括AIP Bootcamp和创纪录市值(逼近5000亿美元,2026年Q1收入16.3亿美元增长85%),美国陆军10年100亿美元协议和五角大楼13亿美元合同。中国有四类玩家争夺企业AI入口:云厂商(阿里云、百度智能云、火山引擎、腾讯云、华为云)、大模型公司(智谱华章、MiniMax、零一万物)、企业软件公司以及咨询机构。阿里云AI收入占外部收入30%且预计一年内超50%,百度在线广告下滑22%而AI云增长79%。案例显示,医药行业FDE需花一个月理解业务术语,用4个月将一线“街头智慧”复制为AI智能体。文章判断FDE是过渡性角色,但当前企业AI落地依赖这种“脚手架”,35岁程式员积累的沟通、架构和业务经验正成为溢价资本。

Read More

微软、字节、福特都在高薪招人 AI又衍生了一个新岗位

2026年7月,微软、字节跳动、Ford、AWS等全球科技巨头正同步转向一种新的人才策略:高薪招募前线部署工程师(FDE)。微软砸下25亿美元成立Frontier Company,抽调约6000名工程师派驻联合利华、诺和诺德等客户现场,微软商业业务总裁Judson Althoff公开承认“三年前做Copilot时只绑定OpenAI模型是个错误”,核心原因在于SaaS式的AI产品自助化远未跑通,企业不会用、不敢用,导致软件许可证成了摆设。另一边,Ford突然召回350名老工程师回来修复AI自动化设计系统,因为AI因缺少隐性工程经验(如特定焊接工艺)制造了海量错误造成质量滑坡,VP Charles Poon坦承以为引入AI就能产出高质量产品是对现实的误判;Ford为此补充了10万个AI自动化测试和40人QA团队。在国内,字节跳动为FDE开出每月3.5到7万的高薪,15薪下最高年薪达105万;阿里云智能FDE月薪也达到2到5万。LinkedIn报告显示,2023至2025年间全球FDE岗位发布量激增42倍,而同期AI工程师仅增长13倍,数据来源于平台发布基数。德勤发布的《2026中国制造业AI落地白皮书》显示91%的样本企业未达预期,证明企业落地AI的真正瓶颈不在于Token调用成本,而在于遗留系统对接、隐性知识缺失以及业务流程重组所需的人力服务;花旗和Adobe也已开始限制使用旗舰大模型以节省算力。文章核心论断是大厂账本算的是同一本,AI 2B的价值正在从“接口调用费”系统性转移到“人天服务费”,人的角色正从执行岗升级为打通AI与真实业务“最后一公里”的翻译官、调试官和管控岗。

Read More

前沿部署工程师(AI)- 广告(墨西哥)

FlexNova 发布了为广告行业(墨西哥)招聘 Forward Deployed Engineer (AI) 的职位信息,该职位将派驻客户侧,负责核心 AI 系统的大规模部署与成功落地。FDE 是连接底层 AI 基础设施与大型客户定制化需求的关键桥梁,需兼具软件工程、架构设计及现场实施能力。职责包括与团队共同部署并适配 AI 解决方案,确保 API 融入客户工作流;制定符合安全、数据隐私(如个人身份信息脱敏)与大语言模型成本控制的部署标准;识别重复客户需求并开发内部库、SDK 或自动化工具;与产品经理合作进行技术深度分析以挖掘常规指标可能遗漏的痛点。任职要求具备 Python、Node.js 及现代 AI 编排框架(如 LangChain、Semantic Kernel、AutoGPT)的实战经验,深刻理解向量数据库、嵌入模型以及提示工程(少样本、思维链等),能驾驭复杂的企业级身份认证(OAuth、SAML)并打通异构数据孤岛(SQL、NoSQL、ERP),还需构建评估框架以衡量 LLM 性能、幻觉率和延迟。该职位由总部位于纽约的 Truelogic 公司发布,提供 100% 远程工作、以美元计价的竞争力薪酬及带薪休假,面向拉丁美洲高端技术人才。

Read More

前部署工程师(Forward Deployed Engineer)

这是一则发布于 2026 年 7 月 2 日的 Forward Deployed Engineer 招聘启事。该全职岗位由猎头/人力资源公司 morgan pinnacle group 代表一家成立于2023年、拥有约25名员工和$25M风投资金的AI初创公司在美国旧金山发布。工作地点要求每周五天现场办公,但提供签证担保并考虑异地搬迁支持。该岗位年薪为 $175,000 至 $235,000 美元,附加 0.08% 至 0.15% 的股权。 核心职责包括端到端负责高价值客户的参与实施,收集客户需求并据此设计 AI 自动化方案融入现有工作流,开发客户特定的功能与集成模块且最终沉淀为核心平台产品。岗位高度强调与客户、产品、工程及客户成功团队的紧密协作,要求在快节奏创业环境中交付生产就绪的解决方案。 技术栈方面,必备 Python 和 TypeScript 的深厚功底,特别是需要拥有使用大语言模型(LLM)和 AI Agents 构建生产软件的实际经验。候选人需具备 2-4 年 FDE 或具备客户导向经验的后端工程师背景,应有VC支持的AI初创公司或充裕资金的技术公司履历。优先考虑曾有创始工程师或早期创业经历的候选人,强调其解决客户问题的热情尤胜于单纯的内部平台开发。该岗位是观察 AI 2B 前端部署角色在就业市场中定位、薪酬体系和技术演进方向的典型样本,直接反映了行业对能将 AI 能力快速落地到真实业务场景的工程人才的迫切需求。

Read More

前场部署工程师,AI赋能(UR和MiR,North Reading, MA)职位详情

Teradyne 于 2026 年 7 月 2 日发布了一则 FDE 前线部署工程师 AI 赋能方向的招聘信息,工作地点位于美国马萨诸塞州 North Reading。该职位隶属于首席人工智能官(Chief AI Officer)领导的 AI 转型团队,核心使命是通过 AI 增强工作流来增强员工能力,并将智能嵌入关键业务流程。FDE 需利用 Microsoft Copilot Studio/Foundry、LangChain、LlamaIndex 等现代平台,设计并部署 AI 增强工作流,构建自然语言界面和对话式 AI 系统,并与销售、工程、运营、财务和产品团队合作,将 AI 能力转化为可衡量的业务价值。职位要求 3-5 年软件工程经验,熟练使用 Cursor、OpenAI Codex、Claude Code 等 AI 原生开发工具,并具备全栈开发能力。此外,具备智能体 AI 框架(如 OpenClaw、LangGraph)、本地模型推理(Ollama)、MCP、RAG 架构及向量数据库等经验者优先。该岗位薪资范围为 169,700 至 271,500 美元,体现了 Teradyne 对 AI 前线部署人才的高度重视。

Read More

打造克制、好用的 AI 产品。

VerySmallWoods 博客首页聚合了2026年6月9日至13日的AI领域重要资讯与独立开发实践。内容涵盖智能体主动性突破:Simon Willison 观察到 Claude Fable 5 展现出“ relentlessly proactive ”的自主调试能力,通过注入诊断代码、自主创建HTTP服务、跨浏览器截图验证来修复滚动条bug,标志着有意图的多步自纠智能体行为;Google DeepMind 提出“模型 diffing ”新范式,让审计智能体主动构造 prompt 搜索模型间行为差异,推动评估方法升级。基础设施层面,Google Cloud 发布 Open Knowledge Format,以带YAML frontmatter的Markdown为AI结构化知识建立开放标准;OpenAI 收购 Ona 为 Codex 补足持久化云端执行环境,使Agent在电脑离线后仍能在企业云中持续运行。同时,Anthropic 推出企业订阅 Claude Corps 并联合 DXC 进军受监管行业;AWS 开源 Agent-EvalKit 系统化评估Agent全链路表现;Google 发布扩散架构文本生成模型 DiffusionGemma 和一行SDK启动的 Gemini Managed Agents;开源模型方面,Gemma 4 12B无编码器多模态模型可在16GB显存本地运行,GLM-5.2 在编程能力上表现顶尖。此外,博客还介绍了自研产品 AirType 语音转文字工具、Sessionly Claude Code 会话管理器,以及多门付费课程如 LangChain 智能体开发、MCP 协议实战等,体现了从AI前沿追踪到轻巧工具制作的完整独立开发实践链路。

Read More