GitHub

Articles related to "GitHub"

5 articles in total

前置部署工程师 — Agentforce 编排 - 柏林

本招聘信息由 Salesforce 发布于 myAbility.jobs 平台,工作地点包括柏林、杜塞尔多夫和斯图加特,职位为前线部署工程师(Forward Deployed Engineer),专门负责 Agentforce 编排与运营。该角色属于动手能力强的技术构建者,需在企业客户环境中设计、构建并部署企业级代理 AI 解决方案。Agentforce 负责驱动多智能体编排层,能将混乱的运营工作流、非结构化数据(如电子邮件、PDF、规格表)以及遗留 ERP 日志转化为具有人在回路(humans in the loop)的自主执行引擎。候选人将在敏捷部署小组中工作,与部署策略师和专业 AI 工程师合作,作为连接高级 AI 代理与更广泛企业技术格局的关键纽带。日常工作包括:编写生产代码、构建实时数据接地系统(采用 RAG、向量数据库和知识库)、进行提示工程管理、实施多智能体通信协议(含模型上下文协议 MCP),以及部署自动化供应链和后台工作流。要求具备三年以上软件工程或技术交付经验,并至少有一个生产级 AI、数据工程或企业集成系统成功部署;精通 Python、JavaScript/TypeScript、Java 或 Apex;具备 LLM 编排、RAG 管道、向量搜索索引及知识库检索器的实践经验;掌握 API 设计(REST/SOAP/Webhook)及现代代理协议;需有 25% 至 30% 的出差意愿。优先考虑具备供应链、制造或物流执行领域专业知识,或熟悉 Salesforce 生态系统(如 Agentforce Specialist、Data Cloud、Apex)的候选人。

Read More

TensorRT Model Connect - 开源模型部署工具,两命令转C+

TensorRT Model Connect(TRTMC)是 NVIDIA 于 2026 年 8 月 18 日以 Apache-2.0 协议在 GitHub 开源的一款模型部署工具,旨在将 Hugging Face 或本地模型检查点直接转换为原生 C++ 推理引擎。开发者仅需 `trtmc build` 和 `trtmc run` 两条命令即可完成部署,全程无需导出 ONNX 中间格式,构建产物为版本化的 .bundle 文件,运行时完全脱离 PyTorch 环境。该项目由 OpenAI Codex Agent 在人类监督下构建,代表了 AI 辅助开发部署工具的范式转变。TRTMC 提供覆盖 105 个模型系列、76 个模型家族的参考实现,包括 Qwen、Llama、Mistral、DeepSeek 等主流开源大语言模型以及 Whisper 语音模型。性能验证方面,在 GB300 快照测试中,102 个 profile 的推理性能较声明基准提升超过 5%。其技术架构将构建阶段与运行时解耦,提供统一的 C++ 任务 API(generate、transcribe、embed 等),并支持 NVIDIA 全系列 GPU(如 A100、H100、Jetson),可实现云端到边缘的全场景部署,适用于大模型推理服务、边缘 AI 推理、C++ 应用集成与模型快速评估。该工具通过版本化 .bundle 天然支持模型回滚与灰度发布,为生产环境提供了高一致性的交付单元。

Read More

davidahmann/fde-guide

FDE Guide 是由 davidahmann 创建的一个面向 Forward Deployed Engineers (FDEs) 和内部应用 AI 团队的技术框架与工程套件。其核心目标是将模糊的操作性问题转化为受支持、可测量且持续运行的 AI 服务。该指南采用三层深度架构:指南层面向领导者、学习者和架构师,提供思维模型、原则和能力路线图;手册层面向一线 FDE,包含生命周期操作手册和人类可读库;工程套件层面向工程师和运维,提供 JSON Schema 模板和可执行参考系统。整个方法建立在“价值工程”哲学之上,强调以被接受的结果为产品,代币仅是输入,自主性仅为设计选择,并通过 12 Factors of AI Value Engineering 将价值契约工程化。仓库采用“Validation-as-Code”设计,内置 Node.js 测试套件,不仅校验代码正确性,还强制治理完整性,如确保每个发布清单关联有效的评估报告。核心工件包括 catalog.json 作为受治理工件注册表,llms.txt 作为文件索引,AGENTS.md 定义 AI 代理修改仓库的规则。环境要求 Node.js ≥ 22,通过 npm ci 和 npm test 验证本地环境。该仓库为 AI 部署工程师提供了一套从原则到自动化验证的端到端实践方法。

Read More

Needle 2 发布:仅 14MB 的超轻量级基础模型,赋能端侧 AI 应用

cactus-compute 在 GitHub 开源了名为 Needle 2 的超轻量级基础模型,模型体积仅为 14MB,专门针对手机、可穿戴设备、智能家居和机器人等资源受限的小型设备优化。该模型的核心竞争力在于极致轻量化,14MB 的大小使其能轻松装入大多数嵌入式设备的闪存,甚至能在高端微控制器的 SRAM 中运行,极大降低了对存储空间和运行内存的要求。Needle 2 支持在端侧直接部署,无需依赖高带宽云端计算,为边缘计算提供了极具竞争力的基础架构。主要应用场景涵盖移动与可穿戴设备(如智能手机和智能手表)、智能家居(传感器、智能开关)以及机器人领域,为小型机器人提供本地化模型支持,以实现更快响应和更高隐私安全。Needle 2 的出现标志着端侧 AI 进入精细化阶段,为 AIoT 普及提供低门槛起点,并通过本地数据处理保障隐私,可能引发行业对模型小型化技术路径的重新关注,推动更多针对边缘计算优化的算法架构诞生。

Read More

Microsoft Frontier 想要 6,000 名 FDE。Palantir 培养了其中约 800 人。

2026年7月,AI行业的前向部署工程师(FDE)人才争夺战白热化。微软宣布成立Frontier公司,投入25亿美元,计划配备约6000名工程师和行业专家嵌入企业客户,但主要来自内部现有团队和埃森哲、安永等联盟的整合,外部净增职位未披露。此前AWS承诺10亿美元组建FDE团队,OpenAI和Anthropic分别与私募股权及咨询公司成立合资企业,估值高达15亿美元。Palantir作为FDE模式的发明者,拥有约800名FDSE,成为全行业的人才培训基地,其薪酬带宽为17.1万至29.5万美元,中位数21.1万美元。全市场FDE平均总薪酬已达23.8万美元,顶级薪酬48.6万美元,职位需求年增长800%。由于不同公司使用不同的头衔(如Forward Deployed Software Engineer、Applied AI Engineer、Solutions Implementation Engineer等),仅靠职衔搜索已无法覆盖人才池。文章指出五个主要人才来源:Palantir前员工、四大咨询公司的Palantir认证顾问、微软Frontier早期客户(伦敦证券交易所集团、Land O'Lakes、联合利华、诺和诺德)的嵌入工程师、20-100人规模的精品AI咨询公司(如已被OpenAI收购的Tomoro),以及GitHub上从事Snowflake、Databricks、Airflow、SAP、NetSuite、Salesforce Apex和IBM iSeries等企业集成工作的工程师。Bob McGrew强调,前10名FDE决定产品形态,创始人应将其视为产品招聘。OpenAI Deployment Company与TPG、Advent、Bain Capital、Brookfield等19家投资方合作,Anthropic Venture与Blackstone、Hell

Read More