davidahmann

与「davidahmann」相关的文章

共 3 篇文章

评估与发布治理

本文介绍了《FDE指南》(前线部署工程师指南)中关于AI智能体系统评估与发布治理的框架。指南强制要求以证据为支撑的发布模型,适用于同时包含确定性代码和非确定性智能的智能体系统。核心机制包括一条不可篡改的完整性链(Integrity Chain),通过绑定特定版本的环境、行为和证据,确保生产系统与通过评估的系统一致。评估不再是一次性事件,而是由确定性模式验证到语义专家审核的分层检查。关键实体包括评估案例(Evaluation Case)、评估报告(Evaluation Report)、解决方案发布(Solution Release)以及发布门禁(Release Gates)。评估报告通过记录系统被测对象(SUT)的SHA-256摘要(如agent_system、behavior_bundle、tool_contract和runtime)来提供主要证据。解决方案发布清单必须绑定workflow_charter、data_context、threat_model和security_policy等完整交付上下文。发布流程遵循严格的门禁递进:Gate 0(设计)验证章程、价值案例和架构;Gate 1(沙箱)聚焦合约测试、授权和预算控制;Gate 2(影子模式)在无业务影响下测量真实数据表现;Gate 3(金丝雀)在有限分段中执行并配备主动终止开关。运营控制延伸到生产环境,通过持续监控和“验证者规则”(Verifier's Rule)进行治理,该规则宣称智能体的自主性上限取决于验证而非生成能力。每次生产故障都必须被分类为可复现示例和回归测试,使评估语料库随系统复杂性同步增长。整个体系为FDE(前线部署工程师)在管理智能体系统风险、确保安全有效交付方面提供了可操作的治理模板。

阅读全文

Agent 系统架构

本文出自 davidahmann 创建的 fde-guide 项目,专门为前线部署工程师(FDE)提供 Agent 系统架构指南。核心主张是将 Agent 视为运营软件中的组件,而非系统本身,通过显式边界和持久化状态来构建可控的系统。架构按 Harness、Loop、Graph 三层组织:Harness 层负责模型运行的安全上下文、工具、权限和沙箱;Loop 层管理目标、证据、反馈和重试等改进闭环;Graph 层定义节点、路由、审批和恢复等工作流逻辑。智能选择遵循“最小充分机制”原则,只在非结构化解释能带来可量化价值时才调用基础模型,否则优先使用确定性代码或经典 ML。指南还提供了 11 种参考蓝图,例如用于证据路径多变的 Bounded Retrieval Agent、需要策略约束与回滚的 Transactional Write Agent、以及处理多专业上下文的 Multi-Agent Coordinator 等。安全方面采用神经符号护栏,将概率模型推断与确定性领域逻辑结合,并强制实施最小权限、隔离和显式工具契约。对于多智能体系统,仅在数据权限、上下文或组织归属不相交时才被允许,协调通过 handoff-envelope 绑定身份、权限与预算。整个方案旨在将 Agent 架构从模型中心转向工程化、可验证的系统实践。

阅读全文

解决方案组合

本文介绍了由 davidahmann 开源的 FDE 指南(fde-guide)中的解决方案组合框架。该方案库为前线部署工程师(Forward Deployed Engineers,FDEs)构建可运营的 AI 系统提供了结构化组合框架,核心思想是基于业务决策、行业垂直属性和技术故障边界来选择与组合模式,而非从零构建。框架包含四个层次:业务流模式(Business-Flow Patterns),定义了异常解决、信号调查、风险优先处理和请求激活四类核心决策回路;垂直行业档案(Vertical Industry Profiles),针对医疗访问协调、金融服务调查和工业运营响应等场景提供特定领域的对象模型与监管约束;横向基础加速器(Horizontal Foundation Accelerators),针对集成运行时、安全 AI 工作负载、企业基础和部署运营等主要交付风险提供技术方案;以及智能选择层。文章还介绍了从意图到代码实体的映射方法,强调通过最小可行垂直切片实现可衡量的业务成果,是一套面向 AI 工程化落地的完整方法论与最佳实践集合。

阅读全文