行业动态

打造克制、好用的 AI 产品。

Key takeaway: VerySmallWoods 博客首页聚合了2026年6月9日至13日的AI领域重要资讯与独立开发实践。内容涵盖智能体主动性突破:Simon Willison 观察到 Claude Fable 5 展现出“ relentlessly proactive ”的自主调试能力,通过注入诊断代码、自主创建HTTP服务、跨浏览器截图验证来修复滚动条bug,标志着有意图的多步自纠智能体行为;Google DeepMind 提出“模型 diffing ”新范式,让审计智能体主动构造 prompt 搜索模型间行为差异,推动评估方法升级。基础设施层面,Google Cloud 发布 Open Knowledge Format,以带YAML frontmatter的Markdown为AI结构化知识建立开放标准;OpenAI 收购 Ona 为 Codex 补足持久化云端执行环境,使Agent在电脑离线后仍能在企业云中持续运行。同时,Anthropic 推出企业订阅 Claude Corps 并联合 DXC 进军受监管行业;AWS 开源 Agent-EvalKit 系统化评估Agent全链路表现;Google 发布扩散架构文本生成模型 DiffusionGemma 和一行SDK启动的 Gemini Managed Agents;开源模型方面,Gemma 4 12B无编码器多模态模型可在16GB显存本地运行,GLM-5.2 在编程能力上表现顶尖。此外,博客还介绍了自研产品 AirType 语音转文字工具、Sessionly Claude Code 会话管理器,以及多门付费课程如 LangChain 智能体开发、MCP 协议实战等,体现了从AI前沿追踪到轻巧工具制作的完整独立开发实践链路。

Key Takeaways
  1. Claude Fable 5 展现出自主诊断代码、自建诊断服务、跨浏览器验证的主动多步纠错能力,被Simon Willison记录为“ relentlessly proactive ”行为。
  2. Google DeepMind 提出“模型 diffing ”评估新范式,由审计智能体自主生成prompt对比两个模型的行为差异,改变传统静态评估方式。
  3. OpenAI 收购 Ona,为 Codex 构建持久化云端执行环境,使Agent在用户离线后继续在自有云中执行任务,推动Agent迈向生产级。
  4. Anthropic 发布企业订阅产品 Claude Corps,并与DXC合作进入合规要求严格的受监管行业,加速Claude的商业落地。
  5. Google 同时发布扩散架构文本生成模型 DiffusionGemma、Managed Agents 沙箱服务以及机器遗忘审计框架,形成模型-运行-安全完整方案。
  6. 开源模型进展:Gemma 4 12B 可在16GB显存本地运行多模态任务;GLM-5.2 在编程能力评测中跻身全球顶尖,展示出开源阵营的强劲竞争力。
  7. 博客主理人同步开发多款独立产品,包括 AirType 语音转文字工具、Sessionly 会话管理器以及 MCP 与 LangChain 系列课程,实践轻量级AI产品方法论。
当大多数AI资讯号还在追逐单点模型性能时,VerySmallWoods这期页面呈现出一种难得的系统性视角。它把智能体的主动性突破、模型评估新范式、基础设施开放标准三条线索编织在一起,清晰地勾勒出AI Agent走向生产级的关键拼图。更难得的是,主理人并非只做信息搬运,而是同步交付了AirType、Sessionly等独立工具以及MCP系列课程,这种“追踪前沿+亲身下场”的实践密度,对正向工程化转型的前线部署工程师来说极具启发。推荐每一位关注Agent落地和独立Build的读者细读这组动态。

Claude Fable 5 展现出自主诊断代码、自建诊断服务、跨浏览器验证的主动多步纠错能力,被Simon Willison记录为“ relentlessly proactive ”行为。

—— 络石智能编辑部 · Editor's Pick

打造克制、好用的 AI 产品。

分享实用 AI、轻巧工具和创作型工作流。

博客

最新文章

【AI早读 0613】智能体主动性飞跃与模型评估新范式

2026年6月13日今天聚焦智能体的两个方向加一个底层动向:Simon Willison 记录 Claude Fable 5 的“relentlessly proactive” —— 为查一个滚动条 bug 自主注入代码、自写诊断 HTTP 服务、跨浏览器截图验证,是有意图的多步自纠探索;Google DeepMind 提出“模型 diffing”新范式,让审计智能体自主构造 prompt 主动搜索两个模型的行为差异;Google Cloud 发布 Open Knowledge Format,用带 YAML frontmatter 的 Markdown 为 AI 的结构化知识建开放标准。能力、评估、基础设施三条线正拼成智能体开发的完整图景。AI DailyAI AgentClaude Fable 5模型评估阅读全文 →

2026年6月12日

【AI早读0612】OpenAI收购Ona为Codex构建持久化Agent执行环境

今天的主线是 AI Agent 正在走向“生产级”:OpenAI 收购 Ona,给 Codex 补上持久化云端执行 —— 电脑离线后 Agent 仍能在企业自有云里接着跑。Google Cloud 用 TEE 推出 Confidential AI 保护推理数据;Anthropic 发布企业订阅 Claude Corps 并联合 DXC 进入受监管行业;AWS 开源 Agent-EvalKit 系统化评估 Agent 全执行链路;再加 DeepMind“模型察觉被评估反而表现更差”的研究与多 Agent 安全投资。

AI DailyOpenAICodex

2026年6月11日

【AI早读 0611】Google AI 三连发:DiffusionGemma、Managed Agents 与 ML 遗忘审计

Google 昨天一天连发三项:用扩散架构把文本生成提速 4 倍的 DiffusionGemma、一行 SDK 背后拉起 4 vCPU 沙箱的 Gemini Managed Agents,以及给「机器遗忘」做置信度评估的审计框架。再加上 GitHub Copilot CLI 接入 LSP 拿到语义级代码理解,以及 Simon Willison 对 Claude Fable 5「静默拒绝」推理策略的观察。

AI DailyGoogleDiffusionGemma

2026年6月10日

【AI早读 0610】Claude Fable 5 全平台上线,Gemma 4 12B 开源本地多模态

6 月 9 号是今年最密集的 AI 发布日之一:Anthropic 正式放出前沿模型 Mythos 5 与消费版 Fable 5,强项在超长上下文 agentic coding,但定价翻倍、普通用户感知有限,并同步上架 Google Cloud。Google DeepMind 开源 Gemma 4 12B 无编码器多模态模型,16GB 显存即可本地跑。OpenAI 连发 Codex 企业落地案例,AWS 放出两篇 agent 实践,Cloudflare 分享前沿模型攻击的防御架构。

AI DailyClaude Fable 5Gemma 4 12B

2026年6月9日

【AI早读 0609】OpenAI 连续发布金融行业 AI 实战案例

OpenAI 集中上线了一批 Ignite 大会演讲:方案工程师讲企业级 AI 落地框架 - 把 AI 当工作流里的一个可控节点而非独立智能层;GTM Lead 谈金融服务的特殊诉求,已从“帮我们分析数据”变成“嵌入实时交易决策链”;Erste Group、LSEG、Allica Bank 三家银行客户分享了平台层整合、数据协同和挑战者银行的差异化打法;另有两场从产品增长和人力杠杆角度切入 AI 的实践。

AI DailyOpenAI金融科技

合作伙伴CompeteMap — 英国及爱尔兰学生竞赛一站式搜索数学、编程、科学、写作等各类竞赛信息汇总,支持按年龄和科目筛选,再也不错过报名截止日。了解更多 →

实时

最新动态

★ 值得深读

  • datasette 1.0a34· Simon Willison ↗
  • — a still that plays· Simon Willison ↗
  • [AINews] GLM-5.2: the top Frontend Coding model in the world, IndexShare for Speculative Decoding · Latent Space ↗

⚡ 实时速递

  • GLM-5.2 (max) is currently the third best model available, across both open and proprietary.· r/LocalLLaMA ↗
  • The founder's playbook: Building an AI-native startup· Hacker News (front) ↗
  • 林俊旸新公司卜拉格亮相!首轮估值135亿,腾讯高榕红杉全投了· 量子位 ↗
  • Grok 4.3现已在Amazon Bedrock上正式可用· 量子位 ↗
  • 头部具身大脑公司再获数亿美元融资!世界模型路线,15家VC抢着投· 量子位 ↗

视频

最新视频

HyperFrames 入门 | 一句话,让 AI 用 HTML 渲出一条视频(全程不写代码 · 真实演示)

【Loop Engineering 循环工程】从理论到实践,它真的适合每个人吗?

【茶社AI早读】0612 | OpenAI 收购 Ona、价格战开打、Google 三连发 - 9 条今日 AI 资讯速览

B站

五里墩茶社

更多中文视频内容与课程

产品

产品与服务

LangChain智能体开发

CaiCai App

MCP开发从入门到实战

书籍人民邮电出版社出版,系统讲解 MCP 协议与实战开发。人民邮电出版社MCP 协议详解

n8n入门

MCP极简入门

课程B站付费课程,用最简洁的方式理解 MCP 协议。B站课程MCP 协议

AirType

产品你的思考速度是打字的 4 倍——AirType 让你用说的代替打的。macOS 菜单栏常驻,任意应用中按住快捷键说话,AI 自动润色成干净文本。语音转文字macOS 菜单栏

Sessionly

产品Claude Code 会话历史浏览器,可视化查看和管理 CLI 会话记录。Claude Code会话管理

YouTube 频道会员

最近一封 · Sample

【AI早读 0613】智能体主动性飞跃与模型评估新范式

“今天聚焦智能体的两个方向加一个底层动向:Simon Willison 记录 Claude Fable 5 的“relentlessly proactive” —— 为查一个滚动条 bug 自主注入代码、自写诊断 HTTP 服务、跨浏览器截图验证,是有意图的多步自纠探索;Google DeepMind 提出“模型 diffing”新范式,让审计智能体自主构造 prompt 主动搜索两个模型的行为差异;Google Cloud 发布 Open Knowledge Format,用带 YAML frontmatter 的 Markdown 为 AI 的结构化知识建开放标准。能力、评估、基础设施三条线正拼成智能体开发的完整图景。”

—— william

Letters

来信

里面装的是

  • 新文章 — 写完一篇就寄一封,不攒货
  • 这周读到的、看到的、好用的工具
  • 正在折腾的实验,附带翻车记录

约莫 1–2 周一封 · 随时退订

Email寄给我→

Tags

Related Topics

Expert Comment

This article is curated by the editorial team from public sources for reference only.

Related Articles

亚马逊投资10亿美元设立新岗位。以下是该岗位的工作内容。

2025年,Amazon 在第二季度财报电话会议上宣布,将投资 10 亿美元组建 AWS Forward Deployed Engineering 团队。这是一支全新的 AI 工程师队伍,核心工作模式是直接嵌入客户组织内部,协同客户在“几天而非几个月”内构建和启动智能体 AI 系统。该报道来自 Business Insider,指出此举不仅凸显了 Amazon 在企业级 AI 落地上的激进投入,更标志着前线部署工程师(FDE)这一曾由 Palantir 率先推广的小众角色,已迅速崛起为科技行业最炙手可热的岗位。文章援引 Indeed 数据称,自 2025 年 1 月以来,FDE 岗位的招聘公告数量激增,Anthropic、OpenAI、Palantir、Stripe 和 Google Cloud 等顶级科技公司均在大力扩招这一角色。FDE 的核心价值在于将工程师从后端研发推向客户一线,直接根据客户的独特业务需求定制软件,解决标准化产品无法覆盖的复杂场景。这一趋势深刻反映了企业 AI 竞争的重心正从模型能力本身,转向快速部署、深度定制和现场交付的综合工程能力。

Read More

AWS的10亿美元押注前线部署工程师,标志着企业AI进入下一阶段

2026年7月,AWS宣布了一项10亿美元的巨额投资,计划构建一个专门的前向部署工程师(Forward Deployed Engineering, FDE)组织,将数千名AI工程师直接嵌入到客户组织内部,与客户团队合作构建生产级AI系统。作者Michael Preston指出,这一战略决策标志着企业AI领域的竞争重心,正从基础设施采购(如GPU、模型API)转向工程执行。文章分析认为,当前企业AI项目失败的根源,已不再是模型准确率问题,而是系统集成、工作流重塑、身份管理、安全合规与遗留系统对接等复杂的工程和组织挑战。AWS此举旨在销售“运营能力”而非单纯的技术,目标是在金融服务和政府等受监管行业建立客户独立自足的能力,而非长期依赖。在微软Azure、Google Cloud等基础设施能力日益同质化的背景下,文章进一步判断,难以被商品化的工程交付能力将成为云厂商新的差异化护城河。这也将改变企业AI的人才需求结构,促使市场需要更多集分布式系统、安全、数据工程于一体的复合型人才。这一战略对传统技术咨询市场也将产生深远影响,可能压缩其部分价值链。整个判断表明,企业AI正进入一个以执行和系统整合为核心的新阶段,未来赢家可能不只是拥有最强模型的公司,而是能持续将AI原型变为可靠生产系统的公司。

Read More

AWS 宣布成立 10 億美元 FDE 組織,跟進 OpenAI 與 Anthropic 搶攻企業 AI 部署市場

Amazon Web Services (AWS) 宣布投入 10 亿美元内部资源,成立专属的前端部署工程师 (Forward-Deployed Engineer, FDE) 组织,由工程师直接驻点客户企业现场构建 AI 代理系统。AWS Frontier AI 副总裁 Francessca Vasquez 强调,团队目标是交付解决方案的同时,确保客户获得自主运作 AI 的能力。这是继 OpenAI 与 Anthropic 之后,第三家在同一季度成立大规模 FDE 组织的头部 AI 厂商,AI 三强各自建立了规模超 10 亿美元的现场部署能力,但结构差异显著。OpenAI 与 Anthropic 均选择与私募股权机构成立合资公司,规模分别约 40 亿美元和 15 亿美元,借助私募伙伴的资本和客户网络;AWS 则完全内部自建,利用自身在财富 500 强中极高的云服务渗透率,直接在现有客户关系上深化部署。FDE 模式由 Palantir 首创,核心是工程师进厂定制化交付,成功后迁移成本极高,形成深度锁定。AWS 选择自建的另一战略价值是数据主权:FDE 过程中积累的客户工作流洞察与使用数据将全部留存在亚马逊体系内,用于优化 Amazon Bedrock 等 AI 基础设施。这一竞赛凸显出当前企业 AI 采用的结构性缺口——模型能力差距缩小,但将 AI 融入实际工作流程的工程能力极度缺失,服务交付能力正成为新的竞争护城河。

Read More

独家解读丨花百亿建「FDE团队」:AWS 们在走 BAT 云「定制化」老路吗?

2026年,云巨头AWS投入10亿美元组建数千人的FDE(前线部署工程师)团队,以“嵌入式AI工程师”身份进入客户现场,帮助企业落地AI Agent和生产系统。谷歌、OpenAI、Anthropic、Meta等也纷纷设立FDE岗位,总投入超数百亿元人民币;国内阿里巴巴、字节跳动、腾讯等同样组建了驻场团队。文章分析了新一代AI驻场服务与传统云时代定制化驻场的本质区别:AWS的FDE以交付“语义层”和“知识图谱”为核心,而非应用层定制代码;打破按人头计费模式,采用基于固定结果的增量计费;并制定“AI-45法则”将驻场周期控制在数周内。然而,由于AI技术迭代快、产品不成熟、复合型人才稀缺及客户期待复杂,FDE项目仍面临烂尾风险。国内FDE岗位更是遭遇客户不愿溢价付费、行业低价竞争的困境,被视为IT施工队,甚至出现“岗位烂尾”现象。文章指出,云大厂从MaaS走向CaaS,通过FDE为未来算力消耗“买路”,但此举不仅冲击了埃森哲、麦肯锡等传统IT咨询外包巨头,还可能为Lambda Labs、CoreWeave等NeoCloud新云厂商做嫁衣,因为它们可能凭借灵活的Token Factory模式在未来竞争中占据优势。

Read More

$9B in 90 Days: Why AI Vendors Now Want Engineers in Your Office

2026年4月至7月,全球五大AI厂商在90天内累计承诺超过95亿美元用于解决企业AI部署最后一公里问题,标志着AI行业从模型竞赛转向部署能力竞赛。微软于7月2日宣布成立Frontier Company,投入25亿美元组建6000人的工程师团队嵌入客户现场;AWS于6月30日承诺10亿美元建立Forward Deployed Engineering部门,以5-6人小组进行45天驻场部署;OpenAI于5月联合TPG、Advent International、Bain Capital、Brookfield等私募基金推出超40亿美元的The Deployment Company;Anthropic同月与Blackstone、Hellman & Friedman、Goldman Sachs成立15亿美元合资企业;Google Cloud于4月宣布7.5亿美元合作伙伴基金。根据MIT、McKinsey、RAND和Gartner的研究,73%至95%的企业AI试点未能产生可衡量结果,模型本身并非瓶颈,关键在于将AI能力转化为实际业务流程变革。文章指出,Palantir十余年前开创的FDE模式正被全行业采纳,并分析了三种部署结构模式:微软和AWS的内部军队模式、OpenAI和Anthropic的PE支持合资模式、Google Cloud的合作伙伴生态模式,每种模式在数据可移植性、基础设施依赖性、知识保留和退出难度方面存在不同权衡。文章还提供了AI部署模型决策矩阵和90天部署准备清单两个实用框架,并预测到2026年Q4总部署投入将超过150亿美元,但行业失败率短期内难以显著改善。

Read More