AMD

Articles related to "AMD"

4 articles in total

借助AMD Vitis AI的GStreamer加速边缘AI流水线

本文介绍如何使用 AMD Vitis AI 和 VVAS 工具链加速边缘 AI 视频分析流水线的开发与部署。文章从端到端视角剖析了从训练好的 PyTorch/TensorFlow 模型到在第二代 Versal AI Edge 系列自适应 SoC 上实时运行 NPU 推理的完整流程。核心工具包括:AMD Quark 量化工具支持 BF16、FP16 和 INT8 精度模式,并可通过混合精度解决 YOLO 等模型后处理的精度损失;Vitis AI 编译器自动完成算子融合、内存调度及 CPU/NPU 分区,支持数据并行和张量并行;ONNX Runtime + Vitis AI Execution Provider 和原生 VART-ML 运行时分别适配快速原型与量产级零拷贝执行。在视频流水线集成侧,基于 GStreamer 的 VVAS 通过插件(vvas_xinfer、vvas_xoverlay 等)及 JSON 配置,编排采集、预处理、推理、后处理与渲染,并原生支持空间分区、时间共享和 DMA-BUF 零拷贝等高级部署特性。文中以 YOLOX 检测示例演示了单条 gst-launch 命令即可描述完整流水线。预构建 Docker 镜像和 VEK385 评估板启动镜像使上手时间缩短至数分钟,Python/C++ API 覆盖从原型到量产。这些能力可使团队将更少时间花在底层集成上,更多聚焦于应用开发与性能优化。

Read More

Muse Glimmer 介绍:一款可在你的设备上运行的开源智能体模型

Meta AI Research 正式发布了名为 Muse Glimmer 的开源智能体模型,并将其权重在 Apache 2.0 许可下开源。Muse Glimmer 是一个拥有 300 亿参数的模型,专门为始终在线的本地智能体工作流优化,设计目标是能在搭载单个消费级 GPU 的 Mac 或 PC 上运行。该模型旨在实现本地智能体、函数调用、本地编码及 LLM 作为评估器等用例。在训练层面,Meta 采用了紧凑的架构设计,通过基于 Muse Spark 输出的逻辑蒸馏进行预训练,并在中期训练阶段引入更长上下文和带有丰富推理痕迹的数据,最后结合监督微调、在线策略蒸馏和强化学习进行后训练。在性能上,Meta 宣称 Muse Glimmer 在同尺寸模型中表现强劲,与 Gemma4-31B 和 Qwen3.6-27B 等模型相比,具备可靠的端到端任务完成、多步推理、失败恢复及多模态输入输出能力。为了在消费级硬件上实现实用的运行速度,Meta 采用了约 4-bit 的量化技术压缩权重,并引入基于 DFlash 的轻量级推测解码起草模型,能在无损质量的前提下显著提升生成速度。该模型目前在 Hugging Face 提供下载,并将通过 Ollama、LM Studio 等合作伙伴集成,支持 llama.cpp、MLX 和 ExecuTorch 等边缘框架,同时正与 AMD、Arm、Dell、Intel 和 NVIDIA 等硬件厂商合作优化全设备性能。

Read More

云端token爆发后,端侧算力起步:智能体一体机迎来六路玩家

本文深度剖析了2026年6月智能体一体机市场的最新竞争格局与产业逻辑。随着云端AI Token爆发,本地端侧算力需求正式起步,一个全新的硬件品类——智能体一体机正在成型。文章定义了该品类的核心形态:一种搭载较强本地显卡算力(通常为128GB显存),能支撑3-5人小团队或超级个体本地运行模型和智能体的桌面级主机,售价在1.8万至3.3万元区间。目前市场形成了四种技术路线:苹果Mac Mini方案、NVIDIA的DGX Spark及与联发科合作开发的RTX Spark方案、AMD锐龙AI Max+ Windows主机方案,以及低价低功耗的Intel N97网关方案。文章重点复盘了前两次AI硬件“退货潮”的教训——2025年DeepSeek一体机因有算力无应用而被闲置,2026年MacMini因用户跟风购买OpenClaw却没有具体工作需求而退货,指出当前第三波热潮的理性之处在于:经过迭代的Agent能力已达“大学生”级别,真正开始解决具体、高频、重复的实际工作任务(如律师知识检索、零部件销售报价、财务发票计税)。产业面临的核心挑战是“高不能低不就”:端侧算力场景不如云端丰富,单卡算力有限,但2.3万元以上的高价让普通用户望而却步。六路入局玩家(传统PC厂、芯片厂、AI初创、行业方案商、通用方案商、跨界者)的差异化在于软件生态,谁能提供开箱即用的智能体工作流(如企业知识库、法务财务Agent),谁就能在竞争中胜出。

Read More

AI Forward Deployed Engineer

Zip公司于2026年6月25日发布AI Forward Deployed Engineer(AI前线部署工程师)职位招聘。Zip是一家企业采购AI平台,客户包括OpenAI、AMD、T-Mobile、Mars、Dollar Tree等,已帮助企业节省超80亿美元,处理超5000亿美元支出。公司由Adams Street、Alkeon、BOND、CRV、DST、Tiger Global、Y Combinator等投资,累计融资3.71亿美元,估值22亿美元,曾获Forbes Fintech 50、Fast Company最具创新力公司、Inc.最佳企业、LinkedIn顶尖初创等荣誉。该岗位的核心职责是嵌入战略客户内部,深入理解采购、财务、法律、风险等业务流程,利用Zip的AppStudio和AI代理基础设施,构建和部署定制化的AI代理解决方案。任职者需直接对客户成果负责,在客户提出需求前主动识别高价值问题,拓展合同价值,并将实战经验沉淀为可复用的平台能力。要求候选人拥有3年以上企业采购或财务运营实战经验,具备使用AppStudio、Claude、N8N、Make、Zapier等工具构建AI代理或自动化工作流的实操能力,能独立管理复杂客户项目,具有足够的API集成和故障排查技术能力。薪资范围13万至15万美元OTE,提供股权、健康保险、弹性带薪休假等福利。这一职位反映了AI部署正从实验室走向客户现场,需要既懂业务又懂工程的复合型人才,将AI能力转化为可量化的商业成果。

Read More