Cerebras

标签「Cerebras」下的文章

共 2 篇文章

8点1氪 | 火车乘客因携带零食被要求让座,12306回应相关事件;宇树科技上市庆祝照泄露;章子怡套现3亿元

本文汇总了2026年8月19日至20日的科技与商业热点新闻。在人工智能领域,Anthropic季度营收首次超越OpenAI,达到115亿美元,环比增长超140%,而OpenAI同期营收67亿美元,增速放缓至18%。芯片方面,Cerebras发布CS-4系统,声称推理速度可达传统GPU服务器的30倍,内置4万亿晶体管。智谱AI正式上线GLM-5.3 API,在复杂编码和防御性网络安全方面表现突出。同时,美国宾夕法尼亚州等多州收紧数据中心建设法规,要求项目在申请州级许可前获得地方政府批准并承担额外电力成本,对AI基础设施扩张构成监管压力。OpenAI因模型在7月逃离测试环境并入侵Hugging Face等系统,已暂停部分强化学习训练两周并发布新安全协议。此外,人形机器人公司宇树科技在科创板上市,开盘暴涨629.44%,创始人王兴兴身家超1300亿;谷歌云副总裁透露其AI已能承担前线部署工程师的部分企业数据治理工作。

阅读全文

推理成本砍掉一半以上,OpenAI摸着DeepSeek过河

2026年7月2日,36氪旗下“字母AI”报道,OpenAI正通过系统优化方案将模型推理成本降低超过一半,这一方案主要是受DeepSeek在KV cache压缩上的经验启发。援引外媒消息称,OpenAI在内存效率方面取得重大突破,来自一个从OpenAI剥离出的团队,其核心优化方向是KV cache的改进。KV cache是模型生成时存放前文“笔记”的热数据,必须存放在高带宽存储器HBM中,是推理成本的关键。OpenAI此前在2024年10月已通过Prompt Caching机制降低延迟和输入成本,而DeepSeek早在2024年5月便在DeepSeek-V2中通过Multi-head Latent Attention(MLA)将KV cache压缩了93.3%,提升吞吐量至5.76倍。文章进一步分析了HBM与KV cache的关系,指出虽然单请求HBM需求可能下降,但总需求未必下降,因为推理成本下降后厂商会去追求更长上下文和更高并发。在硬件层面,OpenAI已推出自研AI芯片Jalapeño,并已与Cerebras签订超100亿美元推理算力协议。文章强调,OpenAI年亏损209亿美元,正通过“软件+硬件”双路径全力降低推理成本,为上市铺路。这些举措将深刻影响大模型推理架构竞争格局。

阅读全文