NVIDIA AI 工厂如何通过高效、耐用与通用性最大化投资回报
NVIDIA通过高效、耐用和通用的AI工厂平台提升吞吐、延长硬件收益期,并扩大可承载的AI与非AI工作负载,以最大化投资回报。每兆瓦工厂成本约为$60 million,Vera Rubin NVL72较GB300 NVL72吞吐量提升超过30x,在DeepSeek V4 Pro上每百万tokens成本最高降低45x。A100自2020年出货后仍持续商用,CUDA跨代运行可避免既有硬件闲置。
NVIDIA通过高效、耐用和通用的AI工厂平台提升吞吐、延长硬件收益期,并扩大可承载的AI与非AI工作负载,以最大化投资回报。每兆瓦工厂成本约为$60 million,Vera Rubin NVL72较GB300 NVL72吞吐量提升超过30x,在DeepSeek V4 Pro上每百万tokens成本最高降低45x。A100自2020年出货后仍持续商用,CUDA跨代运行可避免既有硬件闲置。
Destro AI 以 AI intelligence layer 协调物流场景中的机器人与人类工人,并凭此从 stealth 状态融资 $8 million seed round。
Replicate宣布加入Cloudflare,并将保持独立品牌;其 API 不变,现有模型和已构建的应用将继续运行。双方计划把 Replicate 的模型运行能力与 Cloudflare Developer Platform 整合,用于构建智能体、运行实时模型及在边缘部署模型。
推荐理由:这次整合保留了 Replicate 的 API 和现有模型,同时为智能体、实时模型与边缘运行提供更完整的云平台协同。