NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU。
按时间与主题检索每一条 AI 创作信号,从发现到回溯保持同一条路径。
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU。
AWS 发布教程,演示如何把 Amazon S3 Vectors 作为 NVIDIA NeMo Agent Toolkit(NAT)的自定义记忆后端,并部署在 Amazon EKS 上。
编辑推荐 / 面向需要为多智能体系统搭建持久记忆层的开发者,本文给出可复用的插件实现与 EKS 部署步骤,可先按示例代码在测试环境验证再接入生产。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 可用,Cognition 成为首个在生产负载上运行 Vera Rubin 的客户。
编辑推荐 / 面向在 CoreWeave 上跑 Agent 与推理的团队,可据此评估 Vera Rubin NVL72、Vera CPU 与 Forge 是否值得进入现有训练和推理流程,注意吞吐与启动速度数据来自厂商及早期客户测试。
NVIDIA 提出 AI 工厂投资回报由产出能力、使用寿命和需求三要素决定,其平台通过全栈协同设计实现每兆瓦吞吐最大化。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本低至 45 分之一。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放发布 2800 多种病毒的蛋白质复合物预测 3D 结构,供全球科学家免费使用。