如何为 Claude Platform on AWS 实现多环境访问
面向需要在 AWS 生产环境、开发者笔记本和外部云 CI/CD 三类环境调用 Claude Platform on AWS(CPonAWS)推理的场景,该指南给出完整配置步骤:在组织内建专用 AI Services 账户承载订阅与工作区,AWS 工作负载通过跨账户 SigV4 免密钥调用,开发者在开发工作区使用长期 API key,外部环境经 OIDC 联邦获取短期凭证。
按时间与主题检索每一条 AI 创作信号,从发现到回溯保持同一条路径。
面向需要在 AWS 生产环境、开发者笔记本和外部云 CI/CD 三类环境调用 Claude Platform on AWS(CPonAWS)推理的场景,该指南给出完整配置步骤:在组织内建专用 AI Services 账户承载订阅与工作区,AWS 工作负载通过跨账户 SigV4 免密钥调用,开发者在开发工作区使用长期 API key,外部环境经 OIDC 联邦获取短期凭证。
AWS 发布参考实现,演示如何用 Amazon Bedrock AgentCore 构建 ambient agent:由 Amazon S3 事件或定时任务触发,经 SQS 与 Lambda 调用 AgentCore Runtime 上的容器化 LangChain agent,需要时通过单个 ask_human 工具暂停并等待人工回复。
编辑推荐 / 面向在 AWS 上做文档处理与告警分流的开发者,可据此参考实现搭建事件驱动、带人工审批的 Agent 流水线,注意示例仅覆盖 S3 与定时两类信号源。
Amazon Payments 在 Amazon SageMaker AI 上用多目标 contextual multi-armed bandit 对产品获客漏斗做个性化,七周在线 A/B 测试中,一个人群在最终漏斗转化上目前看到高个位数百分比的相对提升,另一个人群相较现有体验没有改善。
编辑推荐 / 做个性化推荐与转化优化的产品、增长和算法团队可参考其多目标 contextual bandit 架构与踩坑经验,注意内容池质量可能才是效果瓶颈。
AWS 发布教程,演示如何把 Amazon S3 Vectors 作为 NVIDIA NeMo Agent Toolkit(NAT)的自定义记忆后端,并部署在 Amazon EKS 上。
编辑推荐 / 面向需要为多智能体系统搭建持久记忆层的开发者,本文给出可复用的插件实现与 EKS 部署步骤,可先按示例代码在测试环境验证再接入生产。
AWS 为 Amazon Quick 推出 Live Data in Apps,AI 构建的 Quick 应用可在每次打开时实时查询受治理的 Quick Sight 数据集,不再依赖构建时的静态快照。
AWS Professional Services 在 Amazon Bedrock AgentCore 上给出四 Agent 迁移模式,覆盖 Intake、IaC、迁移治理与 SRE 四个环节,基于内部项目跟踪数据,IaC 开发时间从每应用 3 到 4 周降至分钟级。
编辑推荐 / 负责大规模上云迁移的企业架构与平台团队可据此评估四 Agent 模式是否值得自建,并先用试点波次测算单应用 token 与运行成本。
AWS 发布开源决策模型 Strands Decider 2B,用于在预设选项中做选择并给出置信度,已完全开源、当前可用,且小到可本地运行。该模型基于 Qwen3.5-2B 的“躯干”构建,不生成文本而是输出校准后的选择,定位为高速、低成本的决策步骤。
Google 的轨道计算卫星原型随 SpaceX 火箭升空,首次将其 TPU 送入太空,验证芯片能否在轨运行模型。Google 同期发布经同行评审的轨道数据中心白皮书,估算若星舰每次发射 200 吨载荷,需在 10 年内发射约 1800 次、即每年 180 次,才能把发射价格降至接近每公斤 200 美元。
Albertsons 正使用 ChatGPT Enterprise 和 OpenAI API 帮助团队加快工作速度,并让数百万顾客的购物体验更便捷。
OpenAI 提出,先进 AI 的价值可能最体现在突破性创意背后的日常执行工作上。文章探讨执行环节为何可能塑造下一阶段的经济形态与进步速度。
Google 宣布下一代前沿模型 Gemini 4 Argon,但初期仅向一组“可信网络防御方”开放,并称正参与美国政府关于预发布模型访问的自愿流程,同时逐步扩大访问范围。
Google 发布新前沿模型 Gemini 4 Argon,在部分基准上超过 OpenAI 和 Anthropic 的竞品,但未取得明显领先。该模型先面向 Fairwind 计划的“可信网络防御者”和 Google 内部团队开放,之后才逐步开放给开发者、企业和消费者,首发付费 API 客户和 Google AI Ultra 订阅用户,具体日期未公布。
编辑推荐 / 关注前沿模型的开发者与产品团队可据此了解 Gemini 4 Argon 的基准表现、定价与开放节奏,并留意其 token 消耗偏高和尚未全面开放的限制。
OpenAI 称已阻止一场窃取模型推理的攻击,并封禁相关账号、收紧注册、修补加密推理复用漏洞;但研究人员 9 月 13 日复测发现,同一手法在 Microsoft Azure 上对其尝试的每个 OpenAI 模型(含 GPT-6 Astra)及 Anthropic 至 Sonnet 5 的模型仍然有效,单次尝试即可逐字取出推理内容。
编辑推荐 / 关注模型安全与API合规的开发者可据此了解推理蒸馏攻击的机制与云平台防护差异,并留意自家所用云端点是否已打补丁。
安全初创公司 Glow Security 发现,AI Agent 将 343 家机构的 13000 多张内部软件项目截图上传到公开 GitHub 仓库,涉及财富 500 强公司、金融机构和 AI 实验室。
Google 母公司 Alphabet 发布 Gemini 4 Argon,称其可处理编程、研究和写作等任务,并专门针对防御性网络安全训练,能“自主发现、验证并修补关键软件漏洞”。
前 Google 云业务与 SpaceX Starlink 员工 Rama Afullo 联合创立 Satlyt,完成 800 万美元种子轮,由休斯顿 Non Sibi Ventures 领投。
OpenAI 与美国 SBDC 合作,扩大小企业的实操 AI 培训与本地支持,并同步发布一份关于小团队如何使用 AI 的新报告。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 可用,Cognition 成为首个在生产负载上运行 Vera Rubin 的客户。
编辑推荐 / 面向在 CoreWeave 上跑 Agent 与推理的团队,可据此评估 Vera Rubin NVL72、Vera CPU 与 Forge 是否值得进入现有训练和推理流程,注意吞吐与启动速度数据来自厂商及早期客户测试。
NVIDIA 提出 AI 工厂投资回报由产出能力、使用寿命和需求三要素决定,其平台通过全栈协同设计实现每兆瓦吞吐最大化。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本低至 45 分之一。
Google DeepMind 宣布新前沿模型 Gemini 4 Argon,正通过 Fairwind Program 向一批可信网络防御方开放,并将逐步扩大访问范围。
编辑推荐 / 关注前沿模型的开发者与企业团队可据此了解 Gemini 4 Argon 的能力范围、1M 输出上限与分阶段开放节奏,并留意其当前仅面向可信测试方、尚未全面开放。
Barclays 扩大与 Anthropic 的战略合作,在全行范围部署 Claude,用于加速软件开发、现代化遗留系统并提升运营效率。Barclays 预计到 2026 年底 Claude Code 覆盖 50% 开发者,2027 年覆盖多数软件工程师。
AWS 官方博客给出在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线的完整步骤:Composition、Delivery、Compliance 三个智能体通过同一 runtimeSessionId 共享会话,被调度到同一台 GPU 实例上协作。
编辑推荐 / 面向在 AWS 上构建多智能体系统的开发者,可据此了解 Runtime Instances 的共享会话、GPU 与持久卷用法,并注意 EBS 卷受可用区限制。
AWS 官方博客给出用 Amazon Bedrock Knowledge Bases 构建理赔问答助手的技术教程:从 Amazon S3 摄取 PDF、Word、文本理赔文档及 .metadata.json 元数据,通过 AgenticRetrieveStream API 做多轮追问、元数据过滤和带引用的回答。
编辑推荐 / 面向在 AWS 上构建企业级 RAG 助手的开发者,可据此复现带引用、元数据过滤和 grounding 护栏的理赔问答流程,并注意评测基于合成数据。
Amazon Bedrock 在印度上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让数据在印度境内处理。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编程、计算机使用和日常专业工作负载提供更强推理能力。据 OpenAI 表述,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为其五分之一,并比 GPT-6 Sol 最佳成绩高 6.4 个百分点。
编辑推荐 / 开发者和企业团队可据此判断 GPT-6.1 Sol 在 Amazon Bedrock 上的可用性、成本与数据留存条款,再决定是否接入现有 Agent 或 Codex 流程。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放发布 2800 多种病毒的蛋白质复合物预测 3D 结构,供全球科学家免费使用。
Anthropic 宣布成立生命科学研究组与实验室,并称 Claude 在仅有高层级指令的情况下自主发现了一种与 DNA 重复序列相关的新型酶系统,命名为 array-associated reverse transcriptases(ART)。
编辑推荐 / 关注 AI for Science 的研究者与实验室可据此了解 Claude 自主发现新酶系统的流程与规模,并留意其功能尚未确定、结果仍为预印本。
Qwen 发布 Qwen3Guard,这是 Qwen 系列首个安全护栏模型,基于 Qwen3 基础模型微调,可对 prompt 和回复做安全分类并给出风险等级与类别。
编辑推荐 / 面向需要内容审核能力的开发者与产品团队,可据此评估 Qwen3Guard 的流式检测与三级风险分类是否适配自身审核流程,并注意其开源尺寸与语言覆盖范围。