NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU。
按时间与主题检索每一条 AI 创作信号,从发现到回溯保持同一条路径。
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU。
Graphite 研究分析了前沿模型的写作习惯,发现 Claude Opus 5.5 使用“this matters”的频率是人类的 116 倍,“dependable”出现频率高 23 倍;OpenAI 的 Astra 则偏爱“not simply X”等纠正性框架,此类表达比人类写作常见 100 倍以上。
OpenAI 宣布在全球上线 ChatGPT 的两项购物功能:虚拟试穿和收藏。虚拟试穿允许用户上传自拍或全身照,查看某件服装或配饰穿在自己身上的效果,入口是购物结果中的 Try On 按钮,也可上传商品图片(如网页截图)让 ChatGPT 试穿;收藏功能可将发现的产品保存到应用内的 Library,并与试穿图片一同保存。
Albertsons 正使用 ChatGPT Enterprise 和 OpenAI API 帮助团队加快工作速度,并让数百万顾客的购物体验更便捷。
OpenAI 提出,先进 AI 的价值可能最体现在突破性创意背后的日常执行工作上。文章探讨执行环节为何可能塑造下一阶段的经济形态与进步速度。
Google 宣布下一代前沿模型 Gemini 4 Argon,但初期仅向一组“可信网络防御方”开放,并称正参与美国政府关于预发布模型访问的自愿流程,同时逐步扩大访问范围。
Google 发布新前沿模型 Gemini 4 Argon,在部分基准上超过 OpenAI 和 Anthropic 的竞品,但未取得明显领先。该模型先面向 Fairwind 计划的“可信网络防御者”和 Google 内部团队开放,之后才逐步开放给开发者、企业和消费者,首发付费 API 客户和 Google AI Ultra 订阅用户,具体日期未公布。
编辑推荐 / 关注前沿模型的开发者与产品团队可据此了解 Gemini 4 Argon 的基准表现、定价与开放节奏,并留意其 token 消耗偏高和尚未全面开放的限制。
OpenAI 称已阻止一场窃取模型推理的攻击,并封禁相关账号、收紧注册、修补加密推理复用漏洞;但研究人员 9 月 13 日复测发现,同一手法在 Microsoft Azure 上对其尝试的每个 OpenAI 模型(含 GPT-6 Astra)及 Anthropic 至 Sonnet 5 的模型仍然有效,单次尝试即可逐字取出推理内容。
编辑推荐 / 关注模型安全与API合规的开发者可据此了解推理蒸馏攻击的机制与云平台防护差异,并留意自家所用云端点是否已打补丁。
OpenAI 与美国 SBDC 合作,扩大小企业的实操 AI 培训与本地支持,并同步发布一份关于小团队如何使用 AI 的新报告。
OpenAI 披露阻断了一场协同模型蒸馏行动,该行动旨在提取其受保护的模型推理能力。OpenAI 表示正在加强针对对抗性蒸馏的防御措施。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编程、计算机使用和日常专业工作负载提供更强推理能力。据 OpenAI 表述,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为其五分之一,并比 GPT-6 Sol 最佳成绩高 6.4 个百分点。
编辑推荐 / 开发者和企业团队可据此判断 GPT-6.1 Sol 在 Amazon Bedrock 上的可用性、成本与数据留存条款,再决定是否接入现有 Agent 或 Codex 流程。