NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU。
按时间与主题检索每一条 AI 创作信号,从发现到回溯保持同一条路径。
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行于 NVIDIA Blackwell GPU。
AWS 为 Amazon Quick 推出 Live Data in Apps,AI 构建的 Quick 应用可在每次打开时实时查询受治理的 Quick Sight 数据集,不再依赖构建时的静态快照。
Ideogram 称其新模型 Ideogram 4.5 只修改用户指定的区域,其余部分保持不变,目标场景包括产品摄影、室内设计、照片修复和图像内文字编辑。该模型提供四档质量,每张图 0.8 至 22 美分,均为原生 2K 分辨率,现已在 Ideogram 平台和 API 上线,合作方包括 Picsart、Runway、Pika 和 Leonardo AI。
Tavus 推出名为 Griffin 的模型,公司称其为首个“Human Interaction Model”(HIM),可在接收和生成视频的同时处理语音、面部表情、语气、手势和停顿。
AWS 发布开源决策模型 Strands Decider 2B,用于在预设选项中做选择并给出置信度,已完全开源、当前可用,且小到可本地运行。该模型基于 Qwen3.5-2B 的“躯干”构建,不生成文本而是输出校准后的选择,定位为高速、低成本的决策步骤。
OpenAI 宣布在全球上线 ChatGPT 的两项购物功能:虚拟试穿和收藏。虚拟试穿允许用户上传自拍或全身照,查看某件服装或配饰穿在自己身上的效果,入口是购物结果中的 Try On 按钮,也可上传商品图片(如网页截图)让 ChatGPT 试穿;收藏功能可将发现的产品保存到应用内的 Library,并与试穿图片一同保存。
Google 在 Gemini Live 中推出 Guided Vision,可在兼容 Android 设备上通过摄像头实时提供音频描述,用于阅读小字、描述周围环境、寻找或识别物体等场景。
Google 宣布下一代前沿模型 Gemini 4 Argon,但初期仅向一组“可信网络防御方”开放,并称正参与美国政府关于预发布模型访问的自愿流程,同时逐步扩大访问范围。
SpaceXAI 旗下 AI 百科 Grokipedia 发布 v0.3 更新,启用新 logo 并改版首页与实时编辑页。新首页新增精选条目、最多阅读列表和“最新编辑”追踪器,精选与最多阅读板块以可旋转、横向滚动的“书籍”形式呈现。Grokipedia 于 2025 年 10 月下旬以 v0.1 上线,v0.2 在一个月后推出,今年早些时候曾疑似停止更新。
Google 发布新前沿模型 Gemini 4 Argon,在部分基准上超过 OpenAI 和 Anthropic 的竞品,但未取得明显领先。该模型先面向 Fairwind 计划的“可信网络防御者”和 Google 内部团队开放,之后才逐步开放给开发者、企业和消费者,首发付费 API 客户和 Google AI Ultra 订阅用户,具体日期未公布。
编辑推荐 / 关注前沿模型的开发者与产品团队可据此了解 Gemini 4 Argon 的基准表现、定价与开放节奏,并留意其 token 消耗偏高和尚未全面开放的限制。
Google 母公司 Alphabet 发布 Gemini 4 Argon,称其可处理编程、研究和写作等任务,并专门针对防御性网络安全训练,能“自主发现、验证并修补关键软件漏洞”。
听力科技初创公司 Legato 周四宣布,其 AI 助听眼镜 Legato Frames 已可购买,起售价 999 美元,面向轻中度听力损失成年人。该眼镜将助听技术集成于镜腿,AI 系统可区分人声与背景噪音,双扬声器系统在耳旁数英寸处降低 99% 漏音,重 34 克,续航 10-12 小时,支持处方镜片和蓝牙串流。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 可用,Cognition 成为首个在生产负载上运行 Vera Rubin 的客户。
编辑推荐 / 面向在 CoreWeave 上跑 Agent 与推理的团队,可据此评估 Vera Rubin NVL72、Vera CPU 与 Forge 是否值得进入现有训练和推理流程,注意吞吐与启动速度数据来自厂商及早期客户测试。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,可在生物代码中嵌入不可感知签名,并在实验室测试中保持蛋白质生物功能。该方法适配蛋白质序列与预测 3D 结构,在 VEGF-A、SARS-CoV-2 spike protein RBD 和 PD-L1 三个靶点的湿实验中,水印设计的命中率、结合亲和力与天然序列多样性均与未加水印版本相当。
编辑推荐 / 生物科技与AI安全从业者可据此了解首个可验证的AI生成蛋白质水印方案,并关注其开源代码与权重用于自身合规流程。
Google DeepMind 宣布新前沿模型 Gemini 4 Argon,正通过 Fairwind Program 向一批可信网络防御方开放,并将逐步扩大访问范围。
编辑推荐 / 关注前沿模型的开发者与企业团队可据此了解 Gemini 4 Argon 的能力范围、1M 输出上限与分阶段开放节奏,并留意其当前仅面向可信测试方、尚未全面开放。
Amazon Bedrock 在印度上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让数据在印度境内处理。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编程、计算机使用和日常专业工作负载提供更强推理能力。据 OpenAI 表述,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为其五分之一,并比 GPT-6 Sol 最佳成绩高 6.4 个百分点。
编辑推荐 / 开发者和企业团队可据此判断 GPT-6.1 Sol 在 Amazon Bedrock 上的可用性、成本与数据留存条款,再决定是否接入现有 Agent 或 Codex 流程。
DeepSeek 正式发布 DeepSeek-V4.1-Flash,这是其新架构家族中最小、原生支持多模态视觉理解的模型,官方称新架构面向更高能力上限、更快推理和更高吞吐。
编辑推荐 / 关注国产模型与 API 成本的开发者可据此评估是否将 deepseek-flash 接入现有流程,并注意旧模型名仅临时路由到 V4.1 Flash。
Kimi 发布 Kimi K3,称其为 2.8T 参数、具备原生视觉能力和 100 万 token 上下文窗口的模型,并称其为全球首个开放的 3T 级模型。Kimi K3 即日起在 Kimi.com、Kimi Work、Kimi Code 和 Kimi API 上线,默认使用 max thinking effort,完整模型权重将于 2026 年 7 月 27 日发布。
编辑推荐 / 关注开源大模型与长程编码能力的团队可据此评估 Kimi K3 的 2.8T 参数、1M 上下文与 API 定价是否值得接入,并留意其思考历史敏感与过度主动两项限制。
Qwen 发布 Qwen3Guard,这是 Qwen 系列首个安全护栏模型,基于 Qwen3 基础模型微调,可对 prompt 和回复做安全分类并给出风险等级与类别。
编辑推荐 / 面向需要内容审核能力的开发者与产品团队,可据此评估 Qwen3Guard 的流式检测与三级风险分类是否适配自身审核流程,并注意其开源尺寸与语言覆盖范围。