跳到正文
AI Spark / Signal Archive

#通用大模型

按时间与主题检索每一条 AI 创作信号,从发现到回溯保持同一条路径。

0今日新增9当前结果08:20 更新
10月2日周五
10月1日周四
  1. The Decoder78

    Google 发布 Gemini 4 Argon:缩小与 OpenAI、Anthropic 的差距但未取得明显领先

    Google 发布新前沿模型 Gemini 4 Argon,在部分基准上超过 OpenAI 和 Anthropic 的竞品,但未取得明显领先。该模型先面向 Fairwind 计划的“可信网络防御者”和 Google 内部团队开放,之后才逐步开放给开发者、企业和消费者,首发付费 API 客户和 Google AI Ultra 订阅用户,具体日期未公布。

    编辑推荐 / 关注前沿模型的开发者与产品团队可据此了解 Gemini 4 Argon 的基准表现、定价与开放节奏,并留意其 token 消耗偏高和尚未全面开放的限制。

  2. The Decoder80

    OpenAI 称已阻止窃取模型推理的攻击,但该手法在 Azure 上仍然有效

    OpenAI 称已阻止一场窃取模型推理的攻击,并封禁相关账号、收紧注册、修补加密推理复用漏洞;但研究人员 9 月 13 日复测发现,同一手法在 Microsoft Azure 上对其尝试的每个 OpenAI 模型(含 GPT-6 Astra)及 Anthropic 至 Sonnet 5 的模型仍然有效,单次尝试即可逐字取出推理内容。

    编辑推荐 / 关注模型安全与API合规的开发者可据此了解推理蒸馏攻击的机制与云平台防护差异,并留意自家所用云端点是否已打补丁。

  3. Google DeepMind78

    Google DeepMind 宣布 Gemini 4 Argon,先向可信网络防御方开放

    Google DeepMind 宣布新前沿模型 Gemini 4 Argon,正通过 Fairwind Program 向一批可信网络防御方开放,并将逐步扩大访问范围。

    编辑推荐 / 关注前沿模型的开发者与企业团队可据此了解 Gemini 4 Argon 的能力范围、1M 输出上限与分阶段开放节奏,并留意其当前仅面向可信测试方、尚未全面开放。

9月30日周三
  1. AWS Machine Learning Blog78

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编程、计算机使用和日常专业工作负载提供更强推理能力。据 OpenAI 表述,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为其五分之一,并比 GPT-6 Sol 最佳成绩高 6.4 个百分点。

    编辑推荐 / 开发者和企业团队可据此判断 GPT-6.1 Sol 在 Amazon Bedrock 上的可用性、成本与数据留存条款,再决定是否接入现有 Agent 或 Codex 流程。

9月29日周二
  1. Apple Machine Learning Research62

    Apple 研究:语言模型树结构表达式序列化的往返通信瓶颈

    Apple 研究团队提出往返协议,测试语言模型用自然语言传递树结构表达式时的信息损耗。对十六个模型两两组合评估显示,通道有损且不对称,交换生成与提取角色可使准确率相差最多 60.4 个百分点,最佳组合由不同模型分别担任两端,达到 92.9%。

    编辑推荐 / 研究多模型协作与结构化推理的开发者可据此理解自然语言中间表示的信息损耗,并留意生成端才是主要瓶颈。