Graphite 研究:Claude Opus 5.5 最爱说“this matters”,各模型写作痕迹各不相同
Graphite 研究分析了前沿模型的写作习惯,发现 Claude Opus 5.5 使用“this matters”的频率是人类的 116 倍,“dependable”出现频率高 23 倍;OpenAI 的 Astra 则偏爱“not simply X”等纠正性框架,此类表达比人类写作常见 100 倍以上。
按时间与主题检索每一条 AI 创作信号,从发现到回溯保持同一条路径。
Graphite 研究分析了前沿模型的写作习惯,发现 Claude Opus 5.5 使用“this matters”的频率是人类的 116 倍,“dependable”出现频率高 23 倍;OpenAI 的 Astra 则偏爱“not simply X”等纠正性框架,此类表达比人类写作常见 100 倍以上。
Google 的轨道计算卫星原型随 SpaceX 火箭升空,首次将其 TPU 送入太空,验证芯片能否在轨运行模型。Google 同期发布经同行评审的轨道数据中心白皮书,估算若星舰每次发射 200 吨载荷,需在 10 年内发射约 1800 次、即每年 180 次,才能把发射价格降至接近每公斤 200 美元。
OpenAI 提出,先进 AI 的价值可能最体现在突破性创意背后的日常执行工作上。文章探讨执行环节为何可能塑造下一阶段的经济形态与进步速度。
美国联邦法官驳回 Chegg 和 Rolling Stone 母公司 Penske Media Corporation 针对 Google AI Overviews 的两起反垄断诉讼,认定其主张不符合反垄断法。
OpenAI 称已阻止一场窃取模型推理的攻击,并封禁相关账号、收紧注册、修补加密推理复用漏洞;但研究人员 9 月 13 日复测发现,同一手法在 Microsoft Azure 上对其尝试的每个 OpenAI 模型(含 GPT-6 Astra)及 Anthropic 至 Sonnet 5 的模型仍然有效,单次尝试即可逐字取出推理内容。
编辑推荐 / 关注模型安全与API合规的开发者可据此了解推理蒸馏攻击的机制与云平台防护差异,并留意自家所用云端点是否已打补丁。
研究团队开发的 Ataraxos 在与 Stratego 史上最成功选手 Niemeijer 的对局中取得 85% 的有效胜率(和棋按半胜计),作者称这一水平在最高级别前所未有。
编辑推荐 / 关注强化学习与不完全信息博弈的研究者和开发者可据此了解 Ataraxos 的低算力路线,并留意其搜索方式带来的性能上限。
Google 母公司 Alphabet 发布 Gemini 4 Argon,称其可处理编程、研究和写作等任务,并专门针对防御性网络安全训练,能“自主发现、验证并修补关键软件漏洞”。
OpenAI 披露阻断了一场协同模型蒸馏行动,该行动旨在提取其受保护的模型推理能力。OpenAI 表示正在加强针对对抗性蒸馏的防御措施。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,可在生物代码中嵌入不可感知签名,并在实验室测试中保持蛋白质生物功能。该方法适配蛋白质序列与预测 3D 结构,在 VEGF-A、SARS-CoV-2 spike protein RBD 和 PD-L1 三个靶点的湿实验中,水印设计的命中率、结合亲和力与天然序列多样性均与未加水印版本相当。
编辑推荐 / 生物科技与AI安全从业者可据此了解首个可验证的AI生成蛋白质水印方案,并关注其开源代码与权重用于自身合规流程。
AWS 官方博客给出用 Amazon Bedrock Knowledge Bases 构建理赔问答助手的技术教程:从 Amazon S3 摄取 PDF、Word、文本理赔文档及 .metadata.json 元数据,通过 AgenticRetrieveStream API 做多轮追问、元数据过滤和带引用的回答。
编辑推荐 / 面向在 AWS 上构建企业级 RAG 助手的开发者,可据此复现带引用、元数据过滤和 grounding 护栏的理赔问答流程,并注意评测基于合成数据。
Apple 研究团队提出往返协议,测试语言模型用自然语言传递树结构表达式时的信息损耗。对十六个模型两两组合评估显示,通道有损且不对称,交换生成与提取角色可使准确率相差最多 60.4 个百分点,最佳组合由不同模型分别担任两端,达到 92.9%。
编辑推荐 / 研究多模型协作与结构化推理的开发者可据此理解自然语言中间表示的信息损耗,并留意生成端才是主要瓶颈。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放发布 2800 多种病毒的蛋白质复合物预测 3D 结构,供全球科学家免费使用。
Anthropic 宣布成立生命科学研究组与实验室,并称 Claude 在仅有高层级指令的情况下自主发现了一种与 DNA 重复序列相关的新型酶系统,命名为 array-associated reverse transcriptases(ART)。
编辑推荐 / 关注 AI for Science 的研究者与实验室可据此了解 Claude 自主发现新酶系统的流程与规模,并留意其功能尚未确定、结果仍为预印本。
Qwen 发布 Qwen3Guard,这是 Qwen 系列首个安全护栏模型,基于 Qwen3 基础模型微调,可对 prompt 和回复做安全分类并给出风险等级与类别。
编辑推荐 / 面向需要内容审核能力的开发者与产品团队,可据此评估 Qwen3Guard 的流式检测与三级风险分类是否适配自身审核流程,并注意其开源尺寸与语言覆盖范围。