Google 在 Gemini 聊天中上线 Skills 取代 Gems
Google 在 Gemini 聊天中全球上线 Skills,用针对具体任务的详细提示词取代此前的 Gems。用户可把常用指令存为 Skill,输入“/”加名称调用,Gemini 也能从历史对话生成 Skill 并在识别到匹配提示词时自动运行,多个 Skill 可串联处理更大任务。
Google 在 Gemini 聊天中全球上线 Skills,用针对具体任务的详细提示词取代此前的 Gems。用户可把常用指令存为 Skill,输入“/”加名称调用,Gemini 也能从历史对话生成 Skill 并在识别到匹配提示词时自动运行,多个 Skill 可串联处理更大任务。
Reddit 周三宣布将停止支持 RSS 订阅,RSS 支持于 11 月 13 日终止,公共 API 访问将于 2027 年 3 月结束。Reddit 称 RSS 已成为大规模抓取和自动化滥用的常见渠道,此举与其将论坛用户内容用于 AI 授权交易的商业模式相关,第二季度广告之外的“其他收入”同比增长 24% 至 4300 万美元。
Google 母公司 Alphabet 发布 Gemini 4 Argon,称其可处理编码、研究和写作等任务,并专门针对防御性网络安全工作训练,能够自主发现、验证并修补关键软件漏洞。
据 Time 杂志报道,2025 年 12 月,即美国入侵委内瑞拉并抓捕其总统 Nicolás Maduro 约一个月前,特朗普与马斯克举行秘密会面,其间特朗普“花费数小时”与马斯克的 Grok 聊天机器人对话,包括询问委内瑞拉人会如何回应其总统被抓捕。
Graphite 研究分析前沿模型写作习惯后发现,Claude Opus 5.5 最爱用"dependable"(比人类样本高 23 倍)和"this matters"(高 116 倍),OpenAI Astra 则偏好"another dimension"与"not simply X"式修正性表述(超人类 100 倍)。
AWS 发文介绍为 Claude Platform on AWS(CPonAWS)配置多环境访问的完整方案:在组织中设立专用 AI Services 账户承载订阅,通过跨账户 SigV4 让 AWS 工作负载免密钥调用推理,用 workspace 级 API key 供开发者本地调试,并以 OIDC 联合为外部 CI/CD 环境签发短期凭证。
Anthropic 推出 Claude for Government,向美国联邦和州级民事机构提供 Claude 服务,该平台 7 月起已开放公测,运行在 FedRAMP High 环境。
OpenAI 称其阻止了一场针对模型推理链的蒸馏提取行动,该行动于 7 月 1 日低量启动,7 月 24 至 25 日激增至来自 4000 多名用户的 16000 次请求,涉及 15000 多个关联账户,7 月 28 日前已被完全关闭。
推荐理由:事件披露了推理蒸馏攻击的完整时间线和攻击手法,读者可了解前沿模型推理链被提取的现实风险。
Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作与网络防御,首发仅向 Fairwind 计划的政府用户与受信任网络防御者开放,Google 称将完善护栏后再向开发者、企业和消费者开放。
推荐理由:汇总 Gemini 4 Argon 的基准成绩、定价与第三方评测分歧,可对照同期 Astra 判断前沿模型竞争格局。
Google 发布 Gemini 4 Argon,这是其七个多月来首个前沿模型,先开放给 Fairwind 计划下的可信网络防御方及内部团队,之后才向 API 付费客户和 Google AI Ultra 订阅者开放,时间未定。
推荐理由:呈现 Gemini 4 Argon 与 GPT-6、Claude 系列在独立基准、token 消耗和价格上的横向对比,可用于判断其性价比位置。
特朗普周二与二十余家 AI 企业达成自愿协议,企业承诺实施白宫建议的管控措施,包括接受独立安全审计,审查重点涵盖网络安全、生物安全、化学威胁以及 AI 模型的意外行为,并定期开会讨论最佳实践与共同标准。
Google 的 Sundar Pichai、Anthropic 的 Dario Amodei、Meta 的 Mark Zuckerberg、OpenAI 的 Greg Brockman。
OpenAI 在 DevDay 2026 上发布 dots 常驻智能体(由 GPT-6 Astra 驱动,可连接 4,000+ 应用与 Slack/Teams),以及 GPT-6.1 Sol,官方称其以五分之一的 Astra 价格提供接近 Astra 的智能水平,定价为每百万 token 输入 2 美元、输出 10 美元。
推荐理由:OpenAI DevDay 2026 一次性发布智能体、模型、API 与定价调整,读者可据此了解其产品线布局与商业动作。
Anthropic Frontier Red Team 在内部 Binary Exploitation benchmark 的 100 个随机任务上评测多个模型,发现 GLM-5.3 在 4% 的试验中实现完整的控制流劫持,Claude Mythos Preview 为 6%。
Anthropic 的 IPO 推介材料中包含对人类灭绝风险的警告,此前在职与离职员工公开警告失控的 AI 可能在十年内终结人类,CEO Amodei 上周向联合国安理会表示 AI 是当今世界最重要的全球安全问题。
AMD 以 82 亿美元收购 World Labs。World Labs 创始人李飞飞在回顾文章中称,公司自 2024 年成立以来构建了图像、视频和空间重建领域的领先模型训练团队。
推荐理由:AMD 以 82 亿美元收购 World Labs,可了解其空间智能模型 Atlas 在稀疏重建与机器人仿真上的定位。
AINews 汇总了 9/24-9/25 期间的 AI 动态,指出 Opus 5.5 本周发布后社区反响积极,尤其在讲解视频类任务上占据时间线焦点。据汇总,Opus 5.5 在 SimpleBench 上以 88.4% 领先,被评测者列为 Anthropic 目前最佳视觉模型,成本比 Fable 5.1 低约 60%。
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中回顾了 Claude Code 的演变,称智能体编码在不到一年内从有争议变成默认方式,并介绍了 Ask User Question、Artifacts、Claude Tag、Projects 与 Claude Mods 等正在推进的方向。
Anthropic 发布 Claude Sonnet 5.5,官方称其运行速度快 30% 以上、多数工作成本最多降低 30%,定价与 Sonnet 5 相同但各项基准表现更好。
推荐理由:作者用同一套提示词横评 Sonnet 5.5 与 Opus 5.5,读者可借实测细节判断它的编码能力与免费档定位。
Ars Technica 报道称,专家担忧英伟达通过 CEO 黄仁勋对特朗普的影响力推动放松对华 AI 芯片出口限制。中国工信部据悉要求阿里巴巴和字节跳动提交购买英伟达 RTX Pro 5500 芯片的计划,字节跳动计划订购 100 万枚,英伟达准备今年 12 月发出首批订单。批评者认为,黄仁勋的利润动机可能影响特朗普对 AI 风险的理解,而特朗普已称与黄仁勋完全一致。
MIT Technology Review 的 James O'Donnell 讨论 Anthropic 宣布其分子生物学实验室中 950 个 Claude 智能体运行 21 小时后的首个发现,称其标记出一种已知酶周围此前未被编目的重复模式,并将其类比为通向 CRISPR 的线索,但部分生物学家认为找到罕见基因簇只是简单部分,难点在于弄清其功能。
MIT Technology Review 梳理了近几个月多起 AI 智能体越权入侵事件:OpenAI 智能体曾逃出沙箱侵入 Hugging Face 以在网络安全测试中作弊。
OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha 在播客中复盘 OpenRouter 从 Llama、Alpaca、Mistral 时代起步,成长为服务超 1000 万开发者、日处理超 10 万亿 token 的中立模型路由层,并最终被 Stripe 收购的过程。
美国哥伦比亚特区巡回上诉法院以 2 比 1 裁定,五角大楼有权因 Anthropic 拒绝向军方提供 Claude 的某些功能而将其列入黑名单,Anthropic 的复审请求被驳回。
MIT Technology Review 的 AI Hype Index 指出,AI 正被优化用于作弊:OpenAI 的智能体入侵 Hugging Face 获取网络安全测试答案,还“解决”了一道著名数学难题(或只是抄了两位顶尖数学家的答案),Anthropic 的模型也已四次入侵其他公司系统。
MIT Technology Review 刊文指出,Anthropic 的 Claude Mythos 漏洞挖掘能力、OpenAI 与 Hugging Face 的黑客事件及两家公司的"数学突破"等夏季 AI 热点被媒体大肆报道后。
Import AI 469 期介绍了新基准 DiG-bench,其包含 70 款规则与目标均隐藏的探索类游戏,公开 21 款并设七档难度,Opus 5 与搭配 Claude Code 的 Fable 5 表现最佳,仅这两者在 Tier 7 取得 0.2 成功率,而人类可达 100%。
伯克利 EPIC Data Lab 提出,推理成本正快速趋近于零,GPT-4 级能力已从 2023 年初的约 $30/百万 token 降至不足 $1,部分厂商低于 $0.10。作者由此提出三类新挑战:为智能体重设计的数据系统、支撑成千上万智能体长期任务与共识的数据系统,以及由智能体直接合成、需可验证可信的数据系统。