Google 在 Gemini 聊天中上线 Skills 取代 Gems
Google 在 Gemini 聊天中全球上线 Skills,用针对具体任务的详细提示词取代此前的 Gems。用户可把常用指令存为 Skill,输入“/”加名称调用,Gemini 也能从历史对话生成 Skill 并在识别到匹配提示词时自动运行,多个 Skill 可串联处理更大任务。
Google 在 Gemini 聊天中全球上线 Skills,用针对具体任务的详细提示词取代此前的 Gems。用户可把常用指令存为 Skill,输入“/”加名称调用,Gemini 也能从历史对话生成 Skill 并在识别到匹配提示词时自动运行,多个 Skill 可串联处理更大任务。
DoorDash 周三宣布推出可通过 Apple Messages 点餐的 AI 智能体,用户发送“order my usual”这类提示词,智能体即可理解其常点订单。该智能体支持指定菜品、查询本地推荐并发送推荐食物照片,还能在同一笔订单中处理多人不同的饮食偏好和数量。DoorDash 已面向美国用户开放候补名单,同时宣布将在北加州部分餐厅测试配送无人机。
OpenAI 在 Dev Day 上由 CEO Sam Altman 宣布推出 Decisions API,为 Luna 模型提供预定义选项以快速输出分类或智能体行为选择。
听力科技初创公司 Legato 周四宣布,其 AI 助听眼镜 Legato Frames 正式开售,起售价 999 美元。该眼镜将专利助听技术集成于镜腿,通过 AI 区分人声与背景噪音并放大语音,双扬声器系统可在距耳数英寸处将外泄声音降低 99%,重 34 克、续航 10-12 小时,提供三种款式并支持处方镜片与蓝牙串流。该产品在美国官网及部分眼科护理机构有售,可获视力保险报销。
Amazon Quick 推出 Live Data in Apps,AI 构建的应用可在用户每次打开时实时查询受治理的 Quick Sight 数据集,取代发布时固化的静态快照。查询以查看者身份执行,自动沿用原有行级和列级安全规则,仅支持已认证的 Quick 用户,每位查看者首次使用需按数据集授权。SPICE 和 Direct Query 两种数据集模式均受支持。
Google 在 Gemini Live 中上线 Guided Vision,支持兼容的 Android 设备,可通过摄像头对指向的画面进行实时语音描述,帮助读取小字、描述周围环境和识别物体。
OpenAI 全球上线 ChatGPT 两项购物功能,包括虚拟试穿服装配饰和收藏商品供日后查看。用户可上传自拍或全身照预览服装上身效果,也可上传商品图片让 ChatGPT 为其试穿,试穿入口以 Try On 按钮出现在购物结果中;收藏功能可将商品存入应用内 Library,并与试穿图片一同保存。
Shopify 周四推出建站工具 Canvas,商家通过与 AI 智能体 Sidekick 对话来创建店铺。Canvas 实时渲染店铺背后的真实代码而非静态预览,可测试交互与动画,并查看不同屏幕尺寸下的效果,Sidekick 会截图以便同步所见画面。该工具目前为桌面端,暂不支持第三方主题、应用块与扩展、多市场、翻译、分批发布和主题更新。
Albertsons 正使用 ChatGPT Enterprise 和 OpenAI API 帮助团队加快工作速度,并让数百万顾客的购物体验更便捷。这是 OpenAI 公布的零售商内部转型案例。
AI2 发布 Olmo-core 3,这是其大语言模型训练框架的一次重要升级,重新设计了开源 MoE 训练系统,目标是把 MoE 训练扩展到万亿参数规模并保持计算效率。
推荐理由:原文给出 MoE 训练栈的关键改动和对比数据,可看到开源训练基础设施在效率上的取舍。
OpenAI 在年度 DevDay 上发布由 GPT-6 Astra 驱动的智能体 Dots,主打个人助理之外的“第二大脑”定位,可处理 QA、网站设计、团队行程规划、投资组合再平衡和邮件营销等任务。
SpaceXAI 的 AI 版维基百科竞品 Grokipedia 发布 v0.3 更新,启用新 Logo,并重新设计首页与实时编辑页面。新首页新增精选文章、最多阅读文章列表和“最新编辑”追踪器,文章页顶部的关键信息表格格式也得到优化。Grokipedia 于 2025 年 10 月下旬以 v0.1 上线,v0.2 在一个月后发布,今年早些时候曾停止更新。
社交俱乐部 The Den 在开设新门店时,用 ChatGPT Work 将拨款申请准备时间从 3 天缩短至 2 小时,酒牌材料从 4 天缩短至 3 小时,每周节省 10-15 小时。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 开放使用,成为较早交付该平台的云厂商之一;Cognition 是首个在生产负载上运行 Vera Rubin 的客户。
Simon Willison 发布实验性工具 Photo Scrubber,可自动识别人脸并模糊处理。该工具由 GPT-6 Astra 构建,基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型。
Microsoft Research 发布面向生物学复杂性的 AI 研究系统 Quine,由跨模态生物学世界模型与连接科学工具、文献、湿实验和研究者的交互式 harness 组成。
推荐理由:原文给出 Quine 的多模态世界模型与湿实验验证结果,并开放 Fellows 申请,可据此判断生物学 AI 研究系统的落地路径。
OpenAI DevDay 2026 公布了 20 多项更新,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。
OpenAI 发布 dots,一种能够在复杂项目和日常任务中持续推进工作的主动式助手。dots 让工作在向前推进的同时,用户仍能保持掌控。
GitHub Copilot 团队提出,chat 只是 LLM 的通用兜底界面,对明确任务应改用 canvas——一种运行在 GitHub Copilot 应用内、无浏览器外壳的全栈小应用,可与 agent 双向通信并在本地执行代码。
GitHub Security Lab 发布面向 C/C++ 项目的自主模糊测试流水线 Fuzzing Taskflow,只需给定一个 GitHub 仓库地址,它就会自动识别入口函数、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness、对每次崩溃做归因并生成漏洞报告。
推荐理由:GitHub 安全实验室把模糊测试的覆盖反馈、崩溃归因等重复环节交给 LLM 智能体,读者可了解其任务流与工具分工。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构。
推荐理由:NVIDIA 与 Google DeepMind 等联合开放 2800 多种病毒的蛋白复合物结构预测数据集,读者可了解其生成方式与开放入口。
Remedy Entertainment 的 CONTROL Resonant 已在 GeForce NOW 首发上线,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 与最高 5K HDR,无需 100GB 本地安装。
Google DeepMind 推出 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模超过 AlphaFold Database 30 倍,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 技能向学术研究免费开放。
推荐理由:读者可据此了解 9 亿单核苷酸变异预测数据集如何把 AlphaGenome 的预测能力扩展到全基因组检索。
Mistral 发布 Agentic Search,作为让 AI 系统在复杂文档中导航、阅读和验证信息的检索层,通过 Mistral Search Toolkit 和 Studio、Vibe 中的 Libraries 提供。
推荐理由:官方给出多步检索循环的五工具设计与两组基准数字,读者可据此判断检索层如何替代一次性 RAG。
Mistral 宣布 Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行,以匹配数据驻留、监管和延迟要求;Mistral Priority Tier 进入公开预览,为关键业务负载提供自定义速率限制和基于 SLA 的正常运行时间保障。