Google 在 Gemini 聊天中上线 Skills 取代 Gems
Google 在 Gemini 聊天中全球上线 Skills,用针对具体任务的详细提示词取代此前的 Gems。用户可把常用指令存为 Skill,输入“/”加名称调用,Gemini 也能从历史对话生成 Skill 并在识别到匹配提示词时自动运行,多个 Skill 可串联处理更大任务。
Google 在 Gemini 聊天中全球上线 Skills,用针对具体任务的详细提示词取代此前的 Gems。用户可把常用指令存为 Skill,输入“/”加名称调用,Gemini 也能从历史对话生成 Skill 并在识别到匹配提示词时自动运行,多个 Skill 可串联处理更大任务。
Meta 推出 Muse AI 智能体,宣称能帮用户发邮件、在线购物,前提是愿意把数据交给 Meta 并绑定信用卡。发布后 Meta 又宣布了类似 Tamagotchi 的 Muse Charm 设备,并陆续公布面向小企业的工具扩展、企业平台 Muse Enterprise Platform,以及登陆 Meta 智能眼镜、推出 Mac 应用等动作。
DoorDash 周三宣布推出可通过 Apple Messages 点餐的 AI 智能体,用户发送“order my usual”这类提示词,智能体即可理解其常点订单。该智能体支持指定菜品、查询本地推荐并发送推荐食物照片,还能在同一笔订单中处理多人不同的饮食偏好和数量。DoorDash 已面向美国用户开放候补名单,同时宣布将在北加州部分餐厅测试配送无人机。
OpenAI 在 Dev Day 上由 CEO Sam Altman 宣布推出 Decisions API,为 Luna 模型提供预定义选项以快速输出分类或智能体行为选择。
听力科技初创公司 Legato 周四宣布,其 AI 助听眼镜 Legato Frames 正式开售,起售价 999 美元。该眼镜将专利助听技术集成于镜腿,通过 AI 区分人声与背景噪音并放大语音,双扬声器系统可在距耳数英寸处将外泄声音降低 99%,重 34 克、续航 10-12 小时,提供三种款式并支持处方镜片与蓝牙串流。该产品在美国官网及部分眼科护理机构有售,可获视力保险报销。
GPT-6 Astra Ultrafast 现已在 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户中上线,运行于 NVIDIA Blackwell GPU 之上。
推荐理由:通过 8x 提速和 API 可用性两个事实,读者能判断这一版本对编码智能体循环的实际影响。
Amazon Quick 推出 Live Data in Apps,AI 构建的应用可在用户每次打开时实时查询受治理的 Quick Sight 数据集,取代发布时固化的静态快照。查询以查看者身份执行,自动沿用原有行级和列级安全规则,仅支持已认证的 Quick 用户,每位查看者首次使用需按数据集授权。SPICE 和 Direct Query 两种数据集模式均受支持。
Google 在 Gemini Live 中上线 Guided Vision,支持兼容的 Android 设备,可通过摄像头对指向的画面进行实时语音描述,帮助读取小字、描述周围环境和识别物体。
OpenAI 全球上线 ChatGPT 两项购物功能,包括虚拟试穿服装配饰和收藏商品供日后查看。用户可上传自拍或全身照预览服装上身效果,也可上传商品图片让 ChatGPT 为其试穿,试穿入口以 Try On 按钮出现在购物结果中;收藏功能可将商品存入应用内 Library,并与试穿图片一同保存。
Ideogram 发布新模型 Ideogram 4.5,称其只修改用户指定的区域,替换服装时人物体型和背景保持不变。官方称目标场景包括产品摄影、室内设计、照片修复和图中文字编辑,早期测试者确认多次编辑后一致性较强。
Shopify 周四推出建站工具 Canvas,商家通过与 AI 智能体 Sidekick 对话来创建店铺。Canvas 实时渲染店铺背后的真实代码而非静态预览,可测试交互与动画,并查看不同屏幕尺寸下的效果,Sidekick 会截图以便同步所见画面。该工具目前为桌面端,暂不支持第三方主题、应用块与扩展、多市场、翻译、分批发布和主题更新。
Albertsons 正使用 ChatGPT Enterprise 和 OpenAI API 帮助团队加快工作速度,并让数百万顾客的购物体验更便捷。这是 OpenAI 公布的零售商内部转型案例。
台湾统一企业集团旗下数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词级输出优化,以适配其零售审核策略。该策略按行为(9 类)和主体类型(brand、other、forbidden)两个维度分类互动,微调数据集含 3391 个对话窗口,评估使用 737 个对话窗口的留出测试集。
OpenAI 在年度 DevDay 上发布由 GPT-6 Astra 驱动的智能体 Dots,主打个人助理之外的“第二大脑”定位,可处理 QA、网站设计、团队行程规划、投资组合再平衡和邮件营销等任务。
SpaceXAI 的 AI 版维基百科竞品 Grokipedia 发布 v0.3 更新,启用新 Logo,并重新设计首页与实时编辑页面。新首页新增精选文章、最多阅读文章列表和“最新编辑”追踪器,文章页顶部的关键信息表格格式也得到优化。Grokipedia 于 2025 年 10 月下旬以 v0.1 上线,v0.2 在一个月后发布,今年早些时候曾停止更新。
社交俱乐部 The Den 在开设新门店时,用 ChatGPT Work 将拨款申请准备时间从 3 天缩短至 2 小时,酒牌材料从 4 天缩短至 3 小时,每周节省 10-15 小时。
Latent Space 在 OpenAI DevDay 当天采访 OpenAI Computer Use 产品与工程负责人 Ari Weinstein 及 API 产品负责人 Nikunj Handa,Ari 回应了 Dwarkesh 关于 Computer Use 两年未进步的判断,称其已“180 度不同”。
OpenAI 在 DevDay 2026 上发布 dots 常驻智能体(由 GPT-6 Astra 驱动,可连接 4,000+ 应用与 Slack/Teams),以及 GPT-6.1 Sol,官方称其以五分之一的 Astra 价格提供接近 Astra 的智能水平,定价为每百万 token 输入 2 美元、输出 10 美元。
推荐理由:OpenAI DevDay 2026 一次性发布智能体、模型、API 与定价调整,读者可据此了解其产品线布局与商业动作。
Hugging Face 推出 Open TTS Leaderboard,用客观指标评测开源 TTS 模型,让单模型评测耗时从数周投票缩短到数小时。
Simon Willison 发布实验性工具 Photo Scrubber,可自动识别人脸并模糊处理。该工具由 GPT-6 Astra 构建,基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲。
推荐理由:以现场直播形式完整记录了 OpenAI DevDay 的发布节奏与演示细节,适合观察其智能体与开发者生态的落地方向。
OpenAI DevDay 2026 公布了 20 多项更新,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。
OpenAI 发布 dots,一种能够在复杂项目和日常任务中持续推进工作的主动式助手。dots 让工作在向前推进的同时,用户仍能保持掌控。
Remedy Entertainment 的 CONTROL Resonant 已在 GeForce NOW 首发上线,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 与最高 5K HDR,无需 100GB 本地安装。
Google DeepMind 公布 Private AI Compute 架构更新,将为该平台引入持久的服务端记忆层,让 AI 助手在跨设备场景中保留上下文,同时维持接近设备端处理的隐私标准。
推荐理由:Google 公布把设备端密钥与云端安全隔离区结合的持久记忆方案,可用来看云端 AI 隐私的工程取舍。
Mistral 发布 Agentic Search,作为让 AI 系统在复杂文档中导航、阅读和验证信息的检索层,通过 Mistral Search Toolkit 和 Studio、Vibe 中的 Libraries 提供。
推荐理由:官方给出多步检索循环的五工具设计与两组基准数字,读者可据此判断检索层如何替代一次性 RAG。
Mistral 宣布 Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行,以匹配数据驻留、监管和延迟要求;Mistral Priority Tier 进入公开预览,为关键业务负载提供自定义速率限制和基于 SLA 的正常运行时间保障。