NVIDIA GPU 加速 OpenAI GPT-6 Astra Ultrafast
GPT-6 Astra Ultrafast 现已在 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户中上线,运行于 NVIDIA Blackwell GPU 之上。
推荐理由:通过 8x 提速和 API 可用性两个事实,读者能判断这一版本对编码智能体循环的实际影响。
GPT-6 Astra Ultrafast 现已在 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户中上线,运行于 NVIDIA Blackwell GPU 之上。
推荐理由:通过 8x 提速和 API 可用性两个事实,读者能判断这一版本对编码智能体循环的实际影响。
Google DeepMind 发布前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络防御方开放,随后逐步扩展至开发者、企业和消费者,起价为每百万输入 token 2 美元、每百万输出 token 10 美元。
推荐理由:官方给出 Gemini 4 Argon 的基准得分、输出上限与分阶段开放路径,便于判断其在编码与企业任务上的位置。
OpenAI 披露其阻断了一起协同的模型蒸馏行动,该行动旨在提取受保护的模型推理能力。OpenAI 表示正在加强对对抗性蒸馏的防御。
NVIDIA 发布表格数据开源基础模型 Kumo Tabular,可在单次前向传播中完成分类与回归预测,无需训练、调参和特征工程。
推荐理由:文章完整披露了表格基础模型的预训练数据构造与架构设计,可据此判断免训练推理在表格任务上的可行性边界。
OpenAI 发布 GPT-6.1 Sol,主打接近 Astra 的智能水平,覆盖编码、电脑操作和专业工作场景,标准 API 输入与输出 token 价格均为 Astra 的五分之一。原文未给出更多参数、基准或开放细节。
推荐理由:OpenAI 以 Astra 五分之一的价格推出面向编码与电脑操作的新模型,可据此比较其定位与成本取舍。
H 公司发布 Holo4 系列智能体模型,包含 27B dense 和 35B-A3B MoE 两个尺寸,均可通过 H Models API 调用,同时开源基于 Nemotron 3 Nano Omni 后训练得到的 Holotron4 Nano。
推荐理由:Holo4 用同一套权重打通 GUI、代码、MCP 与 API,公开了完整轨迹,读者可据此评估通用计算机智能体的跨界面路线。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上把近实时视频生成与语音对话原生结合,让企业智能体具备会听、会看、会说的动态视觉形象,即日起在 Gemini Enterprise 上线。
推荐理由:原文给出了实时视频形象与语音对话的原生耦合方式,读者可据此判断企业级实时多模态交互的落地形态。
Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark 草稿模型,通过投机解码实现设备端最高 3.13 倍、H100 上最高 2.66 倍解码加速,端到端最高提升 2.62 倍和 2.27 倍。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与逐行表演指导,后者面向高并发、低成本的配音与语音智能体场景。
推荐理由:原文给出两款 TTS 模型的能力差异、基准排名和开放入口,读者可据此判断语音生成在创作与规模化场景中的分工。
Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音对话模型,分别面向规模化低成本场景和高复杂度多步推理任务。
推荐理由:官方给出语音对话模型的两档定位与多语言、后台调用工具等能力细节,可供开发者判断接入场景。
Google DeepMind 与 Google Research 发布全球天气 AI 模型 WeatherNext 3,直接学习实时卫星观测,逐小时生成预报,温度等关键地表变量分辨率达 5 公里,整体比上一代 WeatherNext 2 精细约五倍。
推荐理由:官方披露了实时卫星数据训练、逐小时刷新与降水精度提升的具体数字,可用于对比上一代全球天气模型。
微软研究院发布 GigaPath-Flash 和 GigaTIME-Flash,用蒸馏自十亿参数 GigaPath 编码器的 22M 参数 ViT-S 骨干替换原有模型,以 Apache 2.0 许可开源。