Graphite 研究:Claude Opus 5.5 爱说"this matters",各前沿模型写作痕迹各不相同
Graphite 研究分析前沿模型写作习惯后发现,Claude Opus 5.5 最爱用"dependable"(比人类样本高 23 倍)和"this matters"(高 116 倍),OpenAI Astra 则偏好"another dimension"与"not simply X"式修正性表述(超人类 100 倍)。
Graphite 研究分析前沿模型写作习惯后发现,Claude Opus 5.5 最爱用"dependable"(比人类样本高 23 倍)和"this matters"(高 116 倍),OpenAI Astra 则偏好"another dimension"与"not simply X"式修正性表述(超人类 100 倍)。
Google DeepMind 发布论文,让 100 个运行 Gemini 3.1 Pro 的自主 LLM 智能体协作求解 71 道数学题,并为它们提供公共公告板、私信和共享知识库三种协作渠道。
Import AI 469 期介绍了新基准 DiG-bench,其包含 70 款规则与目标均隐藏的探索类游戏,公开 21 款并设七档难度,Opus 5 与搭配 Claude Code 的 Fable 5 表现最佳,仅这两者在 Tier 7 取得 0.2 成功率,而人类可达 100%。