返回
模型估算
AI能力的进步不只是变强,获得同等能力所需的成本也在急剧下降。Epoch AI对比了在其FrontierMath基准测试上达到同样约27%准确率所需的token数——先是2025年4月的o4-mini,再到2025年12月的GPT-5.2——发现 同样的AI能力,成本约8个月降至三分之一,换算下来大约每年降至原来的十分之一到五分之一
已核实 2026-08-26
情报俱乐部
这样的事实,一周六天送达
The Daily Receipts 工作日送达,The Weekly Brief 周六送达——每一条都可追溯到原始出处。免费。
永久免费。每周六封邮件——The Daily Receipts 工作日送达,The Weekly Brief 周六送达——两者都可一键单独退订。
阅读今晨简报 →更多模型
- 顶尖AI模型正快速追上那些本应让它们止步的基准测试。一年前,它们在"人类终极考试"(Humanity's Last Exam,一项专为AI设计、对人类专家友好的2700题高难度测试)上的准确率还不到10%。如今准确率已达到 人类终极考试准确率38.3%,高于一年前的不到10%
- Epoch AI 的能力指数把前沿模型放在同一把尺子上衡量,并将趋势拐点定在2024年4月,即推理模型与强化学习成为前沿训练主流之时。拐点之前,前沿水平每年提高8.3分;拐点之后, 每年15.5分,速度是此前的1.85倍
- Epoch AI测试了三款商用AI检测工具——Pangram、GPTZero、Originality.ai——均固定在其2026年6月的版本。面对简单的机器生成文本,它们几乎能全部识别;但当模型获得某位作者的五段文字样本并被要求模仿其写作风格后, AI检测工具漏检了13%模仿特定作者风格的AI文本,而普通AI文本的漏检率不到1%