UK AI Security Institute

测试博客

Test blog

二〇二六年六月二十三日 · 英文原文

OpenAI 的研究表明,当AI模型在测试阶段获得更多计算资源时,其任务处理性能会提升并最终趋于平缓。新模型通过更高效利用测试时计算(test-time compute),进一步扩大了能力差距。该发现基于对LLM(大语言模型)的benchmark测试,揭示了计算资源分配与模型性能之间的非线性关系。

更多测试时计算,更多能力——示意说明

当AI被赋予更多计算资源来处理任务时,其性能会提升——随后最终趋于平缓。随着新模型在测试时更善于利用计算资源,能力差距会进一步扩大。

译自 UK AI Security Institute · 录于 二〇二六年六月二十三日