SemiAnalysis:OpenAI 模型使用工具的频率有多高?
继对 Claude 的分析之后,我们查看了来自内部使用数据的 616,300 个 OpenAI 响应。
我们发现,GPT 5.6 Terra 平均每个响应有 1.94 次客户端工具调用,而 Sol 为 1.00 次,Luna 为 0.97 次。我们早期 GPT 6 Astra 的使用情况介于两者之间,在 11,717 个响应中平均每个响应 1.18 次调用。
Astra 的平均值较高很有趣,因为它在响应中使用工具的比例比 Sol 小,93.5% 对 96.7%。但当它使用工具时,我们发现它的平均调用次数更多:1.27 对 1.04。
作为提醒,这些数据代表了我们特定的工作负载,这使得与其他数据进行比较变得困难。模型倾向于看到不同的任务分类,Astra 的观察窗口较短,而且早期的 GPT 队列比 Sol 的小得多。

