GPT-6来了,AI的“实习期”该结束了吗?
GPT-6 Astra发布,奥特曼晒出了接近满分的测试成绩。与此同时,一些付费用户还在等访问权限。模型已经递上了“转正申请”,普通人最关心的,还是它能不能把工作做完。
这次值得看的变化,是AI开始更深入地操作电脑。填表、建模、画电路板,都需要识别软件状态、执行操作,再检查结果。OpenAI公布的Playco案例中,Astra从一个基础原型做出三个游戏版本,多数首次就能运行。Playco报告,人工修正减少了50%,但性能问题仍需要人处理。
数学研究里的186也值得关注。OpenAI公布的论文将一项素数间隔上界推进到186,意味着存在无穷多对相邻素数,间隔不超过这个数值。它没有解决孪生素数猜想,公开的形式化工程也依赖尚未在工程内全部证明的输入条件。成果有分量,验证还要继续。
能力越强,验收就得越具体。有没有越权,文件能不能恢复,结果是否检查过,都影响我们能否放心交出任务。使用成本还包括等待、核对和返工。生成得再快,如果检查时需要重做一遍,也省不下多少时间。
我的判断是,可以让AI在熟悉、能够验收的任务里先结束实习。做得稳,再扩大范围。转正的标准很简单,把任务交出去,回来时能拿到接着用的结果。





