阿里和腾讯,这对在互联网战场上斗了十几年的老对手,最近罕见地坐到一起,看中的竟是一家成立还不到一年的公司,而且估值可能达到168亿元人民币。
这家公司叫UniPat AI,创始人叫李宽,没听过很正常,因为UniPat AI成立还不到一年,而创始人李宽,香港科技大学博士生,研究方向为LLM Agent和可信机器学习,2025年还在通义实验室DeepResearch项目组实习。
据彭博社报道,阿里将按25亿美元估值,领投UniPat AI一轮3亿美元融资,腾讯跟投,红杉中国也在老股东名单里。25亿美元,约合人民币168亿元。
一个90后实习生创办不到一年的公司,凭什么值这么多钱?
一年前,李宽还在通义实验室期间,主攻训练后分析、数据合成和强化学习。出来创业,他没造大模型、没造芯片、没抢算力,而是专门给AI出题、造任务、打分。
简单说,大模型是“学生”,UniPat就是“考官”—负责出卷、批改,告诉AI到底哪里做错了。
他们把AI模型放进真实任务里测试:代码Agent能不能修好一个Bug、浏览器Agent能不能自己完成网页操作、多模态模型的视觉推理能力到底行不行。
他们造的那张“考卷”,曾经让所有大模型都尴尬了。UniPat曾联合红杉中国旗下评测体系xbench,发布了一个叫BabyVision的多模态视觉推理评测。测试的是大模型“看懂世界”的能力—不依赖语言提示,纯靠视觉。
16位本科以上学历的成年人做同一套题,准确率94.1%。
表现最好的AI模型Gemini 3 Pro,只有49.7%。
也就是说AI能写论文、解奥数、生成代码,但让它看一张图、判断一个简单的视觉场景,它可能还不如你家三岁的孩子。
这件事为什么突然值钱了?过去几年,AI行业拼的是谁的模型更大、谁的芯片更强、谁的算力更多。
但现在模型越来越多,真正让AI公司头疼问题变了:我的AI到底好不好?它能不能真正干活?
尤其现在AI不只是聊天了,它开始变成Agent。要自己打开网页、查资料、写代码、调用工具,甚至完成一整套真实任务。你让一个AI去修程序Bug,它得读代码、找问题、改文件、跑测试,第一次失败还得接着试。这已不是“问AI一道题”——这是给AI安排一场真正考试
谁掌握了这套“考试系统”,谁就在AI产业链里卡住了一个关键节点。而UniPat就是那个出题的人,所以它变得非常之值钱。
评论区聊聊你的看法👇
#UniPat #阿里 #腾讯









