众力资讯网

横向对比一些「flash」模型的视觉,在读漫画方面的能力 6张图,总分30分 deepseek-v4.1-flash:13分 mimo-v2.6-flash:17分 glm-5.3-flash:11分 gemma-4-31b-it:17分 --- deepseek和glm在胡言乱语,幻觉比较大 mimo理解比较准确,但死于话多.. gemma话少出错得也就少,对画面氛围把控还是比较准确 ​

横向对比GPT系列模型在读漫画方面的能力

6张图,总分30分gpt-6-luna(none):1分gpt-6-luna(max):3分gpt-6-sol(none):6分gpt-6-sol(max):28分gpt-6-astra(max): 29分

luna级别模型,不管是否开思考,比先前测的 flash系列中最差的模型都要差sol开深度思考对正确率帮助很大astra有时候会做过多的解读、发挥,但分析得很细腻,几乎满分

---

早上测的Flash系列模型,传送门:网页链接