
你见过AI相互打分PK吗?同时问豆包、通义千问、DeepSeek、腾讯元宝、Kimi、百度文心这六大AI同一个问题:“对豆包、通义千问、DeepSeek、腾讯元宝、KIMI、百度文心进行评测并打分,满分10分,说明各自有什么优势、评分多少,并给出结论谁是最强的。”六大AI同台互评,堪比选秀导师现场battle,结果很有意思。

一、豆包:最高分给了DeepSeek
先看豆包。它给的分最“平均主义”:DeepSeek 8.8最高,Kimi 8.7、通义千问 8.6、自己 8.5、文心一言 8.2、元宝 7.8。它的态度很明确:没有绝对最强,写代码做难题选DeepSeek,读长报告选Kimi,日常写文案选自己。“硬核技术”这一票,它投给了DeepSeek。

二、通义千问:全场最高分给DeepSeek
通义千问更大方,给DeepSeek打了全场最高9.5,自己9.0,豆包8.8,Kimi 8.5,元宝8.0,文心7.5。结论同样是按需求选,但话里话外都在说:要极致推理和写代码,DeepSeek最强。它还建议组合用:日常豆包、深度DeepSeek、办公千问。

三、DeepSeek:综合第一给通义千问
DeepSeek最“技术流”,直接搬出SuperCLUE 7月榜:通义千问71.48分国产第一,自己数学推理全场第一,综合却只排第四。它给的分数:通义千问9.2、自己8.8、Kimi 8.7、豆包8.5、文心7.8、元宝7.5。结论干脆:通义千问综合最强。

四、腾讯元宝:也投通义千问
腾讯元宝也把第一投给通义千问(9.0分),理由是SuperCLUE登顶、编程榜全球第一。它的排名:千问9.0、DeepSeek 8.7、豆包8.6、Kimi 8.4、自己7.9、文心7.1。还补了一句:论技术DeepSeek咬得很紧,论国民度豆包断层第一。

五、Kimi:综合第一仍是通义千问
Kimi给的排名是:通义千问9.2、DeepSeek 9.1、豆包8.8、自己8.6、元宝8.3、文心8.0。它承认“没有绝对最强”,但综合第一仍是通义千问,技术上限第一给DeepSeek。

六、百度文心:力挺Kimi
最戏剧化的是百度文心——几乎没夸自己,反而大篇幅力挺Kimi:Kimi K3智能指数全球第四、开源模型历史最高,前端代码全球第一。等于把“最强”这一票,直接投给了Kimi。

七、结论
盘一下票数:通义千问拿到三票综合第一(DeepSeek、腾讯元宝、Kimi都排它榜首);DeepSeek拿到两票最高分(豆包8.8、通义9.5);文心把唯一一票投给了Kimi。
金口碑网络 AI 研究院综合六家AI互评结果发现:通义千问是公认度最高的综合王者;DeepSeek是“硬核技术尖子生”;豆包则拿下C端体验第一名。这一轮综合最强,多数票指向通义千问。
当然,AI迭代太快,今天的排名明天可能就变。下一篇金口碑网络 AI 研究院接着让这六家AI互评,看看谁是最弱的那一个。

原标题:金口碑网络AI研究院实测:六大AI互评,谁会是最强王者?
广告
广告
广告