栏杆拍遍 (@Langanpaibian)说个暴论:grok的能力可能被大家高估了 中发帖

Grok4.6似乎被大家认为是5.6sol的平替或者只比他低半档,但是我实际使用中发现他甚至不如部分国模。如题,个人平时用途是科研相关,搜集文献,确认选题,分析结果等,也会用来写一些代码。当然grok4.6的agent能力是优秀的,但是在科研问题上经常给我的感觉是不靠谱(当然这些东西我现在没办法证实)。但是现在我举一个例子吧,我想搜万达和孙割事件女主角的关系,因此搜了这样一个问题 * “有一次王思聪在某个节目中说出类似 我说实话,我被禁止讨论这个话题,这是谁说的什么事?什么节目?似乎是个国内某个类似谈话类的综艺节目。” * 
以下是几个AI网页版的回答(GROK和google我订阅了,kimi没订阅) 
grok4.6 expert模式:询问多次没有给出正确答案 
 [image] 
[image] 
[image] 
Ai studio的3.7flash和3.1pro:我去油管上找了原视...
 
 
Back to Top