且笑风尘不敢造次 (@showyoubetter)日常问答prompt对模型能力的提升好像还是有用的 中发帖

使用的问题
我用关于怎么鉴别掺水的sol和其他高级模型,不用搞那么复杂的测试,一个逻辑题就解决问题 中的问题 
你在参加赛跑,如果你奋力冲刺超过了最终的第二名,你最终得了第几名? 
使用的模型

api的deepseek-v4-flash, 注意不是0731
网页版的 gemini-3.6-flash

使用的prompt
都是以前在站内收集的, 比较老了 
结果: deepseek-v4-flash全部答错, gemini-3.6-flash使用O1思考和全能中文ai助理的prompt以及不用prompt的时候答错了 
就这一个问题测下来, 感觉prompt还是有用的, 至少对gemini-3.6-flash有提升 
▶ 
prompt
 
 
Back to Top