且笑风尘不敢造次 (@showyoubetter) 在 日常问答prompt对模型能力的提升好像还是有用的 中发帖
使用的问题
我用关于怎么鉴别掺水的sol和其他高级模型,不用搞那么复杂的测试,一个逻辑题就解决问题 中的问题
你在参加赛跑,如果你奋力冲刺超过了最终的第二名,你最终得了第几名?
使用的模型
api的deepseek-v4-flash, 注意不是0731
网页版的 gemini-3.6-flash
使用的prompt
都是以前在站内收集的, 比较老了
结果: deepseek-v4-flash全部答错, gemini-3.6-flash使用O1思考和全能中文ai助理的prompt以及不用prompt的时候答错了
就这一个问题测下来, 感觉prompt还是有用的, 至少对gemini-3.6-flash有提升
▶
prompt