@45dino 在 AI 去做小型困难研究类任务的工作流 中发帖
书接上回
我最近在打一个 heuristic 性质的编程比赛,就是给一个现实场景的模型,要通过代码实现一个调度方案,每次评测的时候会给你的调度方案塞一个具体场景,调度的效果越好得分越高。
我现在在本地跑 fable/opus-5,然后让他直接向网页版的 gpt pro 提问交流,即便用了我认为最顶尖的两个 AI,目前前面仍然有一堆人,我不知道他们是如何 push AI 去做的,我大概让他跑了十几个小时,反复迭代,最后的得分是他们有些人 1h 拿到的。
所以我就非常好奇,有没有一些 prompt/tools 能够更大程度地调度 AI,还是说这个水平的 AI 应该减少人类的干预?因为我个人感觉 superpowers 之类的已经不太好用了