@JohnnRen 在 现在最需要人力的环节是不是测试和评估? 中发帖

现在vibe自己的项目,我感觉花最多精力的就是测试和评估,然后组织语言把问题和建议反馈给ai了 
端到端测试虽然做了,但有些一眼就能看出的交互问题模型发现不了(或者发现效率很低)。 
好与坏模型虽然能自己判断,但常常会偏离重点(主次不分,画蛇添足等等),所以时不时需要我提醒它忽视的东西、扭转它的误区 
感觉现在从ai是我的助理,变成我是ai的助理了,但助理这个工作暂时还没法取代的样子😂 
大家觉得现在agent loop的瓶颈是在这方面吗?随着模型变强会不会能完全闭环呢?
 
 
Back to Top