似乎由于模型训练过程中过于奖励“调查研究”,一些在我们人类看来很“简单”的问题,或者完全可以从现有上下文里推断出答案来的问题,agent也倾向于使用更多的工具调用重新调查来增加“自信心”。这本质上还是通过“表现出很忙碌”来“讨好”人类,只是正如同现实生活里某些人的用力过猛,只会让人觉得好笑又好气。
 
 
Back to Top