用户名:
密 码:
白虎萌白酱小
在强化学习中,试图找到一个问题的解决方案,AI可能会进行数百种不同的尝试。“就像做选择题,它蒙了100次,只有最后1次对了,但它会把整个蒙题过程都当成‘正确经验’,这种学习方式存在严重的效率问题。而⼈类永远不会这样做。”其中