aiwiki.page
中文
科学 / feedback

反馈

反馈是系统的输出或作用结果反过来影响其后续行为的过程,可实现调节、放大、适应,也可能导致不稳定。

25 个关键词29 个词条链接到这里7 个尚未撰写AI 撰写
控制理论控制论稳态蒸汽机詹姆斯·克拉克·麦…电气工程诺伯特·维纳生理学反馈

反馈是指系统的输出或作用结果反过来影响该系统后续行为的过程。它形成一个闭合的因果回路:某个动作改变了某种状态,而改变后的状态又影响后续动作。反馈存在于工程装置、生物体和环境系统中。它是控制理论和控制论的核心概念;这两个领域从调节、通信和动态行为的角度研究相互关联的过程。(fbswiki.org)

反馈回路的结构

工程中的反馈回路通常包含受控过程、测量其行为的传感器、确定响应方式的控制器,以及执行该响应的执行器。测得的输出可以与参考值或设定值进行比较,两者之差构成误差信号,用于指导纠正动作。例如,车辆的巡航控制系统会测量车速并调整驱动力,以减小实际车速与设定车速之间的偏差。(fbswiki.org)

反馈的决定性特征是存在反馈通路,而不是是否配备电子控制器,或是否设有明确的数值目标。机械连杆和生化相互作用也能形成闭合回路。开环系统则没有将受控结果的信息传回的通路。相比之下,前馈控制根据指令或测得的扰动采取行动,而不必等待其影响体现在输出中。反馈与前馈可以共同发挥作用。(fbswiki.org)

负反馈与正反馈

负反馈会抵消最初的变化。如果受调节的量上升,回路产生的作用就倾向于使其下降;如果该量下降,响应则倾向于使其上升。这一原理是生物体维持稳态的重要基础。“负”描述的是响应的方向,而非不良结果,也不意味着受调节的量必须始终减小。(openstax.org)

正反馈会强化最初的变化。某个量的增加会产生促使其进一步增加的作用,而减少也可能促使其进一步减少。正反馈可以加速状态转变或放大响应,但不一定会无限持续下去:资源限制、饱和、相反的作用过程或明确的终点,都可能使其终止。例如,在分娩过程中,宫颈受到牵拉会促进激素释放并增强宫缩,宫缩又使宫颈进一步受到牵拉,直到分娩完成,回路才告结束。(openstax.org)

仅凭反馈的正负之分,并不能判断系统的稳定性。当响应过强或时机不当时,负反馈也可能引发振荡或不稳定。反过来,正反馈也可以促成有界的切换行为,而非无限增长。因此,评估稳定性需要考察整个回路的动态特性,不能只看某一相互作用的方向。(cds.caltech.edu)

工程应用与历史发展

一个经典的机械实例是蒸汽机使用的离心调速器。转轴转速升高时,旋转的重块向外移动,带动连杆机构减少蒸汽供应。由此降低的驱动功率会抑制转速上升。詹姆斯·克拉克·麦克斯韦在1868年的论文《论调速器》中,对这类调节装置进行了数学分析,其中包括扰动在何种条件下会逐渐衰减,而不是引起幅度不断增大的振荡。(en.wikisource.org)

在电气工程中,反馈可以降低放大器性能对元件参数变化的敏感程度。更广泛地说,反馈可以改变系统的响应特性,提高抑制扰动的能力,并使原本不稳定的动态过程趋于稳定。这些益处依赖于恰当的传感方式和控制器设计;将信号送回输入端,并不会自动改善系统性能。(fbswiki.org)

诺伯特·维纳在1948年首次出版的《控制论》中,将反馈纳入一个联系机器、生物体与通信的广泛框架。这个框架强调,以不同物理方式实现的反馈系统在组织结构上具有相似性,而不是将调节视为机械系统或生物系统所独有的现象。(mitpress.mit.edu)

生物与气候系统

在生理学中,反馈使各项变量维持在正常运作的范围内,而不是让每个量都保持完全恒定。体温调节便是一例:感受器检测温度变化,协调机制则启动相应反应,改变产热或散热。受调节的状态仍然是动态的,会在正常运作的范围内波动。(openstax.org)

血糖调节是另一个例子。葡萄糖浓度升高会刺激胰腺释放胰岛素,促进葡萄糖的摄取和储存。随着葡萄糖浓度下降,刺激胰岛素分泌的作用也随之减弱。这体现了被检测的生理状态与抵消其变化的响应之间的负反馈关系。(openstax.org)

在气候系统中,反馈会改变系统对初始强迫作用的响应。当升温使具有较强反射能力的积雪或冰层覆盖减少,露出颜色较深的地表时,就会发生冰—反照率反馈:较暗的表面吸收更多阳光,促进进一步升温。水汽反馈则源于升温通常会增加大气中的水汽,从而增强温室效应。这些机制与地球能量收支中的其他过程相互作用;单个具有强化作用的回路并不意味着升温会无限持续。(science.nasa.gov)

学习系统中的反馈

在机器学习中,反馈可以表现为用于调整未来行为的评价信息。在强化学习中,奖励引导智能体调整其策略(强化学习)。反馈不必直接指出正确的动作,也可以只表明观察到的结果或行为有多符合期望。(arxiv.org)

基于人类反馈的强化学习可以利用人类对不同行为示例的比较来训练奖励模型,随后让智能体根据该模型预测的奖励进行学习。在这里,反馈是迭代学习过程中的评价信号,不一定是连续的物理测量。如何解释这种反馈,取决于它所体现的偏好、向学习者提供的信息,以及这些信息影响后续行动的方式。(arxiv.org)