第四节 自我控制一一有限意志

第四节 自我控制一一有限意志

一、自我控制

跨期选择经济学模型中一个标准的假设是人们有时间一致偏好:无论一个人何时被问及,他在早期和晚期对福利的偏好都相同。然而事实并非如此。从早期看,他们希望行动相对有耐性,但当行动的那一刻临近时,他们迫不及待地想要开始。这就是所谓的自控对行为的影响,它的存在已经被心理学家们研究证实,并得出了重要结论:人们有递减的贴现率一一随着日期T 临近"现在",相对于日期T+△ ,人们对日期T 的偏好更明显。行为经济学中,人的自我控制行为是研究的一个重点,它是指人们在进行跨期决策时,可能会因预测到自己的行为在未来产生的效用而控制自己现在的行为。由行为经济学导出的时间变化偏好模型来预测的行为,经常与传统经济学的指数模型预测的行为大相径庭。最明显的例子是人们在自控方面所做的努力:因为你可能不喜欢自己将来的某种行为方式,所以你会调整自己对未来的选择。

假如你的老板并没有要求你在2 月1 日必须做出何时工作的决定,而是给你3 种选择:你可以在4 月14 日完成任务;你可以在4 月15 日完成任务;或者你可以等到4 月14 日再决定何时工作。那么你会选择哪一个?延后再决定的优势非常明显:由于你的任何决定都不会被阻止,因此如果从现在到4 月之间出现的所有突发事件都已经被解决,那么你会认为自己一直维持的这种适应性很有价值。

然而,我们的行为有时却会影响自己将来的适应性。如果所有事都很确定,那么你可能会将日期从2 月1 日推到4 月14 日。如果你目前的偏好是希望早日完成工作,那么你会约束自己将来不要拖延。

总之,研究者们已经探究了很多用以限制我们未来选择的自我约束模式,例如戒酒中心、减肥中心,在那儿你不能随意离开,不能购买酒水美食,而这些都归功于"圣诞节俱乐部",因为直到圣诞节,你才被允许提款去购买小包装的诱人美食,避免你到家后过量饮食。另外,即使你没有参加自我控制中心,你也可以通过各种"自我要求规则"控制自己。考虑标准贴现效用模型的简单修正(Phelps & Pollak , 1968) :

其中,系数8 是标准贴现率,表示"时间一致"的迫不及待。系数。引入了一种时间非一致的对及时行乐的偏好,反映了人们的自控问题。特别地,任意自< 1 ,在任何一个给定的时期,人们相对未来对"现在"更偏爱。

以该模型为基础,分析下述看电影的例子:

假设某人可以选择在时期2 看"卧虎藏龙"或在时期3 看"十面埋伏",这些选择产生以下即时效用:

在时期2 看"卧虎藏龙":U 1 =0 ,U2 =4 ,u3 =0

在时期3 看"十面埋伏":U 1 =0 , U2 =0 ,叫=6

当? = 1 ,自= 1/2 时,考虑某人的偏好:在时期1 ,此人的偏好为u l (U1,U2,U3)=U 1 + ( 1/2 ) U2 + ( 1/2 )叫,因此,此人一定偏好"十面埋伏",因为这样得到的即时效用为(1/2) x6 =3 ,而看"卧虎藏龙"只能得到即时效用(1/2) x4 =2 。在时期2 ,此人的偏好为u2 (吨,同)三U2 + (1/2) 屿,结果,此人更偏好"卧虎藏龙",因为这样得到的即时效用是(1 )x4=4 ,而看"十面埋伏"的即时效用只有(1/2) x6 =3 0这个例子说明这些情, 8) 偏好如何增加了自控问题:尽管早期人们想耐心行事等待观看更好的电影,然而在行动的时刻他却迫不及待选择现在观看次等的电影。

二、有限意志

有限意志理性选择理论认为行为人具有完全意志能力,能够保证其效用函数具有有序性和单调性。有序性保证行为人在不同行动方案下得到的效用是可以比较的。单调性则保证行为人能够在不同的效用之间区分出偏好程度的差异并进行排列。

有序性和单调性使行为人对自己的效用函数有清醒的认识,使之符合最大化的要求。但是行为人的效用不一定都是社会所认可和激励的效用,甚至与行为人自身的整体、长期效用最大化也是有区别的。社会要求每个成员都对其效用进行自我控制,但更多的情形是:一是有些效用在某些情况下成为了主导效用,行为人没有或难以对自己的整体效用进行控制,二是因为行为人同时具有多个效用目标追求,而难以对它们进行排序。行为人的意志力是有限的,主要体现在两个方面:

1.习惯、传统、嗜好是过去行为对当前行为选择的影响。习惯了重复过去的行为,但并不代表着被重复实施的行为就是最有效率的行为。对传统的维护更多的是与"现状偏见"联系在一起的,行为人坚持了与其当前的效用水平一致的选择。嗜好则是行为人在过去的实践中体验到的能使其感到快乐的行为,尽管在很多情形下不良嗜好会带来降低行为人效用水平的后果(如吸烟) ,但行为人多坚持满足自己的嗜好。

2. 生理欲望,如饥饿、干渴、性欲、睡眠、疼痛等,是人类本性所产生的欲望,它们不同于从过去行为中建立起来的欲望,但同样可以使行为人丧失对个人效用的控制。如饥饿使减肥者过量进食,尽管她对苗条身材的渴望超过了吃饭。一个疲劳的卡车司机尽管清楚打瞌睡的危险,但还是经常发生因打瞌睡而导致的交通事故。实验也表明,一旦行为人为一种生理欲望所控制时,行为的选择常常是为实现欲望。习惯、传统、嗜好、生理欲望都是暂时性的主导效用,极有可能不符合行为人的整体或长期效用的最大化,这和人们常说的"感情战胜了理智"是一致的。

"有限意志"表明行为人不能形成有序的效用函数,在多重目标的冲突中,没有追求整体效用的最大化,而是追求了当前效用的最大化。但行为人毕竟是进行了最大化的追求,并且在多数情况下实现了当前效用的最大化,尽管行为人的效用选择是错误的(就其整体效用的实现而言)。

此外,"经济人"假定每个人都具有无限意志力而追求效用最大化。在经济实践中,人们往往知道何为最优解,但因为自我控制意志力方面的原因无法做出最优选择。人们往往根据短期利益而非长期利益进行选择。阿罗不可能走理已经表明,不存在与个人偏好完全一致的社会偏好。

例如,经济学中广泛讨论的搭便车问题,其存在有其必然性,因为我们并不能指望个人无条件地提供公共产品,除非其私人福利会因此而得到提高。然而实际上,存在着许多公共产品由私人提供的例子,例如对饥荒的救济、私人资助的医学研究等。所以,用利己原则解释利他主义的经济现象,其结论显然是牵强、不具有说服力的。

David Laibson ( 2侃)())和Mathew Rabin ( 1998 )描述了有关人和金钱之间存在的一种"反常现象",即人们的储蓄行为中出现的"夸张贴现"现象。他们认为,当人们预期有金钱收人但尚未收到的时候,人们是能够相当理性地在花多少和储蓄多少的问题上做出规划的。在有限的剌激下,人们愿意储蓄和推迟开支,从而企业可以利用这些储蓄进行投资,推动整个经济增长。

他们还指出,尽管人们的愿望是好的、符合理性选择的,但是当真的收到金钱的时候,人们的意志便崩溃了,钱往往立即被花掉,这一现象被称为"夸张贴现"。这是因为,在人们的时间偏好中,短期贴现率往往大于长期贴现率。夸张贴现函数正是抓住这一特征,认为人们并不能够在一生中都合乎理性地对开支和储蓄作统筹安排,而是从年轻到老年都负债。Lucas 也承认储蓄行为中存在的谜团多得足以令人们怀疑行为论者"夸张贴现"的观点。

三、多重自我

每一个行为人在任何给定时间都可能不具有一个理性选择理论所限定的单一的、内在一致的偏好集合,更多的情形是,行为人同时具有许多相互竞争的偏好。这就使行为人面临着一个多重偏好的"集体行动"问题。多重自我问题在跨期决策上有着充分的体现,未来本位的自我将和现在本位的自我产生冲突,如吸烟是当前的享受与未来的健康受损冲突、年轻时过度消费的快乐和年老时衣食无忧的安逸冲突。其实,任何一个决策都面临着多重自我问题,如何使它们统一起来还没有一个行之有效的办法。一般认为个人的天生禀赋、经历、年龄、教育等能起到一定的作用,另外,也可以通过法律鼓励所希望的偏好或抑制所不希望的偏好。

四、自我了解一一伽是"天真的人"还是"老练的人"基于人们对自己的自我控制力的认识程度的不同,斯特罗茨( Strotz ,1955 )将人们分为"老练的人"和"天真的人"。

"老练的人"指的是对自己未来的自控问题具有充分认识的人,"天真的人"指的是对自己未来的自控问题毫无意识的人。人们通常低估自己的未来行为与他们目前对未来行为的偏好不一致的程度。例如,当学生们认为明天他们会下定决心"天一亮就起来"时,其实他们可能并不常具有这种意志力。Loewenstein ( 1996 )间接地从心理学研究中得出结论:人们可能是天真的。

Ariely 和Wertenbroch 做过一项研究,他们使一组被观测者有能力给自己强加有成本的期限(比如,给学术论文定期限) ,而第二组由外力施加平均分割的期限。第一组被观测者选择自己施加期限,说明他们并非完全夭真。

但是他们选择的期限比平均分割的期限允许更多的拖延,而且通过一些表现(如学术成绩测评)发现,他们的成绩更差。这一结果与"人们在某种程度上不完全知道未来的自控问题"的论点是一致的。

Donoghue 和Rabin 阐述了一种更现实的假设方法一一"部分天真"。他们认为一个人有真实的自控问题。,但觉察到未来他会有自控问题。假定这个人相信未来他会像一个老练的人那样行动,自控问题为自。那么此人将选择最大化其当前偏好的当前行为,这由他的真实的自控问题。决定。

在这段阐述中,有标准的时间一致偏好的人,称之为TC ,他们有白=自= 1;老练的人有自=自< 1; 天真的人有自〈自= 1; 部分天真的人有自〈自<1 。

再考虑看电影的例子。如上所述,此人在时期l 偏好"十面埋伏",时期2 则偏好"指环王",那么此人在时期1 认为他在时期2 的偏好是什么呢?给定白,则此人觉察他在时期2 的偏好为U2 ( 屿,同) = u2 +自u30 如果自<2/3 ,那么他会认为时期2 他会更喜欢"指环王",就是说,他正确地预测到他的偏好会改变。相反,如果在>2/3 ,那么他会认为在时期2 他会偏好"十面埋伏",就是说,他错误地认为他的偏好不会改变。

Donoghue 和Rabin 对一些简单环境下探究认知的作用进行了深入的讨论,并勾勒出一些基本原理。我们将在此基础上稍作修改,并为简便起见假定? = 10

1.一-锤定音( One-shot Decisions)

在某些情况下,个人对未来自控问题的认知不影响它的行为。最明显的例子就是简单的一锤定音。比如,某人选择是否吃棕子。假定棕子的即时效用为5. 但产生未来成本为10 。如果这是吃棕子的惟一支付,那么此人的决策将非常简单:如果5- 自(10)>0 或自<2/3 ,那么他将吃掉棕子。换句话说,他会实施他当前感觉最好的决策,这与他对未来自控问题的认知是不相关的。

关于这个结论的一些评论有助于说明认知造成影响的途径:

(1)一锤定音不一定只包括短期行为。例如,如果某人必须在一月把棕子依次委托到后三个月,他将仅选择他当前感觉最好的顺序,与对未来自控问题的认知还是无关的。一般地,对任何包含长期许诺的决策,认知都不会有明显的影响。

(2) 如果某人面临一系列完全不相关的一锤定音,那么这与他对未来自控问题的认知还是无关的。比如,连续七夜这个人必须选择是否吃棕子。

如果在任意一夜吃棕子不影响其他夜晚吃棕子的支出,那么这些决策不相关。如果上述支出适用于所有夜晚,那么若自< 112 ,则此人每晚都会吃棕子,反之则反是。人们注意到,如果收益小于成本,那么每夜此人都想在下一夜逃过吃棕子。可见,此人对下一夜是否吃棕子的预期取决于他的认知一一一如果。< 112 ,他将会预计未来每夜都吃棕子;如果。> 112 ,他预计未来哪一夜都不吃棕子。但若当不同决策的支出无关时,这些关系都不能影响他今夜吃棕子的决策。

什么是决策无关?如果对每个决策的选择都不影响另一决策的支出,则两个决策无关。它取决于这两个决策具体而定。例如,某人对下周末看"卧虎藏龙"还是"十面埋伏"的预期会影响他今晚吃棕子的决策吗?大概不会。但是对他明天午饭吃扬州炒饭还是吃红烧肉的预期会有影响吗?有可能。对他今晚吃苹果还是吃饼干的预期会有影响吗?也有可能。

由此可见,真正的一锤定音是稀少的。如果此人今夜吃棕子影响明夜吃棕子的支出一一例如,由于棕子的成本与棕子个数不是线性关系,或个人对棕子的胃口变好,或对棕子的预算有限一一那么这就不再是一锤定音,而遭遇且对未来自控能力的认知将影响行为。

2. 何时行动( When to Move)

当决策相关时,认知有可能减轻或加剧自控问题引起的行为偏误,这主要取决于环境。为了说明这些可能性,奥·唐格霍( 0 ' Donoghue) 和拉宾( Rabin) 介绍了单一行动环境的修正版本。假定某人在有限的几个时期里必须做出一次确切的行动,每个时期,此人只选择做与不做,没有可获得的外界许诺保证未来的行为。在该条件下,自控问题的含义以及认知的作用,取决于行动是繁重的还是快乐的。

( 1 )繁重的任务

假定有一项繁重的工作,某人必须在以后的T 个时期内的某一个时期完成(T 可能很大)。任务很繁重,需要此人承受的损失为10 。完成该任务产生未来的回报,但是拖延任务将减少回报。具体地,如果此人在时期完成任务,他得到的回报是Y ,但是每一次拖延减少112 的回报。因此,如果此人在k + 1 期完成任务(即延误了k 期) ,那么回报将变为(÷)kv。

在8 = 1 ,自=0.9 的条件下考察行为。给定8 = 1 ,标准的时间一致者仅在最大化回报与成本之差的时期内完成任务。因为反映了在问及前期观点时,有自控问题的人们怎样行动,他们的行为是一个有用的基准。每个时期,有自控问题的人们在拖延承受繁重任务的成本和短期拖延造成的回报损失之间权衡取舍。

完全不知道未来自控问题的天真者往往拖延任务直到最后期限T。因为天真者通常认为自己总是我行我素并在未来选择最优,他们总是相信如果在本期拖延他们会在下期完成任务(因为任何未来的拖延都不是最佳的)。因此,每期他们都把承受任务成本的收益放在未来而不是现在做比较:现在是(l -?) xlO=l ,拖延1 期的贴现回报损失是自x ( 112) = 0.45 。可见拖延的收益大于损失,所以天真者总偏好下期而非本期完成任务,于是他们一直等待,直到T 期才完成任务。

相反,老练者能够完全知道未来的自控问题,他们更早地完成任务。与天真者一样,老练者也喜欢拖延遭受繁重任务的成本。但是与天真者不同,老练者正确地预期如果现在拖延,他们将在未来何时能完成任务。因此,如果老练者选择在时期1 拖延,他们就必须平和地对待实际将发生的拖延。换句话说,如果老练者拖延到时期,那么他们必须在时期1 已经偏好于在时期T 完成而不是时期1 。在这个例子中,老练者至多容忍两期拖延(到时期3) ,即必须在前三期的某一期完成任务。

相信? <0. 佣9 的部分天真者行为与老练者的完全一致,他们提前完成任务;而白>0.909 的部分天真者则选择在最后时刻完成任务。部分天真者将会拖延,但是最多容忍两期的延误。如果他们的信念校准得十分好一-?足够接近日一一-那么部分天真者对未来行为的预期与老练者一样,因此与老练者行为相同。如果他们过分乐观,认为未来对拖延的容忍至少比现在的容忍少一期一一就是说,他们觉察到未来对拖延的容忍少于两期,那么在所有时期部分天真者都相信,如果他们现在等待,他们将在两个时期内完成任务。结果是,他们一直等下去,直到在时期T 完成任务。

由此可见:对于繁重的任务,只要有一点点天真就有可能导致严重拖延。无论某人愿意容忍到何时,比如,一个k 期的拖延,他只需要过度乐观地觉察到未来拖延容忍少于或等于k -1 ,就能导致严重拖延。结论说明,只要有一点点天真,完全老练的假定就很可能是站不住脚的。的确,老练者都难免严重拖延,那么有任何一点天真的就更有可能严重拖延。

(2) 快乐的活动

相对于繁重的任务,对快乐活动的情况,比如看电影,他们也进行了深入的讨论。

假定有一项快乐的活动,某人将在以后的T 个时期内的某一个时期完成。这个活动会带来快乐,完成这个活动产生即时回报,并且随时间增加。特别地,如果此人在时期T 完成任务,他得到的回报是V ,但是如果提前完成,每期回报减少为O.99V 。因此,如果此人在t 期完成任务,那么回报为(0.99)T 斗V 。此外,活动没有成本。

我们仍然在& = 1 ,自=0 的条件下考察行为。时间一致代理商在最大回报的时期T 完成活动。因此,如果从前期出发,有自控问题的人很可能等到时期T。尽管如此,在每个时期,他们都在即时获取回报和等待带来的更大回报的渴望中权衡取舍。

天真者将拖延至时期T- 10。如前,天真者总是相信他们将在未来我行我素并选择最佳的,这里意味着他们总相信如果他们等待,那么将在时期T完成这个活动。因此,在时期t ,他们比较及时行乐的回报(0.99) T → V 和等到时期T 的回报?V , t 越大,及时行乐的效用值就越大。天真者完成活动的时间是当他们与等到时期T 相比更偏好及时行乐的时候,即时期T -100不幸的是,老练者一点也不能拖延,他们在时期1 取得回报。因为只有当d > 10 ,才有(O.99)T-.V< 自(0.99) T → -d 。所以,老练者认为他们将等待10 期以上的时候,他们才会拖延。不幸的是,一个类似于有限重复的囚徒困境的阐释导致他们总是认为如果他们现在拖延的话,他们下一期就能获取回报。因为他们正确地预见到他们将在T -1 期完成活动,在T -2 期他们意识到等待仅仅意味着再等一个时期,而这是不值得的。因此,他们将在T-2 时期完成活动。但这意味着在T-3 期他们正确意识到等待仅仅意味着又一个时期的等待,所以他们将在T-3 期完成活动……直到老练者在时期决定他们及时行乐也是一样的。

认为自>0.99 的部分天真者行为与天真者完全一致,拖延到时期T 一10完成任务;而认为自<0.99 的部分天真者与老练者完全一致,决不拖延。当自>0.99 时,部分天真者像天真者一样,认为如果他们等待,那么他们将在时期T 完成。骂自<0.99 时,相反,部分天真者和老练者一样,总认为如果他们现在拖延,那么他们将在下一期会得到回报。

该例子说明即使是一点程度的认知也会产生老练者效应。因此,仅仅发现人们担心未来的行动,并不意味着他们就是完全老练的。

无论人们是成熟还是天真,他们在及时行乐方面的时间不一致偏好对经济学领域的各项研究都很重要。消费带给顾客的利益是即刻的,而让利所增加的未来消费是拖延的,因此上述偏好相关的分析对商家何时采取恰当的让利行为是非常重要的(四aler& Shefrin , 1981 ; Laibson , 1997 )。

此外,自控问题在研究人们对易上瘾食物和高脂肪食物的需求方面也很重要。比如,无营养的食物通常以小包装出售是因为人们希望避免大包装可能引起的过量消费。

{本章参考文献]

[ 1 ] Ariely. D. &Wertenbroch , K. in press. Procrastination. Deadlines. and Performance Using Precommitment to Regulate One' s Behavior. Psychology science

[2] Frederik. S. G. [ρewenstein. T. 0 Donoghue. Time discounting and time preference: A critical review. Journal of Economic Literature , 2002

[ 3 ] Harris. C. &Laibson. Hyperbolic discounting and consumption ,2001

[ 4] Kirby. K. N. &Herrnstein. R. Preference reversals due to myopic discounting of delayed reward. Psychological Science , 19956 : 2. 83 - 89

[5] Laibson. D. 1. Intertemporal decision making ,2002 URL: http://post. economics. Harvard. edu/ faculty/laibson/ papers/ ecsmar2.pdf

[ 6 ] Laibson. D. 1. Life-Cycle Consumption and Hyperbolic Discount Functions.European Economic Review , Vol , 1998 ,42 , 861 - 71

[ 7] Loewenstein. G. &Perlec. D.Anomalies in Intertemp叫Choice: Evidence and an Interpretation. Quarterly Joumal of Economics, 1992 ,57 ,573 - 598

[ 8 ] Loewenstein. G. &Perlec. D. Preference for Sequences of Outcomes.Psychological Review , 1993 , 100 :1 , 91-108

[9] 0 ' Donoghue. T. &Rabin. M. Self awareness and self control, 2001

[10]Read. D. &Orsel. B. &Rahman. J. &Frederick. S. Four Score and Seven Years from now: The "Date/Delay Effect" in temporal discounting , 2004

[ 11 ] Read. D. Intertemporal choice , 2004

[ 12] Read. D. Is time-discounting hyperbolic or subadditive? Joumal of Risk and Uncertainty , 2∞123 (1 )5-32

[ 13] Read. D. &P. H. M. P. Roelofsma. Subadditive versus hyperbolic discounting: A comparison of choice and matching. Organizational Behavior and Human Decìsion Process ,2;∞391 (2) 140 -153

[ 14] Samuelson. P. A Note on Measurement of Utility. Review of Economic Studies , 1937 ,4. 155 -161

[ 15] Strotz. R. H. Myopia and inconsisitency in dynamic utility maximization.Review of Economic Studies ,1995 ,23 ( 3 ) 165 - 180

[16] Thaler. R. Some empirical evidence of dynamic inconsistency. EconomicsLetters ,1981 ,8(3)201 -207

[ 17] Thaler. R. &Shefrin. H. An economic theory of self-control. Joumal ofpolitical economiy , 1981 ,89 : 2 ,392 - 410

[18J Varey. C. &Kahneman. D. The integration of aversive experiences over time: Normative consideration and lay intuitions. Joumal of Behavioral Decision Making, 1990