Part IV Multiagent Decision Making
用效用、社会选择、联盟、拍卖、议价、论证与逻辑逐层分析集体决策。
学习目标
- 能说明效用、社会选择、联盟与拍卖的关系
- 能用机制设计视角分析集体决策
- 能识别各类机制的激励边界
为什么必须先冻结联合模型
先预测:停车位先到先得与拍卖分配,哪个更公平?带着判断进入本页。
用↡量化代理偏好与收益的函数,是分析策略行为的基本尺度。、社会选择、联盟、拍卖、议价、论证与逻辑逐层分析集体决策。 第四部分固定参与者、信息、行动、偏好与机制,再分别研究稳定、效率、公平、激励和可证明性;这些性质不能互相替代。 本页不以单个代理“看起来聪明”为通过条件,而是检查联合状态、偏离动机、失败传播和可重放证据。
直觉、对象与计算合同
贯穿场景是:多个自利代理竞争资源并需要形成可解释的集体结果。参与者、可观察信息、行动集、偏好或目标、环境转移、协议版本和终止条件必须在运行前固定,不能在看到结果后修改效用或阈值。
公式用于公开关系与前提,不替代正式证明或实证测量。任何性质都必须绑定精确定义和前提,不能由单次仿真结果推断。 本页重点防范:看到总福利最高就宣称机制公平、稳定且不可操纵。
合作、竞争与协调的光谱:收益结构决定交互性质。
正式目录节点:解释与联合验证
下列目录节点逐项映射到解释、页面专属实验和章末答案。每个节点都必须指出它改变哪个联合状态以及什么观测会推翻结论;单纯出现术语不计覆盖。
Part IV Multiagent Decision Making
“Part IV Multiagent Decision Making”决定感知、内部状态、目标与行动怎样连接,应在相同环境轨迹上比较。 在“第四部分固定参与者、信息、行动、偏好与机制,再分别研究稳定、效率、公平、激励和可证明性;这些性质不能互相替代。”这条联合因果链中,本节点重点检查效用;只改变一个条件并保存联合轨迹,若出现“看到总福利最高就宣称机制公平、稳定且不可操纵”,就在首个分叉停止。
常见误区
术语
小结
- 用效用、社会选择、联盟、拍卖与逻辑分析决策
- 固定参与者、信息、行动、偏好与机制再研究性质
- 稳定、效率、公平、激励和可证明性不能互相替代
- 性质必须绑定精确定义和前提
- 不能由总福利最高推断机制公平且不可操纵
知识点对照
Part IV Multiagent Decision Making
第四部分分析群体决策的↡设计交互规则使自利代理的均衡行为达成预期集体结果的学科。,覆盖交互分析、投票、联盟、拍卖、议价、论证与逻辑基础。
容易踩的坑
误区 1
现象 → 设计机制不看激励 原因 → 机制被策略性操纵 修法 → 选↡机制使每个代理说真话成为最优策略的性质,防操纵的底线。的机制如 VCG
误区 2
现象 → 混淆投票与拍卖场景 原因 → 机制错配目标 修法 → 先定义集体目标再选机制
误区 3
现象 → 忽略联盟稳定性 原因 → 收益分配引发退出 修法 → 用核与 Shapley 分析稳定性
练习与答案
前后导航
练习
练习
问题 1: 机制设计解决什么问题?
问题 2: 效用、社会选择、联盟与拍卖的关系?
问题 3: 为一个停车位分配问题选择机制并说明理由。(独立实现)
名词解释
本章出现的专业名词,用大白话再讲一遍。
- 机制设计
- 设计交互规则使自利代理的均衡行为达成预期集体结果的学科。
- 效用
- 量化代理偏好与收益的函数,是分析策略行为的基本尺度。
- 纳什均衡
- 无人能通过单方面改变策略而获益的策略组合,交互的稳定点。
- 激励相容
- 机制使每个代理说真话成为最优策略的性质,防操纵的底线。