Part IV Multiagent Decision Making

用效用、社会选择、联盟、拍卖、议价、论证与逻辑逐层分析集体决策。

学习目标

  • 能说明效用、社会选择、联盟与拍卖的关系
  • 能用机制设计视角分析集体决策
  • 能识别各类机制的激励边界

为什么必须先冻结联合模型

先预测:停车位先到先得与拍卖分配,哪个更公平?带着判断进入本页。

、社会选择、联盟、拍卖、议价、论证与逻辑逐层分析集体决策。 第四部分固定参与者、信息、行动、偏好与机制,再分别研究稳定、效率、公平、激励和可证明性;这些性质不能互相替代。 本页不以单个代理“看起来聪明”为通过条件,而是检查联合状态、偏离动机、失败传播和可重放证据。

直觉、对象与计算合同

贯穿场景是:多个自利代理竞争资源并需要形成可解释的集体结果。参与者、可观察信息、行动集、偏好或目标、环境转移、协议版本和终止条件必须在运行前固定,不能在看到结果后修改效用或阈值。

mechanismresult=rule(types,reports,jointactions)mechanism_result = rule(types, reports, joint_actions)

公式用于公开关系与前提,不替代正式证明或实证测量。任何性质都必须绑定精确定义和前提,不能由单次仿真结果推断。 本页重点防范:看到总福利最高就宣称机制公平、稳定且不可操纵

第四部分 · 群体决策
第四部分 · 群体决策机制设计:让自利代理达成好的集体结果;点击节点查看详情1交互2投票拍卖3协商论证
交互类型

合作、竞争与协调的光谱:收益结构决定交互性质。

正式目录节点:解释与联合验证

下列目录节点逐项映射到解释、页面专属实验和章末答案。每个节点都必须指出它改变哪个联合状态以及什么观测会推翻结论;单纯出现术语不计覆盖。

Part IV Multiagent Decision Making

“Part IV Multiagent Decision Making”决定感知、内部状态、目标与行动怎样连接,应在相同环境轨迹上比较。 在“第四部分固定参与者、信息、行动、偏好与机制,再分别研究稳定、效率、公平、激励和可证明性;这些性质不能互相替代。”这条联合因果链中,本节点重点检查效用;只改变一个条件并保存联合轨迹,若出现“看到总福利最高就宣称机制公平、稳定且不可操纵”,就在首个分叉停止。

常见误区

术语

小结

  • 用效用、社会选择、联盟、拍卖与逻辑分析决策
  • 固定参与者、信息、行动、偏好与机制再研究性质
  • 稳定、效率、公平、激励和可证明性不能互相替代
  • 性质必须绑定精确定义和前提
  • 不能由总福利最高推断机制公平且不可操纵

知识点对照

Part IV Multiagent Decision Making

第四部分分析群体决策的,覆盖交互分析、投票、联盟、拍卖、议价、论证与逻辑基础。

容易踩的坑

误区 1

现象 → 设计机制不看激励 原因 → 机制被策略性操纵 修法 →的机制如 VCG

误区 2

现象 → 混淆投票与拍卖场景 原因 → 机制错配目标 修法 → 先定义集体目标再选机制

误区 3

现象 → 忽略联盟稳定性 原因 → 收益分配引发退出 修法 → 用核与 Shapley 分析稳定性

练习与答案

前后导航

练习

练习

问题 1: 机制设计解决什么问题?

问题 2: 效用、社会选择、联盟与拍卖的关系?

问题 3: 为一个停车位分配问题选择机制并说明理由。(独立实现)

名词解释

本章出现的专业名词,用大白话再讲一遍。

机制设计
设计交互规则使自利代理的均衡行为达成预期集体结果的学科。
效用
量化代理偏好与收益的函数,是分析策略行为的基本尺度。
纳什均衡
无人能通过单方面改变策略而获益的策略组合,交互的稳定点。
激励相容
机制使每个代理说真话成为最优策略的性质,防操纵的底线。

讨论

评论区加载中…